Grok 4.6 출시, GPT-5.6과 성능 경쟁, 비용은 60% 이상 절감

xAI가 Grok 4.6을 출시하여 AI 지능 지수에서 61점을 기록했으며, 이는 GPT-5.6 Sol (Max)과 동급이며 Claude Opus 5 (63점) 및 Claude Fable 5 (62점)에는 약간 뒤처집니다. 이 성능은 Grok 4.6을 세계 최상위 모델 중 하나로 위치시키며, OpenAI와 Anthropic의 플래그십 제품을 직접적으로 겨냥합니다. Grok 4.5의 기반을 바탕으로 구축된 이 업데이트는 추론 및 고급 기술 개념 훈련에서 핵심적인 향상을 도입했으며, 모델 자체가 생성한 선별된 데이터, 고품질 엔지니어링 데이터셋, 그리고 최적화된 훈련 알고리즘을 활용합니다.
훈련 방법론의 중요한 변화는 자기 강화 데이터 루프를 포함합니다: Grok 4.5가 감독된 미세 조정 궤적을 재생성하는 데 사용되었으며, 여기에는 추론, 에이전트 도구 활용, 그리고 STEM, 소프트웨어 엔지니어링, 지식 업무와 같은 분야에 초점이 맞춰졌습니다. 또한 이 모델은 지식 업무, 일반 코딩, 커널 최적화, 웹 개발, 컴퓨터 지원 설계 등 에이전트 기반 강화 학습 작업에 대해 광범위하게 훈련되었으며, 이는 명확히 부상하는 “에이전트 시대”의 주요 워크로드를 해결하기 위해 설계된 전략입니다.
에이전트 벤치마크에서 극적인 개선이 이루어졌으며, 복잡하고 장기적인 작업에 필요한 노력이 크게 감소했습니다.
에이전트 관련 벤치마크 평가에서 Grok 4.6은 뛰어난 성능을 보였습니다. GDPval-AA v2에서 1753의 Elo 점수를 기록하여 Claude Opus 5에 이어 두 번째로 높았으며, DeepSWE v1.1 점수는 Grok 4.5의 54%에서 65.9%로 눈에 띄게 증가했습니다. 또한 APEX-Agents는 47.1%에서 57.5%로 상승했으며, Terminal-Bench v3.0은 15.7%에서 26%로 개선되었습니다. CursorBench v3.2에서 69.9%, FrontierCode v1.1에서 61.3%의 강력한 결과를 추가하여 코딩 및 에이전트 능력 모두에서 중요한 돌파구를 마련했습니다.
특히 Grok 4.6은 뚜렷한 비용 효율성 이점을 제공합니다. 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $6으로 가격 책정되어 Claude Opus 5 ($5/$25) 및 GPT-5.6 Sol ($5/$30)보다 60% 이상 저렴합니다. AA-Briefcase 장기 지식 업무 벤치마크에서 Grok 4.6은 약 5억 개의 입력 토큰을 사용하여 평균 53라운드 만에 작업을 완료한 반면, Claude Opus 5는 약 103라운드와 20억 개의 토큰이 필요했습니다. 이는 Grok 4.6이 4분의 1 미만의 자원으로 유사한 결과를 달성함을 의미하며, 명확한 비용 대비 성능 우위를 강조합니다. 현재 이 모델은 Cursor, Grok Build, API, OpenRouter, Vercel, Cloudflare를 통해 접근할 수 있습니다. 첫 주 동안 사용자는 Grok Build 및 Cursor에서 두 배의 사용 크레딧을 받습니다. 500,000개의 컨텍스트 윈도우를 갖춘 이 모델은 “더 낮은 가격에 동등한 지능”에 초점을 맞춘 경쟁 구도를 공식적으로 시작했습니다.
관련 기사
미국의 주식 시장이 AI와 항공우주 거대 기업들의 1조 달러 데뷔를 앞두고 역사적 이정표에 도달
엘론 머스크, 샘 알트만, 그리고 다리오 아모데이라는 기술 산업의 거인 세 명이 각자의 기업에 대해 공개 시장 상장(IPO)을 앞두고 있다. 스페이스X, 오픈AI, 앤트로픽이라는 세 산업의 거대 기업이 1조 달러 이상의 기업 가치를 달성하며 상장을 준비함에 따라, 2026년은 미국 역사상 신주 발행 측면에서 가장 중요한 해가 될 것으로 전망된다.이러한 역사적인 자본 증가는 전 세계 금융계의 주목을 받고 있으며, 공공 시장이 이러한 규모의 자금
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성
AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib
구글, 사용자 제어 강화에 맞춰 제미니용 레미 AI 에이전트 테스트
비즈니스 인사이더에 따르면, 구글은 제미나이를 위한 새로운 AI 개인 에이전트인 레미를 테스트하고 있습니다. 이 도구는 사용자를 대신하여 작업을 실행하여 전문적인 워크플로우와 일상적인 루틴을 모두 간소화하는 것을 목표로 합니다.현재 레미는 제미나이 애플리케이션의 내부 직원 전용 버전에서 테스트 중입니다. 이 보고서는 내부 문서와 프로젝트에 정통한 두 명의 인물과의 인터뷰를 인용합니다. 내부 자료는 레미를 “24/7 개인 에이전트”로 묘사하며,
관련 특별 주제 추천
의견 (0)
0/500

xAI가 Grok 4.6을 출시하여 AI 지능 지수에서 61점을 기록했으며, 이는 GPT-5.6 Sol (Max)과 동급이며 Claude Opus 5 (63점) 및 Claude Fable 5 (62점)에는 약간 뒤처집니다. 이 성능은 Grok 4.6을 세계 최상위 모델 중 하나로 위치시키며, OpenAI와 Anthropic의 플래그십 제품을 직접적으로 겨냥합니다. Grok 4.5의 기반을 바탕으로 구축된 이 업데이트는 추론 및 고급 기술 개념 훈련에서 핵심적인 향상을 도입했으며, 모델 자체가 생성한 선별된 데이터, 고품질 엔지니어링 데이터셋, 그리고 최적화된 훈련 알고리즘을 활용합니다.
훈련 방법론의 중요한 변화는 자기 강화 데이터 루프를 포함합니다: Grok 4.5가 감독된 미세 조정 궤적을 재생성하는 데 사용되었으며, 여기에는 추론, 에이전트 도구 활용, 그리고 STEM, 소프트웨어 엔지니어링, 지식 업무와 같은 분야에 초점이 맞춰졌습니다. 또한 이 모델은 지식 업무, 일반 코딩, 커널 최적화, 웹 개발, 컴퓨터 지원 설계 등 에이전트 기반 강화 학습 작업에 대해 광범위하게 훈련되었으며, 이는 명확히 부상하는 “에이전트 시대”의 주요 워크로드를 해결하기 위해 설계된 전략입니다.
에이전트 벤치마크에서 극적인 개선이 이루어졌으며, 복잡하고 장기적인 작업에 필요한 노력이 크게 감소했습니다.
에이전트 관련 벤치마크 평가에서 Grok 4.6은 뛰어난 성능을 보였습니다. GDPval-AA v2에서 1753의 Elo 점수를 기록하여 Claude Opus 5에 이어 두 번째로 높았으며, DeepSWE v1.1 점수는 Grok 4.5의 54%에서 65.9%로 눈에 띄게 증가했습니다. 또한 APEX-Agents는 47.1%에서 57.5%로 상승했으며, Terminal-Bench v3.0은 15.7%에서 26%로 개선되었습니다. CursorBench v3.2에서 69.9%, FrontierCode v1.1에서 61.3%의 강력한 결과를 추가하여 코딩 및 에이전트 능력 모두에서 중요한 돌파구를 마련했습니다.
특히 Grok 4.6은 뚜렷한 비용 효율성 이점을 제공합니다. 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $6으로 가격 책정되어 Claude Opus 5 ($5/$25) 및 GPT-5.6 Sol ($5/$30)보다 60% 이상 저렴합니다. AA-Briefcase 장기 지식 업무 벤치마크에서 Grok 4.6은 약 5억 개의 입력 토큰을 사용하여 평균 53라운드 만에 작업을 완료한 반면, Claude Opus 5는 약 103라운드와 20억 개의 토큰이 필요했습니다. 이는 Grok 4.6이 4분의 1 미만의 자원으로 유사한 결과를 달성함을 의미하며, 명확한 비용 대비 성능 우위를 강조합니다. 현재 이 모델은 Cursor, Grok Build, API, OpenRouter, Vercel, Cloudflare를 통해 접근할 수 있습니다. 첫 주 동안 사용자는 Grok Build 및 Cursor에서 두 배의 사용 크레딧을 받습니다. 500,000개의 컨텍스트 윈도우를 갖춘 이 모델은 “더 낮은 가격에 동등한 지능”에 초점을 맞춘 경쟁 구도를 공식적으로 시작했습니다.
미국의 주식 시장이 AI와 항공우주 거대 기업들의 1조 달러 데뷔를 앞두고 역사적 이정표에 도달
엘론 머스크, 샘 알트만, 그리고 다리오 아모데이라는 기술 산업의 거인 세 명이 각자의 기업에 대해 공개 시장 상장(IPO)을 앞두고 있다. 스페이스X, 오픈AI, 앤트로픽이라는 세 산업의 거대 기업이 1조 달러 이상의 기업 가치를 달성하며 상장을 준비함에 따라, 2026년은 미국 역사상 신주 발행 측면에서 가장 중요한 해가 될 것으로 전망된다.이러한 역사적인 자본 증가는 전 세계 금융계의 주목을 받고 있으며, 공공 시장이 이러한 규모의 자금
스웨덴의 AI 스타트업 로버블 아이즈, 주요 자금 조달 라운드 이후 132억 달러의 기업 가치 달성
AI 기반 코딩 도구가 인기를 얻으면서 스웨덴 스타트업 로버블(Lovable)이 주요 자금 조달 라운드를 성사시켰다. 이 회사는 30억 달러를 조달하여 지난 12월 기록된 66억 달러의 두 배인 132억 달러의 기업 가치를 달성할 수 있을 것으로 기대된다. 멘로 벤처스(Menlo Ventures)가 이 투자 라운드를 주도할 것으로 예상된다.로버블의 매력은 복잡한 코딩 기술이 필요하지 않은 소프트웨어 제작을 단순화하는 핵심 '바이브 코딩(vib





집






