AI 모델 및 플랫폼

SpaceXAI, Grok 4.6

mm
Unite.AI를 Google의 선호 소스에 추가

과거 xAI라는 이름으로 알려진 인공지능 회사 SpaceXAI가 2026년 8월 12일 Grok 4.6을 출시했습니다. 장시간 실행되는 에이전트와 더 야심 찬 상호작용·시각 작업을 위한 새 주력 모델입니다. 같은 날 Cursor 코드 편집기, 회사 자체 도구인 Grok Build, API에서 사용할 수 있게 됐습니다. 시작 가격은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러라고 회사 발표는 설명합니다.

Grok 4.6은 Grok 4.5를 바탕으로 에이전트 기반 코딩과 지식 업무를 향한 회사의 행보를 확장합니다.

Grok 4.6의 기능

회사는 Grok 4.6을 “여러 단계에 걸친 복잡한 작업을 끝까지 수행하는” 모델로 설명합니다. 주제 조사, 코드베이스 전반의 작업, 폭넓은 제품 아이디어를 실제 작동하는 애플리케이션 초안으로 구현하는 일 등이 해당합니다. 회사에 따르면 작업 과정이 길어질 때 모델이 다음 단계로 넘어가기 전에 스스로 결과를 시험하고 검증하는 행동이 늘었으며, 시각적·상호작용 프로젝트의 첫 결과물도 Grok 4.5보다 개선됐습니다.

이러한 성능 향상은 Grok 4.5보다 긴 추가 학습에 기반합니다. SpaceXAI는 추론과 기술 개념을 위한 선별된 모델 생성 데이터, 개선된 최적화 알고리즘, Grok 4.5가 다시 생성한 지도 미세조정(SFT)용 작업 과정을 사용했습니다. 이 과정은 다양한 추론 강도와 에이전트 실행 환경, STEM·소프트웨어 공학·지식 업무 등의 영역을 포괄하며, 모델 기반 검사로 문제가 있는 기록을 걸러냈습니다. 이후 커널 최적화, 웹 개발, 컴퓨터 지원 설계의 분야별 환경을 포함한 여러 에이전트 강화학습 과제로 학습했습니다.

벤치마크 경쟁

SpaceXAI에 따르면 Grok 4.6은 9개 벤치마크를 종합한 Artificial Analysis Intelligence Index에서 61점으로 OpenAI GPT-5.6 Sol과 동점을 기록했습니다. Anthropic Fable 5 Max의 62점보다는 낮고 Grok 4.5 High의 56점보다는 높습니다. 회사 자체 평가표에서 개별 시험의 결과는 더 엇갈립니다.

소프트웨어 공학 벤치마크 DeepSWE v1.1에서 Grok 4.6은 65.9%로 Grok 4.5의 54%를 넘었지만 GPT-5.6 Sol Max의 73%에는 못 미쳤습니다. Terminal-Bench v3.0에서는 26%로 Grok 4.5의 15.7%보다 크게 개선됐지만 GPT-5.6 Sol Max와 Fable 5 Max의 약 34%보다 상당히 낮았습니다. 지식 업무 평가 GDPVal-AA v2에서는 1753점으로 선두였으며 CursorBench와 FrontierCode에서도 개선을 보였습니다. 이는 회사 자체 수치이며, 다른 회사 모델의 점수는 자체 보고나 공개 결과에서 가져왔습니다. 아직 독립적인 평가로 확인되지는 않았습니다.

이번 출시는 경쟁이 치열한 시장에서 나왔습니다. Anthropic은 공격적인 가격으로 Opus 계열의 최첨단 성능을 추구하고 있으며, OpenAI GPT-5.6 계열은 에이전트 코딩에서 기존의 경쟁 기준입니다. SpaceXAI는 성능뿐 아니라 가격과 유통 경로로도 경쟁하려 합니다. 입력 토큰 100만 개당 2달러인 Grok 4.6은 여러 최첨단 경쟁 모델보다 저렴합니다. 회사는 개발자를 끌어들이기 위해 첫 주 동안 Grok Build와 Cursor의 기본 포함 사용량을 두 배로 제공합니다. Cursor와 Grok Build 외에도 OpenRouter, Vercel, Cloudflare 등의 파트너를 통해 이용할 수 있습니다.

모델을 내놓은 새로운 회사

Grok 4.6은 지난 1년간 사업 구조가 완전히 재편된 회사가 지금까지 내놓은 제품 중 가장 분명하게 방향성을 보여 줍니다.

Grok 4.6은 처음부터 SpaceXAI 이름을 단 첫 주력 모델입니다. 가격, 파트너를 통한 유통, 에이전트에 대한 집중은 이 사업부가 Grok을 X 소셜 네트워크의 기능이 아니라 개발자와 기업을 위한 플랫폼으로 자리매김하고 있음을 보여 줍니다.

Evan Mercer는 Unite.AI에서 AI가 생성한 특파원으로, AI 스타트업, 벤처 캐피털 및 차세대 기술 기업을 형성하는 자금 조달 역학을 다룹니다. 그의 보도는 초기 단계 혁신, 자본 흐름, 그리고 AI 기업이 개념에서 글로벌 영향력으로 성장함에 따라 창업자와 투자자가 내리는 전략적 결정에 초점을 맞춥니다.

전략적이고 분석적인 시각으로, Evan은 AI 스타트업 생태계 전반의 자금 조달 라운드, 시장 포지셔닝 및 신흥 트렌드를 검토합니다. 그는 벤처 캐피털, 기업 투자 및 공개 시장이 인공지능의 돌파구와 어떻게 교차하는지를 추적하며, 지속 가능한 신호와 단기적 과대광고를 구분합니다.

Evan Mercer가 작성한 기사들은 AI가 생성하고 Unite.AI의 편집팀이 검토하여 정확성, 맥락 및 전 세계 AI 투자 환경에 대한 책임 있는 보도를 보장합니다