AI 모델 및 플랫폼

Grok 4.6이 GitHub Copilot에 도착한 8개의 개발 표면에서

mm
Unite.AI를 Google의 선호 소스에 추가

xAI는 2026년 8월 12일 Grok 4.6 출시 이틀 뒤인 8월 14일, GitHub Copilot에서 모델을 순차 제공한다고 발표했습니다 . 장시간 작동하는 에이전트와 다단계 업무를 겨냥한 xAI의 주력 코딩 모델입니다. VS Code, Visual Studio, Copilot CLI, Copilot 클라우드 에이전트, Copilot 앱, JetBrains IDE, Xcode, Eclipse 등 여덟 환경의 모델 선택 메뉴에서 사용할 수 있습니다.

같은 날 게시된 GitHub 변경 기록은 Copilot Pro, Pro+, Max, Business, Enterprise 요금제를 지원한다고 확인했습니다. 새 모델 도입으로는 범위가 넓습니다. 대부분의 Copilot 모델 출시가 집중되는 VS Code를 넘어 JetBrains, Xcode, Eclipse 사용자에게도 Grok 4.6이 제공됩니다.

GitHub는 내부 시험에서 Grok 4.6이 VS Code와 Copilot CLI의 터미널 기반 코딩, 특히 지속적인 추론과 도구 사용이 필요한 장기 작업에서 좋은 성능을 보였다고 밝혔습니다. 이는 xAI가 출시 때 강조한 방향과 일치합니다. 회사는 “Grok 4.6은 Grok 4.5를 기반으로 장시간 실행되는 에이전트와 더 복잡한 대화형·시각적 작업에 특히 집중합니다”라고 설명했습니다.

모델 선택 메뉴에 추가되는 Grok 4.6의 역량

Grok 4.6은 현 세대 코딩 모델의 상위권에 해당하는 공급자 발표 평가 결과와 함께 Copilot에 도입됩니다. 다만 이는 xAI가 선택한 평가 실행 환경에서 직접 측정한 수치라는 한계가 있습니다. 공개 평가표에서 Grok 4.6 High는 아홉 벤치마크를 합친 Artificial Analysis Intelligence Index에서 61점을 기록했습니다. OpenAI의 GPT-5.6 Sol Max와 같고 Anthropic의 Fable 5 Max 62점보다 1점 낮습니다. 지식 업무 평가 GDPVal-AA에서는 1753점으로 GPT-5.6 Sol Max의 1728점, Fable 5 Max의 1741점과 비교됩니다.

에이전트 코딩 평가에서는 차이가 더 큽니다. CursorBench v3.2에서 Grok 4.6은 69.9%로 GPT-5.6 Sol Max의 67.2%보다 높고 Fable 5 Max의 70.5%보다 낮습니다. DeepSWE v1.1에서는 65.9%로 전작 Grok 4.5 High의 54%를 크게 앞서지만 GPT-5.6 Sol Max의 73%에는 미치지 못합니다. GitHub가 강조한 터미널 작업을 측정하는 Terminal-Bench v3.0에서는 26%로 GPT-5.6 Sol Max의 34.6%보다 낮지만 전작 Grok 4.5 High의 15.7%보다 크게 높습니다.

xAI에 따르면 학습은 선별한 추론·엔지니어링 데이터로 더 긴 추가 학습을 진행하고 Grok 4.5가 다시 생성한 풀이 과정을 지도 미세조정에 사용한 뒤, 커널 최적화, 웹 개발, 컴퓨터 지원 설계 등 에이전트 작업에서 강화학습을 수행하는 방식이었습니다. 모든 지표에서 선두는 아니지만 터미널·에이전트 평가의 세대 간 향상이 그 결과로 나타납니다.

접근 권한과 요금의 세부 조건

실제 사용 가능 여부와 비용에는 두 가지 조건이 있습니다. 첫째, 순차 출시이므로 선택 메뉴에 Grok 4.6이 아직 없다면 제공 범위가 확대되는 동안 다시 확인해야 한다고 GitHub는 안내합니다. 둘째, Copilot Business와 Enterprise에서는 Grok 4.6 정책이 기본적으로 꺼져 있습니다. 관리자가 Copilot 설정에서 활성화해야 사용자가 모델을 선택할 수 있습니다.

요금은 정액 요청 허용량에서 차감하는 방식이 아니라 사용량 기준으로 공급자 정가를 적용합니다. xAI가 게시한 API 기본 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러부터입니다. 이는 GitHub 가격표의 Grok 4.5 기본 요율과 같습니다. 선택 메뉴의 다른 주력 모델보다 낮은 편으로, GPT-5.6 Sol은 100만 토큰당 입력 5달러·출력 30달러, Claude Opus급 모델은 입력 5달러·출력 25달러입니다.

Copilot 밖에서는 xAI API, Cursor, Grok Build와 OpenRouter, Vercel, Cloudflare 등의 서비스를 통해 계속 사용할 수 있습니다. Unite.AI의 출시 보도에서 설명했듯 xAI는 출시 첫 주에 Grok Build와 Cursor의 포함 사용량을 두 배로 제공했으며 이 기간은 2026년 8월 19일 끝납니다.

Copilot 통합은 Grok 4.6 출시 첫 48시간의 유통 확대 흐름을 이어 갑니다. xAI 도구와 Cursor에서 시작한 뒤 사용자 좌석 수 기준 최대 규모의 외부 코딩 보조 서비스로 진입한 것입니다. Business·Enterprise의 허용 여부를 관리자가 결정하는 만큼 기업 도입 속도는 순위표에 앞서 Copilot 설정에서 드러날 것입니다.

Jonas Reeve는 Unite.AI에서 AI 생성 분석가로 활동하며 인지 AI, 인공 일반 지능(AGI) 및 기계 지능의 이론적 기반에 집중합니다. 그의 연구는 학습, 추론, 기억, 추상화가 생물학적 시스템과 인공 시스템 모두에서 어떻게 나타나는지를 탐구하고, 현대 AI 아키텍처와 인지 과학 및 마음 철학의 오랜 질문들 사이의 연결을 제시합니다.

개념적이고 반성적인 접근 방식을 통해 Jonas는 추론 모델, 에이전트 시스템, 발생 인지, 정렬 이론과 같은 프레임워크를 검토하며, AGI에 대한 진전이 실제로 의미하는 바와 의미하지 않는 바를 명확히 하고자 합니다. 일정이나 과대광고를 쫓기보다 그는 기본 원칙, 개념적 엄밀성, 그리고 현재 모델의 한계를 강조합니다.

Jonas Reeve가 작성한 기사들은 AI 생성이며, 정확성, 명확성 및 고급 AI 개념에 대한 책임 있는 논의를 보장하기 위해 Unite.AI 편집팀이 검토합니다.