AI 모델 및 플랫폼
AWS, xAI의 Grok 4.7을 Amazon Bedrock에 추가, 500K 컨텍스트 윈도우 제공

Amazon Web Services는 2026년 9월 28일에 xAI의 Grok 4.7 모델이 Amazon Bedrock에서 사용 가능하다고 발표했으며, 이 모델을 Bedrock 모델 카탈로그에 추가하고 500K 토큰 컨텍스트 윈도우, 텍스트 및 이미지 입력, 네 가지 구성 가능한 추론 노력 수준을 제공한다. AWS Machine Learning Blog 발표는 Grok 4.7을 코딩, 장기 실행 에이전트 및 지식 작업을 위해 구축된 최첨단 모델로 설명한다.
xAI는 2026년 9월 21일에 출시 발표를 통해 Grok 4.7을 처음 공개했으며, 이 모델을 Cursor와 Grok Build, 그리고 Grok API, 서드파티 코딩 하니스, 모델 라우터 및 클라우드 플랫폼을 통해 사용할 수 있게 했다. 해당 발표에서 xAI는 모델 가격을 입력 토큰 백만 개당 $2, 출력 토큰 백만 개당 $6부터 시작한다고 밝히고, 출력 속도가 두 배인 빠른 버전을 두 배 가격에 제공한다고 말했다.
xAI가 말하는 Grok 4.7이 구축된 목적
AWS 게시물에서 인용한 바에 따르면, xAI는 Grok 4.7이 코딩 및 지식 작업에 가장 능력 있는 모델이며, 순수 속도보다 지속성에 중점을 둔다고 설명한다: 모델은 어려운 작업에서 더 오래 작동하고 다음 단계로 넘어가기 전에 자체 작업을 더 신중히 검증한다. xAI는 Grok 4.7이 더 크고 새로운 기반 모델을 사용하며, 더 긴 강화 학습 과정을 통해 더 어려운 작업 혼합을 학습했고, 여러 시간이 소요되는 문제에 가중치를 두었다고 보고한다. xAI는 이 훈련 덕분에 두 가지 능력이 향상되었다고 평가한다: 모델 자체 작업의 검증이 개선되고, 장기 작업에서 500K 토큰 컨텍스트 윈도우를 보다 효과적으로 활용한다. 또한 xAI는 모델이 Grok Bot 하니스를 원시적으로 이해하도록 훈련했으며, 이를 대화 작업 및 일반 지식 작업의 향상에 기여했다고 언급한다.
xAI는 문서 및 프레젠테이션 생성 능력이 더욱 강화되었으며, 변호사, 간호사, 금융 분석가와 같은 전문가들의 지식 작업에서도 향상이 있었다고 보고한다. 공개된 평가에서는 소프트웨어 엔지니어링을 CursorBench와 DeepSWE로, 여러 시간에 걸친 터미널 및 사무 작업을 Terminal-Bench와 AA Briefcase로, 전기 공학을 EEBench로, 법률 작업을 Harvey Legal Agent Benchmark로, 임상 추론을 HealthBench Professional로 각각 평가했다.
독립 평가 수치
AWS 게시물은 또한 Artificial Analysis를 인용하는데, 이 회사는 개발자가 보고한 수치에 의존하지 않고 자체 평가를 수행한다고 설명한다. 해당 결과에서 Grok 4.7은 지능 지수 46(전 버전 Grok 4.6은 44), 코딩 에이전트 지수 56(전 버전 47), AA‑Briefcase Elo 1,657(전 버전 1,546), GDPval‑AA Elo 1,695(전 버전 1,605), 그리고 AA‑전지성 지수 32(전 버전 30)를 기록했으며, 환각 비율은 29%로 전 버전 34%보다 낮았다. Artificial Analysis는 Grok 4.7을 xhigh 추론 노력 수준에서, Grok 4.6을 각 측정치에 대해 보고된 노력 수준에서 측정했다.
게시물은 해당 표의 마지막 행에서 트레이드오프를 강조한다: Grok 4.7은 지능 지수 작업당 약 81,000개의 출력 토큰을 사용했으며, Grok 4.6은 약 38,000개를 사용했다. 이는 작업당 거의 두 배에 해당하며, 기본값을 그대로 사용하기보다 노력 수준을 의도적으로 설정해야 하는 이유라고 설명한다.
안전 및 사이버 보안
xAI에 따르면 Grok 4.7은 완전히 새로운 보호 스택으로 구축되었으며, 거부 및 탈옥 저항성 테스트에서 가장 강력한 모델이다. xAI는 사이버 보안 및 생물학 작업과 같은 이중 사용 분야에서 목표를 정당한 작업에는 유용하게 유지하고 위험한 작업은 거부하도록 설정한다. 특히 사이버 보안 분야에서 모델은 위험한 이중 사용 프롬프트의 소수만을 허용하고 정당한 보안 작업은 거의 차단하지 않으며, 방어 연구를 위해 선택된 사이버 보안 파트너에게 Grok 4.7의 레드팀 기능에 초대 전용 접근을 제공하기 시작했다.
Amazon Bedrock에서 Grok 4.7이 제공되는 방식
Bedrock에서 Grok 4.7은 텍스트와 이미지 입력을 받아 텍스트를 반환한다. 이 모델은 cross-Region 추론 프로파일을 통해 bedrock-runtime 엔드포인트에서 제공되며, 요청에서는 순수 모델 ID 대신 프로파일 이름을 지정한다: 미국 지리 프로파일은 us.xai.grok-4.7, 글로벌 프로파일은 global.xai.grok-4.7이며, 두 경우 모두 bedrock-runtime 기본 URL의 /openai/v1 경로를 사용한다. Grok 4.7은 Responses API, Chat Completions API, InvokeModel, Converse API를 지원한다.
이 모델이 OpenAI와 호환되기 때문에 OpenAI SDK는 /openai/v1 경로에 베어러 토큰으로 작동하며, 이 토큰은 Amazon Bedrock API 키이거나 AWS Identity and Access Management(IAM) 자격 증명으로 발행된 단기 토큰일 수 있다. AWS SDK는 Converse를 통해 동일한 모델에 접근하며, 일반 AWS 자격 증명으로 요청에 서명한다.
이 모델은 또한 표준 Bedrock 기능과 연결된다. 암시적 프롬프트 캐싱이 반복되는 프롬프트 접두사에 자동으로 적용되어, 매 턴마다 큰 시스템 프롬프트나 참조 문서를 재전송하는 에이전트는 해당 접두사에 대해 캐시된 요금을 지불한다. Bedrock Guardrails는 요청에 ID와 버전으로 부착되어, 콘텐츠 필터, 금지 주제, 개인 식별 정보 삭제, 단어 정책을 프롬프트와 응답 모두에 적용한다. 구조화된 출력은 응답을 JSON 스키마에 제한하여 하위 코드가 직접 파싱할 수 있게 하고, 호출 로깅은 Amazon CloudWatch에 요청, 응답 및 추론 토큰을 포함한 토큰 수를 기록한다.
라우팅 프로파일, 서비스 티어 및 접근 권한
Global 프로파일은 각 요청을 지원되는 상업용 AWS Region 중 어느 곳으로든 라우팅하여 부하를 더 많은 용량에 분산시키며, 지리적 프로파일보다 낮은 가격으로 제공됩니다. 이 게시물은 트레이드오프가 특정 요청이 제공되는 위치에 대한 제어가 감소한다는 점이며, 이는 더 가변적인 지연 시간을 의미할 수 있다고 지적합니다. US 지리적 프로파일은 처리를 미국 내에서만 수행하여 미국 데이터 거주 요건을 충족합니다.
세 가지 서비스 티어가 제공됩니다. Standard는 약정 없이 토큰당 과금이며, Priority는 프리미엄을 통해 더 빠르고 우선 순위가 지정된 처리를 제공하고, Flex는 시간에 민감하지 않은 작업에 대해 저비용 접근을 제공합니다. 티어별 토큰당 가격은 Amazon Bedrock 가격 페이지에 표시됩니다.
첫 번째 호출 전에, 사용자는 모델이 사용하려는 AWS Region의 Bedrock 콘솔에서 이용 가능한지 확인해야 합니다. 권한 측면에서 bedrock:InvokeModel은 세 가지 리소스(계정의 기본 프로젝트, 명명된 인퍼런스 프로파일, 그리고 기본 모델)와 비교 평가되며, 기본 모델의 Amazon Resource Name은 리전 간 프로파일이 호출 Region 외부로 라우팅되기 때문에 리전 전체에 와일드카드 처리됩니다. Bearer-token 인증은 추가로 bedrock:CallWithBearerToken을 요구하며, 프로파일은 개별적으로 범위가 지정되므로 US 프로파일을 명시한 정책은 Global 프로파일을 포함하지 않습니다.
Grok 4.7에서는 추론이 항상 활성화됩니다. 추론 노력은 Responses API의 reasoning 파라미터 또는 Converse의 additionalModelRequestFields를 통해 설정되며 기본값은 high입니다. 추론 내용은 암호화되어 있으며, Responses API 요청에 include: \”reasoning.encrypted_content\”를 전달하면 반환될 수 있고, 이후 턴에서 다시 전달되어 모델이 이전 추론을 다중 턴 대화의 컨텍스트로 사용할 수 있습니다. Chat Completions API는 추론 토큰을 반환하지 않습니다.
이 게시물은 장기 Amazon Bedrock API 키를 탐색 전용 자격 증명으로 간주하고, 프로덕션에서는 IAM 자격 증명으로 생성된 단기 bearer token을 사용하며, 필요 없게 되면 Bedrock 콘솔에서 탐색 키를 삭제할 것을 권고합니다.












