AI 모델 및 플랫폼

구글, 벤치마크 기록을 깬 Gemini 3 Pro 출시

mm
Unite.AI를 Google의 선호 소스에 추가

구글은 오늘 Gemini 3 Pro를 출시했으며, 이는 가장 진보된 AI 모델로 기록적인 벤치마크 성능과 새로운 에이전트 개발 플랫폼인 Antigravity를 제공합니다. 이 모델은 LMArena에서 1501 Elo를 기록하며, Gemini 2.5 Pro의 1451을 초과하여 주요 AI 평가 지표에서 1위를 차지했습니다.

이 출시에는 AI 산업에서 몇 개월간의 기대가 따랐으며, 모델은 10월 22일부터 일부 사용자에게 조용히 롤아웃된 후에 공개적으로 발표되었습니다. 구글의 개발자 중심 릴리스는 코딩 기능과 자율 에이전트 기능을 강조하며, Claude의 코딩 성능과 OpenAI의 개발 도구와 경쟁하기 위해 회사를 더 공격적으로 위치시킵니다.

Gemini 3 Pro는 약 750,000단어인 1백만 토큰 컨텍스트 창을 지원하며, 두 가지 티어가 다른 사용 사례에 대해 200K와 1M 토큰을 제공합니다. 이 모델은 텍스트, 이미지, 비디오 및 오디오를 처리하는 예외적인 멀티모달 능력을 보여주며, 시각적 추론과 그래픽 생성이 개선되었습니다. 통합은 Google의 제품 생태계 전반에 걸쳐 이루어지며, Workspace, Chrome 및 Android가 포함됩니다.

기록적인 벤치마크 성능

Gemini 3 Pro는 MMLU 벤치마크에서 91.8%의 정확도를 달성하며, Gemini 2.5 Pro의 89.5%보다 5점이 향상되었습니다. 이 모델은 특히 교차 학제 질문에서 강점을 보여주며, 여러 지식 도메인을 아우르는 작업에서 92%의 점수를 기록했습니다. 반면 Gemini 2.5는 유사한 도전에서 65%로 떨어졌습니다.

코딩 관련 벤치마크에서 Gemini 3 Pro는 SWE-bench Verified에서 76.2%의 점수를 기록하며, 전임 모델을 크게 초과했지만 Claude 4.5의 77.2%에는 미치지 못했습니다. 이 모델은 WebDev Arena 리더보드에서 1487 Elo를 기록하며, 예외적인 웹 개발 능력을 보여주었습니다. Terminal-Bench 2.0에서, 이 모델은 54.2%의 점수를 기록했습니다.

이 모델은 Gemini 2.5 Pro보다 작업 크기에 따라 약 2배 빠른 추론을 제공합니다. 50줄의 Python 스크립트와 같은 작은 작업은 12초 만에 완료되며, 이전에는 25초가 걸렸습니다. 10,000개의 데이터 행을 포함하는 큰 작업은 15분 30초 만에 완료되며, 이전에는 32분 15초가 걸렸습니다.

구글은 또한 Gemini 3 Deep Think 모드를 도입했으며, 이는 더 어려운 벤치마크에서 더 높은 성능을 제공하는 고급 추론 능력입니다. 이 모드는 GPQA Diamond에서 93.8%의 점수를 기록하며, 표준 모드의 91.9%보다 높습니다. Humanity’s Last Exam에서는 41.0%의 점수를 기록하며, 37.5%보다 높습니다. 이 모드는 향후 몇 주 내에 AI Ultra 구독자에게 제공될 예정입니다.

Antigravity 플랫폼이 개발자 워크플로를 변革하다

구글은 Gemini 3를 기반으로 하는 에이전트 개발 플랫폼인 Antigravity를 출시했습니다. 이 플랫폼은 코드 편집기, 터미널 및 브라우저에서 동시에 작동하는 자율 에이전트를 가능하게 하며, 전통적인 도구 기반 보조에서 협력 모델로의 전환을 나타냅니다. 여기서 에이전트는 상당한 개발 책임을 맡습니다.

Antigravity는 Gemini 3 Pro를 기본 추론 엔진으로 사용하며, Gemini 2.5 Computer Use를 브라우저 제어용으로 사용하고, Nano Banana(Gemini 2.5 Image)를 이미지 편집용으로 사용합니다. 에이전트는 독립적으로 복잡한 개발 작업을 계획하고 실행할 수 있으며, 결과를 제시하기 전에 코드를 검증할 수 있습니다.

플랫폼은 “바이브 코딩“을 강화하며, 여기서 자연어는 주요 구문이 됩니다. 개발자는 단일 프롬프트로 고급 창의적 아이디어를 완전히 상호작용하는 애플리케이션으로 번역할 수 있으며, 구현 세부 정보를 지정할 필요가 없습니다. 이 기능은 Gemini 3의 예외적인 웹 개발 점수를 지원합니다.

Antigravity의 에이전트는 기능 구축, UI 반복, 버그 수정, 솔루션 연구 및 보고서 생성을 자율적으로 관리합니다. 이 플랫폼은 Mac, Windows 및 Linux에서 무료로 공개 미리 보기로 제공되며, Cursor, GitHub, JetBrains, Manus 및 Cline을 포함한 통합 지원을 제공합니다.

기업 통합 및 시장 영향

Gemini 3 Pro는 Google (GOOGL ) AI Ultra 구독자와 유료 Gemini API 사용자에게 제공됩니다. 이 모델은 Google Search에 직접 내장되며, 이는 20억 명의 월간 AI 요약 사용자에게 도달합니다. 기업 배포는 Google AI Studio 및 Vertex AI를 통해 모델에 액세스할 수 있습니다.

Gemini 앱은 Gemini 3를 위해 특별히 설계된 새로운 인터페이스와 향상된 에이전트 기능을 포함하는 업데이트를 받았습니다. 이러한 개선은 경쟁하는 AI 어시스턴트와의 경쟁에서 구글을 위치시키며, 동시에 회사의 지배적인 배포 채널을 활용합니다.

구글의 출시 전략은 개발자 채택과 기업 배포를 강조하며, 가격과 성능은 기업 고객을 대상으로 합니다. 기록적인 벤치마크, 자율 코딩 기능 및 광범위한 생태계 통합은 주요 제공업체 간의 AI 모델 기능이 수렴함에 따라 회사의 경쟁력 유지 의도를 나타냅니다.

이 출시는 Gemini 2.0 이후 약 11개월 만에 이루어졌으며, AI 산업에서 경쟁이 격화함에 따라 구글의 출시 타임라인이 크게 압축되었습니다.

Alex McFarland은 인공 지능의 최신 개발을 탐구하는 AI 저널리스트이자 작가입니다. 그는 전 세계의 수많은 AI 스타트업과 출판물들과 협력했습니다.