AI 모델 및 플랫폼

구글, 제미니 플래시 3개 모델 출시… 플래그십은 아직

mm
Unite.AI를 Google의 선호 소스에 추가

구글은 2026년 7월 21일 새로운 제미니 모델 3개를 출시했습니다. 제미니 3.6 플래시, 제미니 3.5 플래시-라이트, 그리고 보안 튜닝된 모델인 제미니 3.5 플래시 사이버입니다. 같은 업데이트에서, 회사는 이미 제미니 4를 위한 가장 야심적인 사전 훈련을 시작했다고 말했습니다.

새로운 모델은 모두 구글의 라인업에서 더 저렴하고 빠른 쪽에 있습니다. “플래시” 티어는 최대 이유 깊이보다는 속도와 높은 볼륨을 위해 설계되었습니다. 이는 중요합니다. 왜냐하면 최고의 성능을 내는 모델인 3.5 프로는 구글이 2026년 5월 I/O 컨퍼런스에서 설정한 목표를 훨씬 넘긴 상태입니다. 그곳에서 회사는 프로 버전이 다음 달에 출시될 것이라고 말했습니다. 구글은 현재 프로 버전이 파트너와 테스트 중이며 준비가 되면 출시될 것이라고 말합니다.

새 모델이 하는 일

제미니 3.6 플래시는 구글이 I/O에서 출시한 3.5 플래시 모델의 직접적인 후속입니다. 주요 판매점은 효율성입니다. 구글은 3.6 플래시가 인공 분석 지수에서 3.5 플래시보다 약 17% 적은 출력 토큰을 사용하며, 여러 단계 작업을 완료하는 데 필요한 이유 단계와 도구 호출이 적다는 것을 말합니다. 이는 1백만 입력 토큰당 1.50달러, 1백만 출력 토큰당 7.50달러로, 이전 플래시보다 출력에 대해 더 저렴합니다. 지식 절단선은 2025년 1월부터 2026년 3월까지 앞으로 이동했습니다.

구글의 자체 코딩 및 에이전트 벤치마크에서, 3.6 플래시는 전임 모델을 능가합니다. 딥스위 코딩 테스트에서 49% 대 37%, OS월드 컴퓨터 사용 벤치마크에서 83% 대 78.4%를 기록했습니다. 이는 벤더가 보고한 숫자로, 외부 평가자가 아직 복제하지 못했습니다. 새로운 모델이 이전 모델과 비교하는 방식을 설명하며, 라이벌 플래그십과 비교하는 방식은 설명하지 않습니다.

제미니 3.5 플래시-라이트는 더 저렴한 동료입니다. 이는 에이전트 검색 및 문서 처리와 같은 고 처리량, 저 지연 작업을 위해 설계되었습니다. 구글은 이를 1백만 입력 토큰당 0.30달러, 1백만 출력 토큰당 2.50달러로 가격을 매겼습니다. 회사는 이를 3.1 플래시-라이트 모델의 명확한 업그레이드라고 말합니다. 두 새로운 모델은 모두 제미니 앱에서 오늘 사용할 수 있으며, 플래시-라이트는 검색에도 출시되며, 개발자는 구글의 안티그라비티, AI 스튜디오, 안드로이드 스튜디오 툴을 통해 접근할 수 있습니다.

보안 모델은 짧은 리드를 유지하고 있습니다

제3의 출시된 모델은 더 특이한 것입니다. 제미니 3.5 플래시 사이버는 소프트웨어 취약점을 찾고, 검증하고, 패치하는 데 미세 조정되었습니다. 이는 코드멘더, 구글 딥마인드의 코드 보안 에이전트 안에서 실행됩니다. 구글은 이 모델을 공개하지 않고 정부와 신뢰할 수 있는 파트너에게만 제한된 접근을 허용하는 것으로 설명합니다.

코드멘더는 저렴한 모델이 여기서 의미를 갖는 이유입니다. 에이전트는 코드베이스를 스캔하여 결함을 찾고, 각 결함의 근본 원인을 작업하며, 패치를 생성하고 자체적으로 검사한 다음 개발자에게 승인을 위해 높은 품질의 수정만 라우팅합니다. 구글 딥마인드는 이미 이 접근 방식이 6개월 동안 오픈 소스 프로젝트에 72개의 업스트림 수정을 생성했다고 말했습니다. 플래시 티어 모델을 사용하여 이 루프를 실행하는 것이 구글이 취약점 감지를 저렴한 토큰당 비용으로 제공할 수 있도록 합니다.

이 제한은 이 기술이 이중 사용 가능하다는 것을 나타냅니다. 공격에 유용한 취약점을 찾는 데 능한 모델은 방어자에게도 유용합니다. 구글은 이 모델이 “방어자에게 치명적인 취약점을 찾고 수정하는 데 앞서게 해주며, 더 광범위한 오남용을 방지”할 것이라고 말했습니다. 이는 자율적인 AI 보안 에이전트에서 나타나는 동일한 계산입니다.

플래그십 갭

이 모든 것이 구글의 여름을 정의하는 갭을 메우지 못합니다. 플래시 출시들은 점진적인 것입니다. 실제로 시장의 상위에 도전할 수 있는 모델은 아직 없습니다. 약 1주일 동안, 그록 4.5, 오픈AI의 GPT-5.6의 3가지 변형, 그리고 문샷 AI의 키미 K3가 모두 출시되었습니다. 또한 안트로픽의 클라우드 패밀리는 파블 5 모델을 주도하며, 구글의 플래시 티어가 현재 추종하는 공공 리더보드를 차지했습니다. 압력은 경쟁뿐만 아니라 규제입니다. 구글은 또한 유럽의 규제 당국과 대립하고 있으며, 규제 당국은 구글에 안드로이드와 검색 데이터를 라이벌 AI 어시스턴트와 공유하도록 명령했습니다.

구글의 현재 대응은 플래그십의 최상위 능력보다는 플래시 티어에서 가격과 속도에 대한 경쟁입니다. 이는 5월에 구동한 동일한 전략입니다. 3.5 플래시는 몇 가지 코딩 테스트에서 이전 3.1 프로를 능가했지만, 더 저렴한 옵션입니다. 이는 구글을 대화에 참여시킵니다. 그러나 개발자가 실제로 묻는 질문에는 답하지 않습니다.

이것이 제미니 4 라인이 읽혀야 하는 배경입니다. 사전 훈련을 시작하는 것은 의도된 선언입니다. 아직 출하된 능력은 아니며, 평가가 존재할 때까지 결과 모델이 무엇을 할지에 대해 아무 것도 말하지 않습니다. 주목할 점은 구글이 다음 세대를 강조하면서 현재 플래그십이 테스트에 고착되어 있다는 것을 시그널한다는 것입니다. 현재 중요하게 여겨지는 측정치는 3.5 프로가 마침내 출시되고, 제미니 4가 훈련 실행 이상의 것이 될지 여부입니다.

Jonas Reeve는 Unite.AI에서 AI 생성 분석가로 활동하며 인지 AI, 인공 일반 지능(AGI) 및 기계 지능의 이론적 기반에 집중합니다. 그의 연구는 학습, 추론, 기억, 추상화가 생물학적 시스템과 인공 시스템 모두에서 어떻게 나타나는지를 탐구하고, 현대 AI 아키텍처와 인지 과학 및 마음 철학의 오랜 질문들 사이의 연결을 제시합니다.

개념적이고 반성적인 접근 방식을 통해 Jonas는 추론 모델, 에이전트 시스템, 발생 인지, 정렬 이론과 같은 프레임워크를 검토하며, AGI에 대한 진전이 실제로 의미하는 바와 의미하지 않는 바를 명확히 하고자 합니다. 일정이나 과대광고를 쫓기보다 그는 기본 원칙, 개념적 엄밀성, 그리고 현재 모델의 한계를 강조합니다.

Jonas Reeve가 작성한 기사들은 AI 생성이며, 정확성, 명확성 및 고급 AI 개념에 대한 책임 있는 논의를 보장하기 위해 Unite.AI 편집팀이 검토합니다.