AI 모델 및 플랫폼

제미니 2.5 프로가登場했습니다 – 그리고 그것은 AI 게임을 다시 바꿉니다

mm
Unite.AI를 Google의 선호 소스에 추가

구글은 제미니 2.5 프로를 공개했습니다. 이것은 구글의 “가장 지능적인 AI 모델”입니다. 구글 딥마인드 팀이 개발한 이 최신 대형 언어 모델은 복잡한 문제를 해결하기 위해 내부적으로 단계를 이유로 하여 응답하는 “思考 모델”으로 설명됩니다. 초기 벤치마크는 구글의 자신감을 뒷받침합니다. 제미니 2.5 프로(2.5 시리즈의 첫 번째 실험적 릴리즈)는 LMArena 리더보드에서 상당한 차이로 1위를 차지했습니다. 또한 코딩, 수학, 과학 작업을 위한 표준 테스트에서 많은 모델을 이깁니다.

제미니 2.5 프로의 새로운 기능과 기능에는 다음이 포함됩니다.

  • 사슬思考: 더 직접적인 채팅봇과는 달리, 제미니 2.5 프로는 내부적으로 문제를 “思考”합니다. 이것은 어려운 질의에 대해 더 논리적이고 정확한 답변을 제공합니다. 어려운 논리 퍼즐부터 복잡한 계획 작업까지입니다.
  • 최근 성능: 구글은 2.5 프로가 많은 벤치마크에서 오픈AI와 앤트로픽의 최신 모델을 능가한다고 보고합니다. 예를 들어, 인간의 마지막 시험과 같은 어려운 이유 테스트에서 새로운 최고치를 달성했습니다(18.8% vs. 오픈AI 모델의 14% 및 앤트로픽의 8.9%). 또한 다양한 수학 및 과학 도전에서 앙상블 투표와 같은 비싼 트릭이 필요하지 않습니다.
  • 고급 코딩 기술: 이 모델은 이전 버전보다 코딩 능력이 크게 향상되었습니다. 웹 앱 및 자율 “에이전트” 스크립트를 위한 코드 생성 및 편집에 탁월합니다. SWE-Bench 코딩 벤치마크에서 제미니 2.5 프로는 63.8%의 성공률을 달성했습니다. 오픈AI의 결과보다 앞섰지만 앤트로픽의 전문 Claude 3.7 “소네트” 모델(70.3%)에는 조금 뒤졌습니다.
  • 다중 모드 이해: 이전 제미니 모델과 마찬가지로 2.5 프로는 원生的 다중 모드입니다. 하나의 대화에서 텍스트, 이미지, 오디오, 비디오 및 코드 입력을 모두 수용하고 이유를 제공할 수 있습니다. 이러한 다중 모드 기능은 이미지에 대한 설명, 프로그램 디버깅, 스프레드시트 분석 등을 하나의 세션에서 모두 수행할 수 있습니다.
  • 거대한 컨텍스트 창: 아마도 가장 인상적인 것은 제미니 2.5 프로가 최대 1백만 토큰의 컨텍스트(2백만 토큰 업데이트가 예정됨)를 처리할 수 있다는 것입니다. 실제로 이것은 수백 페이지의 텍스트 또는 전체 코드 저장소를一度에 처리할 수 있음을 의미합니다. 대부분의 다른 AI 모델이 제공하는 것보다 훨씬 긴 기억력을 가지고 있습니다. 제미니는 매우 큰 문서나 토론에 대한 자세한 이해를 유지할 수 있습니다.

구글에 따르면, 이러한 발전은 크게 향상된 기본 모델과 개선된 사후 교육 기술에서 비롯됩니다. 주목할 점은 구글이 제미니 2.0에서 사용한 별도의 “플래시思考” 브랜딩을 2.5에서 기본적으로 모든 모델에 내장된 이유 능력으로 대체한다는 것입니다. 사용자에게 이것은 일반적인 제미니와의 상호작용도 더 깊은 수준의 “思考”을 제공함을 의미합니다.

자동화 및 디자인을 위한 함의

벤치마크와 경쟁의 소음 너머로, 제미니 2.5 프로의 실제 중요성은 최종 사용자와 산업을 위한 가능성에 있을 수 있습니다. 모델의 코딩 및 이유 테스트에서 강한 성능은 퍼즐을 풀기 위한 자랑이 아닙니다. 새로운 자동화, 소프트웨어 개발, 심지어 창의적인 디자인의 가능성을 암시합니다.

예를 들어, 코딩을 생각해 보십시오. 간단한 프롬프트에서 작동하는 코드를 생성할 수 있는 제미니 2.5 프로는 개발자에게 프로젝트를 증폭할 수 있습니다. 하나의 엔지니어가 AI의 도움으로 많은 일을 처리할 수 있는 웹 애플리케이션 또는 전체 코드베이스를 분석할 수 있습니다. 구글 데모에서 모델은 한 문장의 설명만으로 기본 비디오 게임을 구축했습니다. 이것은 비개발자가 아이디어를 설명하고 실행 가능한 앱을 받는 미래를 암시합니다( “바이브 코딩“), 소프트웨어 생성의 장벽을 크게 낮출 것입니다.

경험丰富한 개발자에게도, 큰 코드 저장소를 이해하고 수정할 수 있는 AI를 가지면 디버깅, 코드 리뷰, 리팩터링이 더 빠르게 진행됩니다. 우리는 AI 페어 프로그래머가 복잡한 프로젝트의 “큰 그림”을 머릿속에 가지고 있는 시대로 나아가고 있습니다. 그래서 매번 프롬프트마다 컨텍스트를 상기시킬 필요가 없습니다.

제미니 2.5의 고급 이유 능력은 지식 작업 자동화에도 기여합니다. 초기 사용자는 긴 계약서를 입력하고 모델에 주요 조항을 추출하거나 요약을 요청했으며, 약속된 결과를 보았습니다. 법적 검토,尽职調査 연구, 또는 재무 분석의 일부를 자동화하는 것을 상상해 보십시오. 수백 페이지의 문서를 분석하여 중요한 내용을 추출하는 작업은 현재 수많은 인力を 필요로 합니다.

제미니의 다중 모드 기능은 텍스트, 스프레드시트, 도표를 함께 분석하여 일관된 요약을 제공할 수 있습니다. 이러한 AI는 법률, 의료, 공학 또는 데이터와 문서로溢れる 분야의 전문가에게 귀중한 보조工具이 될 수 있습니다.

창의적인 분야와 제품 디자인을 위한 제미니 2.5 프로와 같은 모델은 또한 흥미로운 가능성을 열어줍니다. 아이디어 생성 또는 마케팅 복사본을 생성하는 브레인스토밍 파트너로 작용하거나, 거친 아이디어를 구체적인 초안으로 변환하는 빠른 프로토タイ퍼로 작용할 수 있습니다. 구글의 에이전트 행동(모델이 도구를 사용하고 다단계 계획을 자율적으로 수행하는 능력)에 대한 강조는 향후 버전이 소프트웨어와 직접 통합할 수 있음을 시사합니다.

디자인 AI가 아이디어를 제안하고 디자인 소프트웨어를 탐색하거나 아이디어를 구현하기 위한 코드를 작성할 수 있는 미래를 상상해 보십시오. 이러한 기능은 AI 영역에서 “생각자”와 “실행자”의 경계를模糊하게 합니다. 제미니 2.5는 다양한 도메인에서 해결책을 개념화하고 실행할 수 있는 AI를 향한 한 걸음입니다.

그러나 이러한 발전은 중요한 질문도 제기합니다. AI가 더 복잡한 작업을 수행할수록, 우리는 그것이细微한 차이와 윤리적 경계(예를 들어, 어느 계약 조항이 민감한지 또는 디자인에서 창의적 측면과 실제 측면을 어떻게 균형잡는지)를 이해하는지 어떻게 확신할 수 있을까요? 구글과 다른 회사들은 강력한 가드레일을 구축해야 하며, 사용자는 이러한 도구가 동료가 되는 medida에 따라 새로운 기술을 습득해야 할 것입니다.

그럼에도 불구하고, 발전의 방향은 명확합니다. 제미니 2.5 프로와 같은 모델은 이전에 인간의 지능과 창의성이 필요한 역할로 AI를 더 깊숙이 밀어 넣고 있습니다. 생산성과 혁신에 대한 함의는巨大하며, 우리는 많은 산업에서 제품이 어떻게 구축되고 작업이 어떻게 수행되는지에 대한 파급효과를 볼 것입니다.

제미니 2.5와 새로운 AI 분야

제미니 2.5 프로와 함께, 구글은 AI 경쟁의 최전선에 자리 잡고 있습니다. 그리고 라이벌에게 메시지를 보냅니다. 몇 년 전, 구글의 AI(초기 바드 반복을 생각해 보십시오)가 오픈AI의 ChatGPT와 마이크로소프트의 공격적인 움직임에 뒤처진다는 이야기가 있었습니다. 지금, 구글 리서치와 딥마인드의 결합된 재능을 동원하여, 지구상에서 가장 좋은 AI 어시스턴트라는 칭호를 합법적으로 주장할 수 있는 모델을 제공했습니다.

이것은 구글의 장기적인 위치를 좋게합니다. AI 모델은 점점 더 핵심 플랫폼(운영 체제 또는 클라우드 서비스와 유사)으로 간주되고 있으며, 최상위 모델을 갖는 것은 구글에게 모든 것에서 강한 카드를 제공합니다. 엔터프라이즈 클라우드 제공(구글 클라우드/버텍스 AI)에서 소비자 서비스(검색, 생산성 앱, 안드로이드)까지입니다. 장기적으로, 우리는 제미니 패밀리가 많은 구글 제품에 통합될 것으로 예상합니다. 이는 구글 어시스턴트를 강화하고, 구글 워크스페이스 앱에 더智能한 기능을 제공하고, 검색을 더 대화형이고 컨텍스트에 민감한 능력으로 향상시킬 수 있습니다.

제미니 2.5 프로의 출시 또한 AI 경쟁이 얼마나 경쟁적이 되었는지를 강조합니다. 오픈AI, 앤트로픽, 메타, 그리고 새로운 스타트업 등 다른 회사들은 모두 모델을 빠르게 반복하고 있습니다. 각 회사의 도약(더 큰 컨텍스트 창, 새로운 도구 통합 방법, 새로운 안전 기술 등)은 다른 회사가迅速하게 대응합니다. 구글의 모든 모델에 이유 능력을 내장하는 전략은 자신이 “지능”에서 뒤처지지 않도록 보장합니다. 한편, 앤트로픽의 사용자에게 더 많은 제어를 제공하는 전략(클라우드 3.7의 조정 가능한 이유 깊이와 같이)과 오픈AI의 지속적인 GPT-4.x 개선은 압력을 유지합니다.

최종 사용자와 개발자에게 이는 주로 긍정적인 것입니다. 더 좋은 AI 시스템이 더 빠르게 도착하고 시장에서 더 많은 선택肢이 있다는 것을 의미합니다. 우리는 하나의 회사가 혁신을 독점하지 않는 AI 생태계를 보게 됩니다. 이것은 초기 개인 컴퓨터 또는 스마트폰 전쟁의 날들과 유사한 역동성을 가지고 있습니다.

이 контек스트에서, 제미니 2.5 프로의 출시가 단순한 구글의 제품 업데이트가 아니라, 새로운 AI 시대에서 리더가 되겠다는 의지의 표시입니다. 구글은 모델을 훈련하기 위해 필요한 거대한 컴퓨팅 인프라와 광대한 데이터 자원을 활용하여 다른 회사가 따라갈 수 없는 경계를 밀어붙이고 있습니다.同時적으로, 구글의 접근 방식(실험 모델을 신뢰할 수 있는 사용자에게 론칭하고, AI를 생태계에 조심스럽게 통합하는)은 야망과 책임 및 현실성 사이의 균형을 원합니다.

구글 딥마인드의 CTO인 코라이 카브쿠오글루는 발표에서, AI를 더 도움이 되고 능력이 뛰어나게 만들면서 빠른 속도로 개선하는 것이 목표라고 말했습니다.

산업 관찰자에게, 제미니 2.5 프로는 2025년 초까지 AI가 얼마나 발전했는지 보여주는 里程碑입니다. 그리고 어디로 가고 있는지에 대한 힌트입니다. “최첨단”의 기준은 계속해서 상승합니다. 오늘날은 이유와 다중 모드 능력입니다. 내일은 더 일반적인 문제 해결 또는 자율성일 수 있습니다. 구글의 최신 모델은 회사가 경쟁에만 참여하는 것이 아니라 결과를 형성하겠다는 것을 보여줍니다. 제미니 2.5가 보여주는 바와 같이, 다음 세대의 AI 모델은 우리의 일과 삶에 더욱 통합될 것입니다. 이것은 우리가 기계 지능을 사용하는 방식을 다시 상상하도록 할 것입니다.

Alex McFarland은 인공 지능의 최신 개발을 탐구하는 AI 저널리스트이자 작가입니다. 그는 전 세계의 수많은 AI 스타트업과 출판물들과 협력했습니다.