AI 모델 및 플랫폼
오픈AI와 앤트로픽, 경쟁 모델 출시로 AI 경쟁 심화

오픈AI와 앤트로픽은 오늘 새로운 플래그십 모델을 몇 분 간격으로 출시하였으며, 오픈AI는同時적으로 엔터프라이즈 에이전트 플랫폼을 출시하고 퍼플렉시티는 멀티모델 연구 기능을 도입하였다. 오늘은 대부분의 주에 발생하는 AI 제품 발표보다 더 많은 중요한 AI 제품 발표가 이루어졌다.
발표된 내용과 그 의미는 다음과 같다.
앤트로픽의 오퍼스 4.6: 에이전트 팀과 1백만 토큰 창
앤트로픽은 클라우드 오퍼스 4.6를 출시하였으며, 두 가지 주요 기능을 갖추고 있다: 1백만 토큰 컨텍스트 창과 새로운 기능인 에이전트 팀이다.
컨텍스트 창은 더 큰 기술적 성과이다. 1백만 토큰의 오퍼스 4.6는 단일 프롬프트에서 약 3,000 페이지의 텍스트를 처리할 수 있으며, 이전 버전의 256,000 토큰 제한의 4배이다. 128,000 토큰 출력 지원과 결합하여, 모델은 이제 코드베이스, 규제 제출, 또는 연구 корп스를 청크나 요약 없이 처리할 수 있다.
에이전트 팀은 클라우드 코드에서 사용 가능하며, 여러 클라우드 인스턴스가 공유 코드베이스에서 병렬로 작업할 수 있다. 단일 에이전트가 순차적으로 작업을 수행하는 대신, 개발자는 하나의 에이전트가 프론트엔드 변경 사항을 처리하고, 다른 에이전트가 테스트를 작성하며, 세 번째 에이전트가 백엔드 논리를 리팩토링하는 팀을 생성할 수 있다. 모두 동일한 프로젝트에서 동시에 협력한다.
오퍼스 4.6은 또한 적응적 사고를 도입하여, 모델이 주어진 프롬프트에 투자할 사고 노력을 조정할 수 있다. 간단한 질문에는 빠른 응답이 주어지며, 복잡한 문제에는 더 깊은 확장된 사고가 발생한다. 개발자는 4つの 수준(낮음, 중간, 높음, 최대)에서 노력 제어를 조정할 수 있다.
벤치마크에서, 오퍼스 4.6는 터미널 벤치 2.0에서 에이전트 코딩을 위한 최고 점수를 얻으며, 휴머니티의 마지막 시험에서 복잡한 사고 평가를 이끌어낸다. 앤트로픽은 GDPval-AA 평가에서 GPT-5.2에 대해 144점의 엘로 우위를 보유하고 있으며, 오퍼스 4.5에 대해 190점의 개선을 보유하고 있다.
API 가격은 1백만 입력 토큰당 5달러, 1백만 출력 토큰당 25달러로 변경되지 않는다. 그러나 20만 토큰을 초과하는 프롬프트는 10달러/37.50달러의 프리미엄 요금이 적용된다.
엔터프라이즈 측면에서, 앤트로픽은 마이크로소프트 파워포인트에서 클라우드 연구 프리뷰를 발표하였다. 여기서 모델은 기존 슬라이드 레이아웃과 템플릿을 읽고 프레젠테이션을 생성하거나 편집할 수 있으며, 브랜드 형식을 보존한다.
오픈AI의 GPT-5.3-코덱스: 스스로를 구축한 모델
앤트로픽의 발표 직후, 오픈AI는 GPT-5.3-코덱스를 출시하였다. 이는 가장 강력한 코딩 모델이다. 이 출시에서는 GPT-5.2-코덱스의 프론티어 코딩 성능과 GPT-5.2의 이성과 전문 지식 능력을 단일 시스템으로 통합하였으며, 25% 빠르다.
가장 주목할만한 주장은 GPT-5.3-코덱스가 스스로를 구축했다는 것이다. 오픈AI의 코덱스 팀은 모델의 초기 버전을 사용하여 훈련 과정에서 디버깅, 인프라 배포, 평가 결과 진단 등을 수행하였다. 이는 오픈AI가 모델이 스스로의 개발에 기여했다는 첫 공식 인정이며, 효율성과 안전성에 대한 의문을 제기한다.
GPT-5.3-코덱스는 SWE-Bench Pro와 터미널 벤치에서 새로운 산업 최고 기록을 세웠다. 이는 실제 소프트웨어 엔지니어링 작업을 평가하는 벤치마크이다. 모델은 장기간 실행되는 작업을 처리할 수 있으며, 사용자는 작업 중에 컨텍스트를 잃지 않고 모델과 상호 작용할 수 있다. 이는 동료와 협력하는 것과 같다.
모델은 현재 모든 채팅GPT 유료 플랜 사용자에게 코덱스 앱, CLI, IDE 확장, 웹 인터페이스를 통해 사용할 수 있다. API 액세스는 곧 제공될 예정이다.
개발자가 AI 코드 생성기 사이에서 선택할 때, 경쟁 환경은 이제 명확하게 정의되었다: 오퍼스 4.6는 에이전트 조정과 긴 컨텍스트 작업에서 선두를 지키며, GPT-5.3-코덱스는 속도와 통합된 이성을 강조한다. 두 모델은 중복되는 벤치마크에서 최고의 점수를 얻었으며, 커서와 같은 도구 및 애플의 X코드는 두 모델을 모두 지원하므로 개발자는 자유롭게 전환할 수 있다.
오픈AI 프론티어: 엔터프라이즈 에이전트의 플랫폼
모델 출시와 함께, 오픈AI는 프론티어를 소개하였다. 이는 에이전트를 구축하고 배포하고 관리하기 위한 엔터프라이즈 플랫폼이다. 프론티어는 데이터베이스, CRM 시스템, HR 플랫폼, 티켓팅 도구, 기타 비즈니스 애플리케이션에 연결하여 에이전트가 그들 사이에서 프로세스를 실행할 수 있다.
오픈AI는 프론티어를 “엔터프라이즈를 위한 시맨틱 레이어”라고 설명하였다. 여기서 인간 직원과 에이전트가 동일한 플랫폼에서 공유 데이터 액세스와 보안 제어를 통해 작동한다. 에이전트는 직원과 같은 ID, 공유 조직 컨텍스트, 엔터프라이즈급 권한을 받는다.
플랫폼은 모델-에이전트이다. 즉, 회사는 오픈AI의 모델과 함께 구축된 에이전트와 구글, 마이크로소프트, 앤트로픽의 에이전트를 관리할 수 있다. 초기 고객에는 인튜이트, 스테이트팜, 테르모 피셔, 우버가 있다.
프론티어는 오픈AI를 세일즈포스의 에이전트포스와 서비스나우의 AI 에이전트와 같은 엔터프라이즈 플랫폼과 직접 경쟁하게 한다. 그러나 오픈AI는 모델 레이어부터 구축하고 있으며, 기존 업체는 기존 워크플로우 툴에 AI를 추가하고 있다. 엔터프라이즈는 에이전트 인프라를 AI 제공업체나 소프트웨어 벤더에서 얻는 것을 선호하는지에 따라 2026年的 엔터프라이즈 AI 경쟁이 정의될 것이다.
퍼플렉시티의 모델 카운슬: 세 모델, 하나의 답변
퍼플렉시티는 모델 카운슬을 출시하였다. 이는 동일한 쿼리를 세 모델(클라우드 오퍼스, GPT, 젬니)에 동시에 실행하고, 하나의 모델을 사용하여 출력을 하나의 답변으로 통합한다. 이 답변은 동의와 불일치 영역을 표시한다.

이미지: 퍼플렉시티
전제는 단일 모델이 모든 쿼리에서 항상 최고라는 것이다. 세 프론티어 모델이 동일한 답변에 도달할 때, 신뢰도가 높다. 모델이 발산할 때, 사용자는 추가적으로 조사해야 한다. 모델 카운슬은 맥스 구독자에게 제공되며, 투자 연구, 전략 분석, 복잡한 의사 결정에 적합하다.
이 기능은 퍼플렉시티가 멀티모델 오케스트레이션을 통해 차별화를 구축하는 전략을 반영한다. 프론티어 AI 채팅봇 간의 격차가 개별 벤치마크에서 좁혀짐에 따라, 그들의 출력을 집계하는 것이 단일 제공업체를 선택하는 것보다 더 유용할 수 있다.
모두가 의미하는 바
이번 출시들은 AI 경쟁이 모델 능력에서 제품 인프라로 이동했음을 확인한다. 오픈AI와 앤트로픽 모두 벤치마크에서 최고의 모델을 보유하고 있다. 이제 차별화는 모델 위에 구축된 것에 있다.
퍼플렉시티는 조용히 모델 전쟁이 모델을 결합하는 방법보다 중요하지 않을 수 있다는 주장을 하고 있다. 모델 카운슬이 유용한 것으로 chứng명되면, 이는 미래가 클라우드와 GPT 중 하나를 선택하는 것이 아니라, 둘 다 사용하는 것임을 시사한다.
개발자와 엔터프라이즈가 AI 스택을 평가할 때, 이는 결정이 더 어려워진다.












