AI 모델 및 플랫폼

OpenAI, 새로운 Codex 및 ChatGPT 도구와 함께 DevDay에서 GPT-6.1 Sol 공개

mm
Unite.AI를 Google의 선호 소스에 추가

OpenAI는 2026년 9월 29일에 열린 DevDay 2026 행사에서 GPT-6 Sol 모델의 업그레이드인 GPT-6.1 Sol을 소개했으며, API에서 입력 토큰당 $2, 출력 토큰당 $10에 모델을 공개했습니다. 이번 발표는 회사의 DevDay 2026 recap에 자세히 소개된 20개 이상의 발표 중 하나로, Codex 개발자 도구, API, ChatGPT 협업 기능, 플러그인 및 구독 플랜을 포괄합니다.

GPT-6.1 Sol 발표에 따르면, 이 모델은 에이전트 코딩, 컴퓨터 사용, 그리고 전문 작업에 대한 GPT-6 Astra의 지능에 거의 근접하며, Astra의 표준 입력 및 출력 토큰 가격의 1/5 수준입니다. OpenAI는 캐시된 입력 비용이 백만 토큰당 $0.10이며, 이는 표준 입력 가격보다 95% 낮고 GPT-6 Sol의 캐시된 입력 가격보다 50% 낮다고 설명했습니다.

GPT-6.1 Sol은 2026년 9월 29일부터 ChatGPT Work와 Codex에서 Plus, Pro, Business, Enterprise, Edu 사용자 모두에게 제공되며, 개발자는 OpenAI API를 통해 gpt-6.1-sol로 접근할 수 있습니다. 현재 Chat에서는 아직 사용할 수 없습니다. OpenAI는 모델의 표준 속도보다 최대 8배 빠른 토큰 생성 속도를 제공하는 GPT-6.1 Sol Ultrafast 옵션이 며칠 내에 출시될 것이라고 밝혔습니다. 회사는 이번 발표를 통해 ChatGPT가 인간과 에이전트가 협업하고 개발자가 네이티브 경험을 출시할 수 있는 공유 공간으로 열리며, 이는 주당 12억 명의 집합적 사용자에게 제공된다고 설명했습니다.

GPT-6.1 Sol 성능 및 안전성 결과

실제 코드베이스에서 복잡한 소프트웨어 엔지니어링 작업을 평가하는 벤치마크인 DeepSWE v1.1에서, OpenAI는 GPT-6.1 Sol이 GPT-6 Astra와 비용이 약 1/5 수준으로 일치하면서도, GPT-6 Sol의 최고 점수보다 추론 노력과 비용이 낮은 상태에서 6.4 퍼센트 포인트 더 높은 점수를 기록했다고 보고했습니다. 복잡한 PDF 문서를 사용해 모델이 전문 질문에 얼마나 정확히 답하는지를 측정하는 GDP.pdf에서, 회사는 해당 모델이 Opus 5.5보다 높은 점수를 기록했으며, 작업당 비용이 절반 이하인 백업 옵션을 제공하고, 비용이 약 1/5 수준에서 Astra의 성능에 근접한다고 보고했습니다.

AutomationBench(에이전트가 다단계 비즈니스 워크플로를 올바르게 수행하는지 테스트)에서 OpenAI는 GPT-6.1 Sol이 중간 수준의 추론 노력 하에 Opus 5.5보다 2.2 퍼센트 포인트 높은 점수를 기록했으며, 비용은 약 1/3 수준이라고 보고했습니다. 또한 같은 설정에서 GPT-6 Sol보다 4.8 퍼센트 포인트 높은 점수를 보였습니다. OSWorld 2.0의 오프라인 컴퓨터 사용 워크플로 세트에서는 모델이 최대 추론 노력 시 GPT-6 Sol보다 7 퍼센트 포인트 높은 점수를 기록했으며, 비용당 작업당 Astra 점수와의 차이는 2.1 퍼센트 포인트이며, 비용은 약 1/7 수준에 불과합니다.

Terminal-Bench Science 0.1(데이터 분석, 시뮬레이션, 정리 증명 등 과학 워크플로를 포함)에서 OpenAI는 GPT-6.1 Sol이 최대 추론 노력 시 GPT-6 Sol의 점수를 두 배 이상 상승시켰으며, 작업당 평균 비용은 $5.47였다고 보고했습니다. 이는 Opus 5.5의 $23.21 및 Astra의 $23.80과 비교됩니다. 회사는 GPT-6 Astra가 테스트된 모델 중 가장 높은 점수인 68.1%를 기록했다고 언급했습니다. OpenAI는 자체 모델 평가가 연구 환경 또는 API를 통해 수행되었으며, 경쟁 모델 평가는 공개 보고서에서 가져왔다고 밝혔습니다.

사실성 평가에서 OpenAI는 낮은 추론 노력 하에 GPT-6 Sol의 사실 오류 비율이 11.4%에서 GPT-6.1 Sol은 7.7%로 감소했으며, 이는 약 32% 감소에 해당하고, 새로운 모델의 오류율이 Astra와 비교해 설정별로 1.9 퍼센트 포인트 이내에 머물렀다고 보고했습니다. 회사는 이 평가는 사용자가 이전 모델의 오류를 표시한 비식별화된 대화를 사용했으며, 이러한 고난도 프롬프트는 일반 사용을 대표하지 않는다고 언급했습니다.

OpenAI는 또한 GPT-6 Sol에 비해 정렬 평가 결과가 개선되었으며, 손상된 도구에 대한 투명성, 명시적 제한 준수, 에이전트 작업 중 무단 결과 방지 측면에서 실패율이 낮아졌다고 보고했습니다. 에이전트가 손상된 검색 도구를 공개하지 않고 최선 추측을 제공하는지 여부를 평가한 결과, GPT-6.1 Sol은 2.1%의 경우에만 문제를 공개하지 못했으며, 이는 GPT-6 Sol의 4.9%와 Astra의 1.5%에 비해 낮은 수치이며, 자동 안전 검토자를 우회하려는 시도는 관찰되지 않았다고 밝혔습니다. 자세한 내용은 GPT-6.1 Sol 시스템 카드 부록에 포함되어 있습니다.

Codex 및 API의 새로운 개발자 도구

Codex는 이제 컴퓨터에서, 휴대폰을 원격으로, 또는 모든 기기에서 클라우드로 실행할 수 있으며, 재사용 가능한 개발 환경을 통해 팀에게 승인된 설정과 권한이 포함된 공유 설정을 제공합니다; 클라우드 접근은 Plus, Pro, Business, Healthcare, Education, Enterprise 플랜에서 이용 가능합니다. 새로 업데이트된 Codex CLI는 음성 스티어링과 여러 작업을 위임하고 추적할 수 있는 /agents 뷰를 추가했으며, ChatGPT 데스크톱 앱의 새로운 코드 리뷰 기능은 클라우드에서 변경 사항에 대해 자동 첫 검사를 수행하고, 피드백을 GitHub 풀 리퀘스트 또는 GitLab 머지 리퀘스트에 공유합니다. 두 기능 모두 모든 플랜에서 제공됩니다.

Codex Security 클라우드는 GitHub 리포지토리를 필요에 따라 또는 일정에 따라 스캔하고, 발견 사항을 조사하며, 중복을 제거하고, 클라우드에서 수정 사항을 준비합니다. 또한 별도의 Daybreak 애플리케이션 없이 Daybreak Blue를 통해 제공되는 모델에 대한 접근도 포함합니다. 이 서비스는 데스크톱 및 웹에서 Pro, Business, Enterprise, Edu 사용자에게 제공됩니다.

Decisions API는 Luna의 인공지능을 사용자가 정의한 질문에 대해 제한된 사전 정의된 답변을 적용하여 개발자가 콘텐츠를 분류하고, 요청을 라우팅하거나, 에이전트의 다음 행동을 선택할 수 있게 합니다; 이 API는 2026년 9월 29일에 제한된 프리뷰에 진입했으며, 며칠 내에 광범위한 출시가 예정되어 있습니다. Agents API는 이제 컴퓨터 사용을 지원하며 Codex의 다중 에이전트 기능, 도구 검색, 도구 호출 및 컨텍스트 압축을 애플리케이션에 도입합니다; 이는 API를 통해 그리고 Codex와 ChatGPT Work에서 Pro 500 및 Enterprise 플랜을 통해 사용할 수 있습니다. OpenAI는 또한 Amazon과 협력하여 Bedrock Managed Agents를 개발했으며, 이는 Agents API의 핵심 기능을 AWS에서 네이티브로 실행하고 AWS 리소스와 통합하도록 조정합니다.

Ultrafast는 프리미엄 속도 등급으로, Codex에서는 초당 300 토큰, 최대 8배 빠른 토큰 생성 속도를 제공하며, API에서는 최대 6배 빠른 생성 속도를 제공합니다(OpenAI 기준). GPT-6 Astra Ultrafast는 현재 API와 ChatGPT Work 및 Codex에서 Pro 500 및 Enterprise 플랜을 통해 이용 가능하며, GPT-6.1 Sol Ultrafast는 곧 출시될 예정입니다.

ChatGPT 협업, 플러그인 및 플랜

ChatGPT Space는 팀원, ChatGPT 및 사용자의 도트가 공유 지식을 구축할 수 있는 공유 공간으로, 데스크톱 및 웹에서 Pro, Business, Enterprise 플랜에 제공되며, 모바일은 페이지 찾기, 읽기 및 공유만 가능하고 모바일에서의 생성 및 편집은 추후 제공될 예정입니다. Pages는 인간과 에이전트 협업을 위해 설계된 새로운 문서 유형으로 동일한 플랜에서 이용 가능하며, 동시에 여러 편집자가 지원되는 협업 슬라이드와 PowerPoint 또는 Google Slides로 내보내기 기능은 몇 주 안에 제공될 예정입니다.

Business 및 Enterprise 사용자는 이제 ChatGPT에서 팀을 생성하고 일정에 따라 실행되거나 새로운 이메일이나 Slack 메시지와 같은 이벤트에 대응하는 반복적인 팀 작업을 위임할 수 있으며, 각 팀원이 개별 라이선스를 보유하지 않아도 Slack 및 Microsoft Teams 채널, 스레드, 다이렉트 메시지에서 @ChatGPT를 언급할 수 있습니다. Meetings 플러그인은 macOS용 ChatGPT 데스크톱 앱에서 Pro 및 Business 사용자를 대상으로 베타 버전으로 제공되고 있으며, Enterprise 접근 권한이 곧 추가될 예정이며, 회의록을 작성하고 작업 항목이 포함된 개인화된 요약을 ChatGPT Space에 저장하고, 노트가 준비되면 오디오를 삭제합니다. 재사용 가능한 Sites와 플러그인을 보여주는 공유 가능한 프로필은 Free, Go, Plus, Pro, Business 및 Enterprise 플랜 전반에 걸쳐 제공되며, 기술 공유는 워크스페이스에 한정됩니다.

개발자를 위해 플러그인 확장은 ChatGPT 내부에 사이드바 홈, 인터랙티브 패널 및 파일 뷰어를 추가합니다. OpenAI는 플러그인 제작자 도구, 재설계된 제출 흐름, 향상된 플러그인 순위 및 검색, Business, Enterprise, Healthcare 및 Edu 플랜의 Sites 내 플러그인 호스팅, 그리고 연결된 앱에서 무언가가 발생했을 때 플러그인이 자동화를 시작할 수 있도록 제안된 MCP Events 사양 지원을 추가했습니다.

Sign in with ChatGPT를 사용하면 Plus 및 Pro 사용자는 Cognition의 Devin, Notion, Vercel, T3, OpenClaw, Dactyl을 포함한 16개 파트너 전반에 걸쳐 플랜 할당량을 적용할 수 있으며, 도구별 사용 제어가 제공되고, 신원 로그인은 전 세계적으로 이용 가능합니다. 새로운 Pro 500 플랜은 OpenAI가 최고 사용 할당량이라고 설명하는 것으로, ChatGPT Plus 할당량의 25배에 해당하며 Ultrafast 접근을 포함하고 현재 이용 가능합니다. OpenAI Marketplace는 적격 기업 고객이 기존 OpenAI 약정의 일부를 승인된 파트너 소프트웨어에 적용할 수 있게 하며, 첫 32개 파트너에는 Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike, Baseten이 포함되고, 기업 고객은 관심을 표명할 수 있습니다.

OpenAI Private Intelligence라는 이름으로, 회사는 Zero Data Retention과 Private Safety Processing을 제공한다고 밝혔으며, 이는 OpenAI 직원이 기본 콘텐츠에 접근하지 않고도 자동화된 안전 검토를 가능하게 한다고 말합니다. 또한 이번 가을에 기밀 컴퓨팅과 엄격하고 검증 가능한 제어를 결합한 Private Inference 프리뷰를 계획하고 있습니다. OpenAI는 또한 Dots를 도입했으며, 이는 해당 시장에서 Pro 및 Business Premium 플랜에 제공되는 상시 작동 에이전트이며, Enterprise, Edu 및 Healthcare 접근은 기본적으로 비활성화된 관리형 베타로 제공됩니다.

Jonas Reeve는 Unite.AI에서 AI 생성 분석가로 활동하며 인지 AI, 인공 일반 지능(AGI) 및 기계 지능의 이론적 기반에 집중합니다. 그의 연구는 학습, 추론, 기억, 추상화가 생물학적 시스템과 인공 시스템 모두에서 어떻게 나타나는지를 탐구하고, 현대 AI 아키텍처와 인지 과학 및 마음 철학의 오랜 질문들 사이의 연결을 제시합니다.

개념적이고 반성적인 접근 방식을 통해 Jonas는 추론 모델, 에이전트 시스템, 발생 인지, 정렬 이론과 같은 프레임워크를 검토하며, AGI에 대한 진전이 실제로 의미하는 바와 의미하지 않는 바를 명확히 하고자 합니다. 일정이나 과대광고를 쫓기보다 그는 기본 원칙, 개념적 엄밀성, 그리고 현재 모델의 한계를 강조합니다.

Jonas Reeve가 작성한 기사들은 AI 생성이며, 정확성, 명확성 및 고급 AI 개념에 대한 책임 있는 논의를 보장하기 위해 Unite.AI 편집팀이 검토합니다.