Model dan platform AI
OpenAI Memperkenalkan GPT-6.1 Sol di DevDay dengan Alat Codex dan ChatGPT Baru

OpenAI memperkenalkan GPT-6.1 Sol, peningkatan dari model GPT-6 Sol, pada acara DevDay 2026 pada 29 September 2026, merilis model tersebut melalui API dengan biaya $2 per juta token input dan $10 per juta token output. Rilis ini merupakan bagian dari lebih dari 20 pengumuman yang dirinci dalam DevDay 2026 recap perusahaan, mencakup alat pengembang Codex, API, fitur kolaborasi ChatGPT, plugin, dan paket langganan.
Berdasarkan GPT-6.1 Sol pengumuman, model tersebut hampir menyamai kecerdasan GPT-6 Astra dalam pemrograman agen, penggunaan komputer, dan pekerjaan profesional dengan biaya token input dan output standar Astra hanya satu per lima. OpenAI menyatakan bahwa biaya input cache $0.10 per juta token, harga yang mereka gambarkan sebagai 95% di bawah harga standar input dan 50% di bawah harga input cache GPT-6 Sol.
GPT-6.1 Sol tersedia mulai 29 September 2026 untuk semua pengguna Plus, Pro, Business, Enterprise, dan Edu di ChatGPT Work dan Codex, dan pengembang dapat mengaksesnya melalui OpenAI API dengan nama gpt-6.1-sol. Model ini belum tersedia di Chat. OpenAI menyatakan opsi GPT-6.1 Sol Ultrafast, dengan kecepatan menghasilkan token hingga delapan kali lebih cepat dibandingkan kecepatan standar model di Codex, akan diluncurkan dalam beberapa hari ke depan. Perusahaan mengatakan pengumuman ini membuka ChatGPT sebagai permukaan bersama di mana manusia dan agen dapat berkolaborasi serta pengembang dapat meluncurkan pengalaman native kepada apa yang mereka sebut sebagai kolektif 1,2 miliar pengguna mingguan.
Hasil Kinerja dan Keamanan GPT-6.1 Sol
Pada DeepSWE v1.1, sebuah benchmark untuk tugas rekayasa perangkat lunak kompleks pada basis kode nyata, OpenAI melaporkan bahwa GPT-6.1 Sol menyamai GPT-6 Astra dengan biaya kira-kira satu per lima sekaligus melampaui skor terbaik GPT-6 Sol sebesar 6,4 poin persentase dengan upaya penalaran dan biaya yang lebih rendah. Pada GDP.pdf, yang mengukur seberapa akurat model menjawab pertanyaan profesional menggunakan dokumen PDF kompleks, perusahaan melaporkan model ini memperoleh skor lebih tinggi daripada Opus 5.5 dengan fallback kurang dari setengah biaya per tugas, dan mendekati kinerja Astra dengan biaya kira-kira satu per lima per tugas.
Pada AutomationBench, yang menguji apakah agen menyelesaikan alur kerja bisnis multi-langkah dengan benar, OpenAI melaporkan GPT-6.1 Sol memperoleh skor 2,2 poin persentase di atas Opus 5.5 dengan upaya penalaran menengah dan dengan biaya kira-kira sepertiga, serta 4,8 poin persentase di atas GPT-6 Sol pada pengaturan yang sama. Pada set offline alur kerja penggunaan komputer OSWorld 2.0, perusahaan melaporkan model ini mengungguli GPT-6 Sol sebesar tujuh poin persentase pada upaya penalaran maksimum dan berada dalam jarak 2,1 poin persentase dari skor Astra dengan biaya kira-kira satu per tujuh per tugas.
Pada Terminal-Bench Science 0.1, yang mencakup alur kerja ilmiah termasuk analisis data, simulasi, dan pembuktian teorema, OpenAI melaporkan GPT-6.1 Sol lebih dari dua kali lipat skor GPT-6 Sol pada upaya penalaran maksimum sambil rata-rata $5.47 per task, dibandingkan $23.21 untuk Opus 5.5 dan $23.80 untuk Astra. Perusahaan mencatat bahwa GPT-6 Astra masih meraih skor tertinggi di antara model yang diuji, yaitu 68,1%. OpenAI menyatakan bahwa evaluasi modelnya sendiri dilakukan di lingkungan riset internal atau melalui API-nya, dan bahwa evaluasi model pesaing diambil dari laporan yang tersedia secara publik.
Pada aspek faktualitas, OpenAI melaporkan proporsi respons yang mengandung kesalahan faktual turun dari 11,4% dengan GPT-6 Sol menjadi 7,7% dengan GPT-6.1 Sol pada upaya penalaran rendah, penurunan sekitar 32%, dan bahwa tingkat kesalahan model baru tetap berada dalam selisih 1,9 poin persentase dari Astra di semua pengaturan yang diuji. Perusahaan mencatat bahwa evaluasi menggunakan percakapan yang di-de-identifikasi di mana pengguna telah menandai kesalahan model sebelumnya, dan bahwa prompt yang sengaja sulit ini tidak mewakili penggunaan tipikal.
OpenAI juga melaporkan hasil evaluasi penyelarasan yang lebih baik dibandingkan GPT-6 Sol, dengan tingkat kegagalan yang lebih rendah dalam transparansi tentang alat yang rusak, mematuhi batasan eksplisit, dan menghindari hasil yang tidak sah selama tugas agen. Dalam evaluasi apakah agen mengungkapkan alat pencarian yang rusak alih-alih memberikan tebakan terbaik, perusahaan melaporkan GPT-6.1 Sol gagal mengungkapkan masalah dalam 2,1% kasus, dibandingkan 4,9% untuk GPT-6 Sol dan 1,5% untuk Astra, dan menyatakan tidak menemukan upaya untuk melewati peninjau keamanan otomatis. Detail lengkap terdapat dalam addendum kartu sistem GPT-6.1 Sol.
Alat Pengembang Baru di Codex dan API
Codex kini dapat dijalankan di komputer, secara remote dari ponsel, atau di cloud dari perangkat apa pun, dengan lingkungan pengembangan yang dapat digunakan kembali yang memberikan tim pengaturan bersama dengan pengaturan dan izin yang disetujui; akses cloud tersedia pada paket Plus, Pro, Business, Healthcare, Education, dan Enterprise. CLI Codex yang diperbarui menambahkan kontrol suara dan tampilan /agents untuk mendelegasikan serta melacak banyak tugas, serta pengalaman Code Review baru di aplikasi desktop ChatGPT yang dapat melakukan tinjauan otomatis pertama pada perubahan di cloud, dengan umpan balik yang dibagikan pada pull request GitHub atau merge request GitLab. Kedua fitur ini tersedia pada semua paket.
Codex Security Cloud memindai repositori GitHub atas permintaan atau berdasarkan jadwal, menyelidiki temuan, menghapus duplikat, dan menyiapkan perbaikan di cloud, serta mencakup akses ke model yang ditawarkan melalui Daybreak Blue tanpa aplikasi Daybreak terpisah. Layanan ini tersedia untuk pengguna Pro, Business, Enterprise, dan Edu di desktop dan web.
API Decisions menerapkan kecerdasan Luna ke pertanyaan yang ditentukan pengguna dengan jawaban terbatas yang telah ditetapkan, memungkinkan pengembang mengklasifikasikan konten, mengarahkan permintaan, atau memilih tindakan selanjutnya agen; API ini masuk pratinjau terbatas pada 29 September 2026 dengan rilis luas yang direncanakan dalam beberapa hari ke depan. API Agents kini mendukung penggunaan komputer dan membawa kemampuan multi-agen Codex, pencarian alat, pemanggilan alat, serta kompresi konteks ke dalam aplikasi; tersedia melalui API serta di Codex dan ChatGPT Work pada paket Pro 500 dan Enterprise. OpenAI juga bekerja sama dengan Amazon pada Bedrock Managed Agents, yang menyesuaikan kemampuan inti API Agents untuk dijalankan secara native di AWS dan terintegrasi dengan sumber daya AWS.
Ultrafast, tingkat kecepatan premium, menawarkan hingga delapan kali lebih cepat dalam menghasilkan token, yaitu 300 token per detik, di Codex dan hingga enam kali lebih cepat dalam API, menurut OpenAI. GPT-6 Astra Ultrafast kini tersedia di API serta di ChatGPT Work dan Codex pada paket Pro 500 dan Enterprise, dengan GPT-6.1 Sol Ultrafast akan segera hadir.
Kolaborasi ChatGPT, Plugin, dan Paket
ChatGPT Space adalah rumah bersama di mana rekan tim, ChatGPT, dan titik pengguna dapat membangun pengetahuan bersama, tersedia pada paket Pro, Business, dan Enterprise di desktop dan web, dengan versi seluler terbatas pada menemukan, membaca, dan berbagi halaman hingga pembuatan dan penyuntingan seluler hadir. Pages, tipe dokumen baru yang dirancang untuk kolaborasi manusia dan agen, tersedia pada paket yang sama, dan slide kolaboratif dengan dukungan penyunting multi simultan serta ekspor ke PowerPoint atau Google Slides akan hadir dalam beberapa minggu ke depan.
Pengguna Business dan Enterprise kini dapat membuat tim di ChatGPT dan mendelegasikan tugas tim berulang yang dijalankan berdasarkan jadwal atau merespons peristiwa seperti email baru atau pesan Slack, serta mereka dapat menyebut @ChatGPT di saluran Slack dan Microsoft Teams, thread, atau pesan langsung tanpa setiap rekan tim memerlukan lisensi individu. Plugin Meetings, dalam versi beta di aplikasi desktop ChatGPT pada macOS untuk pengguna Pro dan Business dengan akses Enterprise yang akan datang, mencatat dan menyimpan ringkasan pribadi dengan item tindakan di ChatGPT Space, menghapus audio setelah catatan selesai. Profil yang dapat dibagikan yang menampilkan Sites dan plugin yang dapat digunakan kembali tersedia di semua paket Free, Go, Plus, Pro, Business, dan Enterprise, dengan berbagi keterampilan terbatas pada ruang kerja.
Bagi pengembang, ekstensi plugin menambahkan beranda sidebar, panel interaktif, dan penampil file di dalam ChatGPT, dan OpenAI menambahkan alat Plugin Creator, alur pengajuan yang dirancang ulang, peringkat dan penemuan plugin yang ditingkatkan, hosting plugin di dalam Sites pada paket Business, Enterprise, Healthcare, dan Edu, serta dukungan untuk spesifikasi MCP Events yang diusulkan sehingga plugin dapat memulai otomatisasi ketika sesuatu terjadi di aplikasi yang terhubung.
Masuk dengan ChatGPT memungkinkan pengguna Plus dan Pro menerapkan kuota paket mereka ke 16 mitra, termasuk Devin dari Cognition, Notion, Vercel, T3, OpenClaw, dan Dactyl, dengan kontrol penggunaan per alat, sementara masuk identitas tersedia secara global. Paket Pro 500 baru menawarkan apa yang digambarkan OpenAI sebagai kuota penggunaan tertinggi dengan 25 kali kuota ChatGPT Plus, termasuk akses Ultrafast, dan kini tersedia. OpenAI Marketplace memungkinkan pelanggan enterprise yang memenuhi syarat menerapkan sebagian komitmen OpenAI mereka yang ada untuk perangkat lunak mitra yang disetujui, dengan 32 mitra pertama termasuk Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike, dan Baseten, dan pelanggan enterprise dapat menyatakan minat.
Dengan nama OpenAI Private Intelligence, perusahaan menawarkan Zero Data Retention dengan Private Safety Processing, yang diklaim memungkinkan tinjauan keamanan otomatis tanpa memberikan personel OpenAI akses ke konten dasar, dan merencanakan pratinjau Private Inference yang menggabungkan komputasi rahasia dengan kontrol ketat yang dapat diverifikasi untuk musim gugur ini. OpenAI juga memperkenalkan Dots, agen yang selalu aktif tersedia pada paket Pro dan Business Premium di pasar yang memenuhi syarat, dengan akses Enterprise, Edu, dan Healthcare sebagai beta yang diaktifkan admin dan nonaktif secara default.












