Model dan platform AI
OpenAI Mengurangi Harga API pada Dua Tingkat GPT-5.6 yang Lebih Murah

OpenAI menurunkan harga API untuk dua model GPT-5.6 yang lebih murah pada 30 Juli 2026, memotong tingkat termurah sebesar 80% dan tingkat menengah sebesar 20% sementara meninggalkan flagship-nya tidak tersentuh. Perubahan ini tercatat dalam changelog API perusahaan dan sudah live pada kartu tarif yang dipublikasikan.
Per juta token input dan output, tarif standar sekarang membaca:
- GPT-5.6 Luna: 20 sen dan $1,20, turun dari $1 dan $6
- GPT-5.6 Terra: $2 dan $12, turun dari $2,50 dan $15
- GPT-5.6 Sol: $5 dan $30, tidak berubah, sesuai dengan tarif yang masih dibawa oleh pendahulunya GPT-5.5
Ketiga tingkat tersebut mencapai ketersediaan umum pada 9 Juli 2026 dengan harga yang lebih tinggi, yang membuat perubahan harga ini terjadi tiga minggu setelah keluarga ini memasuki kehidupan komersial.
Potongan harga ini berlaku untuk semua tingkat layanan pada lembar, tidak hanya tarif yang diiklankan. Pemrosesan Batch dan Flex, keduanya setengah dari harga standar, sekarang menempatkan Luna pada 10 sen input dan 60 sen output. Pembacaan input yang di-cache, yang didiskon 90%, turun menjadi dua sen per juta token pada Luna dan 20 sen pada Terra. Permintaan konteks panjang, yang dikenakan biaya dua kali lipat tarif input dan 1,5 kali output, mendarat pada 40 sen dan $1,80 untuk Luna. Pembeli yang melalui Amazon Bedrock dikenakan biaya oleh AWS, dan OpenAI mencatat bahwa tarif tersebut dapat berbeda dari miliknya sendiri.
Tingkat yang lebih murah adalah tempat lalu lintas produksi volume tinggi berada: klasifikasi, ekstraksi, pengaturan permintaan, pendrafan pertama, dan loop agen panjang di mana satu instruksi pengguna dapat memicu puluhan panggilan model sebelum mengembalikan jawaban. Pemotongan lima kali lipat pada tingkat yang menyerap volume tersebut mengubah aritmatika tentang pekerjaan mana yang layak untuk diotomatisasi.
Di Mana Tingkat yang Lebih Murah Berada Terhadap Claude
Pada 20 sen input dan $1,20 output, Luna mengalahkan model termurah Anthropic yang dipublikasikan, Haiku 4.5, dengan faktor lima pada input dan sekitar empat pada output, menurut halaman harga Anthropic. Tarif baru Terra berada di bawah $3 dan $15 yang akan dikenakan Claude Sonnet 5 setelah tarif perkenalan $2 dan $10 berakhir pada 31 Agustus 2026. Pada bagian atas kedua lineup, Sol masih lebih mahal pada output daripada Opus 5, yang Anthropic hargai $5 dan $25.
Priority Processing Menjadi Mode Cepat
Entri changelog yang sama memensiunkan Priority Processing dan menggantinya dengan Mode Cepat. Untuk Sol, OpenAI mengatakan Mode Cepat berjalan hingga 2,5 kali kecepatan standar dengan harga dua kali lipat, dan perubahan ini backward compatible: permintaan yang sudah ditandai untuk prioritas beralih ke Mode Cepat tanpa perubahan kode. Tarif Mode Cepat adalah $10 dan $60 untuk Sol, $4 dan $24 untuk Terra, dan 40 sen dan $2,40 untuk Luna.
Anthropic menjual produk yang sama dengan nama yang sama dan syarat yang sama — mode cepat untuk Opus 5, hingga 2,5 kali lebih cepat dengan harga standar dua kali lipat. Dua kartu tarif sekarang bersatu pada inferensi yang dipasang wilayah; OpenAI mengenakan biaya 10% lebih tinggi pada model yang dirilis pada atau setelah 5 Maret 2026 ketika pelanggan memerlukan tempat tinggal data; Anthropic mengenakan biaya inferensi US-only 1,1 kali tarif standarnya.
Apa yang Membuat Tingkat yang Lebih Murah Lebih Murah
OpenAI menerbitkan akuntansinya sehari sebelum pemotongan. Dalam sebuah posting teknis 29 Juli 2026, lima anggota staf teknisnya menjelaskan optimasi di seluruh inferensi dan harness agen di balik Codex dan ChatGPT Work. Sol, yang berjalan di dalam Codex, menulis ulang kernel GPU produksi perusahaan; dikombinasikan dengan kernel yang lebih luas, OpenAI mengatakan bahwa itu memotong biaya penyajian ujung-ke-ujung sebesar 20%. Sol juga merancang ulang model draft kode spekulatifnya di seluruh ratusan eksperimen, yang perusahaan kreditkan dengan meningkatkan efisiensi generasi token lebih dari 15%.
Itu adalah angka OpenAI untuk tumpukan sendiri. Postingan itu ditutup dengan komitmen untuk mengembalikan “perbaikan di bawah tenda kembali kepada pengguna dan pelanggan dalam bentuk kecerdasan yang lebih tersedia dan efisien biaya.” Kartu tarif mengikuti sehari kemudian.
Pekerjaan harness menunjuk ke pusat biaya yang sama yang pemotongan harga lakukan. OpenAI membatasi output alat pada 10.000 token secara default dan menjaga riwayat model hanya tambahkan, sehingga loop agen yang mengirim ulang instruksinya dan definisi alat pada setiap langkah mengenai cache prompt bukan membayar tarif input penuh. Pada tugas yang membutuhkan 30 permintaan model, itu adalah 30 kesempatan untuk menghindari menghitung ulang awalan yang sama.
Pemotongan harga ini tiba saat pembeli sedang memeriksa pengeluaran inferensi dan melebarkan tim yang menyentuh model: penelitian OpenAI sendiri menemukan staf menggunakan ChatGPT jauh melampaui jabatan mereka. Organisasi teknik Amazon pindah untuk membatasi pengeluaran AI setelah kelebihan biaya pada hari yang sama, dan OpenAI mengirimkan batas pengeluaran yang keras untuk organisasi dan proyek API pada 22 Juli 2026, memungkinkan administrator menetapkan langit-langit bulanan yang mulai mengembalikan kesalahan sekali pengeluaran yang dilacak mencapainya.
Untuk tim yang sudah mengalihkan pekerjaan bulk ke Luna, panggilan yang sama sekarang dikenakan biaya seperlima dari sebelumnya, dengan langit-langit yang dapat mereka tetapkan di dashboard. Dengan harga Sol tidak berubah, keputusan langsung tetap di mana OpenAI telah menempatkannya sejak keluarga ini dikirim: tingkat mana yang diperlukan untuk setiap permintaan.












