Model dan platform AI

OpenAI Merilis ChatGPT Images 2.5 dengan Sketch dan Dua Model API Baru

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

OpenAI merilis ChatGPT Images 2.5 pada 8 September 2026, menyebutnya sebagai model gambar mutakhir perusahaan, dan menambahkan dua model pendamping ke API-nya. OpenAI mengatakan orang membuat lebih dari 3 miliar gambar setiap minggu melalui ChatGPT Images dan model GPT-Image di API.

Gambar Lebih Tajam dan Alat Penciptaan Baru

Menurut OpenAI, Images 2.5 menghasilkan pencahayaan yang lebih alami dan tekstur yang lebih kaya, lebih baik mempertahankan subjek dari foto referensi pengguna, dan mengikuti instruksi penyuntingan dengan lebih dapat diandalkan selama beberapa putaran percakapan. Perusahaan mengatakan bahwa latensi pembuatan gambar berkurang hingga 50% dibandingkan dengan Images 2.0.

OpenAI menyatakan model ini lebih baik dalam mengubah hanya elemen yang diminta pengguna untuk disunting sementara bagian lain gambar tetap utuh, bahkan dengan subjek dan latar belakang yang kompleks, serta menghasilkan gambar yang mengandung informasi dunia nyata dengan lebih akurat, menangani tata letak yang lebih rumit termasuk latar belakang transparan, dan mempertahankan gaya visual yang diminta secara lebih konsisten. Dalam percakapan yang lebih panjang, perusahaan mengatakan, penyuntingan sebelumnya lebih mungkin dipertahankan dan setiap instruksi baru membangun atas pekerjaan sebelumnya tanpa menurunkan kualitas gambar.

Bagi pengembang API, OpenAI mengatakan tingkat kesetiaan yang sama membuat alur kerja berbasis referensi lebih dapat diandalkan dan memungkinkan satu elemen, seperti produk, latar belakang, atau baris teks, diperbarui sambil mempertahankan subjek, komposisi, dan penanganan merek di sekitarnya.

Seiring dengan model tersebut, OpenAI memperkenalkan Sketch, sebuah fitur yang memungkinkan pengguna menggambar langsung di dalam ChatGPT sebagai referensi visual untuk gambar akhir, yang dapat dipanggil dengan mengetik “@Sketch” dalam obrolan. Template baru menyediakan titik awal untuk format populer seperti selebaran dan foto produk, dengan opsi bernama seperti “Poster” dan “Merch.” Pengguna juga dapat menambahkan komentar langsung pada gambar yang dihasilkan untuk penyuntingan yang lebih terfokus, serta dapat membagikan prompt di balik sebuah gambar sehingga orang lain dapat menjalankan ulang ide tersebut dengan foto dan detail mereka sendiri.

Images 2.5 sedang diluncurkan ke semua pengguna ChatGPT, ChatGPT Work, dan Codex di semua tingkatan pada desktop, seluler, dan web.

Flare dan Sunburst di API

Untuk pengembang, OpenAI merilis dua model gambar di API. GPT-Image-2.5 Flare menghadirkan kualitas, penyuntingan, dan peningkatan kecepatan yang sama dan diposisikan oleh perusahaan sebagai pilihan default untuk kebanyakan aplikasi; OpenAI mengatakan model ini menghasilkan gambar berkualitas lebih tinggi dibandingkan GPT-Image-2 dengan latensi 50% lebih rendah, cocok untuk penggunaan mulai dari konten kreator dan sosial hingga pengalaman produk, pencarian visual, prototipe gambar cepat, dan generasi berkapasitas tinggi. GPT-Image-2.5 Sunburst dirancang untuk alur kerja visual premium yang memperoleh manfaat dari kontrol lebih ketat pada penyuntingan, seperti kreativitas kampanye siap produksi dan gambar produk yang dipoles, dengan waktu generasi yang lebih lama.

OpenAI menerbitkan pernyataan dari tiga pelanggan awal bersamaan dengan peluncuran. Matt Chotin, senior director of product di Adobe, mengatakan model GPT-Image-2.5 OpenAI kini tersedia di Adobe Firefly, studio AI kreatif Adobe. Lucky Liao dari tim evaluasi Manus menyatakan Flare menghasilkan gambar berkualitas tinggi dengan kecepatan dua hingga empat kali lipat dibandingkan GPT-Image-2 dalam evaluasi tim, dengan menyebutkan peningkatan generasi latar belakang transparan. Axultan Alimkulov, head of product di Higgsfield AI, mengatakan model ini mempertahankan karakter, komposisi, dan identitas visual gambar asli melalui penyuntingan.

Halaman harga OpenAI mencantumkan kedua model dengan tarif yang sama: input gambar $8.00 per 1M token, atau $2.00 per 1M token untuk input yang di-cache, output gambar $30.00 per 1M token, dan input teks $5.00 per 1M token, atau $1.25 untuk yang di-cache. Halaman tersebut menjelaskan Sunburst dibangun untuk alur kerja di mana presisi penyuntingan paling penting dan Flare sebagai model tercepat OpenAI untuk generasi gambar sehari-hari berkualitas tinggi.

Evaluasi Keamanan dan Asal-usul

OpenAI juga menerbitkan kartu sistem untuk rilis pada 8 September 2026. Kartu tersebut menyatakan bahwa GPT-Image-2.5-Sunburst dan GPT-Image-2.5-Flare dilatih pada dataset beragam yang mencakup informasi internet yang tersedia secara publik, data yang diakses melalui kemitraan pihak ketiga, serta materi yang disediakan atau dihasilkan oleh pengguna dan pelatih manusia, dengan penyaringan yang bertujuan mengurangi informasi pribadi dan classifier keamanan yang diarahkan mengurangi konten berbahaya atau sensitif. Kartu itu mencatat bahwa realisme yang meningkat, tanpa langkah pengaman, dapat memungkinkan deepfake yang lebih meyakinkan dari orang, tempat, atau peristiwa nyata, yang melanggar kebijakan penggunaan OpenAI.

Kartu tersebut menggambarkan tumpukan keamanan berlapis: pemeriksaan kebijakan berbasis LLM menolak permintaan yang melanggar sebelum proses generasi dimulai, dan model penalaran keamanan kemudian memoderasi input teks dan gambar serta memeriksa output akhir sebelum ditampilkan, memblokir generasi bila salah satu melanggar kebijakan.

Dalam evaluasi adversarial otomatis OpenAI, yang menggunakan prompt dirancang untuk memicu gambar yang melanggar kebijakan di semua kategori keamanan yang dipantau, generasi tidak aman akhir tercatat 1.09% untuk Sunburst dan 1.41% untuk Flare, dibandingkan dengan baseline 1.64% untuk ChatGPT Images 2.0. Kartu tersebut memperingatkan bahwa set tes adversarial tidak mewakili lalu lintas produksi, bahwa label kebijakan otomatis dapat mengandung kesalahan, dan temuan tersebut berlaku untuk set tes tetap serta konfigurasi yang dievaluasi.

Di bawah Kerangka Kesiapan OpenAI, yang melacak risiko biologis dan kimia, keamanan siber, serta risiko perbaikan diri AI, kartu tersebut melaporkan bahwa tidak ada model yang melampaui ambang Bio High atau Cyber High. OpenAI menyatakan bahwa meskipun demikian, mereka menerapkan mitigasi risiko biologis secara hati-hati, termasuk kebijakan keamanan biologis khusus gambar yang ditegakkan melalui model penalaran keamanan, pemblokiran langsung pada lapisan input dan output, tinjauan offline yang menggabungkan sistem otomatis dengan peninjau manusia, serta penangguhan akun bila pola penyalahgunaan berkelanjutan terdeteksi.

Mengenai asal-usul, kartu tersebut menyatakan OpenAI melanjutkan metadata C2PA melalui Program Kesesuaian C2PA dan menambahkan watermark tak terlihat SynthID dari Google DeepMind pada ChatGPT, Codex, dan API OpenAI.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.