Model dan platform AI

Anthropic Membawa Opus dan Sonnet ke Mode Suara Claude

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Anthropic telah membuka mode suara Claude untuk model yang lebih kuat, memungkinkan percakapan lisan berjalan pada tingkat Opus dan Sonnet bukan model Haiku yang ringan yang telah memungkinkan fitur ini sejak diluncurkan pada tahun 2025. Perusahaan tersebut mengkonfirmasi perubahan pada hari Kamis, 23 Juli 2026, dengan menyebutnya sebagai cara untuk membuat berbicara dengan Claude berguna untuk pekerjaan nyata daripada pencarian cepat.

Menurut dokumentasi mode suara Anthropic, fitur ini sekarang dimulai dengan model yang dipilih pengguna terakhir dalam obrolan teks dan menjalankan versi tercepatnya secara default, sehingga sesi tersebut mewarisi kecerdasan model di baliknya. Pengguna juga dapat beralih antara Haiku, Sonnet, dan Opus di tengah percakapan melalui pemilih model. Dalam prakteknya, itu membuka pekerjaan yang sebelumnya ditangani oleh Haiku dengan buruk: alasan yang lebih panjang, umpan balik tentang cara Anda menyusun pitch klien, atau permintaan yang sarat dengan alat seperti menyusun email dan memperbarui slot kalender dengan suara.

Mode suara juga dapat menjangkau aplikasi yang terhubung, termasuk Gmail, Google Kalender, Google Dokumen, dan Slack, sehingga permintaan lisan dapat menarik konteks dari akun pengguna sendiri atau melakukan tindakan seperti membatalkan pertemuan. Integrasi aplikasi tersebut adalah poin pemisah yang paling jelas dari OpenAI, yang mode suaranya telah diperbarui baru-baru ini dan mengubah cara ChatGPT berbicara tetapi masih tidak dapat menggunakan alat luar untuk menyelesaikan pekerjaan.

Keputusan produk, bukan model suara baru

Bagi siapa saja yang melacak apa yang sebenarnya dikirim oleh laboratorium frontier, bagian paling menonjol dari rilis ini adalah apa yang tidak dibangun oleh Anthropic. Tidak ada model suara baru yang asli di sini. Anthropic mengatakan kepada Engadget bahwa pembaruan “fokus pada kecerdasan dan akses alat,” dan bahwa mereka “terus berinvestasi dalam suara” dengan “lebih banyak untuk dibagikan nanti tahun ini.” Pipa dasar tetap berbasis giliran: Claude mendengarkan, berhenti sejenak untuk berpikir, lalu berbicara, dan dilaporkan bergantung pada penyedia teks-ke-suara luar seperti ElevenLabs untuk output suara.

Mengarahkan model alasan ke suara adalah kurang dari upgrade audio daripada kemampuan. Permintaan lisan sekarang dapat ditangani oleh model yang merencanakan dan bekerja melalui masalah, di mana Haiku disetel untuk mengembalikan jawaban cepat daripada jawaban yang dipertimbangkan. Perubahan pada apa yang dapat dilakukan suara sepenuhnya berasal dari model di baliknya.

Itu adalah taruhan yang berbeda dari yang dibuat oleh OpenAI. OpenAI telah menuangkan sumber daya ke dalam sistem asli suara, GPT-Live, yang memproses apa yang Anda katakan dan menghasilkan balasan pada saat yang sama, lebih dekat dengan irama panggilan telepon. Anthropic sebaliknya mengarahkan model alasan terkuatnya ke tumpukan suara konvensional dan menerima keterbatasan percakapan yang datang dengannya. Karena model suara itu sendiri tidak berubah, pengguna tidak mungkin memperhatikan penanganan interupsi yang lebih lancar atau pertukaran yang lebih alami. Apa yang berubah adalah seberapa baik Claude dapat beralasan tentang apa yang diminta, bukan seberapa alami suaranya saat melakukannya.

Pertukaran tersebut memetakan pertanyaan yang sudah dihadapi oleh pengguna Claude dalam teks: model yang paling kuat tidak selalu yang tepat untuk tugas. Memilih model yang lebih berat membeli kedalaman dengan biaya kecepatan, dan percakapan suara sangat sensitif terhadap latensi. Meletakkan pilihan di tangan pengguna, bukan mengatur semua orang ke opsi tercepat, adalah substansi praktis dari pembaruan.

Apa yang tersedia, dan apa yang hilang

Mode suara yang ditingkatkan sedang diluncurkan dalam beta untuk semua pengguna di seluruh aplikasi mobile, desktop, dan web Anthropic. Karena ini adalah masalah mengarahkan model yang ada daripada infrastruktur baru, peluncuran tidak menunggu Anthropic mengirim sistem audio baru. Akun gratis dibatasi pada model Haiku dan satu aplikasi terhubung, dengan tingkat Sonnet dan Opus dicadangkan untuk pelanggan berbayar. Input multibahasa, yang ditambahkan awal tahun ini, disertakan, meskipun Claude masih tidak dapat mendeteksi peralihan bahasa secara otomatis; pengguna harus menamai bahasa yang akan mereka ucapkan, baik secara lisan atau dalam pengaturan suara.

Pemilih tersebut menampilkan Opus, Sonnet, dan Haiku, tetapi tidak Claude Fable 5, model Anthropic yang paling kuat dan tersedia secara luas, yang tetap tidak termasuk dalam suara untuk saat ini. Kekurangan itu sesuai dengan logika rilis. Ini tentang mencocokkan suara dengan model alasan yang paling banyak digunakan orang sehari-hari, bukan tentang mendorong batas apa yang dapat dilakukan asisten lisan.

Hasilnya terbaca kurang seperti terobosan suara daripada pernyataan strategi. Anthropic bertaruh bahwa nilai asisten lisan berasal dari model yang melakukan pemikiran dan alat yang dapat diaksesnya, bukan dari arsitektur audio yang dirancang khusus. Janji untuk melanjutkan pada tahun ini akan menunjukkan seberapa lama posisi itu bertahan ketika OpenAI dan Google terus mendorong sistem asli suara mereka sendiri.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.