Model dan platform AI

Google Membawa Bantuan Visual Waktu Nyata untuk Pengguna Tuna Netra di Android

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Google meluncurkan Guided Vision in Gemini Live pada 1 Oktober 2026, sebuah fitur bantuan visual berbasis suara secara real-time yang dirancang untuk orang yang tuna netra, memiliki penglihatan rendah, atau menginginkan bantuan visual yang intuitif. Fitur ini kini tersedia di perangkat Android yang menjalankan Android 9 ke atas di wilayah dan bahasa yang mendukung Gemini Live.

Google pertama kali menampilkan pratinjau fitur ini pada 1 September 2026, dalam September Android Drop, di mana Guided Vision tercantum akan segera hadir pada ponsel yang menjalankan Android 9 ke atas di negara-negara yang mendukung Gemini. Pratinjau tersebut menjelaskan deskripsi berbagi kamera dan umpan suara untuk mengatur ulang sudut, serta menyertakan catatan kaki yang memperingatkan bahwa fitur ini dapat membuat kesalahan dan tidak dimaksudkan sebagai perangkat medis, alat bantu mobilitas, atau pengganti panduan perjalanan aman, maupun untuk navigasi atau deteksi rintangan.

Cara Kerja Guided Vision

Selama sesi Gemini Live, pengguna membagikan kamera ponsel dan Gemini memberikan deskripsi lisan tentang lingkungan sekitar, menjawab pertanyaan lanjutan secara detail, serta memberikan petunjuk verbal proaktif untuk memusatkan apa pun yang ingin dijelajahi pengguna. Jika kamera diarahkan terlalu tinggi, terlalu dekat, atau sedikit ke samping, Gemini merespons dengan prompt verbal alami untuk mengatur ulang—meminta pengguna memutar perlahan ke kanan, menurunkan sudut, atau mundur hingga mendapatkan konteks visual yang jelas untuk menjawab.

Pengumuman yang ditulis oleh Isha Sheth, Senior Product Manager untuk Gemini Live, menggambarkan Guided Vision sebagai transformasi Gemini menjadi mitra visual percakapan yang dapat terintegrasi dalam rutinitas harian dengan gesekan minimal.

Dikembangkan Bersama Aira dan Komunitas Aksesibilitas

Google menyatakan bahwa Guided Vision dikembangkan melalui kolaborasi erat dengan komunitas aksesibilitas. Untuk melatih Gemini Live dalam konteks percakapan dunia nyata, perusahaan bekerja sama dengan Aira untuk menafsirkan data secara visual selama puluhan ribu jam. Lebih dari 1.000 anggota jaringan Trusted Tester milik Aira membantu melakukan uji beban dan menyempurnakan model dalam berbagai rutinitas harian, dan pakar Aira bekerja langsung dengan tim Google sebagai ahli materi untuk menetapkan dan mengevaluasi batasan keamanan.

Sally Khoo, Deputy Director (Innovation) di SG Enable, mengatakan dalam pengumuman: “Karena ponsel standar biasanya dirancang untuk pengguna yang dapat melihat layar, produk seperti deskripsi visual real-time Gemini Live dengan panduan kamera verbal proaktif dapat membantu menjembatani kesenjangan kritis dalam tugas sehari-hari di rumah, mulai dari membaca tulisan kecil hingga menemukan barang-barang penting sehari-hari.”

Menurut Google, fitur ini mencerminkan pengujian dan umpan balik yang luas dari komunitas tuna netra dan penglihatan rendah di India, Brasil, Singapura, Indonesia, Jepang, dan lainnya, yang dikumpulkan untuk membuat deskripsi, petunjuk pengaturan ulang, dan jawaban terasa alami serta membantu.

Prashant Verma dari National Association of the Blind, India, mengatakan dalam pengumuman yang sama: “Menguji kemampuan ini secara langsung dengan pengguna tuna netra dan penglihatan rendah dalam berbagai bahasa India memastikan teknologi ini memberikan bantuan yang dapat diandalkan dan praktis dalam kehidupan sehari-hari.”

Kasus Penggunaan Sehari-hari yang Didokumentasikan

Google menjelaskan tugas sehari-hari di mana verifikasi visual cepat sangat penting. Untuk membaca tulisan kecil dan teks kompleks, perusahaan menyebutkan label nutrisi kecil pada kemasan makanan, dial peralatan dan siklus mesin cuci, serta menu cetak di restoran yang pencahayaannya redup. Untuk menemukan dan melokalisasi objek, mereka memberikan contoh earbud yang terjatuh di lantai dan lada hitam di dalam lemari rempah yang penuh. Untuk mendeskripsikan objek dan mencocokkan detail, pengguna dapat menanyakan tentang warna, pola, dan bentuk, seperti memeriksa apakah kemeja bergaris cocok dengan celana panjang atau mengidentifikasi warna jaket tertentu. Untuk menjelajahi lingkungan langsung, Guided Vision memberikan ikhtisar deskriptif tentang ruang yang tidak dikenal, tata letak ruangan, atau objek yang diletakkan di atas meja.

Google menyatakan bahwa Guided Vision mendukung percakapan dalam berbagai bahasa dan, seperti banyak inovasi aksesibilitas, juga memberikan bantuan visual praktis bagi lansia, individu dengan tingkat literasi rendah, atau siapa pun yang mencoba membaca tulisan kecil dalam pencahayaan rendah.

Jalur Akses, Ketersediaan, dan Batasan yang Dinyatakan

Pengguna dapat mengakses fitur ini melalui aplikasi Gemini, pintasan Aksesibilitas Android, atau Google TalkBack. Di aplikasi seluler Gemini, pengguna membuka pengaturan profil dan mengaktifkan “Use Guided Vision in Live,” kemudian membuka Gemini Live dan mengetuk untuk membagikan kamera. Di Pengaturan Android, dalam Aksesibilitas dan kemudian Bantuan Vision, pengguna dapat mengonfigurasi pintasan Aksesibilitas untuk meluncurkan Guided Vision menggunakan tombol aksesibilitas mengambang, gerakan gesek dua jari, atau dengan menekan kedua tombol volume. Pengguna yang menjalankan Google TalkBack dapat membuka menu TalkBack dengan ketukan tiga jari dan memilih Guided Vision secara langsung.

Google menyatakan bahwa Guided Vision adalah utilitas bantu dan dapat membuat kesalahan. Fitur ini bukan perangkat medis, alat bantu mobilitas, atau pengganti tongkat putih, dan tidak dimaksudkan untuk navigasi, panduan perjalanan aman, atau deteksi rintangan. Pengguna harus terus mengandalkan alat bantu mobilitas yang sudah ada dan praktik perjalanan aman di lingkungan fisik.

Untuk memulai, Google menyarankan memperbarui aplikasi Gemini dan perangkat lunak sistem Android ke versi terbaru.

Jonas Reeve adalah analis yang dihasilkan AI di Unite.AI, yang berfokus pada AI kognitif, kecerdasan umum buatan (AGI), dan dasar teoretis kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul baik dalam sistem biologis maupun buatan, serta menghubungkan arsitektur AI modern dengan pertanyaan-pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.

Dengan pendekatan konseptual dan reflektif, Jonas meneliti kerangka kerja seperti model penalaran, sistem agen, kognisi emergen, dan teori penyelarasan, dengan tujuan memperjelas apa arti sebenarnya kemajuan menuju AGI—dan apa yang tidak. Alih-alih mengejar jadwal atau hype, ia menekankan prinsip pertama, ketelitian konseptual, dan batasan model saat ini.

Artikel yang ditulis oleh Jonas Reeve dihasilkan AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI tingkat lanjut.