Model dan platform AI
Evolusi Mind DeepMind: Memberdayakan Model Bahasa Besar untuk Pemecahan Masalah Dunia Nyata
Beberapa tahun terakhir, kecerdasan buatan (AI) telah muncul sebagai alat praktis untuk menggerakkan inovasi di berbagai industri. Di garis depan kemajuan ini adalah model bahasa besar (LLM) yang dikenal karena kemampuan mereka untuk memahami dan menghasilkan bahasa manusia. Meskipun LLM berkinerja baik dalam tugas seperti AI percakapan dan pembuatan konten, mereka sering mengalami kesulitan dengan tantangan dunia nyata yang kompleks yang memerlukan penalaran terstruktur dan perencanaan.
Sebagai contoh, jika Anda meminta LLM untuk merencanakan perjalanan bisnis multi-kota yang melibatkan koordinasi jadwal penerbangan, waktu pertemuan, kendala anggaran, dan istirahat yang memadai, mereka dapat memberikan saran untuk aspek individu. Namun, mereka sering menghadapi kesulitan dalam mengintegrasikan aspek-aspek ini untuk secara efektif menyeimbangkan prioritas yang bersaing. Keterbatasan ini menjadi semakin jelas ketika LLM digunakan untuk membangun agen AI yang mampu memecahkan masalah dunia nyata secara otonom.
Google DeepMind baru-baru ini mengembangkan solusi untuk mengatasi masalah ini. Terinspirasi oleh seleksi alam, pendekatan ini, dikenal sebagai Evolusi Mind, memperbaiki strategi pemecahan masalah melalui adaptasi iteratif. Dengan membimbing LLM secara real-time, ini memungkinkan mereka untuk menangani tugas dunia nyata yang kompleks secara efektif dan beradaptasi dengan skenario dinamis. Dalam artikel ini, kita akan menjelajahi bagaimana metode inovatif ini bekerja, aplikasi potensialnya, dan apa yang dimaksud untuk masa depan pemecahan masalah yang didorong AI.
Mengapa LLM Mengalami Kesulitan dengan Penalaran dan Perencanaan yang Kompleks
LLM dilatih untuk memprediksi kata berikutnya dalam kalimat dengan menganalisis pola dalam dataset teks besar, seperti buku, artikel, dan konten online. Ini memungkinkan mereka untuk menghasilkan respons yang tampak logis dan kontekstual. Namun, pelatihan ini didasarkan pada pengenalan pola daripada pemahaman makna. Sebagai hasilnya, LLM dapat menghasilkan teks yang tampak logis tetapi mengalami kesulitan dengan tugas yang memerlukan penalaran yang lebih dalam atau perencanaan terstruktur.
Bagaimana Evolusi Mind Bekerja
Evolusi Mind DeepMind mengatasi keterbatasan ini dengan mengadopsi prinsip dari evolusi alam. Sebagai gantinya menghasilkan satu respons untuk pertanyaan kompleks, pendekatan ini menghasilkan beberapa solusi potensial, memperbaiki mereka secara iteratif, dan memilih hasil terbaik melalui proses evaluasi terstruktur. Sebagai contoh, pertimbangkan tim brainstorming ide untuk proyek. Beberapa ide bagus, yang lain kurang. Tim mengevaluasi semua ide, menyimpan yang terbaik dan membuang sisanya. Mereka kemudian memperbaiki ide terbaik, memperkenalkan variasi baru, dan mengulangi proses sampai mereka mencapai solusi terbaik. Evolusi Mind menerapkan prinsip ini pada LLM.
Berikut adalah bagaimana cara kerjanya:
- Generasi: Proses dimulai dengan LLM membuat beberapa respons untuk masalah yang diberikan. Sebagai contoh, dalam tugas perencanaan perjalanan, model mungkin menghasilkan berbagai itinerary berdasarkan anggaran, waktu, dan preferensi pengguna.
- Evaluasi: Setiap solusi dievaluasi melawan fungsi kebugaran, ukuran seberapa baik solusi memenuhi persyaratan tugas. Respons berkualitas rendah dibuang, sementara kandidat paling menjanjikan melanjutkan ke tahap berikutnya.
- Pembaruan: Inovasi unik dari Evolusi Mind adalah dialog antara dua persona dalam LLM: Penulis dan Kritikus. Penulis mengusulkan solusi, sementara Kritikus mengidentifikasi kelemahan dan memberikan umpan balik. Dialog terstruktur ini mencerminkan bagaimana manusia memperbarui ide melalui kritik dan revisi. Sebagai contoh, jika Penulis mengusulkan rencana perjalanan yang mencakup kunjungan restoran yang melebihi anggaran, Kritikus menunjukkannya. Penulis kemudian merevisi rencana untuk mengatasi kekhawatiran Kritikus. Proses ini memungkinkan LLM untuk melakukan analisis mendalam yang sebelumnya tidak dapat dilakukan dengan teknik penggunaan lainnya.
- Optimasi Iteratif: Solusi yang diperbarui menjalani evaluasi dan rekombinasi lebih lanjut untuk menghasilkan solusi yang diperbarui.
Dengan mengulangi siklus ini, Evolusi Mind secara iteratif memperbaiki kualitas solusi, memungkinkan LLM untuk menangani tugas kompleks lebih efektif.
Evolusi Mind dalam Aksi
DeepMind menguji pendekatan ini pada benchmark seperti TravelPlanner dan Natural Plan. Dengan menggunakan pendekatan ini, Gemini dari Google mencapai tingkat keberhasilan 95,2% pada TravelPlanner, yang merupakan perbaikan luar biasa dari baseline 5,6%. Dengan Gemini Pro yang lebih maju, tingkat keberhasilan meningkat hingga hampir 99,9%. Kinerja transformatif ini menunjukkan efektivitas evolusi mind dalam mengatasi tantangan praktis.
Menariknya, efektivitas model meningkat dengan kompleksitas tugas. Sebagai contoh, sementara metode satu langkah mengalami kesulitan dengan itinerary multi-hari yang melibatkan beberapa kota, Evolusi Mind konsisten outperform, mempertahankan tingkat keberhasilan tinggi bahkan ketika jumlah kendala meningkat.
Tantangan dan Arah Masa Depan
Meskipun kesuksesannya, Evolusi Mind tidak tanpa keterbatasan. Pendekatan ini memerlukan sumber daya komputasi yang signifikan karena proses evaluasi dan pembaruan iteratif. Sebagai contoh, memecahkan tugas TravelPlanner dengan Evolusi Mind mengkonsumsi tiga juta token dan 167 panggilan API—jauh lebih banyak daripada metode konvensional. Namun, pendekatan ini tetap lebih efisien daripada strategi brute-force seperti pencarian menyeluruh.
Selain itu, merancang fungsi kebugaran yang efektif untuk tugas tertentu bisa menjadi tugas yang menantang. Penelitian masa depan mungkin fokus pada optimasi efisiensi komputasi dan memperluas kemampuan teknik ini untuk berbagai masalah, seperti penulisan kreatif atau pengambilan keputusan yang kompleks.
Area lain yang menarik untuk dijelajahi adalah integrasi evaluator spesifik domain. Sebagai contoh, dalam diagnosis medis, mengintegrasikan pengetahuan ahli ke dalam fungsi kebugaran bisa lebih meningkatkan akurasi dan keandalan model.
Aplikasi di Luar Perencanaan
Meskipun Evolusi Mind terutama dievaluasi pada tugas perencanaan, pendekatan ini bisa diterapkan pada berbagai domain, termasuk penulisan kreatif, penemuan ilmiah, dan bahkan generasi kode. Sebagai contoh, peneliti telah memperkenalkan benchmark yang disebut StegPoet, yang menantang model untuk mengkodekan pesan tersembunyi dalam puisi. Meskipun tugas ini tetap sulit, Evolusi Mind melampaui metode tradisional dengan mencapai tingkat keberhasilan hingga 79,2%.
Kemampuan untuk beradaptasi dan mengembangkan solusi dalam bahasa alami membuka kemungkinan baru untuk menangani masalah yang sulit untuk diformalisasi, seperti memperbaiki alur kerja atau menghasilkan desain produk inovatif. Dengan menggunakan kekuatan algoritma evolusioner, Evolusi Mind menyediakan kerangka kerja yang fleksibel dan scalable untuk meningkatkan kemampuan pemecahan masalah LLM.
Kesimpulan
Evolusi Mind DeepMind memperkenalkan cara praktis dan efektif untuk mengatasi keterbatasan kunci dalam LLM. Dengan menggunakan pembaruan iteratif yang terinspirasi oleh seleksi alam, ini meningkatkan kemampuan model ini untuk menangani tugas kompleks yang memerlukan penalaran terstruktur dan perencanaan. Pendekatan ini telah menunjukkan kesuksesan signifikan dalam skenario yang menantang seperti perencanaan perjalanan dan menunjukkan janji di berbagai domain, termasuk penulisan kreatif, penelitian ilmiah, dan generasi kode. Meskipun tantangan seperti biaya komputasi tinggi dan kebutuhan akan fungsi kebugaran yang dirancang dengan baik masih ada, pendekatan ini menyediakan kerangka kerja yang scalable untuk meningkatkan kemampuan AI. Evolusi Mind menetapkan panggung untuk sistem AI yang lebih kuat yang mampu berpikir dan merencanakan untuk memecahkan tantangan dunia nyata.












