Robotika dan AI fisik
Dyna Robotics Melatih DYNA-2 dengan Sejuta Jam Video Manusia, Tanpa Data Robot

Klaim ini penting karena di mana letak kendala bidang ini. Kebijakan robot generalis telah dilatih sebagian besar pada data tindakan teleoperasi: manusia secara fisik membimbing robot melalui tugas, jam demi jam. Data itu mahal dan lambat untuk dikumpulkan, dan itu telah membatasi seberapa jauh model dasar robot dapat diskalakan. Taruhan DYNA-2 adalah bahwa intuisi fisik yang dibutuhkan robot dapat dipelajari dari video manusia melakukan hal-hal, lalu ditransfer ke perangkat keras robot.
“Dengan membangun Model Tindakan Dunia yang membayangkan bagaimana dunia fisik bergerak sebelum mengambil tindakan, kita memberikan robot penalaran spasial dan fisika kontak yang tidak dimiliki oleh model visi-bahasa tradisional.”
Bagaimana DYNA-2 Belajar dari Video Tanpa Melihat Robot
Arsitektur ini disebut Dyna sebagai Model Tindakan Dunia, dibangun pada generasi video daripada adaptasi visi-bahasa-tindakan yang telah mendominasi bidang. Selama pelatihan awal, model menjalankan tujuan ganda (memprediksi bingkai berikutnya dan tindakan berikutnya) atas korpus video manusia. Perusahaan mengatakan bahwa ini memberikan model kerja fisika kontak dan penalaran spasial yang dapat ditransfer ke seluruh tubuh: lengan robot stasioner, prototipe humanoid, dan tangan lima jari yang gesit, meskipun tidak ada robot yang muncul dalam pelatihan awal.
Mengadaptasi hasilnya ke platform tertentu membutuhkan jam-jam pelatihan lokal daripada minggu-minggu pengumpulan data. Dalam satu kasus, Dyna menyebutkan bahwa 13 menit data cukup untuk mengajar pasangan tangan robot lima jari untuk membuka tutup botol. Diagregat atas 15 tugas benchmark, kebijakan yang dilatih pada data manusia lebih banyak secara konsisten mengungguli mereka yang dilatih pada data yang lebih sedikit, kurva penskalaan yang perusahaan tunjuk sebagai hukum.
Perbandingan yang paling jelas adalah melawan model sebelumnya Dyna. DYNA-1, model visi-bahasa-tindakan yang berjalan di penggunaan komersial perusahaan, menghadapi DYNA-2 dalam evaluasi fisik head-to-head di bawah langkah pelatihan dan dataset yang cocok. Pada tugas-tugas gesit seperti memotong makanan dan membersihkan ruang kerja, Dyna mengatakan DYNA-2 pulih dari gangguan fisik tanpa intervensi manusia, di mana baseline VLA gagal dan memerlukan reset manual. Algoritma pelatihan video bersamaan meningkatkan skor mengikuti instruksi sebesar 133% pada tugas-tugas yang memerlukan gerakan yang berbeda dalam menanggapi perintah pengguna.
DYNA-2 dalam Angka
- 1 juta+ jam video manusia egosentris dalam pelatihan awal — digambarkan oleh perusahaan sebagai sekitar 170 tahun pengalaman terjaga terus-menerus
- 20% → 80–90% tingkat keberhasilan tugas pada tugas manufaktur presisi tinggi, dari skala pelatihan awal saja
- 1,55x lebih banyak tugas yang diselesaikan daripada DYNA-1 dalam evaluasi head-to-head di dunia nyata
- 87% vs. 46% tingkat lulus pada penggunaan pelanggan, DYNA-2 melawan DYNA-1
- 13 menit data untuk melatih tangan lima jari untuk membuka tutup botol
- 133% perbaikan pada tugas-tugas mengikuti instruksi dari algoritma pelatihan video bersamaan
- 10 juta jam: skala data pelatihan yang perusahaan katakan bahwa pendekatan ini membuka jalannya
Penggunaan Dyna Sudah Menjadi Tempat Uji
DYNA-2 tiba di atas dasar komersial yang tidak biasa konkret untuk perusahaan yang masih muda. Robot Dyna, yang menjalankan DYNA-1, diterapkan dalam produksi di hotel, restoran, laundromat, dan gym. Bahan-bahan perusahaan sendiri menggambarkan DYNA-1 melipat lebih dari 40 kemeja per jam terus-menerus dan berjalan selama 16 jam sehari di situs pelanggan, dengan tingkat keberhasilan 99% lebih selama operasi non-stop 24 jam.
Jejak penerapan ini juga merupakan roda data di balik penelitian.
Jalur perusahaan yang dinyatakan dari sini adalah skala: jika kurva penskalaan video manusia tetap, Dyna mengatakan bahwa pelatihan pada 10 juta jam menjadi masalah mengumpulkan video daripada membangun armada rig teleoperasi. Hasil 1 juta jam adalah bukti bahwa kurva itu ada. Apakah itu tetap pada 10x adalah pertanyaan teknik terbuka — dan itu sekarang satu yang Dyna telah pertaruhkan jalur pengembangannya.












