Робототехника и физический ИИ

Исследователи MIT Объединяют Данные о Движении Роботов с Языковыми Моделями для Улучшения Выполнения Задач

mm
Добавьте Unite.AI в избранные источники в Google

Роботы для домашнего использования все чаще обучаются выполнять сложные задачи с помощью имитационного обучения, процесса, в котором они запрограммированы копировать движения, продемонстрированные человеком. Хотя роботы оказались отличными имитаторами, они часто испытывают трудности с адаптацией к нарушениям или неожиданным ситуациям, возникающим во время выполнения задач. Без явной программирования для обработки этих отклонений роботы вынуждены начинать задачу сначала. Чтобы решить эту проблему, инженеры MIT разрабатывают новый подход, целью которого является предоставление роботам чувства здравого смысла при столкновении с неожиданными ситуациями, позволяя им адаптироваться и продолжать выполнение задач без необходимости ручного вмешательства.

Новый Подход

Исследователи MIT разработали метод, который объединяет данные о движении робота с “знаниями здравого смысла” больших языковых моделей (LLM). Объединив эти два элемента, подход позволяет роботам логически разбить задачу на подзадачи и физически адаптироваться к нарушениям внутри каждой подзадачи. Это позволяет роботу продолжать выполнение задачи без необходимости перезапуска всей задачи с начала, и устраняет необходимость для инженеров явно программировать исправления для каждого возможного сбоя на пути.

Как объясняет аспирант Яньвей Ван из департамента электротехники и компьютерных наук (EECS) MIT, “С помощью нашего метода робот может самостоятельно исправлять ошибки выполнения и улучшать общий успех задачи.”

Чтобы продемонстрировать свой новый подход, исследователи использовали простую задачу: соскабливание шаров из одной миски и наливание их в другую. Традиционно инженеры бы перемещали робота через движения соскабливания и наливания в одном непрерывном траектории, часто предоставляя несколько демонстраций человека для имитации робота. Однако, как отмечает Ван, “демонстрация человека – это одна длинная, непрерывная траектория.” Команда поняла, что хотя человек может продемонстрировать одну задачу за раз, задача зависит от последовательности подзадач. Например, робот должен сначала достать руку в миску, прежде чем он сможет соскоблить, и он должен соскоблить шары, прежде чем переместиться в пустую миску.

Если робот совершает ошибку во время любой из этих подзадач, его единственная возможность – остановиться и начать сначала, если только инженеры явно не пометят каждую подзадачу и не запрограммируют или не соберут новые демонстрации для робота, чтобы он мог восстановиться после сбоя. Ван подчеркивает, что “такой уровень планирования очень утомителен.” Именно здесь новый подход исследователей начинает работать. Используя силу LLM, робот может автоматически определить подзадачи, участвующие в общей задаче, и определить потенциальные действия по восстановлению в случае нарушений. Это устраняет необходимость для инженеров явно программировать робота для обработки каждого возможного сценария сбоя, делая робота более адаптивным и эффективным в выполнении домашних задач.

Роль Больших Языковых Моделей

Большие языковые модели (LLM) играют решающую роль в новом подходе исследователей MIT. Эти глубокие модели обучения обрабатывают огромные библиотеки текста, устанавливая связи между словами, предложениями и абзацами. Через эти связи LLM может генерировать новые предложения на основе изученных закономерностей, по сути, понимая, какой тип слова или фразы, скорее всего, последует за последним.

Исследователи поняли, что эта способность LLM может быть использована для автоматического определения подзадач внутри более крупной задачи и потенциальных действий по восстановлению в случае нарушений. Объединив “знания здравого смысла” LLM с данными о движении робота, новый подход позволяет роботам логически разбить задачу на подзадачи и адаптироваться к неожиданным ситуациям. Эта интеграция LLM и робототехники имеет потенциал революционизировать способ, которым программируются и обучаются домашние роботы, делая их более адаптивными и способными справляться с реальными проблемами.

По мере того, как робототехника продолжает развиваться, включение технологий ИИ, таких как LLM, станет все более важным. Новый подход исследователей MIT является значительным шагом на пути к созданию домашних роботов, которые не только могут имитировать человеческие действия, но и понимать лежащую в основе логику и структуру задач, которые они выполняют. Это понимание будет ключевым для разработки роботов, которые могут работать автономно и эффективно в сложных, реальных средах.

К Более Умному и Адаптивному Будущему для Домашних Роботов

Позволяя роботам самостоятельно исправлять ошибки выполнения и улучшать общий успех задачи, этот метод решает одну из основных проблем в программировании роботов: адаптивность к реальным ситуациям.

Последствия этого исследования распространяются далеко за пределы простой задачи соскабливания шаров. По мере того, как домашние роботы становятся более распространенными, они должны быть способны справляться с широким спектром задач в динамических, неструктурированных средах. Способность разбить задачи на подзадачи, понять лежащую в основе логику и адаптироваться к нарушениям будет необходима для эффективной и эффективной работы этих роботов.

Более того, интеграция LLM и робототехники демонстрирует потенциал технологий ИИ для революционизации способа, которым мы программируем и обучаем роботов. По мере того, как эти технологии продолжают развиваться, мы можем ожидать увидеть более интеллектуальных, адаптивных и автономных роботов в наших домах и на рабочих местах.

Работа исследователей MIT является важным шагом на пути к созданию домашних роботов, которые могут действительно понимать и ориентироваться в сложностях реального мира. По мере того, как этот подход будет усовершенствован и применен к более широкому спектру задач, он имеет потенциал трансформировать способ, которым мы живем и работаем, делая нашу жизнь проще и более эффективной.

Алекс Макфарленд - журналист и писатель в области искусственного интеллекта, исследующий последние разработки в этой области. Он сотрудничал с многочисленными стартапами и изданиями в области искусственного интеллекта во всем мире.