Модели и платформы ИИ
Новая чат-бот Google Meena может вести осмысленные и конкретные разговоры почти на любую тему
Как впечатляющими и полезными являются виртуальные помощники, такие как Siri, Alexa и Google Assistant, их способности к разговору обычно ограничены получением определенных команд и предоставлением предопределенных ответов. Компании, такие как Google и Amazon (AMZN ), занимаются разработкой методов обучения и улучшения ИИ, чтобы сделать чат-боты более прочными и гибкими, способными вести разговоры с пользователями более естественным образом. По сообщению DigitalTrends, Google недавно опубликовала статью, демонстрирующую возможности своего нового чат-бота, названного «Meena». Согласно блог-посту исследователей, Meena может участвовать в разговоре с пользователями на几乎 любую тему.
Meena – это чат-бот с открытым доменом, то есть он реагирует на контекст разговора и адаптируется к входным данным, чтобы предоставлять более естественные ответы. Большинство других чат-ботов являются закрытыми, то есть их ответы тематически связаны с определенными идеями и ограничены выполнением конкретных задач.
Согласно отчету Google, гибкость Meena была результатом огромной обучающей базы данных. Meena была обучена на примерно 40 миллиардах слов, взятых из социальных сетей и отфильтрованных для получения наиболее актуальных и представительных слов. Google стремилась решить некоторые проблемы, которые встречаются в большинстве голосовых помощников, такие как способность обрабатывать темы и команды, которые разворачиваются в течение нескольких оборотов разговора, когда пользователь предоставляет дополнительные входные данные после ответа бота. Это означает, что многие чат-боты не могут запросить у пользователя уточнение и когда возникает запрос, который не может быть интерпретирован, они часто просто переходят к результатам поиска.
Чтобы решить эту конкретную проблему, исследователи Google сделали так, чтобы их алгоритмы могли отслеживать контекст разговора, что означает, что они могут генерировать конкретные ответы. Модель использовала кодировщик, который обрабатывает то, что было сказано в разговоре, и декодировщик, который создает ответ на основе контекста. Модель была обучена на конкретных и не конкретных данных. Конкретные данные – это слова, которые тесно связаны с предыдущим заявлением. Как объяснил пост Google:
«Например, если А говорит: «Я люблю теннис», и Б отвечает: «Это хорошо», то высказывание должно быть помечено как «не конкретное». Этот ответ можно использовать в десятках разных контекстов. Но если Б отвечает: «Мне тоже, я не могу насытиться Роджером Федерером!», то оно помечается как «конкретное», поскольку оно тесно связано с тем, что обсуждается.
Данные, использованные для обучения модели, состояли из семи «оборотов» в разговоре. Во время обучения модель имела 2,6 миллиарда параметров, которые анализировали 341 ГБ текстовых данных для выявления закономерностей, базы данных примерно в 8,5 раза больше, чем база данных, использованная для обучения модели GPT-2 созданной OpenAI.
Google сообщила, как Meena выступила на метрике Sensibleness and Specificity Average (SSA). SSA – это метрика, разработанная исследователями Google, и она предназначена для количественной оценки способности разговорного агента отвечать конкретными, актуальными ответами по мере продолжения разговора.
Оценки SSA рассчитываются путем тестирования модели на фиксированном количестве подсказок, и количество осмысленных ответов, которые модель дает, отслеживается. Оценка модели основана на проценте осмысленных/конкретных ответов, которые модель смогла дать по отношению к подсказкам. Общие ответы наказываются. Согласно Google, средний человек набирает около 86% на SSA, в то время как Meena смогла набрать 79%. Другая известная модель ИИ, агент, созданный Pandora Bots, выиграл премию Лёбнера в признание того, что их ИИ-боты достигли сложного, похожего на человеческий, общения. Агент Pandora Bots достиг примерно 56% в тесте SSA.
Microsoft (MSFT ) и Amazon также пытаются создать более гибкие и естественные чат-боты. Microsoft пытается создать многоповоротный диалог в чат-ботах в течение двух лет, приобретая Semantic Machines, стартап ИИ, для улучшения Cortana. Amazon недавно провела вызов Alexa Prize, который побуждал участников разработать бота, способного вести разговор примерно 20 минут.










