Інтерв’ю
Міхаель МакТір, почесний професор Університету Ольстера – Серія інтерв’ю

Міхаель МакТір – почесний професор Університету Ольстера. Він понад 20 років досліджує область систем розмовної діалоги та є автором декількох книг, зокрема останньої – “Розмовний штучний інтелект: Системи діалогів, агенти розмов та чат-боти” (Springer Link 2021). Міхаель прочитав ключові доповіді та семінари на багатьох наукових конференціях та семінарах. Наразі Міхаель бере участь у декількох дослідницьких та розробних проектах, що вивчають використання розмовних агентів у підтримці психічного здоров’я та домашньому моніторингу літніх людей.
Що спочатку привернуло вашу увагу до машинного навчання?
До недавнього часу я працював з підходами, заснованими на правилах, до розмовного штучного інтелекту, особливо в галузі управління діалогами, де основною ідеєю є розробка правил, що визначають стратегії агента в діалозі. Однак із недавніми досягненнями у машинному навчанні, спочатку у підкріпленому навчанні, а потім у глибокому навчанні, я виявив, що ці підходи можуть потенційно вирішити деякі питання, пов’язані з підходами, заснованими на правилах, такими як проблема масштабування та необхідність написання декількох правил для забезпечення більш складних потоків діалогів.
Ви працюєте над голосовими та розмовними штучними інтелектами понад 20 років, що спонукало вас зосередитися на цій галузі?
Я давно цікавлюся тим, як працює розмова. У своїй дисертації я вивчав розвиток розмовної компетентності у молодих дітей, і це була тема моєї першої книги. Пізніше я став зацікавлений ідеєю, що комп’ютери можуть вступати у розмови подібно до людей, і з тих пір я слідкував за розвитком цієї галузі. Спочатку це була досить маргінальна область у штучному інтелекті, але за останні роки вона стала дуже важливою, оскільки великі технологічні компанії прийняли її як область стратегічного інтересу.
Одним із ваших останніх проектів, над яким ви працювали, є ChatPAL для підтримки психічного здоров’я в сільських районах. Чи можете ви обговорити проблеми, пов’язані з будівництвом чат-бота для користувачів, які можуть не бути техногенно підкованими або знайомі з концепцією чат-ботів?
Багато людей знайомі з голосовими асистентами на своїх смартфонах та інтелектуальних динаміках, таких як Amazon Alexa. Молоді люди використовують свої телефони в основному для текстових повідомлень, тому вони знайомі з ідеєю взаємодії з текстовим чат-ботом. Однак, коли мова йде про взаємодію з чат-ботом, спеціально розробленим для певної області, як наш проект Chatpal, який був розроблений для підтримки психічного здоров’я в сільських районах, ми виявили, що деякі користувачі мали певні очікування щодо технології на основі їхнього досвіду з Alexa та іншими подібними чат-ботами, які перевищували те, що ми могли запропонувати з обмеженими ресурсами. Ми спробували вирішити проблему користувачів, які не були техногенно підкованими або знайомі з чат-ботами, через початкові сесії живого лабораторного дослідження, а також забезпечуючи, щоб взаємодія з чат-ботом була природною та інтуїтивною.
Які деякі проблеми, пов’язані з будівництвом чат-ботів, орієнтованих на психічне здоров’я?
Є небезпека того, що деякі користувачі можуть очікувати більше від чат-бота, ніж це можливо з сучасними технологіями. Ми не хотіли займатися діагностикою, оскільки вважали це занадто ризикованим, і були повідомлення про шкідливі чи навіть небезпечні відповіді чат-ботів у таких ситуаціях. Ми керувалися вимогами різних етичних комітетів, а також визнаними стандартами для розробки чат-ботів. Іншою проблемою є те, що ми виявили різниці між користувачами щодо того, як вони використовували чат-бот. Деякі користувачі швидко відмовлялися, коли зустрічали технічні проблеми, тоді як інші були готові продовжувати. Також була вікова різниця, оскільки молоді користувачі були щасливими взаємодіяти з нашим текстовим чат-ботом, тоді як старші користувачі були менш щасливими з цим типом інтерфейсу.
Деякі з застосунків, над якими ви працювали, пропонують плани дій для користувачів, як ви ефективно генеруєте мотивацію користувача в застосунку?
Для цього необхідно створити та підтримувати профіль для кожного користувача, який відображає такі речі, як їхні майбутні призначення, ліки, загальні переваги та те, про що вони обговорювали у попередніх розмовах з чат-ботом. Користувачі часто заявляють, що хочуть, щоб чат-бот був знайомий з їхніми індивідуальними потребами та слідкував за тим, про що вони обговорювали раніше, а не надавав більш загальну та менш адаптивну взаємодію.
Однак, проти цього, є питання даних про приватність, і користувачі також висловлюють занепокоєння щодо використання їхньої приватної інформації. Тут потрібно знайти деликатний баланс, і, звичайно, існує все більше законодавства, яке регулює етичне використання штучного інтелекту у громадському та приватному житті.
Які деякі етичні розгляди при будівництві чат-ботів?
Одним із основних етичних розглядов при будівництві чат-ботів є те, чи вони посилюють гендерні стереотипи. Традиційно жінки займали допоміжні ролі на робочому місці, тоді як чоловіки займали лідерські ролі. Реалізація чат-бота з жіночою персоною могла б посилити такі гендерні стереотипи.
Іншою важливою етичною проблемою є те, чи чат-боти повинні приймати людські цінності та поводитися так, щоб надихати довіру. Це відомо як проблема вирівнювання. Чат-боти повинні бути розроблені так, щоб вони уникнули порушення прав людини та створення упередженості, а їхні рішення повинні бути прозорими для людських користувачів.
Також, як згадувалося раніше, чат-боти повинні поважати приватність користувачів та закони про захист даних. Наразі багато досліджень та зусиль спрямовані на ці етичні розгляди.
У світі, що зосереджений на англомовних чат-ботах, які деякі проблеми при розробці багатомовних та міжнародних чат-ботів?
Все залежить від наявності мовних ресурсів, таких як мовні моделі, та для голосових систем – двигунів розпізнавання та синтезу мови. Це не проблема для широко поширених мов, але складно для мов з обмеженими ресурсами, які можуть бути розмовними великою кількістю людей та мають потребу у послугах чат-бота. Одним із можливих рішень є використання переносного навчання з моделі, попередньо натренованої на мові, такій як англійська, та налаштування її на дані з мови з обмеженими ресурсами.
Більшість застосунків, над якими ви працювали, використовують відкритий код, які деякі з кращих відкритих інструментів?
Використання відкритого коду було вимогами агентств, які фінансували наші проекти.
Ми використовували Rasa у наших проектах, оскільки це відкритий код, але також дуже потужний, оскільки він використовує останні розробки у технологіях розмовного штучного інтелекту. Окрім Rasa, є декілька відмінних відкритих програмних продуктів штучного інтелекту, включаючи Botpress, Microsoft (MSFT ) Bot Framework, OpenDialog та DeepPavlov, щоб назвати лише декілька.
Ви будете виступати на майбутній Конференції майбутнього чат-ботів та розмовного штучного інтелекту, організованій Group futurista, про що ви будете говорити?
У моєму доповіді я буду порівнювати традиційні підходи до розробки чат-ботів, засновані на кращих практиках, відомих як розмовний дизайн, з новими підходами, заснованими на великих мовних моделях, таких як ChatGPT. Я покриватиму переваги та недоліки кожного підходу та буду стверджувати, що хоча підходи, засновані на великих мовних моделях, пропонують багато потенціалу для майбутньої розробки чат-ботів, все ще існують багато питань щодо неконтрольованого використання великих мовних моделей, особливо в галузях, таких як охорона здоров’я та бізнес, тому все ще існує потреба у розмовних дизайнерах, які можуть забезпечити зрозумілі, прозорі та етичні розмовні штучні інтелекти.
Дякую за велике інтерв’ю, читачам, які бажають почути Міхаеля МакТіра, слід відвідати Конференцію майбутнього чат-ботів та розмовного штучного інтелекту організовану Group futurista.












