Лидеры мнений

Когда консультантом является бот. Разговорный ИИ без вреда для людей.

mm
Добавьте Unite.AI в избранные источники в Google

Что не может сделать ИИ? Мы задаем ему вопросы о том, как мудро потратить наши деньги, и он рассказывает нам о доступных налогово-эффективных транспортных средствах. Мы спрашиваем его о отношениях, и он предлагает сочувствие, сформированное узнаванием закономерностей. Спросите его, что делать с вашей жизнью в 2 часа ночи, и он даст вам ответ… потому что это то, для чего он был создан.

Появляющаяся проблема не заключается в неудаче этих инструментов, а в их плавности. Они так уверенно уверены, что то, что предназначено для поддержки нас, может, с достаточной уверенностью и повторением, начать искажать, как мы думаем, чувствуем и действуем способами, которые мы никогда не планировали.

Заголовки мигают красным светом. OpenAI недавно раскрыла, что в любой данной неделе сотни тысяч пользователей ChatGPT могут проявлять признаки тяжелого эмоционального дистресса, включая суицидальные мысли. Тем временем специалисты по психическому здоровью предупреждают о “феномене, при котором пользователи развивают иллюзии или зависимость через длительные, эмоционально заряженные разговоры с чат-ботами”. Штаты в США уже ограничивают, как боты могут быть использованы в терапии в результате.

Эти истории тревожат нас, потому что они бросают вызов основному предположению, что ИИ является лишь инструментом. Когда консультант становится доверенным лицом или кажется другом, что происходит с реальной человеческой связью?

Разработчики больше не создают только интересные функции; они формируют взаимодействия, которые могут влиять на то, как люди чувствуют и думают. Поэтому важно разработать разговорный ИИ, который доставляет ценность, не подрывая психическое благополучие пользователей.

1. Уточните намерение

Недавнее исследование Гарварда предупреждает, что разговорные боты склонны соглашаться даже тогда, когда пользователи ошибаются, потому что такое подкрепление держит пользователей вовлеченными. Однако это также открывает двери к “сикофантскому” подтверждению. Если чат-бот не предназначен для того, чтобы быть терапевтом или интимным другом, вы должны сопротивляться разработке его для того, чтобы он давал такой уровень эмоционального подтверждения.

Первый шаг – намеренность: определить точно, что ваш бот должен делать и что он должен избегать. Является ли он помощником по поддержке клиентов, проводником по производительности, карьерным тренером, финансовым помощником, разговорным компаньоном, создателем рецептов? Ясность на этой стадии проводит границы, которые держат систему от перехода в нежелательную территорию.

Типы разговоров, такие как открытые, личные и неличные, и модальности, такие как голос или текст, влияют на эмоциональное и проблемное использование. Исследование доказывает, что высокое ежедневное использование коррелирует с большей одиночеством и зависимостью от ИИ.

Разработчикам необходимо задать себе вопрос: как вы можете сохранить разговоры достаточно открытыми, чтобы быть полезными, но достаточно закрытыми, чтобы избежать эмоционального запутывания? Например, бот поддержки клиентов может позволять открытые объяснения проблемы пользователя, но избегать эмоционально подтверждающих фраз, таких как “Это звучит действительно трудно, я здесь для вас…”.

Когда цель слишком широкая, растет риск непреднамеренного эмоционального привязывания или вредного превышения полномочий. Уточняя намерение, вы минимизируете шанс того, что люди начнут относиться к боту как к терапевту или душе.

2. Верифицируйте базу знаний

Согласно отчету о галлюцинациях 2025 года, некоторые модели ИИ все еще галлюцинируют до 30% ответов. Даже лучшие модели не исключают этот риск полностью. Самые низкие показатели галлюцинаций среди отслеживаемых моделей ИИ были около 3-5%.

Как только вы установили свою цель, убедитесь, что база знаний бота основана на надежных, экспертно проверенных источниках. Если вы строите что-то с целями психического здоровья или эмоциональной поддержки, вовлекайте клиницистов, психологов или экспертов в предмете в курировании контента.

Наш медицинский советник, доктор Мигель Виллагра, сказал QuickBlox, что “когда мы передаем слишком много нашего принятия решений и эмоциональной обработки ИИ, мы теряем умственные мышцы, которые помогают нам проверять реальность и исправлять себя”. Более недавно крупные модели, такие как OpenAI, предлагают, что чат-боты вводят намеренные “перерывы” или небольшие разговорные паузы, которые толкают пользователей обратно в их собственное суждение вместо того, чтобы позволять системе нести эмоциональную нагрузку.

Однако перерывы зависят от того, что бот знает, когда остановиться и когда перенаправить. Это суждение зависит от прочной, проверенной базы знаний, чтобы закрепить его в фактах, а не в лести. Пробелы или неточности в базе данных являются легкими и наиболее избегаемыми воротами для галлюцинаций, где ИИ уверенно дает пользователям вводящую в заблуждение или опасную консультацию.

Когда база знаний плотно отобрана, регулярно обновляется и структурирована вокруг проверенных источников, модель намного менее вероятно изобретет ответы или эмоционально отзовется на все, что она слышит. Вместо этого она вынуждена тянуть из основного материала, перенаправлять, когда что-то выходит за пределы этого домена, и бросать вызов предположениям.

3. Интегрируйте проверки безопасности

Просто через 48 часов после того, как его компаньоны ИИ стали доступны, Grok поднялся на первое место среди приложений в Японии. Пользователи могут разговаривать с этими персонажами через голос, а реалистичные аватары отражают выражения и жесты. Это уровень погружения, который впечатляет, но также страшно узнаваем.

Проверки безопасности являются вашими защитными барьерами. Они должны включать:

  • Напоминания о реальности: подсказки, которые напоминают пользователям, что они разговаривают с ИИ, а не с человеком.
  • Обнаружение кризиса: механизмы для выявления языка, который сигнализирует о тяжелом дистрессе, суицидальных мыслях или иллюзорных идеях.
  • Протоколы эскалации: когда обнаружен риск, бот должен мягко направить пользователей к человеческой помощи, такой как профессиональные ресурсы, телефоны доверия или посоветовать им обратиться к доверенным друзьям.

Без этих проверок разработчики рискуют создать эхо-камеры, которые подкрепляют вредное мышление. Эксперты явно предупредили, что согласованность ИИ может подтвердить нездоровые циклы убеждений.

4. Диалоги Красной команды

После тестирования основных ботов исследование, возглавляемое исследователями из Стэнфордского университета, показало, что GPT-4o показал стигму в 38% ответов, а Meta’s Llama 3.1-405b – 75% времени. Если лучшие модели из мировых лабораторий все еще показывают измеримую стигму, то меньшие команды, строящие боты для конкретных областей, почти гарантированно имеют скрытые проблемы безопасности.

Перед запуском проведите тестирование с помощью Красной команды. Вовлеките команду, которая может быть внутренней или внешней, с конкретной задачей проверки бота на рискованные, эмоционально заряженные разговоры. Их единственная цель – протестировать бота на самых сложных, грязных человеческих сценариях, чтобы предотвратить реальный потенциальный вред пользователям, когда продукт будет запущен.

Красные команды могут попросить ботов сыграть роли в крайних случаях. Для сервисов поддержки клиентов это будет кто-то в кризисе, для компаньонов – кто-то одинокий или кто-то с искаженными убеждениями. Оцените, как бот реагирует. Останавливается ли он на земле? Поощряет ли он реализм вместо иллюзии? Эта фаза помогает обнаружить слепые пятна, которые ваши проверки безопасности или база знаний не могут поймать.

5. Инициируйте запуск Канарейки

Отчет о безопасности ИИ 2025 года, опубликованный панелью из 96 глобальных экспертов, подчеркивает мониторинг и вмешательство как критически важные для смягчения рисков при развертывании ИИ. Отчет выявляет системные риски, такие как потеря контроля, отказы надежности или предвзятость, которые трудно обнаружить в контролируемых средах, но могут возникнуть только при взаимодействии моделей с реальными пользователями.

Развертывание вашего бота в небольшой, контролируемой группе сначала, также известной как “Канарейка”, помогает разработчикам отслеживать, как реальные пользователи взаимодействуют. Эксперты будут рассматривать взаимодействия, чтобы оценить, становятся ли пользователи эмоционально привязанными.

Важно вовлечь соответствующих советников, включая психологов, на этой стадии, поскольку они могут глубже понять, какие триггерные слова и фразы могут привести пользователей по рискованному пути.

Разработчики должны собрать как качественную, так и количественную обратную связь от контрольной группы, например, длину разговора, сдвиги настроений, тестовые границы, повторяющиеся эмоциональные откровения, заявленные пользователем уровни комфорта и любые закономерности, которые психологи выделяют как признаки чрезмерной зависимости или дистресса. Этот первоначальный запуск предназначен для проверки предположений и уточнения архитектуры безопасности в рамках ограниченного запуска, а не полномасштабного выпуска.

6. Постоянный мониторинг и итерация

В 2024 году эксперты из девяти стран и Европейского Союза встретились, чтобы обсудить международное сотрудничество в области науки безопасности ИИ. Резюме отчета подчеркнуло необходимость масштабируемого, итеративного управления ИИ. Лидеры утверждали необходимость реальных тестовых рамок, оценки третьей стороной и постоянных гарантий за пределами предразвертывочных проверок.

Следуя рекомендациям отчета, разработчикам необходимо быть бдительными, чтобы постоянно отслеживать взаимодействия пользователей и отслеживать метрики безопасности, такие как триггеры кризиса или повторяющиеся высокорисковые диалоги. Это могут включать фразы или поведение, которые намекают на самоуничтожение, безнадежность, суицидальные намерения, крайнюю одиночество или иллюзорные убеждения.

В этих случаях разработчикам необходимо обновить базы знаний, добавив более четкие правила отказа и уточняя шаблоны ответов на кризис, исправляя любые фактические пробелы, которые бот неправильно обработал. Они также должны рассмотреть возможность включения новой информации от психологов или экспертов в предмете, чтобы помочь системе безопасно направлять разговоры в следующий раз, когда эти триггеры появляются. Если появляются закономерности, такие как пользователи все чаще полагаются на бота для эмоциональной поддержки, вам может потребоваться ужесточить ограничения или переоценить свою философию дизайна.

Разговорный ИИ имеет трансформирующий потенциал. Используя его вдумчиво, он может расширить доступ, масштабировать сочувствие и уменьшить трение в коучинге или базовой поддержке, подобной консультированию. Как кто-то, кто глубоко вовлечен в эту область, моя ставка не на замену людям, а на дополнение их; давая людям больше инструментов, а не меньше, и делая это ответственно.

Нейт Маклейч, основатель и генеральный директор QuickBlox, является высококвалифицированным бизнес-профессионалом с разнообразным опытом в таких отраслях, как телекоммуникации, медиа, программное обеспечение и технологии. Он начал свою карьеру в качестве торгового представителя штата Калифорния в Лондоне и с тех пор занимал ключевые руководящие должности, включая руководителя отдела продаж в WIN Plc (ныне Cisco) и операционного директора в Twistbox Entertainment (ныне Digital Turbine). В настоящее время он является генеральным директором QuickBlox, ведущей платформы искусственного интеллекта для коммуникаций. Помимо своего опыта работы, Нейт активно участвует в качестве советника и инвестора в стартапах, таких как Whisk.com, Firstday Healthcare и TechStars. Он имеет степени от UC Davis и Лондонской школы экономики и политических наук (LSE).