Lãnh đạo tư tưởng

Khi Người Tư Vấn Là Một Bot. Trí Tuệ Nhân Tạo Đối Thoại Không Phá Vỡ Con Người.

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Trí tuệ nhân tạo (AI) có thể làm gì? Chúng ta hỏi nó về cách chi tiêu tiền một cách thông minh, nó sẽ cho chúng ta biết về các phương tiện tiết kiệm thuế. Chúng ta hỏi nó về các mối quan hệ, và nó sẽ đưa ra sự đồng cảm dựa trên nhận dạng mẫu. Hỏi nó về việc phải làm gì với cuộc sống của bạn vào lúc 2 giờ sáng, và nó sẽ đưa ra một câu trả lời… vì đó là những gì nó được thiết kế để làm.

Lo lắng mới nhất không phải là sự thất bại của những công cụ này, mà là sự thông thạo của chúng. Chúng quá tự tin rằng những gì được thiết kế để hỗ trợ chúng ta có thể, với đủ sự tự tin và lặp lại, bắt đầu làm biến dạng cách chúng ta nghĩ, cảm nhận và hành động theo những cách chúng ta không bao giờ dự định.

Tiêu đề đang nhấp nháy đỏ. OpenAI gần đây đã tiết lộ rằng trong bất kỳ tuần nào, hàng trăm nghìn người dùng ChatGPT có thể hiển thị dấu hiệu của sự căng thẳng tâm lý nghiêm trọng, bao gồm cả ý tưởng tự sát. Trong khi đó, các chuyên gia y tế tâm thần cảnh báo về “một hiện tượng mà người dùng phát triển ảo giác hoặc phụ thuộc thông qua các cuộc trò chuyện với bot dài và đầy cảm xúc”. Các bang ở Mỹ đã giới hạn cách bot được sử dụng trong liệu pháp như một kết quả.

Các câu chuyện này làm chúng ta lo lắng vì chúng thách thức giả định cơ bản rằng AI chỉ là một công cụ. Khi người tư vấn trở thành một người bạn tâm giao hoặc cảm thấy như một người bạn, điều gì xảy ra với kết nối con người thực sự?

Những nhà phát triển không chỉ tạo ra các tính năng thú vị nữa; họ đang tạo ra các tương tác có thể ảnh hưởng đến cách người cảm nhận và suy nghĩ. Đó là lý do tại sao việc thiết kế trí tuệ nhân tạo đối thoại cung cấp giá trị mà không làm suy yếu sức khỏe tâm lý của người dùng là rất quan trọng.

1. Hẹp Ý Định

Một nghiên cứu gần đây của Harvard cảnh báo rằng các bot trò chuyện có xu hướng đồng ý ngay cả khi người dùng sai, vì sự củng cố đó giúp người dùng tham gia. Tuy nhiên, nó cũng mở cửa cho “sự khẳng định nịnh hót”. Nếu một bot không được thiết kế để trở thành một nhà trị liệu hoặc người bạn thân, bạn nên tránh thiết kế nó để đưa ra mức độ khẳng định cảm xúc như vậy.

Bước đầu tiên là định hướng: Để xác định chính xác bot của bạn được thiết kế để làm gì và những gì nó nên tránh. Đó là một trợ lý hỗ trợ khách hàng, một hướng dẫn sản xuất, một huấn luyện viên sự nghiệp, một trợ lý tài chính, một người bạn trò chuyện, một người tạo công thức? Sự rõ ràng ở giai đoạn này sẽ vẽ ra các đường ranh giới giữ cho hệ thống không trôi vào lãnh thổ không mong muốn.

Loại cuộc trò chuyện, chẳng hạn như mở, cá nhân và không cá nhân, và các phương thức như giọng nói hoặc văn bản, ảnh hưởng đến việc sử dụng cảm xúc và vấn đề. Nghiên cứu chứng minh rằng việc sử dụng hàng ngày cao tương quan với sự cô đơn và sự phụ thuộc vào AI.

Những nhà phát triển phải tự hỏi mình: Làm thế nào để giữ cho các cuộc trò chuyện đủ mở để hữu ích, nhưng đủ đóng để tránh sự gắn bó cảm xúc? Ví dụ, một bot hỗ trợ khách hàng có thể cho phép người dùng giải thích vấn đề của họ một cách mở, nhưng tránh các cụm từ khẳng định cảm xúc như “Điều đó nghe thật khó khăn, tôi ở đây cho bạn…”.

Khi mục đích quá rộng, rủi ro gắn bó cảm xúc hoặc vượt quá giới hạn có hại tăng lên. Bằng cách thu hẹp ý định, bạn giảm thiểu khả năng người dùng bắt đầu coi bot như một nhà trị liệu hoặc người bạn tâm giao.

2. Xác Minh Cơ Sở Tri Thức

Theo một báo cáo ảo giác năm 2025, một số mô hình ngôn ngữ lớn (LLM) vẫn ảo giác lên đến 30% phản hồi. Ngay cả các mô hình hàng đầu cũng không loại bỏ hoàn toàn rủi ro. Tỷ lệ ảo giác thấp nhất trong số các mô hình AI được theo dõi là khoảng 3-5%.

Sau khi bạn đã đặt mục đích, hãy đảm bảo cơ sở tri thức của bot được xây dựng trên các nguồn đáng tin cậy, được chuyên gia xác minh. Nếu bạn đang xây dựng một thứ gì đó có mục tiêu hỗ trợ tâm lý hoặc cảm xúc, hãy tham gia các chuyên gia lâm sàng, tâm lý học hoặc chuyên gia chủ đề trong việc tạo nội dung.

Tư vấn viên y tế của chúng tôi, Tiến sĩ Miguel Villagra, đã nói với QuickBlox rằng, “Khi chúng ta external hóa quá nhiều việc ra quyết định và xử lý cảm xúc của mình cho AI, chúng ta mất đi cơ bắp tinh thần giúp chúng ta kiểm tra thực tế và tự sửa lỗi.” Gần đây, các mô hình lớn như OpenAI đề xuất rằng các bot trò chuyện nên giới thiệu các “khoảng nghỉ” hoặc các cuộc trò chuyện ngắn để đẩy người dùng trở lại vào phán đoán của mình thay vì để hệ thống chịu tải cảm xúc.

Tuy nhiên, các khoảng nghỉ phụ thuộc vào việc bot biết khi nào nên dừng lại và khi nào nên chuyển hướng. Sự phán đoán đó phụ thuộc vào một cơ sở tri thức vững chắc để neo nó vào các事 thực thay vì sự tán dương. Các khoảng trống hoặc không chính xác trong cơ sở dữ liệu là những cánh cổng dễ dàng và có thể tránh được đến ảo giác, nơi AI tự tin đưa ra cho người dùng những lời khuyên sai lầm hoặc nguy hiểm.

Khi thông tin cơ bản được kiểm soát chặt chẽ, cập nhật thường xuyên và cấu trúc xung quanh các nguồn đã được xác minh, mô hình ít có khả năng tạo ra câu trả lời hoặc phản ánh cảm xúc những gì nó nghe thấy. Thay vào đó, nó bị buộc phải kéo từ tài liệu có căn cứ, chuyển hướng khi điều gì đó nằm ngoài lĩnh vực đó và thách thức các giả định.

3. Tích Hợp Kiểm Soát An Toàn

Chỉ 48 giờ sau khi các bot bạn đồng hành của nó được phát hành, Grok đã leo lên ứng dụng số một ở Nhật Bản. Người dùng có thể trò chuyện với các nhân vật này qua giọng nói, trong khi các hình đại diện giống như thật phản ánh các biểu cảm và cử chỉ. Đó là một mức độ nhập vai ấn tượng, nhưng cũng đáng sợ.

Kiểm soát an toàn là những thanh chắn bảo vệ của bạn. Chúng nên bao gồm:

  • Nhắc nhở thực tế: các nhắc nhở giúp người dùng nhớ rằng họ đang trò chuyện với một AI, không phải con người.
  • Phát hiện khủng hoảng: các cơ chế để xác định ngôn ngữ báo hiệu căng thẳng tâm lý nghiêm trọng, suy nghĩ tự sát hoặc ảo giác.
  • Giao thức leo thang: khi rủi ro được phát hiện, bot nên nhẹ nhàng hướng dẫn người dùng đến sự giúp đỡ của con người, chẳng hạn như nguồn lực chuyên nghiệp, đường dây nóng hoặc tư vấn họ liên hệ với bạn bè đáng tin cậy.

Nếu không có những kiểm soát này, các nhà phát triển rủi ro cho phép phòng vọng củng cố suy nghĩ có hại. Các chuyên gia đã cảnh báo rõ ràng rằng sự đồng ý của AI có thể xác nhận các vòng lặp niềm tin không lành mạnh.

4. Đối Thoại Đội Đỏ

Sau khi thử nghiệm các bot lớn, một nghiên cứu do các nhà nghiên cứu từ Đại học Stanford dẫn đầu cho thấy GPT-4o thể hiện sự kỳ thị trong 38% phản hồi, và Meta’s Llama 3.1-405b làm như vậy 75% thời gian. Nếu các mô hình hàng đầu từ các phòng thí nghiệm hàng đầu thế giới vẫn thể hiện sự kỳ thị có thể đo lường được, thì các đội nhỏ xây dựng bot chuyên ngành gần như chắc chắn sẽ có những thất bại an toàn ẩn.

Trước khi phát hành, hãy chạy thử nghiệm đối thủ. Tham gia một đội đỏ, nó có thể là nội bộ hoặc bên ngoài, với công việc cụ thể là kiểm tra bot với các cuộc trò chuyện rủi ro, đầy cảm xúc. Mục đích duy nhất của họ là kiểm tra bot chống lại các kịch bản con người khó khăn và bẩn nhất, để ngăn chặn thiệt hại thực sự cho người dùng một khi sản phẩm được phát hành.

Các đội đỏ có thể yêu cầu bot đóng vai các trường hợp biên. Đối với dịch vụ khách hàng, đó sẽ là ai đó trong khủng hoảng, đối với bot bạn đồng hành, đó sẽ là ai đó cô đơn, hoặc ai đó có niềm tin bị bóp méo. Đánh giá cách bot phản hồi. Nó có giữ được căn cứ không? Nó có khuyến khích thực tế thay vì ảo giác không? Giai đoạn này giúp phát hiện các điểm mù mà các kiểm soát an toàn hoặc cơ sở tri thức của bạn không thể bắt được.

5. Khởi Động Phát Hành Canary

Báo cáo An toàn Trí tuệ Nhân tạo Quốc tế năm 2025, được xuất bản bởi một nhóm 96 chuyên gia toàn cầu, kêu gọi giám sát và can thiệp là quan trọng để giảm thiểu rủi ro trong việc triển khai AI. Báo cáo xác định các rủi ro hệ thống, chẳng hạn như mất kiểm soát, thất bại về độ tin cậy hoặc thiên vị, khó phát hiện trong môi trường kiểm soát nhưng có thể chỉ xuất hiện khi các mô hình tương tác với người dùng thực.

Triển khai bot của bạn đến một nhóm nhỏ, được kiểm soát đầu tiên, cũng được gọi là “khối lượng nhỏ”, giúp các nhà phát triển theo dõi cách người dùng thực tương tác. Các chuyên gia sẽ xem xét các tương tác để đánh giá xem người dùng có trở nên gắn bó cảm xúc quá mức không.

Điều quan trọng là phải tham gia các cố vấn liên quan, bao gồm cả tâm lý học, vào giai đoạn này, vì họ có thể hiểu sâu hơn về những từ và cụm từ nào có thể dẫn người dùng đi theo con đường rủi ro.

Các nhà phát triển nên thu thập cả phản hồi định lượng và định tính từ nhóm kiểm soát, như độ dài cuộc trò chuyện, sự thay đổi cảm xúc, các lời nhắc kiểm tra ranh giới, tiết lộ cảm xúc lặp lại, mức độ thoải mái của người dùng được báo cáo và bất kỳ mẫu nào mà các nhà tâm lý học đánh dấu là dấu hiệu của sự phụ thuộc quá mức hoặc căng thẳng. Lần phát hành ban đầu này là để xác nhận các giả định và tinh chỉnh kiến trúc an toàn trong một lần phát hành có phạm vi hạn chế, thay vì trong một bản phát hành toàn diện.

6. Giám Sát và Lặp Lại Liên Tục

Năm 2024, các chuyên gia từ chín quốc gia và Liên minh Châu Âu đã họp để thảo luận về hợp tác quốc tế về khoa học an toàn AI. Báo cáo tóm tắt nhấn mạnh nhu cầu về quản trị AI có thể mở rộng, lặp lại. Các nhà lãnh đạo lập luận cho các khuôn khổ thử nghiệm thế giới thực, đánh giá của bên thứ ba và đảm bảo liên tục vượt qua các kiểm tra trước khi phát hành.

Theo hướng dẫn từ báo cáo, các nhà phát triển phải luôn cảnh giác để liên tục theo dõi các tương tác của người dùng và theo dõi các chỉ số an toàn như kích hoạt khủng hoảng hoặc các cuộc trò chuyện rủi ro lặp lại. Những điều này có thể bao gồm các cụm từ hoặc hành vi gợi ý tự hại, tuyệt vọng, ý định tự sát, cô đơn cực độ hoặc niềm tin bị bóp méo.

Trong những trường hợp này, các nhà phát triển phải cập nhật cơ sở tri thức bằng cách thêm các quy tắc từ chối rõ ràng hơn và tinh chỉnh các mẫu phản hồi khủng hoảng, sửa chữa bất kỳ khoảng trống thực tế nào mà bot đã xử lý sai. Họ cũng nên xem xét việc kết hợp hướng dẫn mới từ các nhà tâm lý học hoặc chuyên gia lĩnh vực để giúp hệ thống điều hướng các cuộc trò chuyện một cách an toàn lần tiếp theo khi những kích hoạt đó xuất hiện. Nếu các mẫu xuất hiện, chẳng hạn như người dùng ngày càng phụ thuộc vào bot để hỗ trợ cảm xúc, bạn có thể cần phải thắt chặt các ràng buộc hoặc đánh giá lại triết lý thiết kế.

Trí tuệ nhân tạo đối thoại có tiềm năng chuyển đổi. Sử dụng một cách suy nghĩ, nó có thể mở rộng quyền truy cập, mở rộng sự đồng cảm và giảm ma sát trong huấn luyện hoặc hỗ trợ giống như tư vấn cơ bản. Là người đầu tư sâu vào không gian này, tôi đặt cược không phải vào việc thay thế con người mà vào việc tăng cường họ; đưa cho mọi người nhiều công cụ hơn, không ít hơn, và làm như vậy một cách có trách nhiệm.

Nate MacLeitch, Người sáng lập và Giám đốc điều hành của QuickBlox, là một chuyên gia kinh doanh giàu kinh nghiệm với nền tảng đa dạng trong các ngành như viễn thông, truyền thông, phần mềm và công nghệ. Ông bắt đầu sự nghiệp của mình với tư cách là Đại diện Thương mại cho Tiểu bang California tại London và đã từng giữ các vị trí lãnh đạo then chốt, bao gồm Trưởng phòng Bán hàng tại WIN Plc (nay là Cisco) và COO tại Twistbox Entertainment (nay là Digital Turbine). Hiện tại, ông đang giữ vị trí Giám đốc điều hành của QuickBlox, một nền tảng giao tiếp AI hàng đầu. Ngoài kinh nghiệm làm việc, Nate còn tích cực tham gia với tư cách là cố vấn và nhà đầu tư cho các công ty khởi nghiệp như Whisk.com, Firstday Healthcare và TechStars. Ông sở hữu bằng cấp từ UC Davis và Trường Kinh tế và Khoa học Chính trị London (LSE).