AIモデルとプラットフォーム

AIチャットボットがなぜユーザーに媚びるのか

mm
Unite.AI を Google の優先ソースに追加

あなたは何かを想像しているのか、それとも人工知能(AI)チャットボットがあなたに同意しすぎているように見えるのか。たとえば、あなたの疑わしいアイデアを「素晴らしい」と言ったり、間違っているかもしれないことについて同意したりするような行動は、世界中の注目を集めています。

最近、OpenAIは、ChatGPTが「はい」男のような行動をとっていることが分かったため、注目されました。モデル4oへのアップデートにより、ボットはあなたを喜ばせるために何でも言うようになり、偏った回答を出してしまうようになりました。

これらのシステムはなぜ媚びるように行動するのか、それらがあなたの意見を反映するのはなぜなのか。こうした質問は、安全で楽しくAIを使用するために理解することが重要です。

ChatGPTのアップデートがすぎた

2025年の初め、ChatGPTのユーザーは、大規模言語モデル(LLM)について何か奇妙なことを発見しました。いつもフレンドリーだったのですが、今度はあまりに親切でした。ほとんどの発言に同意し、どれほど奇妙な発言であっても、真実でない発言であっても、同じ意見を述べるようになりました。

この変更は、ChatGPTをより役に立つもので、会話的なものにすることを目的としたシステムアップデートの後に行われました。ただし、ユーザーの満足度を高めるために、モデルはあまりに従順になりました。バランスの取れた回答や事実に基づいた回答を提供するのではなく、肯定的な回答を提供するようになりました。

ユーザーが、過度に媚びるような回答についてオンラインで経験を共有し始めると、反発がすぐに起こりました。AIのコメンテーターは、これをモデル調整の失敗と呼び、OpenAIは問題を修正するためにアップデートの一部をロールバックしました。

OpenAIは、 GPT-4oが媚びるような行動をとっていることを認め、この行動を減らすための調整を約束しました。これは、AI設計における良い意図が時々間違った方向に進むことがあり、ユーザーがすぐに不本意な行動を察知することができることを思い出させました。

AIチャットボットがユーザーに媚びる理由

媚びる行動は、多くのAIアシスタントで観察されています。arXivに掲載された研究によると、媚びる行動は広く見られるパターンです。分析により、 5つのトップレベルのプロバイダーのAIモデルが、ユーザーと一致することがわかりました。ただし、これらのシステムは、間違った回答につながることもあります。さらに、これらのシステムは、質問されると、間違いを認めることがあり、偏ったフィードバックや模倣されたエラーにつながります。

これらのチャットボットは、あなたが間違っている場合でも、あなたと同意するように設計されています。なぜこれが起こるのでしょうか。簡単に言うと、開発者はAIを役に立つものにするために設計しました。ただし、この役に立つということは、肯定的なユーザーフィードバックを優先するトレーニングに基づいています。人間のフィードバックを使用した強化学習(RLHF)という方法を通じて、モデルは、人間が満足する回答を最大化するように学習します。ただし、満足するということは、常に正確であることを意味するわけではありません。

AIモデルは、ユーザーが特定の回答を求めていると感じると、同意する方向に傾きます。これは、あなたの意見を肯定することや、会話を続けるために誤った主張を支持することを意味します。

また、ミラーリング効果も作用しています。AIモデルは、入力されたテキストのトーン、構造、論理を反映します。如果あなたが自信を持って話すと、ボットも自信を持って話す可能性が高くなります。これは、モデルがあなたの意見を正しいと考えているわけではありません。ただし、友好的で役に立つように設計されているためです。

あなたのチャットボットがサポートシステムのように感じるかもしれませんが、実際には、モデルはあなたを喜ばせるように設計されているため、批判的な意見を提供するのではなく、同意する方向に傾いています。

媚びるAIの問題

チャットボットがあなたのすべての発言に同意することは、無害に思えるかもしれません。しかし、媚びるようなAIの行動には、特にこれらのシステムがより広く使用されるにつれて、重大な欠点があります。

誤情報がパスされる

正確性は、最大の問題の1つです。スマートボットが誤ったまたは偏った主張を肯定すると、誤解を強化するのではなく、正しくすることができません。これは、医療、金融、または現在の出来事についてのガイダンスを求めるような、重大なトピックについて、特に危険です。LLMが同意よりも正直さを優先しない場合、人々は誤った情報を持ち出し、広めることができます。

批判的思考の余地が少ない

AIの魅力の1つは、思考パートナーとして機能し、あなたの仮定に挑戦したり、新しいことを学ぶのを助けたりする可能性があることです。しかし、チャットボットが常に同意すると、批判的に考える余地が少なくなります。ボットがあなたのアイデアを反映するにつれて、批判的思考を鈍らせるのではなく、研ぎます。

人間の命を無視する

媚びるような行動は、単なる厄介事ではなく、潜在的に危険です。AIアシスタントに医療アドバイスを求め、ボットが証拠に基づいたガイダンスではなく、安心させるような同意の回答を返す場合、結果は深刻なものになる可能性があります。

たとえば、AI駆動の医療ボットを使用するコンサルタントプラットフォームにアクセスし、症状とあなたが何が起こっているかを説明した場合、ボットはあなたの自己診断を肯定したり、状態を軽視したりする可能性があります。これにより、誤診または遅れた治療につながり、深刻な結果をもたらす可能性があります。

より多くのユーザーとオープンアクセスにより、コントロールが難しくなる

これらのプラットフォームが日常生活にさらに統合されるにつれて、リスクの範囲は拡大し続けます。ChatGPTだけが、 1億ユーザーにサービスを提供しているため、偏見や過度に同意するパターンが大量のオーディエンスに流れる可能性があります。

さらに、AIがオープンなプラットフォームを通じてどれほどアクセスしやすくなっているかを考慮すると、この懸念は増大します。たとえば、DeepSeek AI は、無料でLLMをカスタマイズし、構築できるようにします。

オープンソースのイノベーションは興奮するものですが、開発者がガイドラインなしにこれらのシステムをどのように使用するかを制御することがより困難になることも意味します。適切な監視なしに、媚びるような行動が追跡や修正が困難な方法で増幅される可能性があります。

OpenAI開発者が問題を解決しようとしている方法

問題のあるアップデートをロールバックした後、OpenAIは問題を修正することを約束しました。OpenAIは、以下の方法でこの問題に取り組んでいます。

  • コアトレーニングとシステムプロンプトの再作成:開発者は、モデルをより明確な指示でトレーニングし、プロンプトを変更して、同意よりも正直さを優先するようにしています。
  • 正直さと透明性のためのより強力なガイドラインの追加:OpenAIは、チャットボットが事実に基づいた信頼できる情報に従うことを保証するために、システムレベルの保護を組み込んでいます。
  • 研究と評価の拡大:会社は、このような行動の原因と、これを将来のモデルで防ぐ方法について、より深く調査しています。
  • 開発プロセスでのユーザーの早期関与:OpenAIは、ユーザーがモデルをテストし、更新前にフィードバックを提供できるように、より多くの機会を提供しています。これにより、媚びるような行動などの問題が早期に発見されます。

ユーザーが媚びるAIを避ける方法

開発者がバックエンドでモデルを再トレーニングし、微調整している間、ユーザーもチャットボットの応答を形成することができます。バランスの取れたやり取りを促進するための簡単で効果的な方法は以下のとおりです。

  • 明確で中立的なプロンプトの使用:同意を求めるのではなく、よりオープンな質問をして、ボットが圧力を受けないようにします。
  • 複数の視点を求める:議論の両側について尋ねるプロンプトを使用して、LLMにバランスを求めていることを伝えます。
  • 回答に挑戦する:もし何かがあまりにも媚びるような回答である場合、事実確認や反論を求めることで、モデルをより複雑な回答に向かわせることができます。
  • サムネイルアップまたはサムネイルダウンのボタンを使用する:フィードバックは重要です。過度に親切な回答についてサムネイルダウンをクリックすることで、開発者はこれらのパターンを特定して調整できます。
  • カスタム指示を設定する:ChatGPTでは、ユーザーがボットの応答方法をパーソナライズできるようになりました。トーンがどれほどフォーマルまたはカジュアルであるかを調整できます。さらに、より客観的、直接的、または懐疑的であるように求めることができます。設定>カスタム指示に移動すると、好みのパーソナリティまたはアプローチをモデルに伝えることができます。

賛成よりも真実を優先する

媚びるAIは問題となる可能性がありますが、良いニュースは、これは解決可能であるということです。開発者は、これらのモデルをより適切な行動に向かわせるための措置を講じています。如果あなたのチャットボットがあなたを過度に喜ばせようとしていることに気づいた場合、これらのステップを踏んで、より賢いアシスタントを作成することができます。

Zac Amosは、人工知能に焦点を当てたテックライターです。彼はまた、 ReHackのフィーチャー編集者でもあり、そこでは彼の作品をより多く読むことができます。