AGIと未来のAI
ターリングテストとは何か、それが何故重要なのか?
人工知能(AI)を扱っている人は、たぶん『ターリングテスト』について聞いたことがあるでしょう。このテストは、1950年にアラン・チューリングによって最初に提案され、AIが人間レベルの知能を達成することができるかどうかを判断するための究極の実験でした。概念的に、AIがテストに合格することができると、人間と同等、または人間と区別がつかない知能を達成したことになります。
アラン・チューリングは誰なのか、テストとは何か、それが何故重要なのか、そしてテストの定義が進化する必要がある理由について探究してみましょう。
アラン・チューリングは誰なのか
チューリングは、イギリスの数学者で、未来的な画期的なアイデアで知られています。
1935年、22歳のときに確率論に関する彼の仕事がキングス・カレッジ、ケンブリッジ大学のフェローシップを獲得しました。彼の抽象的な数学的なアイデアは、まだ発明されていなかった分野で彼を別の方向に導きました。
1936年、チューリングは現在コンピューターサイエンスの基礎と認識されている論文を発表しました。この論文では、任意の命令セットを解釈して実行できる『ユニバーサル・マシン』の概念を発明しました。
1939年、チューリングはイギリス政府の暗号解読部門に採用されました。当時、ドイツは『エニグマ・マシン』を使用して軍事および海軍の信号を暗号化していました。チューリングは、エニグマのメッセージを大規模に解読できる新しいマシン(『ボンベ』)を急いで開発しました。この開発は、ナチス・ドイツの攻撃を押し戻す上で重要な役割を果たしたと考えられています。
1946年、チューリングは1936年に発表した革命的なアイデアを基に、様々な計算を実行できる電子コンピューターを開発するために戻りました。彼は『自動計算エンジン』(ACE)と呼ばれるものの詳細な設計を制作しました。
1950年、チューリングは「マシンは考えることができるか?」と問うて、著名な論文を発表しました。この論文は、コンピューターサイエンスとAIの両方を完全に変革しました。
1952年、チューリングは若い男によって警察に報告された後、同性愛行為により粗暴な行為で有罪となりました。結果として、彼の政府へのセキュリティークリアランスが取り消され、キャリアが破壊されました。彼を処罰するために、彼は化学的に去勢されました。
彼の生活が破壊された後、1954年6月8日に彼の家政婦によって彼の家で発見されました。彼は前日のシアン化物中毒で死亡していました。彼の体のそばには、半分食べたリンゴがありました。検死官の判断は、自殺だったというものでした。
幸いにも、彼の遺産は今でも生き続けています。
ターリングテストとは何か
1950年、アルントゥーリングは『計算機械と知能』と題した著名な論文をマインド誌に発表しました。この詳細な論文では、「マシンは考えることができるか?」という疑問が提起されました。論文では、機械が考えることができるかどうかを定義することを放棄し、代わりに『模倣ゲーム』で機械をテストすることを提案しました。このゲームは、3人の人間で遊びます:
- 男(A)
- 女(B)
- 質問者(C)
ゲームの概念は、質問者が別の部屋にいる間、男(A)と女(B)が別々の部屋にいるというものです。質問者の目標は、男(A)と女(B)を特定することです。この場合、男(A)の目標は質問者を欺くことです。一方、女(B)は質問者(C)を助けることができます。このゲームを公平にするために、口頭でのヒントは使用できません。代わりに、タイプされた質問と回答のみが送信されます。質問は、質問者は誰を信じるかということになります。
質問者は、XとYというラベルしか知らないので、ゲームの終わりに「XはAで、YはBだ」という宣言をします。
質問は、男(A)または女(B)を取り除き、代わりに知能のあるマシンを置き換えることができるかどうかです。マシンは、質問者(C)を欺いて、自分が男または女だと思わせることができるでしょうか。これが、ターリングテストの本質です。
他の言葉で言うと、AIシステムと無意識にコミュニケーションをとっていて、それが人間だと思った場合、AIはあなたを永遠に欺くことができるでしょうか?
ターリングテストが重要な理由
チューリングの論文では、ターリングテストが最終的にクリアされる可能性があることを示唆しています。彼は次のように述べています:「2000年までに、約50年後には、約10^9のストレージ容量を持つコンピューターをプログラムすることができ、模倣ゲームを非常にうまくプレイできるようになり、平均的な質問者は5分間の質問の後、正しい識別を70%の確率で行うことができるようになるだろう。」
現代の視点からターリングテストを見ると、AIシステムが5分間人間を欺くことができる可能性は非常に高いようです。サポートチャットボットと人間が交信していることがあるかどうかは、チャットボットが人間かボットかを知らない場合です。
ターリングテストに合格したという報告は何度かあります。2014年、13歳のウクライナ少年を模倣するチャットボットプログラム『ユージーン・グースマン』が、ロンドンの王立協会で開催されたイベントでターリングテストに合格したと言われています。チャットボットは、33%の裁判官を人間だと思わせることができました。ただし、批評家はテストの不十分さ、多くの裁判官が納得していないこと、テストの期間(5分間)、およびこの成果に対する証拠の欠如を指摘しました。
2018年、Google Duplex予約システムは、Google Assistantの支援を受けて、美容院に電話して髪切りの予約をしました。この場合、AIシステムは自分がAIであることを紹介せず、電話中に人間を装いました。短いやり取りの後、髪切りの予約は成功しました。両者は電話を終了しました。
しかし、自然言語処理(NLP)の時代に、自然言語理解(NLU)や自然言語解釈(NLI)などのサブフィールドがある場合、機械が完全に理解することなく質問に答えることができる場合は、機械が真正に知能を持っているのかどうか疑問に思う必要があります。
たとえば、IBMが開発した『ワトソン』というコンピューターシステムは、自然言語で質問を理解して回答する能力を持っています。ワトソンは、200万ページの情報をインターネットからダウンロードして、ジェパディのチャンピオンを破ることができました。ただし、ワトソンは言語の背景を真正に理解しているわけではありません。検索エンジンのように、キーワードや参照ポイントを作成するだけです。
同様に、AIがこれらのレベルの理解を達成できる場合、5分間または10分間人間を欺くことは、十分な基準ではありません。
ターリングテストを進化させるべきか
ターリングテストは、時代の試練を耐えてきたと言えるでしょう。ただし、AIは1950年以来、劇的に進化しています。私たちがAIが人間と同等の知能を達成することができるかどうかの最終的な基準と考えていることは、常にAIが人間と対戦するゲームで勝つ能力に基づいています。
AIの歴史を振り返ると、1950年代に『クロード・シャノン』は、コンピューターがチェスをプレイする方法について論文を発表しました。チェスは、人間の知能の究極の頂点と考えられていました。
1996年2月10日、チェス世界チャンピオン『ガルリ・カスパロフ』が、チェスでコンピューター『ディープ・ブルー』に初めて敗北しました。チェスは、人間の知能の頂点ではなくなりました。代わりに、中国で3000年以上前に起源した『囲碁』が、人間の知能の新たな基準となりました。
2015年10月、AlphaGoは、3回のヨーロッパチャンピオン『范暁騰』と対戦し、5-0で勝利しました。囲碁は、10^360の可能な手数があるため、世界で最も複雑なゲームと考えられています。突然、基準は再び引き上げられました。
最終的に、AIはマルチプレイヤーオンラインロールプレイングゲーム(MMORPG)でチームと対戦する必要があるという議論になりました。OpenAIは、ディープラーニングを使用してこの課題に取り組みました。
この基準の継続的な引き上げにより、ターリングテストの新しい現代的な定義を検討する必要があります。現在のテストは、欺瞞とチャットボットの技術に頼りすぎています。ロボティクスの進化により、AIが真正に人間レベルの知能を達成するには、ゲーム環境やシミュレートされた環境ではなく、現実の世界で人間と交流する必要があるかもしれません。
AIが人間と同じように交流し、会話を始め、アイデアや解決策を提案できる場合、たぶんターリングテストは合格したことになります。ターリングテストの究極のバージョンは、AIが人間に近づいて、自分が自己認識を持っていることを人間に納得させることができる場合です。
その時点で、人工一般知能(AGI)も達成したことになります。AI/ロボットが人間を知能で急速に超えることは、避けられないことになります。












