倫理
研究者がAIの不適切な行動を防ぐためのアルゴリズムを開発

人工知能は、現在までに多くの進歩と利点を示してきましたが、人種や性別の偏見などの不適切な副作用も報告されています。したがって、sciencealert.comは、「高度な思考システムが公平で、さらには安全であることを保証するために、科学者はどのようにしてそれを実現することができるのか」と疑問を提起しています。
答えは、スタンフォード大学とマサチューセッツ大学アマースト校の研究者による報告書にあります。この報告書は、「知的マシンの不適切な行動を防止する」というタイトルで、eurekaalert.orgは、この報告書についての記事で、「AIは現在、機密性の高いタスクを処理するようになっており、政策立案者は、コンピュータ科学者に、自動化システムが、過度のリスクや人種や性別の偏見などの不適切な結果を最小限に抑えるように設計されていることを保証するよう求めています」と述べています。
この研究チームが提示した報告書は、「性別の偏見を避ける」という曖昧な目標を、機械学習アルゴリズムがAIアプリケーションをそのような行動を避けるようにトレーニングできるような、正確な数学的基準に翻訳する新しい技術を概説しています。
目的は、スタンフォード大学のコンピュータ科学の助教授であり、論文の著者であるエマ・ブルンスキル氏によると、「私たちは、人間のユーザーの価値を尊重し、自律システムに寄せられた信頼を正当化するAIを進歩させたい」と述べています。
アイデアは、「安全でない」または「不公平な」結果や行動を数学的用語で定義することで、研究者によると、「これらの望ましくない結果を回避する方法をデータから学習することができるアルゴリズムを作成する」ことができます。
2番目の目標は、「ユーザーが、どのような不適切な行動を制限したいのかを簡単に指定できるようにするための技術セットを開発する」ことでした。また、「過去のデータでトレーニングされたシステムが現実の状況で信頼できるものであることを、機械学習設計者が自信を持って予測できる」ようにすることでした。
ScienceAlertによると、研究チームはこの新しいシステムを「セルドニアン」アルゴリズムと命名しました。これは、アイザック・アシモフの有名なSF小説「ファウンデーション」シリーズの主人公にちなんで命名されたものです。マサチューセッツ大学アマースト校のコンピュータ科学の助教授であり、論文の著者であるフィリップ・トーマス氏は、「セルドニアン・アルゴリズムを使用して、糖尿病の治療を行う場合、不適切な行動とは、危険な低血糖または低血糖症を意味します」と述べています。
「私は、マシンに、『インスリンポンプのコントローラーを改善する際に、低血糖症の頻度を増やすような変更を加えないでください』と言います。ほとんどのアルゴリズムでは、このような制約を課す方法は提供されていません。初期の設計には含まれていませんでした」
トーマス氏はさらに、「このセルドニアン・フレームワークにより、機械学習設計者が、さまざまなアルゴリズムに、行動の回避命令を組み込むことが容易になります。これにより、トレーニングされたシステムが現実の世界で適切に機能する確率を評価できるようになります」と述べています。
エマ・ブルンスキル氏も、「安全性や公平性などの価値を尊重するアルゴリズムを作成する方法について考えることは、社会がAIにますます依存するようになるにつれて、不可欠です」と述べています。












