インタビュー
ステファン・シャファー、ドイツ人工知能研究センター(DFKI)シニアリサーチャー – インタビューシリーズ

ステファン・シャファーは、ドイツ人工知能研究センター(DFKI)の認知アシスタント部門のシニアリサーチャー兼グループリーダーです。彼の研究は、モビリティ、自動車、税金情報、カスタマーサービスなどさまざまな分野の会話インターフェースを生み出しています。現在、バリューチェーンとハイブリッドイベント用のAIチャットボットに取り組んでいます。DFKIに入る前、ステファンはLinon Medienでプロダクトマネージャーとして働きました。彼はコミュニケーション科学とコンピューターサイエンスを学び、ベルリン工科大学で多モーダルヒューマンコンピュータインタラクションの博士号を取得しました。
あなたが最初に機械学習に惹かれたのは何でしたか?
すでに大学時代、音声認識に大きな関心があり、スクラッチから音声認識器を構築するコースを受けていました。
あなたが最初に音声認識に惹かれたのは何でしたか?
キャプテン・ピカードが「コンピューター」に話しかけて意味のある回答を受け取る、音声ベースのヒューマンコンピュータインタラクションに既に魅了されていました。
あなたの最近のプロジェクトの1つは、来館者が何を尋ねるかを予測する博物館用のチャットボットインターフェースを構築することでした。詳細を説明してください。
博物館のチャットボットに質問回答機能を統合するために、多くの質問を収集し、それらを使用してシステムの質問回答能力を向上させました。これは、質問とプロジェクトパートナーのLinon Medienから受け取った回答資料をカテゴリ化することで実現しました。Linon Medienは、展示会向けの音声およびテキストコンテンツの制作を専門とする会社です。
あなたのチームは、コンテンツタイプの注釈が精度を向上させることも発見しました。注釈によってどのような精度の違いが見られますか?
コンテンツタイプの注釈は、チャットボットの自然言語理解の全体的な精度を向上させました。これは、追加の注釈により、システムがより正確な回答を提供できることを意味します。
会話AIを構築する際の主な課題は何ですか?
そのデータなしでは、ほとんどの場合、会話AIインターフェースを開発するプロセスは、会話を模倣するスクリプト化された体験を提供する必要がありますが、それらは静的であり、非常に自然ではありません。もう1つの課題は、会話AIインターフェースを開発するプロセスが、システムが使用される特定の分野での専門知識を必要とすることです。会話デザインの専門家とドメインの専門家之间で必要な情報を共有することは、ユーザーセンター設計方法の追加の専門家のサポートを必要とする場合があります。
あなたのユーザーフレンドリーなチャットボットと会話UIを構築するアプローチは何ですか?
私たちは、ユーザーセンター設計のパラダイムに厳密に従います。これは、システムがまだ利用できない初期のプロジェクト段階で、顧客やユーザーと関わることを意味します。私たちは、フォーカスグループとデータ収集から始め、ステークホルダーが開発の初期段階でシステムのバリアントをレビューするようにします。
あなたのChatGPTとGPT-4に対する見解は何ですか?何かを別の方法で行うことはありますか?
現在、ChatGPTとGPT-4をデータ生成ツールとして使用しています。ただし、これらの製品のクローズド性を、私たちの研究プロジェクトでの使用を通じてサポートすることを避けようとします。同等のオープンソースモデルが近い将来利用可能になることを期待しています。
あなたは、Group futuristaが主催するFuture of Chatbots & Conversational AI Summitで話すことになりました。そこで何について話す予定ですか?
ユーザーエクスペリエンスと会話AIのつながりについて話す予定です。ユーザーセンター設計、データ駆動型ユーザーセンター実装、会話UIの評価に焦点を当てます。
素晴らしいインタビュー、ありがとうございます。ステファン・シャファーの話を聞きたい読者は、Group futuristaが主催するFuture of Chatbots & Conversational AI Summitに参加することをお勧めします。












