インタビュー

ウェルセイドラボスのマット・ホッキング氏 – インタビュー・シリーズ

mm
Unite.AI を Google の優先ソースに追加

マット・ホッキングは、企業向けのAIボイスジェネレーターであるウェルセイドラボスの共同創設者です。彼は15年以上の経験を持つリーダーであり、大規模なテクノロジー・ソリューションの提供に従事しています。

あなたの背景は起業家精神が強いようです。AIに初めて関わるきっかけは何でしたか?

私は常に起業家精神を持っているつもりでいます。大学を卒業して最初のビジネスを立ち上げて以来、多くのスタートアップ企業と関わってきました。多くの優れた創業者と出会い、彼らのアイデアを支援する機会を持つことができました。AIは私にとって新しい分野でしたが、AI2での経験を通じて、研究と新しい進歩を応用する機会を持つことができました。私の目標は、現実のビジネスを開発することです。AIは、将来、多くの機会と効率を創出する可能性を持っています。

ウェルセイドラボスのアイデアはどうやって生まれたのでしょうか?あなたはエントレプレナー・イン・レジデンスとしてアレン・インスティテュート・フォー・AIに参加していたときでしたね。

2018年にアレン・インスティテュート・フォー・AIのエントレプレナー・イン・レジデンスに参加しました。世界で最も革新的なインキュベーターであるAI2では、AIの最先端の研究を応用して、問題を解決する製品を開発しています。私のデザインとテクノロジーの背景から、創造的な分野に興味を持っています。AIブームの時代に、創造性とAIを結びつける方法を探していました。マイケル・ペトロチュク(ウェルセイドラボスの共同創設者兼CTO)と出会い、彼の研究成果を見て、人間と同等のテキスト・ツー・スピーチ(TTS)技術の価値を認識しました。私たちの製品と他の多くのアプリケーションや業界に大きな影響を与えることができると考えました。

ウェルセイドラボスは、AIボイスオーバー・スペースで声優と協力する数少ない企業の1つです。なぜ声優と協力することが重要だと考えたのでしょうか?

私たちの答えは2つあります。まず、プロの声優の能力を補完するソリューションを開発したいと思っていました。二つ目は、製品の品質を高めるために、人間の声の質を高くしたいと思っていました。私たちの声優は、長期的なパートナーであり、声データとその後のコンテンツの使用に対して報酬と収入シェアを受け取ります。私たちは、声優と協力して、最高の品質の製品を開発したいと思っています。

最高の品質の製品を提供するために、データの質を厳格に管理しています。私たちのディープ・ラーニング・モデルは、人間の声の特徴を学習し、自然なスピーチを生成するように設計されています。私たちの声優は、声データを提供するために協力してくれます。彼らは、声データの使用に対して報酬と収入シェアを受け取ります。私たちは、声優と協力して、最高の品質の製品を開発したいと思っています。

ウェルセイドラボスは、倫理的なAIボイス・プラットフォームを目指しています。なぜAIの倫理が重要だと考えるのでしょうか?

AIの採用が増え、主流になるにつれ、有害な使用例や悪い行為に対する懸念が高まっています。AIボイスも例外ではありません。毎日、有名人や政治家の声が偽造されて広告や政治目的で使用されていることが報道されています。正式な連邦規制はまだ発展途上ですが、悪意のある行為や使用を検出して対策することは難しくなります。

AI2での経験から、AIの倫理的な側面を考慮することが重要であることを学びました。私たちが開発するAIスピーチ・テクノロジーには、同意、プライバシー、安全性に関する重大な責任があります。私たちは、テクノロジーを安全に開発し、倫理的な懸念に対処し、合成声の将来の開発の基礎を築く必要があります。私たちは、テクノロジーを責任を持って開発し、誤った道を歩まないために、倫理的な基準を設ける必要があります。

ウェルセイドラボスは、AIボイス・プラットフォームをどのように開発していますか?

ウェルセイドラボスは、倫理的なイノベーションにコミットしています。私たちは、信頼と透明性を重視し、インハウスのデータ・モデル、明示的な同意要件、コンテンツ・モデレーション・プログラム、ブランド保護への取り組みを通じて、中央集権的な信頼と透明性を実現しています。私たちは、責任あるAIの原則に基づいて、設計と決定を下しています。私たちの倫理コードは、説明責任、透明性、プライバシーとセキュリティ、公平性を表しています。

説明責任: 私たちは、有害、憎悪、詐欺、または暴力の扇動を目的としたコンテンツの使用を禁止しています。私たちの信頼と安全チームは、厳格なコンテンツ・モデレーション・プログラムを通じて、これらの基準を維持しています。

透明性: 私たちは、合成声の作成前に、明示的な同意を求めます。ユーザーは、明示的な同意なしに、有名人や政治家の声データをアップロードして、声のクローンを作成することはできません。

プライバシーとセキュリティ: 私たちは、声優のアイデンティティを保護し、ストック・イメージとエイリアスを使用して、合成声の代表としています。私たちは、声優に、ウェルセイドラボスまたは他の合成声会社との関連性を共有する際に、注意を払うよう奨励しています。

公平性: 私たちは、声データを提供する声優に、報酬と収入シェアを提供しています。私たちは、知的財産権を尊重し、ユーザーまたは声優が提供するコンテンツの所有権を主張しません。私たちは、誠実さ、公平性、透明性を重視し、合成スピーチ・テクノロジーが責任を持って、倫理的に使用されることを保証しています。

ウェルセイドラボスは、AIボイス・ジェネレーターを開発する上で、どのような課題に直面していますか?

AIボイス・テクノロジーの開発は、プロデューサーと消費者にとって、新しい一連の課題を生み出しています。主な課題の1つは、AIセクターのノイズとハイプに惑わされないことです。多くの組織は、短期的なAIボイスオーバー開発に注力しています。私たちは、中央的な倫理原則と真実性に基づいて、すべての人に声をかけたいと思っています。この真実性への取り組みは、テクノロジーの開発と展開を遅くする可能性がありますが、ウェルセイドラボスの声とデータの安全性とセキュリティを確保します。

将来的に、ジェネレーティブAIボイスの未来はどうなるのでしょうか?

長い間、AIスピーチ・テクノロジーは、高品質のコンテンツを大規模に生成することができませんでした。オーディオ・テクノロジーが高価な機器やハードウェアを必要としなくなった今、すべての書き込みコンテンツをオーディオ形式で生成して、エンゲージメントのある、マルチモーダルな体験を作成することができます。

今日、AIボイスは人間のようなオーディオを生成し、デジタル・ストーリーテリングをよりアクセスしやすく、自然なものにするために必要なニュアンスを捉えることができます。ジェネレーティブAIボイスの将来は、すべての側面にわたるオーディオ体験を提供することになります。テクノロジーが進化するにつれ、人間と機械が生成するスピーチの境界がさらに曖昧になるでしょう。ビジネス、コミュニケーション、 アクセシビリティ、そして私たちが周囲の世界と関わる方法に、新しい扉が開かれるでしょう。

企業は、AIボイス・インターフェイスで強化されたパーソナライゼーションを見つけるでしょう。バーチャル・アシスタントとのやり取りをより没入感のあるものにするために、これらのインターフェイスを使用します。コンテンツの作成、広告、製品マーケティング、ニュースのナレーション、ポッドキャスト、オーディオブック、その他のマルチメディアでは、エンゲージメントのあるコンテンツを開発するツールを使用して、効率性が向上し、収益が増加するでしょう。プロダクション・チームは、ブランドのニーズに合わせてカスタマイズされた声や、リスナーに合わせて最適化された声で、シンセティック・ボイスを使用することで大きな利益を得るでしょう。

AIの登場以前、TTSテクノロジーは、人間の感情、イントネーション、発音の能力が欠けていました。人間の声の特徴を学習し、自然なスピーチを生成するAIパワード・TTSは、より没入感のある体験を提供します。

人間のようなスピーチ能力を達成することは、旅でしたが、達成した今、AIボイスが企業にリアルなビジネス・バリューを創造する全体的な範囲を目撃しています。

素晴らしいインタビュー、詳しく知りたい読者は、ウェルセイドラボスを訪れてください。

アントワーヌは、Unite.AIのビジョナリーレーダーであり共同創設者です。彼は、AIとロボティクスの未来を形作り、推進するための不屈の情熱に駆り立てられています。シリアルエントレプレナーである彼は、AIが電気と同様に社会に大きな変革をもたらすと信じており、破壊的な技術とAGIの可能性について語ることがよくあります。

彼はフューチャリストとして、これらのイノベーションが私たちの世界をどのように形作るかを探求することに尽力しています。さらに、彼はSecurities.ioの創設者であり、未来を再定義し、全セクターを再構築する最先端技術への投資に焦点を当てたプラットフォームです。