インタビュー

タイラー・ワイツマン、Speechifyの共同創設者兼AI担当 – インタビュー・シリーズ

mm
Unite.AI を Google の優先ソースに追加

タイラー・ワイツマンは、Speechifyの共同創設者、AI担当、社長です。Speechifyは、世界で1番のテキスト・トゥ・スピーチ・アプリで、100,000以上の5つ星レビューを獲得しています。ワイツマンはスタンフォード大学の数学科を卒業し、コンピューター・サイエンスのAIコースで修士号を取得しました。また、Inc. Magazineのトップ50の起業家に選ばれ、Business Insider、TechCrunch、LifeHacker、CBSなどの媒体に登場しています。ワイツマンの修士論文は、AIとテキスト・トゥ・スピーチに関する研究で、最終的な論文のタイトルは「CloneBot:パーソナライズド・ダイアログ・レスポンス・予測」でした。

あなたは9歳の時にコーディングを始めました。コンピューター・サイエンスに興味を持ったきっかけは何ですか?

子供の頃、ドラゴンボールZが大好きで、自分でアニメーションを作りたいと思いました。アドビ・フラッシュとフォトショップを学び、自分が作ったゴクウのアニメーションをファン・ウェブページにアップしました。すぐにシステムとアルゴリズムについて学び、プログラミングができることを知った時はとても楽しかったです。ただの趣味のように思っていました。

(ADBE )

12歳の時にiPhoneアプリの開発を始めました。その頃のアプリは何ですか?

一つのアプリはBlack SMSで、ユーザーが暗号化されたテキスト・メッセージを送ることができます。もう一つのアプリはFrontbackで、ユーザーが自分と向こう側の写真を同時に撮ることができます。

スタンフォード大学での研究についてお話しください。自然言語処理とスピーチ・シンセシスに関する研究でしたね。

私の研究は、トランスフォーマー・ネットワークの多様な用途を網羅し、言語生成モデル、ポスト・タグ付け、句読点予測、テキスト・トゥ・スピーチなどを含みました。モバイル・CPU向けのニューラル・ネットワークの推論を最適化することが主な焦点でした。これは、Speechifyのオフライン・ボイスに直接翻訳され、エアプレーン・モードでも動作します。

Speechifyの創設ストーリーを教えてください。

私は片目が不自由で、弟のクリフはディスレクシアです。私たちは、学校で勉強するために、幼い頃からオーディオブックやテキスト・トゥ・スピーチ・オーディオ・テクノロジーを使用してきました。技術製品を使用するようになってから、Webやモバイルでより良いテキスト・トゥ・スピーチ・アプリを作る機会があることを実感しました。そこで、Speechifyを作り始めました。

Speechifyで使用されているさまざまなマシン・ラーニング・テクノロジーについて教えてください。

私たちは、先進的な生成アーキテクチャー、トランスフォーマー、コンフォーマー、ラージ・スケール・プレトレーニング、分散トレーニング、グラディエント・アキュムレーション、オート・エンコード・ラテント・スペース、ディフュージョン、敵対的ネットワーク、言語モデルなどの最先端の技術を採用しています。さらに、音素化、ピッチ、感情などの特徴処理技術を使用して、スピーチをよりよくモデル化しています。

テキスト・トゥ・スピーチ・アプリを作る上での課題について教えてください。

一つの大きな課題は、人間の声のような、高品質のボイスを作ることです。私たちの目標は、ユーザーがSpeechifyのボイスと人間の声の違いを感じないようにすることです。もう一つの課題は、AIモデルを数百万のユーザーに配布することです。高品質のAIボイスを作ることは一つのことですが、ユーザーがそれらを実際に使用するようにすることは別の挑戦です。

Speechifyはアプリ・ストアで1位を獲得しています。この成功の要因は何ですか?

私たちは、ユーザーが必要とする読み物を聞くための最高の製品を作ったと考えています。学生、職業人、娯楽のために読む人など、誰でも簡単にコンテンツにアクセスできるようにしています。私たちは、セレブのスヌープ・ドッグのような最高のボイスを提供し、ユーザーが簡単にコンテンツをアップロードしてアクセスできるようにしています。また、Speechifyのエコシステム全体でユーザー・エクスペリエンスをシームレスに保っています。例えば、コンピューターで記事を聞き始めて、携帯電話で続けて聞くことができます。

このアプリの主なユース・ケースは何ですか?

Speechifyのジェネレーティブ・AIは、学生が宿題を速く終わらせたい人、ディスレクシアやADHDのある人、視力の低い高齢者、読書が好きだが時間がない人、聴覚学習者など、多くの人々の実際の問題を解決しています。

AIの将来についてのあなたのビジョンは何ですか?

私たちは、AI、特にAIテキスト・トゥ・スピーチ・ボイスを使用して、収入レベル、学習の違い、地理、言語に関係なく、学習の障壁を排除したいと思っています。私たちは、AIを社会のためのツールと見なし、教育の向上を通じて人間の生活の質を高めることを目指しています。

素晴らしいインタビュー、詳しく知りたい読者はSpeechifyを訪れてください。

アントワーヌは、Unite.AIのビジョナリーレーダーであり共同創設者です。彼は、AIとロボティクスの未来を形作り、推進するための不屈の情熱に駆り立てられています。シリアルエントレプレナーである彼は、AIが電気と同様に社会に大きな変革をもたらすと信じており、破壊的な技術とAGIの可能性について語ることがよくあります。

彼はフューチャリストとして、これらのイノベーションが私たちの世界をどのように形作るかを探求することに尽力しています。さらに、彼はSecurities.ioの創設者であり、未来を再定義し、全セクターを再構築する最先端技術への投資に焦点を当てたプラットフォームです。