ソートリーダー
チャットGPT以前から存在する子供向けAI – 現在、子供の音声認識でGoogleを上回っている

子供向けの言語学習アプリ市場は混雑し、ますます厳しくなりつつあります。先週、非営利団体のCommon Sense Mediaは、Youth AI Safety Instituteを立ち上げました。これは、年間2000万ドルで支援される、子供向けAI製品のストレステストを実施する最初の独立した研究所です。この圧力は、AIがすでにデジタル言語学習製品の収益の33.5%を占めるようになったときに到来しています。
同時に、子供向けセグメントだけが、2026年の2億3800万ドルから2035年までに5億1700万ドルに急増することが予測されています。明らかに、金銭的動きはAIの統合と並行して進行していますが、監督も同様です。
研究によると、コロラド大学のAI研究所は、子供の音声認識の精度が大人のそれよりも低いことを明らかにしました。これは、ほとんどの商用システムが、大人のスピーカーからのクリーンなオーディオでトレーニングされているためです。
2024年の論文は、子供の声が大人の声と異なることを強調しています。子供の声には、ピッチ、発音、語彙の急速な変化が含まれており、これにより、大人の音声でトレーニングされたモデルが失敗することになります。
実践的には、これは6歳の英語学習者が、システムが誤って聞き取ったり、反応しなかったり、または全く別のことを反応したりすることを意味します。子供は学習に興味を失い、親はお金を失います。
これは、イヴァン・クレフコフが2018年に取り組み始めた問題です。彼は、大規模言語モデルが一般的な話題になる4年前に取り組み始めました。
馴染みのある出発点
クレフコフのエデュテックへの参入は、個人的なものでした。2014年に彼の家族がシベリアからカリフォルニアに引っ越したとき、彼の娘ソフィアは4歳で、英語を学ぶために苦労していました。彼は利用可能なすべてのツールを試しましたが、すべてのツールに同じギャップを見つけました。
「それらは読み取りを伴うことが多く、彼女はまだ読むことができなかった、それらは仕事のように感じられ、話し方の練習を提供していませんでした。子供たちにとって、話し方の練習は、新しい言語を学ぶ上で非常に重要です」とクレフコフはUnite AIに語りました。
彼はその後、オンラインのライブチューターに切り替え、セッションを録音し始め、予想外のことが発見しました。「先生たちは実際にスクリーンから読んでいた」と彼は述べました。また、多くの先生は認定された教育者ではなく、各セッションの費用は15ドルから20ドルでした。
AIの背景から、クレフコフは状況を明確に理解しました。「80%の仕事は、仮想的な会話AIキャラクターと音声認識で行うことができるということです。これにより、市場は劇的に民主化されます。なぜなら、非常に高価だったからです」と彼は述べました。
「1回のチューター費用で1ヶ月の学習を提供するというアイデアでした」と彼は付け加えました。そのアイデアがBuddy.aiになりました。
9歳未満の全米の子供のうち約32%にあたる1080万人の幼い子供たちが、少なくとも1人の親が家で英語以外の言語を話しているため、双語学習者(DLLs)です。移民政策研究所によると、2000年以降、この人口は24%増加し、現在、24の州とワシントンD.C.の20%以上の幼い子供たちがDLLsです。
これらの家庭は、おそらく、Buddy.aiのようなプラットフォームが提供するものを探す可能性が最も高く、しかし、高品質の幼児プログラムに一貫してアクセスできない可能性も最も高いでしょう。実際に、43%が低所得世帯に住んでおり、非DLLの子供たちの33%に比べて高い割合です。
商業的な論理では、技術が実際に機能するかどうかが難しい質問です。Buddy.aiのアプローチは、競合他社とは明確に異なります。
子供向けに特別に設計されたもの
クレフコフが子供向けに設計されたものと、子供向けに改造されたものとの間で引く区別は、建築的なものであり、コスメティックなものではありません。「子供向けのAIを一から構築するということは、子供の声、行動、規制、注意力のスパンをすべてのレイヤーで制限し、再構築することを意味します。大人向けのチャットボットを『子供用』に改造するのではなく」と彼は述べました。
根本的な問題は音響的なものです。「大人向けのLLMスタックは、大人のテキストと音声、つまり長い文法的な文、安定した発音、静かな環境を前提としています。6歳の子供は、断片的な発言、発音の間違い、叫び声、強いアクセント、背景ノイズを与えます」と彼は述べました。
Buddyの音声認識システムは、年齢、方言、騒々しい家庭環境を問わず、数万時間に及ぶ子供の声でトレーニングされています。同社は、現在、子供の声での音声認識でGoogleの汎用的な音声認識を上回っていると主張しています。これは、初見では思われるよりも信頼性が高い主張です。ターゲット人口に特化してトレーニングすることは、成人データでトレーニングするよりも一貫して上回るからです。
会話レイヤーも同様に特別に設計されています。各セッションは、Buddy.aiの創設者クレフコフが「統制レイヤー」と呼ぶ、カリキュラムに基づいたシステムの中で実行されます。このシステムには、セッションプラン、定義されたトピック、目標追跡が含まれます。言語モデルは、この構造の中で動作し、製品そのものではありません。
子供が話題から外れた場合、システムは子供を誘導します。一般的なLLMが生み出す可能性のあるオープンエンドのドリフトはありません。「セッションプラン、許可されたトピック、目標追跡、会話を必要に応じてステア、リダイレクト、または終了するコードがあります。6歳の子供が、オープンエンドのインターネットチャットに陥ることはありません」と彼は述べました。
プライバシーも、建築上の制約としてだけでなく、競争上の優位性としても扱われます。しかし、COPPA(Children’s Online Privacy Protection Act)により、親の同意なしに子供の音声データを収集することは禁止されています。したがって、大規模な公開子供音声データセットは、数百時間にしかなりません。
Buddy.aiは、年齢、方言、家庭環境を問わず、数万時間に及ぶ子供の音声データを蓄積しています。大人のLLMを子供向けに改造するのではなく、ゼロから構築することを選択しましたが、これが現在、短絡であることが明らかになりました。
クレフコフによると、Buddy.aiでは、すべての干渉がプラットフォーム独自のインフラストラクチャ上で実行され、子供の音声はリアルタイムで処理され、親が気づく前に破棄され、会話は商用AI API経由でルーティングされません。
「私たちは、収集するもの、収集理由、そしてそれを削除する方法について、親たちに非常に明確です。透明性は技術そのものと同等に重要です」とクレフコフは強調しました。
最近の主要なアップデートであるChitChatを米国市場で立ち上げてから、同社は、米国での学生が同じ期間で7.7倍多くの演習を完了したと報告しています。
世界的に見ると、1ヶ月あたりの平均演習数は、前年比で3.5倍に増加しています。
クレフコフは、これらの数字が証明するものについては慎重です。「学生の学習を数量的に測定できる研究を設計することは、私たちが近い将来に希望することです」と彼は述べました。ただし、現在の証拠は、ユーザーのフィードバック、製品のエンゲージメントデータ、業界の賞賛に依存しています。
誰も計画していなかったユースケース
Buddy.aiの物語の中で、最も印象的な瞬間は、招待されなかったものです。ターゲットマーケティングなしに、自閉症や言語遅滞を持つ子供たちの親たちが、プラットフォームの最も関与度の高いユーザーとして調査データに現れ始めました。
「私たちは最初はかなり驚きました。Buddyが世界中の学生に安価にサービスを提供できる他の方法があることを強調しました」とクレフコフは思い出しました。
創設者にとって、それは単なる興味深い異常ではありませんでした。製品が設計されていないギャップを指し示していたのです。同社は、応答するために、適用された行動分析(ABA)コースを構築しました。
ギャップは広く、よく文書化されています。2025年の市場報告書によると、アメリカでの自閉症の発生率は、2000年の1万5千分の1から、1万3千分の1に上昇しています。認定されたセラピストの不足が続いている中で、自閉症治療センターの年間費用は25万ドルに達する可能性があります。
国立衛生研究所(NIH)の研究によると、家族がABAを受けられない理由は、実際にはかなり実用的です。最も一般的な理由として、待ち時間の長さ(34%)、地域にABA提供者がいないこと(10%)、および保険が治療をカバーしていないこと(10%)が挙げられました。調査データはまた、アメリカの郡の半分以上に、認定された行動分析家がいないことも示しています。
AIキャラクターが臨床レベルでの有意な介入を構成するかどうかは、未解決の疑問です。しかし、待ち時間が長い子供たちにとって、安価で、オンデマンドの練習ツールとしての価値は、より簡単に擁護できます。
「これはまだ進行中ですが、取り組みが進んでいることを誇りに思います」とクレフコフは述べました。
より大きな疑問
より広いエデュテック市場は、隣接する主張をする会社でいっぱいです。目的をもって設計されたAI、堅牢なアーキテクチャ、実際の学習を誘発する製品。実際、教育におけるAIの世界市場は、2030年までに3227億ドルに達すると推定されています。すべての主要プレーヤーには子供向けの戦略があります。
Buddy.aiの立場を区別するものは、主張そのものではなく、タイムラインです。クレフコフは、現在の投資ブームが到来する前、LLMが魅力的な音声チューターを午後に構築できるようになる前から、子供向けの音声認識に取り組み始めました。
技術的なインフラストラクチャー – 子供の声でトレーニングされた音響モデル、カリキュラムに基づいたアーキテクチャー、独自のアバターシステム – は、特定の問題に対するほぼ10年のイテレーションを反映しています。急いで市場に参入するのではなく、投資の波に乗るのでもありません。
「2年以内に、Buddyは、英語学習者が最初の英語の単語から流暢さまで進歩するために必要な練習を提供できるようになります。私たちは急いでいません。なぜなら、安全性とプライバシーを優先しているからです」とクレフコフは説明しました。
そして、すべての根底にあるのは、ほとんどのAI製品の考え方に反するデザイン哲学です。「6歳の子供たちはAIのために戻ってきません。彼らは、キャラクターと、自分が一部であると感じる世界のために戻ってきます」と彼は述べました。
「それを再現することは、フレンドリーな名前を持つチャットボットを作るよりも、はるかに難しいことです。現在、Buddy.aiの最も防御可能なエッジです」と彼は付け加えました。












