Myslitelé
Dítětem orientovaný AI, který předchází ChatGPT – nyní poráží Google v rozpoznávání dětské řeči

Trh s aplikacemi pro jazykové vzdělávání dětí se stal přeplněným a stále více prověřovaným. Minulý týden nezisková organizace Common Sense Media spustila Youth AI Safety Institute, první nezávislé laboratoř, která je financována 20 miliony dolarů ročně a testuje produkty AI pro děti – tlak, který přichází právě v době, kdy AI již tvoří 33,5% příjmů z digitálních produktů pro jazykové vzdělávání.
V stejné době se segment pro děti sám o sobě odhaduje, že vzroste z 2,38 miliard dolarů v roce 2026 na 5,17 miliardy dolarů do roku 2035. Zjevně, peníze se pohybují paralelně s integrací AI – ale také s dohledem.
Výzkum z University of Colorado’s AI Institute jasně dokumentuje mezeru: přesnost rozpoznávání řeči je podstatně nižší pro děti než pro dospělé, protože většina komerčních systémů je trénována na čistém audio z dospělých mluvčích – často čtením ze scénářů.
Studie z roku 2024 potvrzuje, proč: děti mají rychlé, nepředvídatelné změny v tónu, artikulaci a vývoji slovní zásoby, což způsobuje, že modely trénované na dospělých selhávají.
A v praxi to znamená, že šestileté dítě, které se učí anglicky, dostane systém, který jej špatně slyší, nezareaguje nebo dokonce zareaguje na něco úplně jiného. Dítě ztratí zájem o učení; rodič ztratí peníze.
To je problém, na který Ivan Crewkov začal pracovat v roce 2018, čtyři roky předtím, než se velké jazykové modely staly mainstreamovou konverzací.
Známý výchozí bod
Crewkovův vstup do edtech prostoru byl osobní. Když jeho rodina přestěhovala ze Sibiře do Kalifornie v roce 2014, jeho dcera Sofia byla čtyři roky stará a měla potíže s učením angličtiny v mateřské škole. Zkusil všechny dostupné nástroje a našel stejné mezery ve všech z nich.
„Často zahrnovaly čtení, které ještě neuměla, cítila se jako práce a nenabízely mluvní praxi – kritickou pro děti, které se učí nový jazyk,“ řekl Unite AI.
Pak se obrátil na živé online učitele, začal nahrávat relace a všiml si něčeho, co neočekával. „Učitelé doslova četli ze svých obrazovek,“ řekl a mnoho z nich nebyli certifikovaní pedagogové; každá relace stála 15 až 20 dolarů.
Přicházející z pozadí AI, Crewkovova interpretace situace byla přímočará: „Bylo mi jasné, že asi 80 % této práce by mohlo být provedeno pomocí virtuálního, mluvícího AI charakteru a rozpoznávání řeči. To by také dramaticky demokratizovalo trh, protože to bylo extrémně drahé,“
„Nápad byl poskytnout měsíc učení za cenu jedné tutorovací relace,“ dodal. Ten nápad se stal Buddy.ai.
Blízko 10,8 milionu mladých dětí – 32 % všech amerických dětí mladších devíti let – jsou dvojjazyčné učící se (DLLs), s alespoň jedním rodičem, který mluví jiným jazykem než angličtinou doma, podle Migration Policy Institute. Od roku 2000 se tato populace zvýšila o 24 % a DLLs nyní tvoří více než 20 % populace mladých dětí ve 24 státech a ve Washingtonu D.C.
Tito jsou pravděpodobně rodiny, které nejvíce hledají, co platformy jako Buddy.ai nabízejí – a nejméně pravděpodobně mají stálý přístup ke kvalitním programům pro děti, s 43% žijícími v nízkopříjmových domácnostech ve srovnání s 33 % dětí, které nejsou DLL.
Komerční logika je tedy jasná. Těžší otázka je, zda technologie skutečně funguje – a zde se Buddy.ai liší od většiny konkurence.
Určené pro účel, ne upravené
Rozdíl, který Crewkov vyzdvihuje mezi budováním pro děti a úpravou pro ně, je architektonický, ne kosmetický. „Budování AI od základu pro děti znamená, že omezíme a přestavíme každý vrstvu zásobníku kolem dětských hlasů, chování, regulace a pozornosti – místo toho, abychom se snažili „dětský režim“ pro adult chatbota.“
Core problém je akustický. „Adult LLM zásobníky předpokládají dospělý text a řeč: dlouhé gramatické věty, stabilní výslovnost a tichá prostředí. Šestileté dítě vám dá opak: fragmentární výpovědi, špatná výslovnost, křik, silné akcenty a pozadí hluku.“
Buddyho rozpoznávač řeči byl trénován a neustále re-trénován na desítkách tisíc hodin skutečných dětských hlasů napříč věky, akcenty a hlučnými domácími prostředími. Startup tvrdí, že nyní překonává obecný rozpoznávač řeči Google na dětských hlasech, což má větší důvěryhodnost, než by se mohlo zdát: specifické trénování na cílové populaci konzistentně překonává trénování na dospělých datech.
Konverzační vrstva je podobně určená pro účel. Každá relace funguje uvnitř toho, co Crekov popisuje jako „řídící vrstvu“ – vzdělávací systém s plánem relace, definovanými tématy a sledováním cílů. Jazykový model funguje jako jeden komponent uvnitř této struktury, ne jako produkt sám o sobě.
Pokud dítě odbočí z kurzu, systém jej přesměruje; není žádný otevřený drift do čehokoli, co by obecný LLM mohl produkovat. „Je zde plán relace, povolená témata, sledování cílů a kód, který řídí, přesměruje nebo ukončí konverzaci, když je to potřeba – takže šestileté dítě nikdy neztratí kontrolu v otevřeném internetovém chatu.“
Privátnost je také považována za architektonickou omezení, stejně jako politiku – ale také se stala konkurenční. Protože Children’s Online Privacy Protection Rule (COPPA) zakazuje shromažďovat data dětských hlasů bez souhlasu rodičů, největší veřejně dostupná datová sada dětských hlasů činí pouze několik set hodin.
Buddy.ai nasbíral desítky tisíc hodin skutečných dětských hlasů napříč věky, akcenty a hlučnými domácími prostředími. Většina vzala snadnější cestu úpravou adult LLM pro děti místo budování od základu, ale zkratka je nyní závadou.
V případě Buddy všechny interference běží na platformě自己的 infrastruktuře, dětské hlasy jsou zpracovávány v reálném čase a jsou odstraněny, než rodiče vůbec pensarají o tom, a žádné konverzace nejsou směrovány přes komerční AI API, podle Crewkova.
„Jsme velmi explicitní s rodiči o tom, co shromažďujeme, proč a jak mohou odstranit data – transparentnost je stejně důležitá jako technologie sama,“ zdůraznil Crewkov.
Od spuštění ChitChat, jeho poslední významné aktualizace na americkém trhu, která představuje pokročilejší volnou konverzaci, společnost hlásí, že američtí studenti dokončili 7,7krát více cvičení ve stejném časovém rámci jako v předchozím roce.
Globálně se průměrný počet dokončených cvičení za měsíc zvýšil 3,5krát oproti předchozímu roku.
Crewkov je upřímný o omezeních toho, co tato čísla prokazují. „Navrhování výzkumných studií, které by mohly kvantitativně měřit učení studentů, je něco, co doufáme, že budeme moci udělat v blízké budoucnosti,“ řekl. Prozatím se však důkazní základ opírá o zpětnou vazbu uživatelů, data o zapojení produktu a uznání odvětví.
Případ, na který nikdo neplánoval
Možná nejvýznamnějším momentem v příběhu Buddy.ai je ten, který přišel nečekaně: bez cílené reklamy, rodiče dětí s autismem a poruchami řeči začali objevovat se v datech průzkumu jako nejvíce zapojení uživatelé platformy.
„Byli jsme zpočátku bastante překvapeni. To určitě ukázalo, že existují další způsoby, jakými by Buddy mohl dostupně sloužit studentům po celém světě,“ vzpomínal Crewkov.
Pro zakladatele to nebylo jen zajímavou anomálií – ukazovalo to na mezeru, kterou produkt nebyl navržen k zaplnění, ale zřejmě mohl. Společnost reagovala vytvořením speciálního kurzu Applied Behavior Analysis (ABA).
Mezera je široká a dobře zdokumentovaná. Zpráva z roku 2025 trhu zjistila, že prevalence autismu v USA je tak vysoká jako 1 z 31 dětí dnes, oproti 1 z 150 v roce 2000 – proti stálému pozadí nedostatku certifikovaných terapeutů. Pro rodiny bez dostatečného pojištění mohou roční náklady na ABA terapii dosáhnout 250 000 dolarů.
Národní instituty zdraví (NIH) výzkum o tom, proč rodiny nedostávají ABA, ukázal, že bariéry jsou překvapivě praktické: nejčastěji uváděné důvody zahrnovaly dlouhé čekací doby (34%), nedostatek poskytovatelů ABA v jejich oblasti (10%) a pojištění, které nezahrnuje terapii (10%). Data průzkumu také ukázala, že více než polovina všech okresů v USA nemá žádné certifikované behaviorální analytiky.
Je-li AI charakter významnou intervencí na klinické úrovni, zůstává otevřenou otázkou – ale jako konzistentní, nízkonákladový, na-demand nástroj pro děti na dlouhých čekacích listinách, jeho hodnota je snazší obhajit.
„To je stále práce v průběhu, ale jsme opravdu hrdí na to, kam se iniciativa ubírá,“ řekl Crewkov.
Širší otázka
Širší trh edtech je nyní plný společností, které činí sousední nároky; AI, které je určené pro účel, robustní architektura; skutečné produkty, které podporují učení. Skutečně, globální trh AI ve vzdělávání se odhaduje, že dosáhne 32,27 miliard dolarů do roku 2030, a každá hlavní hráč má strategii pro děti.
Co odlišuje Buddy.ai je ne nárok sám o sobě, ale časová osa. Crewkov začal pracovat na rozpoznávání dětské řeči dlouho předtím, než současná vlna investic učinila z toho módní téma, a předtím, než LLM učinily z něj přesvědčivě znějící jazykový tutor za odpoledne.
Technická infrastruktura – akustické modely trénované na dětských hlasech, vzdělávací architektura, proprietární avatarový systém – odráží téměř dekádu iterací na specifický problém, ne rychlý pivot směrem k horkému trhu.
„Za dva roky bude Buddy schopen poskytnout anglicky mluvícím studentům praxi, kterou potřebují k pokroku od prvních anglických slov až po plynulost. Není nám spěch, protože priorizujeme bezpečnost a privátnost,“ vysvětlil Crewkov.
A podkladem všeho je designová filozofie, která jde proti většině produktového myšlení AI. „Šestileté děti se nevracejí pro AI. Vracejí se pro charakter a svět, kterého jsou součástí.“
To je těžší věc, než replikovat chatbota s přátelským názvem. A prozatím je to Buddy.ai nejvíce hájitelná výhoda.












