Лідери думок
Дитячий AI, який передував ChatGPT – тепер перемагає Google у розпізнаванні дитячої мови

Ринок мовних навчальних програм для дітей став густим і все частіше піддається перевірці. На минулому тижні некомерційна організація Common Sense Media запустила Інститут безпеки штучного інтелекту для молоді, перший незалежний лабораторний центр, який фінансується у розмірі 20 мільйонів доларів США на рік для проведення стрес-тестів продуктів штучного інтелекту для дітей – тиск, який прибуває саме тоді, коли штучний інтелект вже складає 33,5% доходу серед цифрових мовних навчальних продуктів.
У той же час сегмент дітей всередині цього ринку очікується зростання з 2,38 мільярдів доларів США у 2026 році до 5,17 мільярдів доларів США до 2035 року. Чітко видно, що гроші рухаються паралельно з інтеграцією штучного інтелекту – але так само і нагляд.
Дослідження Університету Колорадо про Інститут штучного інтелекту задокументувало прогалину досить чітко: точність розпізнавання мови суттєво нижча для дітей, ніж для дорослих, оскільки більшість комерційних систем тренуються на чистому аудіо від дорослих дикторів – часто зачитують зі сценаріїв.
Стаття 2024 року підтверджує, чому: голоси дітей включають швидкі, непередбачувані зміни тональності, артикуляції та розвитку слів, що призводить до того, що моделі, треновані на дорослих, спотикаються.
І, на практиці, це означає, що шестирічному дитині, яка вивчає англійську, система неправильно чує її, не реагує або, що ще гірше, реагує на зовсім іншу річ. Дитина втрачає інтерес до навчання; батьки втрачають гроші.
Це проблема, над якою Іван Крюков почав працювати у 2018 році, за чотири роки до того, як великі мовні моделі стали основною темою розмов.
Знайома початкова точка
Вхід Крюкова в освітній технологічний простір був особистим. Коли його сім’я переїхала з Сибіру до Каліфорнії у 2014 році, його дочка Софія була чотири роки і мала труднощі з вивченням англійської мови в дитячому саду. Він спробував усі доступні інструменти і знайшов ті самі прогалини у всіх них.
“Вони часто включали читання, яке вона ще не могла робити, вони відчувались як робота, і не пропонували практику мовлення – критично важливо для дітей, які вивчають нову мову”, – сказав він Unite AI.
Потім він звернувся до живих онлайн-тренерів, почав записувати сесії і помітив щось, чого він не очікував. “Вчителі буквально читали зі своїх екранів”, – сказав він, і багато з них не були сертифікованими педагогами; кожна сесія коштувала 15-20 доларів.
Маючи досвід роботи з штучним інтелектом, Крюков зрозумів ситуацію досить просто: “Було зрозуміло мені, що, ймовірно, 80% цієї роботи можна було б зробити за допомогою віртуального, розмовного штучного інтелекту і розпізнавання мови. Це також суттєво демократизувало б ринок, оскільки це було дуже дорого”,
“Ідея полягала в тому, щоб надати місяць навчання за ціну однієї сесії з тренером”, – додав він. Ця ідея стала Buddy.ai.
Близько 10,8 мільйонів маленьких дітей – 32% усіх дітей у США молодше дев’яти років – є двомовними дітьми (DLLs), з至少 одним батьком, який говорить іншою мовою, ніж англійська, вдома, згідно з даними Інституту міграційної політики. З 2000 року ця популяція зростала на 24%, і зараз DLLs складають понад 20% населення молодих дітей у 24 штатах і Вашингтоні.
Ці сім’ї, ймовірно, будуть шукати те, що пропонують платформи типу Buddy.ai – і найменше мають змогу отримати доступ до високоякісних програм раннього дитинства, з 43% сімей, які живуть у низькодоходних домогосподарствах порівняно з 33% дітей, які не належать до DLL.
Комерційна логіка, тоді, чітка. Найбільш складне питання полягає в тому, чи технологія справді працює – і тут підхід Buddy.ai суттєво відрізняється від більшості конкурентів.
Створений спеціально, а не перероблений
Відмінність, яку Крюков проводить між будівництвом для дітей та адаптацією для них, архітектурна, а не косметична. “Будівництво штучного інтелекту з нуля для дітей означає, що ми обмежуємо і перебудовуємо кожний шар стеку навколо голосів дітей, поведінки, регулювання і уваги – замість того, щоб намагатися створити ‘дитячий режим’ для дорослого чат-бота”.
Основна проблема акустична. “Стек дорослих моделей штучного інтелекту припускає дорослу текстову і мовну інформацію: довгі граматичні речення, стабільну вимову і тихі середовища. Шестирічному дитині дає вам протилежне: фрагментарні вислови, неправильна вимова, крики, сильні акценти і фоновий шум”.
Розпізнавач мови Buddy.ai був тренований і продовжує тренуватися на десятках тисяч годин справжніх голосів дітей різних віків, акцентів і шумних домашніх середовищ. Стартап стверджує, що зараз він перевершує загальний розпізнавач мови Google для дітей, що має більше переконливості, ніж може здатися на перший погляд: спеціальна підготовка на цільовій популяції постійно перевершує підготовку на даних дорослих.
Розмовний шар також створений спеціально. Кожна сесія працює всередині того, що Крюков описує як “управляющий шар” – система, яка усвідомлює навчальну програму, має план сесії, визначені теми і відстеження цілей. Модель мови працює як один компонент всередині цієї структури, а не сама за себе.
Якщо дитина відхиляється від курсу, система перенаправляє; немає відкритого дрейфу в будь-яку відкриту бесіду, яку може створити загальний розпізнавач мови. “Є план сесії, дозволені теми, відстеження цілей і код, який керує, перенаправляє або закінчує розмову, коли це потрібно – так, щоб шестирічному дитині ніколи не доводилося просто впасти в відкриту інтернет-розмову”.
Конфіденційність також розглядається як архітектурне обмеження, а не тільки політика – але це також тихо стало конкурентним. Через те, що правило захисту конфіденційності дітей (COPPA) забороняє збір даних голосу дітей без згоди батьків, найбільша публічно доступна база даних голосів дітей складає лише кілька сотень годин.
Buddy.ai накопичив десятки тисяч годин справжніх голосів дітей різних віків, акцентів і шумних домашніх середовищ. Більшість пішли по легшому шляху адаптації дорослих моделей штучного інтелекту для дітей, а не побудови з нуля, але цей короткий шлях тепер став ліабілітом.
У випадку з Buddy.ai всі інтерференції працюють на інфраструктурі платформи, голос дитини обробляється в реальному часі і викидається, перш ніж батьки навіть подумають про це, і жодні розмови не передаються через комерційні API штучного інтелекту, згідно з Крюковим.
“Ми дуже явно кажемо батькам, що ми збираємо, чому і як вони можуть видалити це – прозорість так само важлива, як і сама технологія”, – підкреслив Крюков.
Від часу запуску ChitChat, свого останнього великого оновлення на ринку США, яке вводить більш просунуту вільну розмову, компанія повідомляє, що американські студенти завершили в 7,7 разів більше завдань за той самий період, ніж у попередньому році.
Глобально середнє кількість завдань, виконаних на місяць, зросла в 3,5 рази за рік.
Крюков відкритий щодо обмежень тих цифр. “Розробка дослідницьких робіт, які могли б кількісно виміряти навчання учнів, – це щось, чого ми сподіваємося досягти в найближчому майбутньому”, – сказав він. Наразі ж доказова база спирається на зворотній зв’язок користувачів, дані про взаємодію з продуктом і визнання галузевих нагород.
Використання, яке ніхто не планував
Можливо, найбільш показовим моментом у історії Buddy.ai є той, який прибув без запрошення: без жодної цільової реклами батьки дітей з аутизмом і порушеннями мови почали з’являтися в даних опитування як одні з найбільш активних користувачів платформи.
“Ми були спочатку досить здивовані. Це точно підкреслило, що були інші способи, у яких Buddy міг би дешево служити студентам по всьому світу”, – згадав Крюков.
Для засновника це не було просто цікавою аномалією – це вказувало на прогалину, яку продукт не був розроблений для заповнення, але, як виявилося, міг. Компанія відповіла на це, створивши спеціальний курс прикладної поведінкової аналітики (ABA).
Прогалина велика і добре задокументована. Звіт ринку 2025 року виявив, що поширеність аутизму в США становить 1 з 31 дитини сьогодні, у порівнянні з 1 з 150 у 2000 році – на тлі постійного дефіциту сертифікованих терапевтів. Для сімей без достатнього страхового покриття річна вартість терапії ABA може досягати 250 000 доларів.
Дослідження Національних інститутів охорони здоров’я (NIH) про те, чому сім’ї не отримують терапію ABA, виявили, що бар’єри були досить практичними: найбільш часто цитованими причинами були тривалі часи очікування (34%), відсутність провайдерів ABA в їхньому районі (10%) і відсутність страхового покриття терапії (10%). Дані опитування також показали, що понад половина всіх округів США не мають сертифікованих поведінкових аналітиків.
Чи AI-персонаж може бути значимою інтервенцією на клінічному рівні, залишається відкритим питанням – але як постійний, низькобюджетний, доступний інструмент для дітей на довгих чергах, його цінність легше обґрунтувати.
“Це залишається роботою в прогресі, але ми дуже горді тим, куди рухається ця ініціатива”, – сказав Крюков.
Більше питання
Ширший ринок освітніх технологій зараз повний компаній, які роблять суміжні заяви; штучний інтелект, створений спеціально, міцна архітектура; продукти, які справді викликають навчання. Насправді, глобальний ринок штучного інтелекту в освіті оцінюється у 32,27 мільярдів доларів США до 2030 року, і кожна велика компанія має стратегію для дітей.
Що відрізняє позицію Buddy.ai, це не самі заяви, а хронологія. Крюков почав працювати над розпізнаванням мови дітей ще до того, як поточна хвиля інвестицій зробила це модним, і до того, як великі мовні моделі зробили це легким для створення переконливого мовного тренера за післяобіднього часу.
Технічна інфраструктура – акустичні моделі, треновані на голосах дітей, архітектура, усвідомлена навчальною програмою, власна система аватарів – відображає майже десятирічну ітерацію над конкретною проблемою, а не швидкий поворот до модного ринку.
“За два роки Buddy буде能够 надати англійським учням практику, яку їм потрібно для просування від перших англійських слів до вільного володіння. Ми не поспішаємо, тому що ми ставимо на перше місце безпеку і конфіденційність”, – пояснив Крюков.
І підтримкою всього цього є філософія дизайну, яка йде проти зерна більшості продуктів штучного інтелекту. “Шестирічним дітям не потрібно штучний інтелект. їм потрібно персонаж і світ, частиною якого вони себе відчувають”.
Це складніше, ніж створити чат-бота з дружнім іменем. І зараз це найсильніша сторона Buddy.ai.












