Фінансування

Колишні дослідники Apple – Nuance Labs – залучили $50 млн Серії А за підтримки Nvidia

mm
Додайте Unite.AI до бажаних джерел у Google

Nuance Labs, сеатлівська дослідницька лабораторія штучного інтелекту, заснована колишніми дослідниками Apple зі ступенем PhD, оголосила про інвестиції у розмірі 50 мільйонів доларів у рамках Серії А 14 вересня 2026 року, очолювані поверненим інвестором Lightspeed Venture Partners, з метою розробки єдиної фундаментальної моделі для людської розмови та вираження.

Повернені інвестори Accel і South Park Commons взяли участь разом з новими інвесторами NVIDIA та Define Ventures. портфоліо Lightspeed зазначає, що фірма вперше інвестувала в Nuance Labs на етапі seed у 2025 році, коли компанія була заснована, і перераховує партнерів Guru Chahal і Nnamdi Iregbulem у компанії.

Nuance Labs заявила, що фінансування прискорить розробку моделі, розширить дослідницьку команду та підтриматиме перший публічний дослідницький прев’ю. Компанія наймає дослідників і інженерів у сферах моделювання, даних, оцінки, інференції та реального часу обслуговування.

Одна повнодуплексна модель замість конвеєра

У оголошенні стверджується, що голосовий ШІ розвивався, тоді як ШІ для спілкування віч-на-віч не розвивався, оскільки існуючі системи аватарів складаються з окремих компонентів. За описом компанії, мова транскрибуються, велика мовна модель вирішує, що сказати, голос озвучує це, а обличчя анімовано у відповідності. Nuance Labs зазначає, що такі передавання знімають людський шар розмови та додають затримку і розірваність, створюючи аватари, які залишаються замороженими, коли людина говорить, перебивають користувача або не встигають.

Nuance Labs стверджує, що її модель сприймає та генерує нативно як єдина повнодуплексна система: аудіовізуальне сприйняття користувача надходить, одночасно надходить аудіовізуальна відповідь, тому система може через вербальні та невербальні сигнали показувати, що вона слідує, поки людина ще говорить. Компанія описує модель як сприймаючу слова, тон, погляд, жести та темп; відповідаючу в режимі реального часу за допомогою мімічних та голосових виразів; і навчаючуся на тому, як люди дійсно поводяться у розмові, з вбудованою реакцією в реальному часі в архітектурі, а не як надбудову.

Компанія також стверджує, що ШІ, який бачить лише транскрипт, працює з частковою картиною того, чого користувач хоче, і що люди говорять більше і вільніше, коли ШІ показує, що слідує за ними. сторінка About компанії характеризує систему як перший у своєму роді аудіовізуальний модель, яка бачить, чує, мислить, говорить і виражається в той самий момент, у реальному часі. Lightspeed описує Nuance Labs у своєму портфоліо як створюючу модель фундаментального людського інтелекту в реальному часі, що додає соціальний та емоційний інтелект голосу, обличчя та тіла.

Засновницька команда та цільові застосування

Nuance Labs була заснована Фанчанґом Ма, Едвардом Чжаном та Карреном Янгом і має штаб-квартиру в Сіетлі. За даними оголошення, засновницька команда провела роки в Apple, працюючи над тим, як машини сприймають і відтворюють людей, де точне відтворення особи для телеприсутності залишалося викликом, не кажучи вже про відстеження взаємодії вербальних і невербальних сигналів у живій розмові. Засновники створили компанію, щоб зрозуміти та створити людську розмову та вираження з аудіо- та відеосигналів нативно в одній моделі, а не збираючи компоненти транскрипції, мови, мовлення та анімації, які не були розроблені для спільної роботи.

Сторінка About компанії перераховує Ма як співзасновника та CEO, Чжана як співзасновника та CTO, а Янг як співзасновника та головного вченого, з Ясером Шейхом у ролі радника. Вона описує персонал як дослідницьких вчених та інженерів, які публікувалися на провідних конференціях і випускали продукти машинного навчання з наднизькою затримкою для мільйонів користувачів.

У випуску названо продажі та обслуговування клієнтів, коучинг, професійне навчання та освіту як сфери, у яких, за словами компанії, вираження стимулює результати, а ШІ працює разом з людьми.

Заяви керівництва та інвесторів

У оголошення Серії А Ма сказав, що аватари ніколи не виглядали природньо, тому що люди змушені були змінювати спосіб спілкування, щоб відповідати машині, а не навпаки, щоб машина адаптувалася до них. “Ось що ми створюємо в Nuance Labs: ШІ, який розуміє безліч способів, якими ми виражаємо себе, і відповідає так, як це робить людина, у моменті”, – сказав він.

Ннамді Ірегбулем, партнер Lightspeed Venture Partners, зазначив, що Nuance Labs створює інтерфейс, який може бачити та реагувати на людину так, як це роблять люди. Він оцінив поєднання технічної глибини та операційного досвіду засновницької команди та сказав, що фірма бачить модель як фундаментальний шар для продуктів ШІ.

Nuance Labs планує відкрити дослідницьке прев’ю для широкої публіки пізніше цього року, з доступом через список очікування на своєму веб‑сайті.

Еван Мерсер - кореспондент, створений штучним інтелектом, у Unite.AI, який висвітлює стартапи штучного інтелекту,风险 капітал та динаміку фінансування, що формують наступне покоління технологічних компаній. Його репортажі зосереджені на інноваціях на ранній стадії, потоках капіталу та стратегічних рішеннях, які приймають засновники та інвестори, коли компанії штучного інтелекту розширюються від концепції до глобального впливу.
З стратегічним та аналітичним підходом Еван вивчає раунди фінансування, позиціонування на ринку та нові тенденції в екосистемі стартапів штучного інтелекту. Він відстежує, як风险 капітал, корпоративні інвестиції та публічні ринки перетинаються з проривами в галузі штучного інтелекту, розрізняючи довгострокові сигнали від короткострокової гіпері.
Статті, написані Еваном Мерсером, створені штучним інтелектом і відредаговані редакційною командою Unite.AI для забезпечення точності, контексту та відповідальної висвітлення глобального ландшафту інвестицій у штучний інтелект