Finanzierung

KI-Text-to-Speech-Unternehmen WellSaid Labs gibt 10-Millionen-Dollar-Finanzierungsrunde bekannt

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

Das KI-Text-to-Speech-Technologie-Unternehmen WellSaid Labs hat eine 10-Millionen-Dollar-Serie-A-Runde angekündigt. Die Runde wurde von FUSE angeführt, zusammen mit dem vorherigen Investor Voyager, Qualcomm (QCOM ) Ventures LLC und GoodFriends.

Laut WellSaid werden die Mittel verwendet, um die KI- und Produktinnovation weiter voranzutreiben, die Vertriebsfunktionen zu skalieren und das Team des Unternehmens zu vergrößern.

Das Unternehmen zielt darauf ab, Unternehmen und Marken mit den besten Text-to-Speech-(TTS)-Dienstleistungen zu bieten und ermöglicht es Content-Erstellern und Produktteams, ansprechende Sprachinhalte für verschiedene Anwendungen wie Streaming-Dienste, Radio, programatische Werbung, digitales Marketing und Unternehmensschulungsinhalte zu entwickeln.

Laut der Pressemitteilung des Unternehmens hat WellSaid “TTS so konzipiert, dass es die schwierigsten Content-Entwicklungsprobleme von Unternehmen löst und eine schnelle Möglichkeit für Content-Ersteller bietet, alle ihre gewünschten Inhalte in einer konsistenten Stimme zu entwickeln, die ihre Marke repräsentiert”.

WellSaid Labs verfügt über eine Voice-Avatar-Bibliothek, die Zugang zu verschiedenen Stilen und Tönen bietet, und Marken können ihre eigenen KI-Voice-Avatars mit ihrem eigenen Aussehen, Stil und ihrer Einzigartigkeit entwickeln.

Cameron Borumand ist General Partner bei FUSE.

“Einfach und klar, WellSaid ist die Zukunft der Content-Erstellung für die Stimme. Deshalb nutzen Tausende von Kunden das Produkt täglich mit einer atemberaubenden Bottom-up-Adoption. Matt und Michael haben ein weltklasse-Team zusammengestellt und wir sind begeistert, Teil der WellSaid-Reise zu sein”, sagte Borumand.

Natürliche Sprache aus Text

Eine der größten Herausforderungen auf dem Gebiet der KI ist die Entwicklung von natürlicher Sprache aus Text, an der Forscher seit Jahrzehnten arbeiten. WellSaid Labs hat in den letzten drei Jahren seine eigene Lösung entwickelt und Durchbrüche in Qualität, Geschwindigkeit und Zuverlässigkeit erzielt.

Das Unternehmen gab im Juni 2020 bekannt, dass seine Text-to-Speech-Technologie als erste die menschliche Parität für Natürlichkeit bei kurzen Audio-Clips über multiple Stimmen erreicht hat.

Matt Hocking ist CEO von WellSaid Labs.

“Wir haben AI-Stimme zum Toolkit von Tausenden von Content-Erstellern und ihren Teams hinzugefügt”, sagte Hocking. “Unsere menschliche Parität-KI-Stimme kann schneller als in Echtzeit produziert und auf Abruf aktualisiert werden. Damit eröffnen sich neue und aufregende Möglichkeiten, ‘Stimme’ zu verwenden, wo sie bisher nicht für möglich gehalten wurde. AI-Stimme stellt sicher, dass jede Produktion effizient und skaliert erstellt und aktualisiert werden kann.”

Worte der Investoren

James Newell ist Teil des Teams bei Voyager Capital.

“Content-Ersteller oder Produkt-Erlebnis-Designer waren früher mit schwierigen Kompromissen zwischen Qualität und Skalierbarkeit bei der Verwendung von TTS-Tools oder menschlicher Stimme konfrontiert. WellSaid’s unglaubliche Stimmen, die über eine Studio-Anwendung oder eine skalierbare API zugänglich sind, eliminieren die Notwendigkeit, zwischen natürlicher, lebensechter Sprache oder unendlich skalierbarer und leicht editierbarer Sprachinhalten zu wählen. WellSaid bietet beides und liefert es, wie Ihr Team es bevorzugt”, sagte Newell. “Kreative Teams haben festgestellt, dass es extrem nützlich ist, wenn sie mehrere hochwertige Inhalte in einer konsistenten Stimme in Stunden anstelle von Wochen produzieren müssen.”

Carlos Kokron ist Vice President bei Qualcomm Ventures Americas.

“Die jüngsten Entwicklungen in der TTS-Technologie mit generativer KI haben es ermöglicht, synthetische Stimmen sehr menschlich klingen zu lassen und finden spannende neue Anwendungen für die Stimme, einschließlich E-Learning, Werbung und Nachrichtenleser”, sagte Kokron. “WellSaid Labs bietet ein branchenführendes Produkt, das hochgenaue menschliche Stimmen generiert. Wir freuen uns darauf, mit WellSaid Labs zusammenzuarbeiten, um die Creator-Economy mit menschlicher Parität-KI-Stimmen über mobile und IoT-Geräte zu unterstützen.”

Dave Gilboa ist Teil des Teams bei Good Friends und Co-CEO von Warby Parker (WRBY ).

“WellSaid’s Team hat tiefgreifende technische Expertise angewendet, um eine Plattform zu entwickeln, die die einfache Erstellung und Bearbeitung von unglaublich lebensechten Audio-Inhalten ermöglicht. Wir sehen ein bedeutendes Wachstumspotenzial bei der Verwendung von hochwertigem Audio, um Marken die Möglichkeit zu geben, mit Kunden zu kommunizieren und Content-Erstellern die Möglichkeit zu geben, mit ihrem Publikum zu interagieren”, sagte Gilboa.

Produktentwickler können auf die Kern-KI-Engine von WellSaid Labs über Echtzeit-APIs zugreifen, was es ihnen ermöglicht, digitale Erlebnisse mit skalierbarer Sprachinfrastruktur zu unterstützen. Kreative können die verschiedenen Barrieren und Komplexitäten überwinden, die in herkömmlichen Text-to-Speech-Technologien gefunden werden.

Erfahren Sie mehr über WellSaid Labs und hören Sie sich die verschiedenen KI-Stimmen des Unternehmens hier an.

Alex McFarland ist ein KI-Journalist und Schriftsteller, der die neuesten Entwicklungen im Bereich der künstlichen Intelligenz erforscht. Er hat mit zahlreichen KI-Startups und Veröffentlichungen weltweit zusammengearbeitet.