Finanziamenti

Società di text-to-speech basata sull’intelligenza artificiale WellSaid Labs annuncia un round di finanziamento da 10 milioni di dollari

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

La società di tecnologia di text-to-speech basata sull’intelligenza artificiale WellSaid Labs ha annunciato un round di finanziamento di serie A da 10 milioni di dollari. Il round è stato guidato da FUSE, insieme all’investitore precedente Voyager, Qualcomm (QCOM ) Ventures LLC e GoodFriends.

Secondo WellSaid, i fondi verranno utilizzati per avanzare ulteriormente l’innovazione dell’AI e del prodotto, scalare le funzioni di go-to-market e crescere il team della società.

La società si propone di offrire alle aziende e ai marchi i migliori servizi di text-to-speech, e consente ai creatori di contenuti e ai team di prodotto di sviluppare contenuti vocali coinvolgenti per vari utilizzi, come servizi di streaming, radio, pubblicità programmatica, marketing digitale e contenuti di formazione aziendale.

Secondo il comunicato stampa della società, WellSaid “ha progettato il text-to-speech per risolvere i problemi di sviluppo di contenuti più difficili delle aziende e offrire un modo veloce per i creatori di contenuti, grandi o piccoli, di sviluppare tutti i contenuti desiderati in una voce coerente che rappresenti il loro marchio”.

WellSaid Labs dispone di una libreria di Voice Avatar che offre l’accesso a più stili e toni, e i marchi possono sviluppare i propri Avatar vocali con la loro somiglianza, stile e unicità.

Cameron Borumand è il General Partner di FUSE.

“Semplicemente, WellSaid è il futuro della creazione di contenuti per la voce. È per questo che migliaia di clienti amano utilizzare il prodotto quotidianamente con un’adozione dal basso fuori dagli schemi. Matt e Michael hanno riunito un team di classe mondiale e non potremmo essere più entusiasti di far parte del viaggio di WellSaid”, ha detto Borumand.

Discorso naturale dal testo

Una delle sfide principali nel campo dell’intelligenza artificiale è lo sviluppo di discorsi naturali dal testo, su cui i ricercatori stanno lavorando da decenni. WellSaid Labs ha sviluppato il proprio discorso negli ultimi tre anni, realizzando importanti progressi in termini di qualità, velocità e affidabilità.

La società ha annunciato nel giugno 2020 che il suo text-to-speech è stato il primo a raggiungere la parità umana per naturalità su clip audio brevi con più voci.

Matt Hocking è il CEO di WellSaid Labs.

“Abbiamo aggiunto la voce AI alla cassetta degli attrezzi di migliaia di creatori di contenuti e dei loro team”, ha detto Hocking. “La nostra voce AI a parità umana può essere prodotta più velocemente in tempo reale e aggiornata su richiesta. Ciò apre nuove e interessanti opportunità per ‘aggiungere voce’ dove non si pensava possibile. La voce AI garantisce che ogni produzione possa essere creata e aggiornata efficientemente in scala”.

Parole degli investitori

James Newell fa parte del team di Voyager Capital.

“I creatori di contenuti o i progettisti di esperienze di prodotto erano precedentemente di fronte a scelte difficili tra qualità e scalabilità quando utilizzavano strumenti di text-to-speech o voce umana. Le voci incredibili di WellSaid, accessibili tramite un’applicazione di studio o un’API scalabile, eliminano la necessità di scegliere tra discorso naturale e lifelike o contenuto vocale infinitamente scalabile ed facilmente modificabile. WellSaid offre entrambi e li consegna nel modo in cui il tuo team desidera consumarli”, ha detto Newell. “I team creativi l’hanno trovato estremamente utile quando devono produrre più pezzi di contenuto di alta qualità in una voce coerente in poche ore invece di settimane”.

Carlos Kokron è Vice President di Qualcomm Ventures Americas.

“Gli sviluppi recenti nella tecnologia di text-to-speech utilizzando l’intelligenza artificiale generativa hanno reso possibili voci sintetiche che suonano molto umane, trovando nuove applicazioni emozionanti per la voce, tra cui e-learning, pubblicità e lettori di notizie”, ha detto Kokron. “WellSaid Labs fornisce un prodotto di classe mondiale che genera voci umane altamente accurate. Siamo impazienti di lavorare con WellSaid Labs per aiutare a alimentare l’economia dei creatori con voci AI a parità umana su mobile e IoT”.

Dave Gilboa fa parte del team di Good Friends e co-CEO di Warby Parker (WRBY ).

“Il team di WellSaid ha applicato una profonda competenza tecnica per costruire una piattaforma che consente la creazione e la modifica facile di audio incredibilmente realistici. Vediamo un potenziale di crescita significativo nell’uso di audio di alta qualità per dare ai marchi la possibilità di comunicare con i clienti e ai creatori di coinvolgere il pubblico”, ha detto Gilboa.

I sviluppatori di prodotti possono accedere al motore di intelligenza artificiale di base di WellSaid Labs tramite API in tempo reale, che consente loro di alimentare esperienze digitali con un’infrastruttura vocale scalabile. I creatori possono superare le varie barriere e complessità trovate nelle tecnologie di text-to-speech tradizionali.

Scopri di più su WellSaid Labs e ascolta le varie voci AI della società qui.

Alex McFarland è un giornalista e scrittore di intelligenza artificiale che esplora gli ultimi sviluppi nel campo dell'intelligenza artificiale. Ha collaborato con numerose startup di intelligenza artificiale e pubblicazioni in tutto il mondo.