Vordenker

Deine authentische Stimme finden: Wie synthetische Stimmen Markengeschichten mit globalen, vielfältigen Publikum teilen können

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

Fast zwei Drittel der Menschen, die sich mit einer Rasse oder ethnischen Minderheit identifizieren, sagen, dass sie eher mit Marken interagieren, die diverse Perspektiven einbeziehen. Aber Vielfalt zu sein, bedeutet mehr, als nur Kunden ermöglichen, sich in Ihrer Marke wiederzuerkennen, es geht auch darum, dass sie sich auch hören können.

Im letzten Jahr stieg die Anzahl der Marken, die erstmals Audio-Identitäten starteten, um 22%. Unternehmen versuchen buchstäblich, durch den Lärm in ihrer Branche zu brechen und ihre Botschaften besser an alle Einzelpersonen anzupassen, denen sie dienen. Aber während Marken die ethischen und wirtschaftlichen Gründe kennen, um Vielfalt in jedem Medium zu fördern, wissen sie nicht immer, welche Werkzeuge ihnen helfen, dies im großen Maßstab zu tun.

Hier kommt die synthetische Stimme ins Spiel. Die Technologie ermöglicht es Marken, mit ihrem Publikum auf eine inklusivere Weise zu kommunizieren – und ohne ihre Authentizität zu beeinträchtigen. Darüber hinaus ermöglicht die einfache Verwendung von synthetischer Stimme mehr Marken, sie zu nutzen und mehr Menschen zu repräsentieren. Hier ist, warum synthetische Stimme zum Lautsprecher für vielfältigere Marken und ihre Geschichten werden wird.

Globale Unternehmen benötigen globale Stimmen

Die massive digitale Transformation hat Marken dazu gebracht, von Anfang an global zu denken. In einer vorwiegend online-basierten Geschäftssphäre müssen Unternehmen Kunden in mehreren Ländern und mit verschiedenen Sprachen, Akzenten, Dialekten und Vokabularien bedienen. Unabhängig davon, in welcher Branche Sie tätig sind, hat sich Ihre Nutzerbasis wahrscheinlich in den letzten Jahren diversifiziert, und Sie müssen diese Expansion in Ihrem akustischen Branding widerspiegeln.

Europa- und Asien-basierte Startups sind vielleicht eher in der Lage, sich zu diversifizieren als ihre US-amerikanischen Pendants. Unternehmen in den Vereinigten Staaten konzentrieren sich in der Regel hauptsächlich auf den heimischen Markt, weil der Umfang und die Größe des Angebots dort so groß sind, und diversifizieren sich später, wenn sie über die Landesgrenzen hinausgehen. Europäische und asiatische Startups diversifizieren sich früher, weil sie eine Vielzahl von Grenzen und Kulturen überqueren. Die Betreibung in einem kleineren Markt bringt tatsächlich den Vorteil eines mehrstimmigen Marktes mit sich.

Die Sprachtechnologie ist in erster Linie für englischsprachige Menschen entwickelt worden – teilweise wegen ihrer Entwicklungswurzeln in den Vereinigten Staaten, aber mehr wegen ihres Status als meistgesprochene Sprache der Welt. Doch mehr als eine Milliarde Menschen sprechen Englisch als zweite Sprache und hören selten Markenstimmen, die ihren Akzent als Fremdsprecher widerspiegeln.

Mit synthetischer Stimme können Marken mit Sprechern arbeiten, die Englisch als zweite Sprache sprechen, ihre vokalen Nuancen leicht und genau erfassen und diese Audioaufnahmen in ihre Marketingkampagnen einsetzen. Marken werden nicht nur mehr soziale Gruppen repräsentieren, sondern auch von einzigartigen, starken Akzenten wie denen von Unterhaltungspersönlichkeiten wie Sofía Vergara (kolumbianisch) und Arnold Schwarzenegger (österreichisch) profitieren.

Mehr vielfältige Akzente replizieren

Während der Pool der Sprecher in den letzten Jahren gewachsen ist, ist die Demografie der Sprecher immer noch eine weiße, männliche Mehrheit. Es ist daher schwierig, Stimmen mit Akzenten aus kleineren oder abgelegeneren Orten der Welt zu finden, beispielsweise von der Insel Malta.

Mit fortschrittlicher, benutzerdefinierter Stimmenklon-Technologie können Sprecher aus diesen Orten (oder sogar normale Menschen von dort) ein bestimmtes Skript in einem bestimmten Ton lesen und die feinen Nuancen in ihrem Akzent aufzeichnen. Diese Akzente können dann in die Audioaufnahmen von Marken repliziert werden, um es Unternehmen zu ermöglichen, ihren Inhalt zu lokalisieren und weniger bekannte Arten des Sprechens ihrem Publikum näherzubringen.

Natürlich ist die Technologie noch in der Entwicklung und benötigt Stunden von Audioaufnahmen, um robust und natürlich klingen zu können. Sprachmodelle funktionieren am besten, wenn sie für bestimmte Anwendungsfälle wie Radio, Erzählung oder Werbung entwickelt werden, sodass Marken berücksichtigen müssen, in welchem Kontext die Stimme verwendet wird, und ihren Prozess entsprechend anpassen. Der Kreislauf ist noch nuancierter, wenn seltene Akzente produziert werden, da Marken möglicherweise nicht in der Lage sind, zu bestätigen, dass die Intonation und die Geschwindigkeit für das Szenario angemessen sind.

Es gibt einen Grund, warum der Markt für synthetische Stimmen voraussichtlich bis 2025 36 Milliarden Dollar wert sein wird; ihre Fähigkeit, buchstäblich mit Menschen zu sprechen, gibt Marken eine direkte Verbindung zu den täglichen Leben ihrer Kunden. Und im Jahr 2022, wenn Menschen wollen, dass Marken aussehen und klingen wie sie, ermöglicht synthetische Stimme es Unternehmen, mehr Stimmen, lauter und ohne ihre ursprüngliche Stimme zu verlieren, zu vermitteln.

Markencharaktere zum Leben erwecken

Akustisches Branding ist ein mächtiges Werkzeug, insbesondere unter jüngeren, technisch versierten Publikum (die auch einige der lautesten sind, die Marken aufrufen, die nicht vielfältig sind). Tatsächlich zeigt eine Studie aus dem Vereinigten Königreich, dass mehr als 1 von 5 Erwachsenen unter 35 sind eher bereit, ein Produkt einer Marke zu kaufen, je mehr sie den Klang hören, der mit dieser Marke verbunden ist.

Aber Audio muss nicht unbedingt von realen Menschen stammen, um als vielfältig angesehen zu werden. Synthetische Stimme kann fiktive Charaktere realisieren, die zu Nischenpublikum sprechen, bestimmte Persönlichkeitsmerkmale verkörpern oder einfach eine lustige, sofort erkennbare Erweiterung der Marke sind. Man braucht nur die likes von Tony the Tiger, Mrs. Butterworth und der Laughing Cow anzusehen.

Synthetische Stimme kann auf der Grundlage einer Reihe von Anforderungen entwickelt werden, die einen gewünschten Charakter konstruieren. Zum Beispiel, wenn ein Charakter aus Schokolade besteht und süß klingen, aber auch ein bisschen atemlos klingen sollte, als ob er schmilzt. Der Umfang der Technologie gibt Marken eine große kreative Flexibilität und ist nützlich, um eine stärkere Präsenz auf sozialen Medien-Plattformen wie Instagram und TikTok aufzubauen, wo Nutzer der Generation Z einzigartige, künstlerische Marken erwarten.

Dr. Timo Kunz ist der Mitbegründer und CEO von Aflorithmic - der weltweit ersten vollautomatisierbaren Lösung für die Erstellung von Sprach- und Audioinhalten aus Text.