Vordenker

Man kann eine Marke, die mit jedem unterschiedlich spricht, nicht probieren‑testen

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

Vor ein paar Tagen geriet ich in eine ziemlich hitzige Diskussion mit meiner Freundin Faniprize. Sie ist die Person, der ich frische Arbeitsgeschichten erzähle, wenn ich darin eine größere Frage spüre, die ich jedoch noch nicht benennen kann.

Diesmal ging es um KI‑Agenten. Nicht darum, ob Unternehmen sie benötigen – das wurde bereits ausreichend diskutiert. Ich war mehr daran interessiert, was passiert, nachdem ein Unternehmen einen Agenten eingeführt hat und dieser reale Arbeit übernimmt, denn dort beginnen die weniger offensichtlichen Probleme.

Ich erzählte ihr von einem kürzlich durchgeführten Projekt mit einer Personalvermittlungsagentur. Ein KI‑Agent übernahm einen Teil der Kommunikation mit potenziellen Kunden. Aus Marketingsicht wirkte das gut: Er kannte das Produkt und die Zielgruppe, der Ton war passend und die Gespräche wirkten persönlich statt vorgefertigt.

Einzelne Gespräche schienen in Ordnung zu sein. Dann stellten wir mehrere nebeneinander.

In sehr ähnlichen Situationen hatte der Agent leicht unterschiedliche Versprechen gemacht. Einer Person gab er einen Zeitplan für die Rückmeldung, einer anderen einen anderen. In einigen Gesprächen sagte er im Grunde: “Wir können hier flexibel sein” bezüglich einzelner Bedingungen, obwohl das Unternehmen ihm nie die Freiheit gegeben hatte, solchen Bedingungen zuzustimmen.

Es gab keine dramatischen Halluzinationen, was das Problem schwerer erkennbar machte.

Der Agent klang völlig normal.

Marketing‑Teams verbringen natürlich viel Zeit mit Tonalität und Positionierung. Ein Personalvermittlungsunternehmen sollte nicht wie ein Krypto‑Startup klingen, und eine Bank sollte nicht wie eine Modemarke kommunizieren. Doch unter der Art, wie eine Marke spricht, gibt es eine weitere Ebene: Was darf der Agent tatsächlich im Namen des Unternehmens versprechen?

Eine kunstvoll formulierte Botschaft hilft wenig, wenn der Kunde später feststellt, dass die besprochenen Konditionen nicht existieren. Dann ist es kein Kommunikationsproblem mehr, sondern ein Reputationsproblem.

Wir haben Agenten beigebracht, wie das Unternehmen zu klingen. Jetzt müssen wir prüfen, ob sie auch so entscheiden.

Warum die übliche Prüfung das übersieht

Die übliche Prüfung besteht darin, ein paar Gespräche zu lesen. Sind die Produktinformationen korrekt? Hat der Agent den Anweisungen gefolgt? Hat er etwas Seltsames gesagt?

Aber fünf zufällige Gespräche können alle gut aussehen und dennoch eine ernsthafte Inkonsistenz verbergen. Personalisierung sorgt per Design dafür, dass jedes Gespräch unterschiedlich ist: ein Kunde fragt direkt, ein anderer erklärt ausführlich, jemand verhandelt, jemand drängt weiter. Die Beispiele sind nicht vergleichbar.

Im Rekrutierungsfall sah nichts falsch aus, bis wir aufhörten zu fragen: “War das eine gute Antwort?” und stattdessen fragten: “Welche Entscheidung hat der Agent hier getroffen?”

Was ich stattdessen zu tun begann

Wenn reale Gespräche keinen klaren Vergleich ermöglichen, erstellen wir sie selbst.

Ich nehme eine geschäftliche Situation und lasse sie acht‑ bis zehnmal durch den Agenten laufen. Die wichtigen Fakten bleiben gleich, aber die Person auf der anderen Seite ändert sich: sanfter, direkter, bereit, heute zu unterschreiben, und erwähnt einen Konkurrenten.

Dann betrachte ich die geschäftliche Entscheidung. Hat der Agent einem Kunden, der stärker drängte, einen Rabatt angeboten? Hat sich eine zeitliche Zusage geändert, weil die Umstände anders waren oder weil das Gespräch einfach in eine andere Richtung verlief? War es überhaupt erlaubt, Sonderkonditionen zu besprechen?

Ich wäre besorgt, wenn die Formulierung unverändert bliebe. Was stabil bleiben sollte, ist die Position des Unternehmens, und wenn sie sich ändert, muss es dafür einen geschäftlichen Grund geben.

Das endgültige Urteil muss von einer Person kommen. Das Modell sollte nicht seine eigene Hausaufgabe bewerten. Wer auch immer diese Entscheidung trägt – der Gründer, der Vertriebsleiter oder der Commercial Director – muss entscheiden, ob sie akzeptabel war.

Worauf ich tatsächlich achte

Ich komme immer wieder zu vier Fragen zurück.

Erstens, wenn die wichtigen Bedingungen gleich bleiben, bleibt die Entscheidung konsistent? Genau hier brach der Rekrutierungsfall zusammen.

Zweitens, arbeitet der Agent noch innerhalb der tatsächlichen Regeln des Unternehmens? Ich habe einmal eine menschliche Variante davon gesehen. Ein Vertriebsleiter begann, Kunden eigenständig einen 20 %‑Rabatt zu gewähren. Das Unternehmen hatte keinen Standard‑20‑Prozent‑Rabatt; solche mussten von der Geschäftsführung genehmigt werden. Er wollte nicht dem Unternehmen schaden. Er wollte verkaufen, und unterwegs verschob er die Grenze dessen, was er zu entscheiden glaubte. Agenten tun dasselbe.

Drittens, hat eine geänderte Entscheidung einen echten Grund? Der Kontext ist wichtig, aber ihn zu verstehen und zu etwas überredet zu werden sind unterschiedliche Dinge. Wenn die einzige Änderung darin besteht, dass ein Kunde hartnäckiger war, möchte ich nicht, dass der Agent stillschweigend großzügiger wird.

Viertens, weiß der Agent wo seine Befugnisse enden? Manchmal ist die richtige Vorgehensweise einfach: Ich muss das mit einer Person klären. Das ist eine völlig akzeptable Antwort.

Der Test deckt manchmal stattdessen das Unternehmen auf

Du bringst die fragwürdigen Entscheidungen zurück zum Team, fragst, was der Agent hätte tun sollen, und Menschen geben unterschiedliche Antworten.

Der Vertrieb hat eine Sichtweise. Das Marketing hat eine andere. Der Gründer sagt: „Nun, normalerweise machen wir das nicht, aber manchmal schon.“ Ein Manager erinnert sich an drei Ausnahmen aus dem letzten Jahr.

All das landet in dem Material, das wir dem Agenten geben. Wenn das Unternehmen sich nicht auf die Logik geeinigt hat, lernt das Modell aus einer chaotischen Realität. Manchmal hat es die Widersprüchlichkeit nicht erzeugt.

Es hat es einfach sichtbar gemacht.

So wird das KI‑Testing fast zufällig zu einer Geschäftsprüfung. Wer kann einen Rabatt genehmigen? Was kann ein Vertriebsmitarbeiter versprechen, ohne nachzufragen? Welche Regeln sind tatsächlich Regeln und welche nur Gewohnheiten? Und ist eine Ausnahme noch eine Ausnahme, wenn Menschen sie jede Woche machen?

Vielleicht benötigen Agenten dieselbe Schulung wie Menschen

Wir behandeln KI‑Agenten immer noch wie Software: wir konfigurieren sie, setzen den Prompt und lassen sie arbeiten. Je mehr Verantwortung wir ihnen übertragen, desto weniger Sinn ergibt das für mich.

Wir geben einem neuen Vertriebsleiter nicht am Montag ein Markenhandbuch und gehen davon aus, dass er für jeden Kunden bereit ist. Jemand hört sich seine Gespräche an, bespricht schwierige Fälle und korrigiert ihn, wenn er zu weit geht. So lernt er die Logik des Unternehmens.

Warum sollte man von einem KI‑Agenten erwarten, dass er das aus einem einzigen Prompt lernt? Sobald er reale Gespräche führt, denke ich, müssen wir ihn durch Fälle und Feedback schulen, fast so, wie wir Menschen coachen.

Das ändert für mich, was Marken­konsistenz bedeutet. Ein Agent, der mit zehn Personen exakt gleich spricht, wäre ein schlechter Agent. Er sollte sich an die Person, die Kultur und die Situation anpassen.

Was sich nicht willkürlich ändern sollte, ist die zugrunde liegende Logik: was das Unternehmen verspricht, was nicht, und wo jemand stoppen und nachfragen muss.

Wenn Ihr Agent morgen zehn leicht unterschiedliche Versionen desselben schwierigen Gesprächs hätte, würde er dann immer noch wie dasselbe Unternehmen handeln?

Olga Belkovich, CEO und Mitbegründerin von U (in) AI, ein MarTech‑KI‑Labor, das empathische KI‑Systeme entwickelt, die die Entscheidungslogik von Experten erfassen und die Kommunikation an verschiedene Personen und Kontexte anpassen. Mit über 18 Jahren Erfahrung in Marketingstrategie und digitaler Transformation konzentriert sie sich auf KI‑Implementierung, digitale Zwillinge und die Wahrung der Markenkonsistenz in automatisierten Kommunikationen.