Tankeledere
Du kan ikke prøve‑teste et brand, der taler til alle på en anderledes måde

For et par dage siden kom jeg i en ret heftig diskussion med min ven Faniprize. Hun er den, jeg fortæller friske arbejdshistorier til, når jeg mærker et større spørgsmål i dem, men endnu ikke kan navngive det.
Denne gang handlede det om AI‑agenter. Ikke om virksomheder har brug for dem – det er blevet diskuteret nok. Jeg var mere interesseret i, hvad der sker, når en virksomhed implementerer en agent, og den begynder at udføre rigtigt arbejde, for det er dér de mindre indlysende problemer starter.
Jeg fortalte hende om et nyligt projekt med et rekrutteringsbureau. En AI‑agent håndterede en del af kommunikationen med potentielle kunder. Set fra et marketingperspektiv så det godt ud: den kendte produktet og målgruppen, tonen var rigtig, og samtalerne føltes personlige i stedet for skabelonagtige.
Individuelle samtaler virkede fine. Så satte vi flere ved siden af hinanden.
I meget lignende situationer havde agenten givet lidt forskellige løfter. Den gav én person én tidslinje for at vende tilbage og en anden person en anden. I nogle samtaler sagde den i bund og grund “vi kan være fleksible her” om individuelle vilkår, selvom virksomheden aldrig havde givet den frihed til at indgå i de vilkår.
Der var ingen dramatisk hallucination, hvilket gjorde problemet sværere at opdage.
Agenten lød helt normal.
Marketingteams bruger naturligvis meget tid på tone og positionering. Et rekrutteringsfirma bør ikke lyde som en kryptostartup, og en bank bør ikke kommunikere som et modebrand. Men under den måde, et brand taler på, findes der et andet lag: hvad er agenten faktisk tilladt at love på vegne af virksomheden?
En smukt skrevet besked hjælper ikke meget, hvis kunden senere opdager, at de vilkår, den drøftede, ikke eksisterer. På det tidspunkt er det ikke længere et kommunikationsproblem. Det er et omdømmespørgsmål.
Vi har lært agenter at lyde som virksomheden. Nu skal vi tjekke, om de også beslutter som den.
Hvorfor den sædvanlige gennemgang overser dette
Den normale kontrol er at læse et håndfuld samtaler. Er produktinformationerne korrekte? Følgte agenten instruktionerne? Sagde den noget mærkeligt?
Men fem tilfældige samtaler kan alle se gode ud og stadig gemme en alvorlig inkonsistens. Personalisering gør hver samtale forskellig af design: én kunde spørger direkte, en anden forklarer udførligt, en forhandler, en anden presser videre. Eksemplerne er ikke sammenlignelige.
I rekrutteringscasen så intet forkert ud, indtil vi stoppede med at spørge “Var dette et godt svar?” og begyndte at spørge “Hvilken beslutning traf agenten her?”
Hvad jeg begyndte at gøre i stedet
Hvis rigtige samtaler ikke giver klare sammenligninger, skaber vi dem selv.
Jeg tager én forretningssituation og kører den gennem agenten otte til ti gange. De vigtige fakta forbliver de samme, men personen på den anden side ændrer sig: blødere, mere direkte, klar til at underskrive i dag, nævner en konkurrent.
Derefter ser jeg på forretningsbeslutningen. Tilbød agenten kun en rabat til den person, der pressede hårdere? Ændrede en tidsforpligtelse sig, fordi omstændighederne var andre, eller fordi samtalen simpelthen gik i en anden retning? Var det overhovedet tilladt at diskutere særlige vilkår?
Jeg ville være bekymret, hvis formuleringen forblev den samme. Det, der skal forblive stabilt, er virksomhedens position, og hvis den skifter, bør der være en forretningsmæssig grund.
Den endelige dom skal komme fra en person. Modellen bør ikke bedømme sit eget arbejde. Den, der ejer beslutningen – grundlæggeren, salgschefen eller den kommercielle direktør – skal sige, om det var acceptabelt.
Hvad jeg faktisk ser på
Jeg vender altid tilbage til fire spørgsmål.
Først, hvis de vigtige betingelser forbliver de samme, forbliver beslutningen så konsistent? Det er præcis her, rekrutteringscasen gik i stykker.
For det andet, opererer agenten stadig inden for virksomhedens reelle regler? Jeg har engang set en menneskelig version af dette. En salgschef begyndte at tilbyde kunder en 20 % rabat på egen hånd. Virksomheden havde ingen standard på 20 % rabat; de krævede ledelsesgodkendelse. Han prøvede ikke at skade forretningen. Han ville sælge, og et sted på vejen flyttede han grænsen for, hvad han troede, han kunne beslutte. Agenter gør det samme.
For det tredje, har en ændret beslutning en ægte grund bag sig? Kontekst er vigtigt, men at forstå den og blive overtalt til noget er to forskellige ting. Hvis den eneste ændring er, at én kunde var mere vedholdende, vil jeg ikke have, at agenten stille og roligt bliver mere generøs.
For det fjerde, ved agenten hvor dens myndighed slutter? Nogle gange er det korrekte træk simpelthen: Jeg skal tjekke dette med en person. Det er et fuldstændig acceptabelt svar.
Testen afslører nogle gange i stedet virksomheden
Du bringer de tvivlsomme beslutninger tilbage til teamet, spørger hvad agenten skulle have gjort, og folk giver forskellige svar.
Salg har én opfattelse. Marketing har en anden. Grundlæggeren siger: “Nå, normalt gør vi ikke det, men nogle gange gør vi det.” En leder husker tre undtagelser fra sidste år.
Alt det ender i det materiale, vi giver agenten. Hvis virksomheden ikke har aftalt logikken, lærer modellen af en rodet virkelighed. Nogle gange skabte den ikke modstridelsen.
Det gjorde det blot synligt.
Så AI-testning bliver næsten ved et uheld en forretningsrevision. Hvem kan godkende en rabat? Hvad kan en sælger love uden at spørge? Hvilke regler er faktisk regler, og hvilke er blot vaner? Og er en undtagelse stadig en undtagelse, hvis folk laver den hver uge?
Måske har agenter brug for træning på samme måde som mennesker
Vi behandler stadig AI-agenter som software: vi konfigurerer dem, indstiller prompten og lader dem arbejde. Jo mere ansvar vi giver dem, jo mindre mening giver det for mig.
Vi giver ikke en ny salgschef en brandbog om mandagen og antager, at de er klar til hver kunde. Nogen lytter til deres opkald, diskuterer svære sager, retter dem, når de går for langt. Sådan lærer de virksomhedens logik.
Hvorfor forvente, at en AI-agent lærer det fra én prompt? Når den håndterer rigtige samtaler, tror jeg, vi bliver nødt til at træne den gennem sager og feedback, næsten som vi coacher mennesker.
Det ændrer, hvad brandkonsistens betyder for mig. En agent, der taler til ti personer på præcis samme måde, ville være en forfærdelig agent. Den skal tilpasse sig personen, kulturen og situationen.
Det, der ikke bør ændre sig tilfældigt, er logikken bag: hvad virksomheden vil love, hvad den ikke vil, og hvornår nogen skal stoppe og spørge.
Hvis din agent i morgen havde ti let forskellige versioner af den samme svære samtale, ville den så stadig opføre sig som den samme virksomhed?












