Rapporter
Hva leser AI? Innside de skjulte mekanismene til generative sitater

Ettersom generativ AI formerer det digitale landskapet, oppstår et nytt spørsmål i sentrum av innholdskreasjon og oppdagelse: Hva leser AI egentlig? En banebrytende studie med tittelen Hva leser AI fra Generative Pulse av Muck Rack analyserte over 1 million sitater fra større AI-systemer, inkludert OpenAI’s ChatGPT (4o og 4o-mini), Google’s Gemini (Flash og Pro) og Anthropic’s Claude (Sonnet og Haiku), for å avdekke de skjulte dynamikkene bak lenkene disse modellene bruker når de genererer svar.
Funnene er ikke bare avslørende, men også transformatoriske for alle som jobber med journalistikk, korporativ kommunikasjon, SEO eller merkestrategi.
Sitater er ikke bare tilbehør – de formerer AI-atferd
Det er åpenbart for alle som er dypt innviklet i AI-verdenen at å aktivere eller deaktivere sitatfunksjonalitet endrer svarene selv. Når sitater er deaktivert, avhenger AI mer tungt av statisk treningdata. Men når sitater er aktivert, genererer modellene materiellet forskjellige utdata, direkte formet av de sanntidsskildrene de henter fra.
NøkkelEksempel: Spurt om det dårligste baseballaget, nevnte en sitatdeaktivert AI 1962 Mets. Men med sitater på, oppdaterte svaret til å inkludere 2024 Chicago White Sox med en rekordbrytende 41–121 sesong—uttrykkelig sitert CBS Sports.
Dominansen til verdige medier
Over 95% av alle siterte kilder kommer fra ubetalte medier. Dette inkluderer:
- 27% journalistisk innhold (f.eks. Reuters, AP, Financial Times)
- 18% regjering/NGO-nettsteder
- 13% akademiske eller forskningskilder
- 10% aggregator/encyklopediske plattformer som Wikipedia eller Visual Capitalist
I motsetning til dette står betalte eller annonceringsbaserte innhold for mindre enn 5% av sitatene, og det blir klart at AI-modellene systematisk er fordomsfulle mot markedsføringsbasert innhold.
Nærhetsskjevhet: Hvorfor nytt innhold vinner
Friskehet teller—spesielt for OpenAI’s modeller. I journalistisk innhold var 56% av sitatene gjort av ChatGPT publisert innen de siste 12 månedene, sammenlignet med 36% for Claude. Denne tendensen, kjent som nærhetsskjevhet, viser til en preferanse for nyere, mer nylig publiserte kilder over eldre, selv om eldre kilder fortsatt kan være nøyaktige eller relevante.
I sammenheng med generativ AI betyr nærhetsskjevhet at språkmodellene—spesielt de som er koblet til sanntidsdata—er mer sannsynlig å referere til og stole på nytt publisert materiale, spesielt når de responderer på forespørsler som involverer nåværende hendelser, nye teknologier eller politiske endringer. For tidssensitive forespørsler som “siste fremgang i behandling av pasienter utenfor sykehus” eller “nye lydinnspillingsinnovasjoner”, vekter modellen tungt innhold som er publisert i løpet av de siste månedene, under antagelse av at det bærer mer relevante eller oppdaterte innsikter.
Dette er en kritisk innsikt for innholdsskapere og merkestrateger: hvis materialet ditt er foreldet—selv bare ett år—er det betydelig mindre sannsynlig å dukke opp i AI-genererte svar. Å holde innholdet ditt friskt er ikke bare god SEO—det er essensielt for synlighet i AI-alderen.
Forskjellige forespørsler utløser forskjellige kilder
AI-modellene sitere ikke kilder tilfeldig—de velger basert på typen spørsmål som stilles. Forskjellige forespørselsstiler leder til forskjellige typer kilder som refereres til:
- Faktaoppslag og leksikalske forespørsler tenderer å trekke fra statiske referansesider som Wikipedia og Britannica, som avhenger av etablerte, men ofte eldre informasjoner.
- Nåværende hendelsesspørsmål utløser vanligvis sitater fra større nyhetskontorer som AP, Reuters eller Axios, der hastighet og nærhet er nøkkel.
- Råd eller meningsutvekslingsforespørsler skyver modellen mot mer dynamiske og konversasjonelle kilder som blogger, forum eller plattformer som Reddit eller Medium.
- Akademiske eller forskningsorienterte oppgaver leder AI til å sitere fra tidsskrifter, forhåndstrykkservere som arXiv eller regjeringsstøttede repositorier som PubMed eller NCBI.
- Kreative forespørsler eller steg-for-steg-instruksjoner fremhever ofte brukergenerert innhold, uformelle instruksjoner eller fellesskapsdiskusjonstråder fra plattformer som Quora eller nisjetekniske forum.
Denne variasjonen betyr at måten et spørsmål er formulert kan ha en direkte innvirkning på hvilke domener som blir fremhevet—and hvilke som blir igjen.
Claude, for eksempel, er langt mindre sannsynlig å sitere større utgaver som Reuters enn ChatGPT eller Gemini, som sitere Reuters 50x mindre hyppig enn ChatGPT.
Autoritet og domene teller—but ikke uniformt
Selv om høyautoritetsutgaver dominerer, er de ikke de eneste aktørene. Bare 15% av de øverste siterte kildene dukker opp i topp 10 over flere bransjer. Dette betyr at nisjespesifikt innhold belønnes. For eksempel:
- I finans, favoriseres kilder som Bankrate og NerdWallet.
- I helsetjenester, dominere regjeringskilder som CDC.gov og NIH.gov.
- I teknologi, stiger læringsplattformer som Udemy, Coursera og Medium til topps.
På side 15 viser en visuell varme kart at Claude utviser den mest domenespesifikke mangfold, ofte velger bransjespesifikke kilder, mens ChatGPT og Gemini tenderer å avhenge mer tungt av generalistiske medier.
Bransjespesifikke innsikter: Hva AI sitere etter sektor
Finans og forsikring
- Journalistikk står for 37% av sitatene, mer enn noen annen bransje.
- Claudes topp 10 kilder er 90% unike, som indikerer en dypere nisjeutforskning.
Helsetjenester
- Regjerings- og NGO-nettsteder sitere 18% av tiden, mer enn dobbelt så mye som gjennomsnittet over bransjene.
- Gemini leder i kildediversitet for denne sektoren.
Reise og flyselskap
- Overraskende er akademiske sitater nesten fraværende (bare 0,7%).
- Kilder som FAA.gov og IATA.org dominere, med mindre avhengighet av nyhetskontorer.
Detaljhandel og e-handel
- Aggregatorer som Wikipedia sitere mindre her enn i andre bransjer (36% vs. 28%).
- Claude sitere det mest nisjespesifikke innholdet.
Media og underholdning
-
Journalistikk leder igjen med 37%, med nisjeplattformer som TVTechnology og Radioking ofte sitert av Claude.
Teknologi
- Virtuelt ingen leksikalske eller akademiske kilder brukes.
- Plattformer som Medium, Coursera og SproutSocial dukker opp prominent, og reflekterer en tendens mot praktikerbasert kunnskap.
Konsekvenser for kommunikasjons- og SEO-lag
Funnene i denne rapporten viser at Generativ Engine Optimering (GEO) blir like viktig som tradisjonell SEO. AI ikke bare summerer statiske databaser—det aktivt lenker til kilder i sanntid. Og disse lenkene påvirkes av:
- Nærhet: Oppdater innholdet ditt regelmessig.
- Domeneautoritet: Bygg opp baklenker og tillit.
- Nisjerelevans: Lag innhold tilpasset din bransje, ikke bare generelle emner.
- Innholdstype: Fokus på verdige medier og informativt innhold fremfor ren markedsføringsinnhold.
Dette endrer beregningen for innholdsmarkedsførere, PR-eksperter og utgivere. Hvis målet ditt er å dukke opp i AI-genererte resultater, må du lage innhold som AI finner verdifullt—not bare brukere eller Google.
Konklusjon: Konsekvensene av å bli lest (eller ignorert) av AI
Denne rapporten fremhever en grunnleggende endring i hvordan informasjon presenteres på nett: AI-modellene ikke bare henter innhold—de kuraterer det selektivt. Og denne kurateringen definerer synlighet i den digitale alderen.
For utgivere, forskere og merker betyr å bli sitert av AI å være en del av den neste generasjonen av søk. Det setter ditt innhold foran brukere som kanskje aldri besøker nettstedet ditt, men som stoler på modellen som refererer til det. Kildene som blir sitert, blir forsterket. De som ikke blir sitert—uavhengig av kvalitet—risikerer å bli ekskludert fra samtalen helt.
Dette skapar nye vinnere og tapere. Høyautoritetsutgaver og verdige, nye medier favoriseres. I mellomtiden risikerer betalt innhold, lett oppdaterte blogger eller mindre etablerte stemmer å bli ulest—ikke bare av mennesker, men også av systemene som former hva folk ser.
Ettersom generativ AI fortsetter å spille en sentral rolle i hvordan kunnskap leveres, blir den viktigste spørsmålet mindre om hvordan man rangerer i søk og mer om: Hvordan blir du en del av hva AI anser som verdifullt å sitere?












