Rapporten
Wat Leest AI? Binnen de Verborgen Mechanismen van Generatieve Citaten

Nu generatieve AI het digitale landschap herschapen heeft, ontstaat een nieuwe vraag in het centrum van contentcreatie en -ontdekking: Wat leest AI precies? Een baanbrekend onderzoek getiteld Wat Leest AI van Generative Pulse door Muck Rack analyseerde meer dan 1 miljoen citaten van grote AI-systemen, waaronder OpenAI’s ChatGPT (4o en 4o-mini), Google’s Gemini (Flash en Pro) en Anthropic’s Claude (Sonnet en Haiku), om de verborgen dynamiek achter de links te onthullen die deze modellen gebruiken bij het genereren van antwoorden.
De bevindingen zijn niet alleen onthullend, maar ook transformatief voor iedereen in de journalistiek, corporate communicatie, SEO of merkstrategie.
Citaten Zijn Niet Alleen Toevoegingen – Ze Vormen het Gedrag van AI
Het is duidelijk voor iedereen die ondergedompeld is in de wereld van AI dat het inschakelen of uitschakelen van de citatiefunctie de antwoorden zelf verandert. Wanneer citaten uitgeschakeld zijn, vertrouwen AI’s meer op statische trainingsgegevens. Maar wanneer citaten ingeschakeld zijn, genereren de modellen materiaal verschillende uitvoer, rechtstreeks gevormd door de real-time bronnen die ze gebruiken.
Belangrijk Voorbeeld: Wanneer gevraagd wordt naar het slechtste Major League Baseball-team, noemt een AI zonder citaten de 1962 Mets. Maar met citaten ingeschakeld, werkt het antwoord bij met de 2024 Chicago White Sox met een recordbrekend seizoen van 41–121— expliciet verwijzend naar CBS Sports.
De Dominantie van Verdiende Media
Meer dan 95% van alle geciteerde bronnen komen uit niet-betaalde media. Dit omvat:
- 27% journalistiek inhoud (bijv. Reuters, AP, Financial Times)
- 18% overheids-/NGO-sites
- 13% academische of onderzoeksbronnen
- 10% aggregator-/encyclopedische platforms zoals Wikipedia of Visual Capitalist
In tegenstelling tot betaalde of advertoriele inhoud die minder dan 5% van de citaten vertegenwoordigt, waardoor duidelijk wordt dat AI-modellen systematisch zijn gebiast tegen marketinggedreven inhoud.
Recentievooroordeel: Waarom Nieuwe Inhoud Wint
Verse inhoud telt—vooral voor OpenAI’s modellen. In journalistieke inhoud werden 56% van de citaten door ChatGPT gemaakt en waren gepubliceerd in de afgelopen 12 maanden, in vergelijking met 36% voor Claude. Deze neiging, bekend als recentievooroordeel, verwijst naar de voorkeur voor nieuwere, onlangs gepubliceerde bronnen boven oudere, zelfs als oudere bronnen nog steeds accuraat of relevant kunnen zijn.
In de context van generatieve AI betekent recentievooroordeel dat taalmodellen—vooral die zoals ChatGPT die zijn verbonden met real-time gegevens—meer geneigd zijn om naar recent gepubliceerde materiaal te verwijzen en te vertrouwen, vooral bij het beantwoorden van vragen over actuele gebeurtenissen, opkomende technologieën of beleidsveranderingen. Voor tijdsgevoelige prompts zoals “laatste vooruitgang in de behandeling van outpatients” of “recente geluidopname-innovaties” weegt het model zwaarder inhoud die in de afgelopen paar maanden is gepubliceerd, onder de veronderstelling dat deze meer relevante of bijgewerkte inzichten bevat.
Dit is een cruciale inzicht voor contentmakers en merkstrategen: als uw materiaal verouderd is—zelfs maar een jaar—dan is het aanzienlijk minder waarschijnlijk dat het zal verschijnen in AI-gegenereerde antwoorden. Het houden van uw inhoud vers is niet alleen goed SEO—het is essentieel voor zichtbaarheid in de tijd van AI.
Verschillende Prompts Activeren Verschillende Bronnen
AI-modellen citeren bronnen niet willekeurig—ze kiezen op basis van het type vraag dat wordt gesteld. Verschillende promptstijlen leiden tot verschillende soorten bronnen die worden verwezen:
- Feitenopzoeken en encyclopedische vragen hebben de neiging om te putten uit statische referentiesites zoals Wikipedia en Britannica, waarbij ze vertrouwen op goed gevestigde maar vaak oudere informatie.
- Recente gebeurtenisvragen activeren typisch citaten van grote nieuwsbureaus zoals AP, Reuters of Axios, waarbij snelheid en actualiteit belangrijk zijn.
- Advies- of meningzoekende prompts verschuiven het model naar meer dynamische en conversational bronnen zoals blogs, forums of platforms zoals Reddit of Medium.
- Academische of onderzoeksgerichte taken leiden AI naar citaten uit tijdschriften, preprint-servers zoals arXiv of door de overheid gesteunde repositories zoals PubMed of NCBI.
- Creatieve verzoeken of stap-voor-stap-instructies doen vaak user-generated content, informele handleidingen of community-discussiethreads van platforms zoals Quora of niche-tech-fora naar boven komen.
Deze variatie betekent dat de manier waarop een vraag wordt gesteld een directe invloed kan hebben op welke domeinen worden verheven—and welke worden achtergelaten.
Claude, bijvoorbeeld, is veel minder geneigd om grote uitgevers zoals Reuters te citeren dan ChatGPT of Gemini, waarbij Reuters 50x minder vaak wordt genoemd dan ChatGPT.
Autoriteit en Domein Tellen—Maar Niet Eenvormig
Hoewel hoge autoriteituitgevers de boventoon voeren, zijn ze niet de enige spelers. Slechts 15% van de meest geciteerde bronnen verschijnen in de top 10 in meerdere industrieën. Dit betekent dat niche-specifieke inhoud wordt beloond. Bijvoorbeeld:
- In Financiën zijn bronnen zoals Bankrate en NerdWallet favoriet.
- In Gezondheidszorg domineren overheidsbronnen zoals CDC.gov en NIH.gov.
- In Technologie stijgen leerplatforms zoals Udemy, Coursera en Medium naar de top.
Op pagina 15 toont een visuele heatmap aan dat Claude de meeste domeinspecifieke diversiteit vertoont, waarbij het vaak industrie-unieke bronnen selecteert, terwijl ChatGPT en Gemini meer vertrouwen op generalistische media.
Industrie-Specifieke Inzichten: Wat AI Citeert per Sector
Financiën & Verzekeringen
- Journalistiek vertegenwoordigt 37% van de citaten, meer dan elke andere industrie.
- Claude’s top 10 bronnen zijn 90% uniek, wat diepere niche-verkenning aangeeft.
Gezondheidszorg
- Overheids- en NGO-sites worden 18% van de tijd geciteerd, meer dan het dubbele van het gemiddelde over alle industrieën.
- Gemini leidt in brondiversiteit voor deze sector.
Reizen/Luchtvaart
- Verwonderlijk genoeg zijn academische citaten vrijwel afwezig (slechts 0,7%).
- Bronnen zoals FAA.gov en IATA.org domineren, met minder afhankelijkheid van nieuwsuitgevers.
Detailhandel & E-Commerce
- Aggregators zoals Wikipedia worden hier minder geciteerd dan in andere industrieën (36% vs. 28%).
- Claude citeert de meeste niche-inhoud.
Media/Entertainment
-
Journalistiek leidt opnieuw met 37%, met niche-platforms zoals TVTechnology en Radioking die vaak door Claude worden geciteerd.
Technologie
- Virtueel geen encyclopedische of academische bronnen worden gebruikt.
- Platforms zoals Medium, Coursera en SproutSocial verschijnen prominent, wat een voorkeur voor praktijkgerichte kennis weerspiegelt.
Implicaties voor Communicatie- en SEO-Teams
De bevindingen van dit rapport onthullen dat Generatieve Engine Optimalisatie (GEO) net zo belangrijk wordt als traditionele SEO. AI resumeert niet alleen statische databases—het verbindt actief met bronnen in real-time. En die links worden beïnvloed door:
- Actualiteit: Houd uw inhoud up-to-date.
- Domeinautoriteit: Bouw backlinks en vertrouwen op.
- Niche-relevantie: Maak inhoud die is afgestemd op uw industrie, niet alleen algemene onderwerpen.
- Inhoudstype: Focus op verdiende media en informatieve inhoud in plaats van pure marketingpagina’s.
Dit verandert de berekening voor contentmarketeers, PR-professionals en uitgevers. Als uw doel is om te verschijnen in AI-gegenereerde resultaten, moet u inhoud creëren die AI waardevol vindt—niet alleen gebruikers of Google.
Conclusie: De Gevolgen van Door AI Worden Gelezen (of Genegeerd)
Dit rapport benadrukt een fundamentele verschuiving in hoe informatie online wordt getoond: AI-modellen halen niet alleen inhoud op—ze selecteren deze zorgvuldig. En die selectie redefineert zichtbaarheid in de digitale tijd.
Voor uitgevers, onderzoekers en merken betekent het door AI worden geciteerd deel uitmaken van de volgende generatie zoekopdrachten. Het zet uw inhoud voor gebruikers die mogelijk nooit uw site bezoeken maar het model dat ernaar verwijst vertrouwen. De bronnen die worden geciteerd, worden versterkt. Diegenen die dat niet doen—ongeacht de kwaliteit—lopen het risico om volledig uit het gesprek te worden geweerd.
Deze verschuiving creëert nieuwe winnaars en verliezers. Hoge autoriteituitgevers en tijdige, verdiende media worden begunstigd. Ondertussen lopen betaalde inhoud, licht bijgewerkte blogs of minder gevestigde stemmen het risico om ongelezen te blijven—niet alleen door mensen, maar door de systemen die bepalen wat mensen zien.
Terwijl generatieve AI een centrale rol blijft spelen in de manier waarop kennis wordt geleverd, wordt de belangrijkste vraag minder over hoe je in zoekresultaten kunt ranken en meer over: Hoe word je onderdeel van wat AI de moeite waard vindt om te citeren?












