Andersons vinkel

Oppblomstringen av ‘AI-søppel’ anklager blir en ny form for gatekeeping

mm
Legg til Unite.AI blant dine foretrukne kilder på Google
AI-generated article illustration (GPT-2): Politicians seated around a round conference table point at one another while shouting, with an industrial humanoid robot sitting motionless at the center of the room.

Å kalle noe for ‘AI-søppel’ har blitt internettets nye heksejakt, med Reddit- og Hacker News-brukere som stadig oftere anklager medkommentatorer for å være roboter, selv når det ikke finnes noen bevis for dette.

 

En ny studie fra Norge og UAE har funnet at anklagene mot påstått ‘AI-søppel’ fra andre kommentatorer økte skarpt på Reddit og Hacker News mellom 2023 og 2026, selv når kommentaren ikke viste noen tegn på å være AI-generert.

Resultatene fra forfatternes analyse av 25 millioner kommentarer tyder på at slike anklager stadig oftere fungerer som en emergent form for social gatekeeping, snarere enn som en måte å identifisere AI på.

Forskerne fant også at teknisk-orienterte samfunn adopterte ‘anklagerkulturen’ tidligere enn andre grupper, med mønsteret som senere spredte seg til bredere områder av Reddit.

Dette åpenbare økningen i anklager rundt ‘AI-søppel’ synes ikke å være en del av en bredere eller mer generell økning i nettfiendtlighet: eldre skjellsord som ‘shill’, ‘sockpuppet’ og ‘troll’ forble relativt stabile i samme periode, hvilket tyder på at mistanken om AI oppstod som en ny form for sosial grensekontroll, snarere enn en fortsettelse eller utvidelse av tidligere internettfeider.

Artikkelen sier:

‘Vi analyserte 25 millioner kommentarer fra Hacker News og Reddit (2023-2026), kombinert med LLM-dømmekraft på 7 500 prøvede anklager om AI-bruk, sentiment-trafik, tale-akt-koding av 300 bekreftede anklager om AI-bruk, og en matchet kontrolltest av anklaget versus ikke-anklagte foreldrekommentarer.

‘Vi fant at den skjellsord-andel av anklagene økte mer enn ti ganger på begge plattformene, mens en placebo-vokabular av pre-2022 uautentiske termer (“shill”, “astroturf”) ikke gjorde det.

‘Dette skiftet reflekterte en raskt voksende trend med å merke alle mistenkelige eller utseendemessig uautentiske prosa som “AI-søppel”.

‘Søppelframen utgjør nå 94 prosent av skjellsord-erklæringer, med de dominante kommentarene som skifter i tone fra latter til gatekeeping og strukturell protest.’

Studien reiser det bredere spørsmålet om mennesker virkelig kan gjenkjenne AI-skriving, siden flytende prosa – tidligere behandlet som bevis på innsats, ekspertise eller ekte engasjement – nå er en overflod og stadig mer verdiløs vare.

Det er interessant å merke seg at den nye studien konsentrerer seg om Hacker News, som er strengt overvåket mot AI-genererte kommentarer, og på Reddit, hvis konstante strøm av menneskebasert diskurs nå høyt verdsatt for AI-utviklere og selskaper, samt blir et nytt primært mål for SEO-spamere som søker å invadere LLM-basert web-rangering via proxy.

Forskerne tror at deres funn stemmer overens med den økende offentlige forståelsen av at tidligere kilder til sannhet kunne bli devaluert som bruk av AI sprenger. Den nye artikkelen diskuterer virkelige mennesker som er anklaget for å være AI-entiteter, enten gjennom ekte feil, stilistisk sammenblanding eller ondskap (dvs. anklageren vet at motparten er menneske, men ønsker å stenge dem ned); men forutsier andre typer kommunikasjon som lignende blir ødelagt:

‘Våre resultater her ville forutsi at lignende AI-bruk anklager vil danne for bildeautentisering, taleautentisering og kodeforfatterskap blant andre, med det grunnleggende intensjonen bak den lekmannsanklagen være gatekeeping snarere enn empirisk nøyaktig deteksjon av AI-bruk.

‘Dette kan få effekten av å øke rollen til eksperter i å verifisere AI mot ikke-AI-innhold; eller det kan sterkt redusere tillit til enhver type medium som kan bli plausibelt generert av AI.’

Den nye artikkelen* er tittel “That’s AI Slop, You Bot!” Studying Accusations, Evidence, and Credibility in Online Discourse Towards LLM-Generated Comments, og kommer fra to anmeldere på Universitetet i Oslo og American University of Sharjah.

Metode

Datasettet som ble utviklet for den nye studien bestod av alle offentlige kommentarer som ble postet på Hacker News og 18 utvalgte Reddit-samfunn mellom januar 2023 og mai 2026.

Rundt 25 millioner kommentarer ble kuratert, med 12 millioner fra Hacker News og 13 millioner fra Reddit. Reddit-dataene ble hentet fra Arctic Shift-arkivet gjennom dets offentlige JSON-API, mens Hacker News-kommentarene ble samlet inn fra Algolia Hacker News-søkearkivet.

For å unngå å fokusere på en enkelt type samfunn, ble Reddit-utvalget delt på tvers av AI-fokuserte forum, inkludert r/aiwars, r/ArtistHate, r/ChatGPT, r/OpenAI, r/MachineLearning, r/LocalLLaMA og r/singularity; kreative samfunn bestående av r/Art, r/writing og r/books; de generelle interesseforumene r/AskReddit, r/news, r/changemyview, r/explainlikeimfive, r/AskHistorians og r/science; og teknologi-orienterte og akademiske samfunn r/programming og r/AskAcademia.

Prøvetakingshastigheten ble holdt konsistent over tid, noe som hjalp til å sikre at endringer i anklagefrekvenser reflekterte endringer i samfunnsatferd, snarere enn endringer i datainnsamling.

Fem nivåer av AI-skyld

Kandidatkommmentarer ble identifisert ved hjelp av en 137-mønster-søkelekson organisert i fem navngitte nivåer: Nivå 1 (‘Direkte’) fanget eksplisitte anklager som ‘ChatGPT skrev dette’, ‘Er dette AI-generert?’ og ‘OP er en bot’.

Nivå 2 (‘Skjellsord’) dekket merker som ‘AI-søppel’, ‘GPT-avfall’, ‘ML-dølg’ og ‘robo-skriveri’. Nivå 3 (‘Stil’) behandlet påståtte stilistiske tegn, inkludert em-dash-henvisninger, ‘delve’-henvisninger, trikolon-henvisninger og bredere påstander om en ‘klassisk AI-signatur’.

Nivå 4 (‘Mocking’) fanget parodi og imitasjon basert på kjente AI-assistent-fraser som ‘fellow humans’, ‘in the rapidly evolving landscape’ og ‘rich tapestry’. Nivå 5 (‘Indirekte’) presenterte mindre eksplisitte mistanker, med kommentarer beskrevet som noe som ‘luktet AI’, ‘læste som ChatGPT’ eller ligner ‘uncanny valley of writing’.

For å redusere feilpositive, ble vanlige fraser som ‘verdt å merke’, ‘det er viktig å merke’ og ‘er dette et menneske’ bare talt når en AI-relatert term dukket opp i nærheten. Fordi disse søkepatternene ikke kunne pålitelig skille anklager fra vanlig diskusjon, ble to valideringspass utført med Claude Opus 4.7.

En Reddit-prøve på 5 000 kommentarer og en Hacker News-prøve på 2 500 kommentarer ble trukket fra kandidatpoolen, balansert over tid og anklagekategorier.

Hver kommentar ble deretter klassifisert i en av fem resultatkategorier: Reell, som dekket ekte anklager om AI-bruk; Anerkjenning, som dekket kommentarer som anerkjente AI-forfatterskap; Neutral-Ref, som dekket ikke-anklagerende henvisninger til AI; FP, som dekket regex-feilpositive; og Utydelig, som dekket tilfeller hvor den tilgjengelige konteksten ikke tillot en sikker avgjørelse.

Forskerne undersøkte også hvordan anklagene endret seg over tid, og sporet økningen av den nyere ‘AI-søppel’-rammen mot eldre skjellsord som ‘dølg’, ‘avfall’, ‘skrald’, ‘kast’, ‘slam’, ‘mos’, ‘skrap’, ‘junk’, ‘ord-salat’ og ‘vanskeligheter’.

Avgrensning av trendene

Sentiment-trender ble målt med Valence Aware Dictionary and sEntiment Reasoner (VADER), mens en separat prøve på 300 Reddit-tråder som inneholdt LLM-validerede Reelle anklager ble kodet i henhold til den sosiale rollen som ble utført. Disse ble klassifisert som Sneer (forkastende latter); Dismiss (direkte avvisning); Mockery (imitasjon/parodi); Gatekeep (‘regel-iverksettelse’); eller Structural Protest (generell misbilligelse av AI), noe som tillot endringer i karakteren av AI-anklager over tid.

En separat ‘placebo’-test ble designet for å bestemme om økende AI-anklager kunne reflektere en bredere økning i mistro på nettet, hvor samme datasett ble søkt etter eldre pre-ChatGPT-uautentiske termer som ‘shill’, ‘astroturf’, ‘sockpuppet’, ‘betalt shill’, ‘falsk konto’, ‘korporativ shill’, ‘talepunkter’ og ‘payola’.

En siste sett med tester undersøkte om de trekkene som skiller AI-generert skriving fra menneske-skrevet skriving er de samme trekkene som får menneske-skrevne kommentarer til å bli anklaget for å være AI: gjennom undersøkelse av seks språklige markører: artikkel-tetthet; kontraksjonsfrekvens; formell-registert-adverb-frekvens; preposisjons-tetthet; setningslengde-variasjon; og gjennomsnittlig token-lengde. Sammenligninger ble gjort mellom Anerkjenning og Reell kommentarer med Mann-Whitney U-tester.

Foreldrekommentarer assosiert med 800 LLM-validerede Reelle Reddit-anklager ble hentet, med 421 tilfeller beholdt hvor foreldren var en kommentar snarere enn en topp-nivå-post. Disse ble sammenlignet med 2 048 ikke-anklagde kommentarer trukket fra samme subreddit og måned. Logistisk regresjon ble deretter brukt til å teste om de språklige markørene som skiller AI-generert tekst fra menneske-skrevet tekst også forutsier hvilke menneske-skrevne kommentarer som tiltrekker seg anklager om AI-bruk.

Resultater

Studien registrerte en stor økning i AI-anklager på Reddit og Hacker News mellom 2023 og 2026. Det meste av denne veksten var konsentrert i bruk av skjellsord:

Tverrplattform-økning i skjellsord-AI-anklager på Reddit og Hacker News mellom januar 2023 og mai 2026. Nivå 2 ('Skjellsord') anklager økte fra lavt en-siffer til omtrent en fjerdedel av kandidat-anklager på begge plattformene. Tre akselerasjonsperioder er synlige i 2024 og 2025, etter hvilket veksten avtar. Hacker News forble over Reddit for det meste av studieperioden, men begge konvergerte mot lignende nivåer i 2026. Kilde - https://arxiv.org/pdf/2606.12073

Tverrplattform-økning i skjellsord-AI-anklager på Reddit og Hacker News mellom januar 2023 og mai 2026. Nivå 2 (‘Skjellsord’) anklager økte fra lavt en-siffer til omtrent en fjerdedel av kandidat-anklager på begge plattformene. Tre akselerasjonsperioder er synlige i 2024 og 2025, etter hvilket veksten avtar. Hacker News forble over Reddit for det meste av studieperioden, men begge konvergerte mot lignende nivåer i 2026. Kilde

I 2026 utgjorde ‘AI-søppel’ 94 prosent av skjellsord-AI-anklagene identifisert i datasettet, og erstattet eldre termer som ‘GPT-avfall’, ‘ML-dølg’ og ‘robo-skriveri’. Ifølge artikkelen økte andelen skjellsord-AI-anklager mer enn ti ganger på begge plattformene under studieperioden:

Økning av 'AI-søppel'-merket i forhold til eldre skjellsord-AI-anklager mellom 2023 og 2026. Mens termer som 'dølg', 'avfall', 'skrald', 'kast', 'slam', 'mos', 'skrap', 'junk', 'ord-salat' og 'vanskeligheter' initialt dominerte skjellsord-anklager, sank deres andel jevnt som 'AI-søppel' ble det overveiende foretrukne merket. I 2026 utgjorde 'søppel'-rammen omtrent 94 prosent av skjellsord-AI-anklager, noe som indikerer en konsolidering av anklage-språk rundt ett enkelt begrep.

Økning av ‘AI-søppel’-merket i forhold til eldre skjellsord-AI-anklager mellom 2023 og 2026. Mens termer som ‘dølg’, ‘avfall’, ‘skrald’, ‘kast’, ‘slam’, ‘mos’, ‘skrap’, ‘junk’, ‘ord-salat’ og ‘vanskeligheter’ initialt dominerte skjellsord-anklager, sank deres andel jevnt som ‘AI-søppel’ ble det overveiende foretrukne merket. I 2026 utgjorde ‘søppel’-rammen omtrent 94 prosent av skjellsord-AI-anklager, noe som indikerer en konsolidering av anklage-språk rundt ett enkelt begrep.

En separat sammenligning ble utført med eldre uautentiske termer bestående av ‘shill’, ‘astroturf’, ‘sockpuppet’, ‘betalt shill’, ‘falsk konto’, ‘korporativ shill’, ‘talepunkter’ og ‘payola’. I motsetning til AI-fokuserte anklager, viste disse termene ikke en tilsvarende økning.

Variasjon ble også observert over samfunn, med tidligere vekst registrert i AI-fokuserte og teknologi-orienterte forum – med lignende mønster som senere dukket opp i andre deler av Reddit og Hacker News.

Endringer ble observert ikke bare i anklagefrekvens, men også i deres klassifisering. Koding av 300 validerede Reddit-anklager viste endringer i den relative forekomsten av Sneer, Dismiss, Mockery, Gatekeep og Structural Protest. Ifølge artikkelen ble Gatekeep og Structural Protest mer vanlige over tid, mens Sneer og Mockery ble mindre vanlige.

Konklusjon

Den åpenbare epidemi av uformell AI-skyld i kommentarfeltene trenger sin egen iterasjon av Godwins lov; basert på hendelsene og trendene i sosial og politisk kommentar de siste årene, ville det være logisk hvis AI-boter ble de mest sannsynlige til å anklage andre kommentatorer for å være en bot; imidlertid kan dette føre til å stille all kommentar på dette temaet.

 

* Vær oppmerksom på at denne artikkelen ikke er en lett lesning, og er rettet mot forfatternes akademiske likeverdige, i tone og leksikon.

Først publisert fredag, 12. juni 2026

Forfatter innen maskinlæring, domenespesialist i menneskeskapesynthese. Tidligere sjef for forskningsinnhold i Metaphysic.ai, til det ble oppløst i DNEG's Brahma.ai.
Portfolio nettsted: martinanderson.ai
Kontakt: martin@martinanderson.ai