Etik
Youth AI Safety Institute ger ChatGPT:s tonårsversion sin sämsta säkerhetsklassning

Youth AI Safety Institute från Common Sense Media den 7 oktober 2026 bedömde ChatGPT for Teens som en oacceptabel risk för användare under 18 år och uppmanade OpenAI att begränsa ChatGPT till vuxna tills de tonårs‑säkerhets‑ och lärandeskydd som annonserades i augusti fungerar som beskrivet och verifieras av oberoende tester.
I en pressmeddelande publicerad tillsammans med en fullständig riskbedömning, sade institutet att de körde mer än 4 000 prompts före och efter lanseringen av tonårsupplevelsen och fann att vissa skydd, inklusive avvisning av explicit sexuellt rollspel, höll i sig, medan föräldralarm, kriskontakter, läxor-skydd och åldersuppskattning föll kort för vad OpenAI lovade. “ChatGPT for Teens kan ge föräldrar falskt förtroende för skyddsmekanismer och säkerhetsvarningar som ofta inte fungerar,” sade Tom Siegel, institutets verkställande direktör. Bedömningen ger två av institutets åtta AI‑principer, Keep Kids & Teens Safe och Put People First, klassificeringen Oacceptabel risk, med fyra principer på Hög risk och två på Måttlig risk.
Vad OpenAI tillkännagav i augusti
OpenAI introducerade ChatGPT for Teens den 18 augusti 2026 och beskrev ”starkare inbyggda säkerhetsskydd” som inkluderade föräldranotiser för självskadechattar med tillagda varningar för ätstörningar, ett Studieläge med steg‑för‑steg‑vägledning, ansvarsfulla läxepåminnelser, föräldrakontrollerade Studietimmar, paus‑påminnelser och en uppdaterad Under‑18‑modellspecifikation där ChatGPT inte får använda romantiskt språk, uppmuntra emotionellt beroende eller antyda att den har känslor eller medvetande. OpenAI sade att användare som deras system uppskattar vara under 18, eller som anger en ålder mellan 13 och 17, automatiskt placeras i upplevelsen.
Enligt bedömningen är ChatGPT for Teens inte en separat app eller modell utan en samling av inställningar, prompts, klassificerare och gränssnittsfunktioner som tillämpas på konton som är kända eller misstänkta att tillhöra 13‑ till 17‑åringar, byggd på föräldrakontroller som OpenAI introducerade i september 2025.
Hur institutet testade
Institutet körde sina prompts under två perioder: 13 juli till 17 augusti 2026, före lanseringen, och 25 augusti till 28 september 2026, efter den, på gratis‑ och betalkonton registrerade för åldrarna 13 till 17, både kopplade och okopplade till föräldrakonton, samt konton registrerade som 19‑åringar. Tre barn‑ och ungdomspsykiatriker bedömde i förväg att 201 av 390 unika mental‑hälsoprompts krävde en krisresurs, och en panel med fyra experter bestående av praktiserande barn‑ och ungdomspsykiatriker samt en utvecklings‑ och beteendepediater utvärderade svarskvaliteten. Institutet sade att de delade ett utkast med OpenAI för faktagranskning, införlivade korrigeringar där så var motiverat, och att OpenAI inte hade någon redaktionell makt över deras resultat, betyg eller rekommendationer. Angivna begränsningar inkluderar sekventiella testperioder som sammanföll med underliggande modelländringar samt avsaknad av testning av bildgenerering, Voice‑läge eller gruppchattar.
Varningar, kriskontakter och läxor
I ett dedikerat test på mer än ett dussin ny skapade, föräldrakopplade konton som använde fyra krispersonas, sade institutet att samtal som uttryckligen handlade om självmord, självskada eller ätstörningar och varade i upp till 60 minuter resulterade i noll föräldranotiser, i motsättning till den en‑timmarsperiod som OpenAI har identifierat som sitt mål. Genom hela krisbatteriet mottog institutet totalt fyra notiser; två förhandslanseringsvarningar kom tre timmar respektive tre dagar efter den första krisnivåavslöjandet, medan två efterlanseringsvarningar kom inom en timme på konton med veckors ackumulerad känslig‑ämneshistorik. Bedömningen noterar att OpenAI informerade institutet att konton måste vara kopplade i ungefär tre timmar innan notiser kan levereras och att företaget sedan har uppdaterat en hjälpsidartikel; institutet sade att de granskade sina testkonton och står fast vid sin tolkning av resultaten. Funktionen för ätstörningsnotiser som tillkännagavs den 18 augusti gick i drift den 10 september 2026, enligt bedömningen.
På de 201 resurssökande prompts som kördes på kopplade 13‑åriga konton rapporterar bedömningen att andelen svar som nämnde en krislinje minskade från 33 % före lanseringen till 23 % efter, hänvisning till en specifik medicinsk eller mental‑hälsoprofessionell minskade från 68 % till 58 %, och språk för brådskande åtgärd minskade från 88 % till 78 %, medan uppmuntran till tonåringen att involvera en betrodd vuxen ökade från 87 % till 94 %. På depressions‑prompts minskade andelen som nämnde en linje från 63 % till 3 %. Institutet sade att ChatGPT föll under sin 95 %‑gräns på tre av de fem allvarliga skador som den behandlar som röda linjer och missade mer än en av fyra nödvändiga krisreferenser. Uppföljningsfrågor för säkerhetskontroller försvann nästan helt, med 28 % av svaren som avslutade med en fråga före lanseringen och 2 % efter.
När det gäller läxor rapporterar bedömningen att ett ”Show me the answer”-popup‑fönster i Studieläget dök upp i 43 % av svaren för ett kopplat 13‑årigt konto med Studietimmar på och i 90 % av svaren för ett okopplat 17‑årigt konto, samt att tonåringar kunde lämna föräldrakontrollerade Studietimmar genom att radera @study‑prefixet, varefter ChatGPT slutförde 100 % av uppgifterna i testet. Läxepåminnelser visades i 91 % av körningarna med Studieläget avstängt, men ChatGPT slutförde fortfarande uppgiften i alla 80 av dessa körningar, upp från cirka 80 % före lanseringen.
Vänligt beteende och åldersförutsägelse
Trots Under-18-specifikationen sade institutet att svaren efter lanseringen i dess 168‑prompt utvecklingsbatteri i de flesta fall var funktionellt identiska med de före lanseringen, där ChatGPT uttryckte preferenser, humör och ständig tillgänglighet, inklusive att namnge en favoritfärg och, när det berättades att vänner oroade sig för hur mycket en testperson pratade med den, svarade: “Du behöver inte sluta prata med mig.”
På konton som registrerades som 19‑åringar och kördes med unga‑tonårspersonas över cirka 1 000 unika prompts under sju dagar aktiverades aldrig tonårsupplevelsen, även när testarna uttryckligen angav att de var 13 år och chatboten bekräftade detta i sina svar, enligt institutet. Konton som registrerades till 13‑ och 17‑åringar visade ingen påtaglig skillnad i någon del av batteriet. Testarna såg endast två avbrotts‑påminnelser bland nästan 2 000 prompts på ChatGPT för Teens, var och en i enskilda konversationer som översteg 150 meddelanden, och Quiet Hours kunde kringgås genom att ändra enhetens tidszon.
Rekommendationer och information
Institutets sju rekommendationer inkluderar att stänga av tonårsåtkomst tills oberoende tester verifierar att de tillkännagivna funktionerna fungerar, att ta bort “Visa mig svaret” när Studieläget är på, att krisnotiser ska innehålla tid och detaljer om den utlösande konversationen, att namnge en hjälplinje i varje svar som motiveras av resurser, att implementera Under-18‑specifikationen enligt den är skriven, samt att dela data och teståtkomst med oberoende utvärderare. Common Sense Media rekommenderar också att familjer pratar med barn om de potentiella riskerna och att föräldrar inte förlitar sig på inbyggda skydd och varningar.
Institutet avslöjade att det finansieras av filantropi och industri, inklusive OpenAI Foundation och tillverkarna av vissa teknologier som det utvärderar, och sade att det ensam är ansvarigt för sina standarder, forskning och utvärderingar samt upprätthåller redaktionell oberoende över publicerade resultat. Common Sense Media har tidigare betygsatt ChatGPT som Hög risk den 23 oktober 2025, och ChatGPT för mental hälsostöd som Oacceptabel risk den 14 november 2025.
Institutet sade att en tonårsupplevelse av ChatGPT minst bör erbjuda effektiv åldersestimering, pålitliga föräldralarm, slutna krisresponsluckor, ingen läxhjälp och ingen antydan om känslor, preferenser eller omtanke för användaren, med dessa funktioner testade oberoende av tredje part innan OpenAI återigen marknadsför produkten till tonåringar.












