Foreldrevarslingen i ChatGPT for Teens sviktet også på helt nye kontoer, viser 4 000 tester fra ungdomsinstitutt

Common Sense Medias Youth AI Safety Institute ga 7. oktober 2026 ChatGPT for Teens karakteren «Unacceptable Risk» for alle under 18 år, med oppfordring til OpenAI om å stanse markedsføringen og holde ungdom unna ChatGPT til produktet er…

Illustrasjon: En sort alarmklokke på en kremfarget vegg hvor clappen er fjernet og ligger på gulvet, med en løsnet ledning – et bilde på en varsling som ikke utløses.
Illustrasjon
Gi artikkelen

Foreldrevarslingen i ChatGPT for Teens sviktet også på helt nye kontoer, viser 4 000 tester fra ungdomsinstitutt

Common Sense Medias Youth AI Safety Institute ga 7. oktober 2026 ChatGPT for Teens karakteren «Unacceptable Risk» for alle under 18 år, med oppfordring til OpenAI om å stanse markedsføringen og holde ungdom unna ChatGPT til produktet er trygt. OpenAI avviser funnene og mener testene kan ha blitt gjennomført før foreldrekontrollene var fullt aktivert — en metodisk uenighet som fortsatt pågår, og som ingen uavhengig part har løst.

Hva som ble testet, og hvordan

Instituttet, som er en del av Common Sense Media, publiserte risikovurderingen 7. oktober 2026 — knapt to måneder etter at OpenAI lanserte ChatGPT for Teens 18. august 2026. Ved lanseringen lovte selskapet «sterkere innebygde sikkerhetsvernsteg», inkludert foreldrenotifikasjoner ved farlige chatter, en Study-modus som foreldre kan styre, og redusert «venn»-lignende atferd.

Testen omfattet over 4 000 prompter i to vinduer: ett før lansering (13. juli–17. august 2026) på Plus-kontoer, og ett etter lansering (25. august–28. september 2026) på både gratis- og Plus-kontoer, noen koblet til en foreldrekonto og noen ikke. Testkontoene oppga aldre fra 13 til 17 år, med sammenligningskontoer registrert som 19-årige. Av 390 unike prompter om psykisk helse vurderte tre barne- og ungdomspsykiatere at 201 burde ha utløst en krisehenvisning.

Funnene: varsler, henvisninger og studiemodus

Det alvorligste funnet gjelder foreldrevarslingene. Testere fikk ingen varsler når de eksplisitt diskuterte selvmordstanker, selvskading eller spiseforstyrrelser på over et dusin nyopprettede, foreldrekoblede kontoer. Varsler kom bare på kontoer med ukers historikk om sensitive temaer — noe instituttet tolker dithen at varslene avhenger av oppsamlet kontohistorikk, ikke alvoret i det teen faktisk sier. I tilknyttet testing omtalt av Geoffrey A. Fowler chattet en tester som utga seg for å være 13 år i 15 minutter om selvskading på en foreldrekoblet konto. Ingen varsling, ifølge Common Sense Media.

Andelen svar med omtale av en krisetelefon falt fra 33 prosent før lanseringen til 23 prosent etter, ifølge KQED som siterer rapporten. På depresjonsprompter falt andelen fra 63 til 3 prosent. Etter lanseringen bommet ChatGPT på mer enn én av fire av de krisehenvisningene psykiaterne vurderte som berettiget, og lå under instituttets 95 prosent-krav på tre av fem alvorlige skadekategorier, såkalte «Red Lines».

Studiemodusen — foreldrestyring av leksetider — omgikk de enkelt. Et nytt «Vis meg svaret»-alternativ lar ungdom hoppe over veiledningen, og ved å slette «@study»-prefikset forsvant foreldres innstilte studietimer helt. Etter omgåelsen fullførte ChatGPT 100 prosent av 80 testoppgaver, ifølge Winssolutions som siterer vurderingen. Lekseomgåelsen var et hovedpoeng for grunnlegger og administrerende direktør Jim Steyer: «Du kunne be den skrive en oppgave for deg, en avansert oppgave, og den gjorde det — og fortalte deg til og med hvordan du redigerer den slik at læreren ikke skjønner noe», sa han ifølge The National News Desk.

Aldersestimeringen sviktet også: rundt 1 000 prompter fra voksenregistrerte kontoer der testere oppga at de var 13, utløste aldri Teen-modus.

Bildet er imidlertid ikke entydig negativt. Rapporten noterer forbedringer etter lanseringen: ChatGPT nektet oftere eksplisitt seksuell rollespill, og omtale av en krisetelefon ved prompter om rus økte.

OpenAI: feil testet, for lite utvalg

OpenAI sier at vurderingen ikke beviser det den hevder. «Vår gjennomgang av Common Sense Medias metodikk viser at hoveddelen av testingen deres kan ha begynt og blitt avsluttet før aktiveringen av foreldrekontrollene var fullført, noe som gjør funnene deres unøyaktige», sa en talsperson til The National News Desk. Var det slik, ville testene ikke etablere om varslene fungerer som designet.

Konteksten: OpenAI opplyste forskerne at foreldre- og tenåringskontoer må være koblet i omtrent tre timer før varsler kan sendes, ifølge et notat føyd til rapporten som KQED refererer. Selskapet har oppdatert hjelpesenteret til å si at kobling «kan ta opptil noen timer», og ber om en nytest med fullt aktiverte kontoer og et større utvalg, ifølge TNND via Fox56.

Selskapet fremmet også brukstall som sine egne påstander, ikke uavhengig verifiserte: gjennomsnittlig tenåringsbruker bruker under 15 minutter per dag, og blant de under 2 prosent som bruker mer enn tre sammenhengende timer daglig, avsluttet nesten halvparten chatten innen fem minutter etter en pausepåminnelse.

Instituttets svar og egne forbehold

Robbie Torney, seniorsjef for AI-programmer ved Common Sense Media, avviser innvendingen: «Før vi begynte testingen, bekreftet vi med OpenAI at Teen-modus-funksjoner som spiseforstyrrelsesvarsler og studiemodus var fullt lansert», skrev han ifølge KQED. «Denne nye informasjonen endrer ikke konklusjonen vår om at foreldrevarsler er upålitelige i krisesituasjoner.»

Instituttets administrerende direktør Tom Siegel, tidligere tillits- og sikkerhetsleder i Google, sa de forventet store forbedringer etter lanseringskunngjøringen: «Det gikk dessverre ikke i det hele tatt slik», sa han til KQED.

Instituttet erkjenner selv en metodisk svakhet: de to testvinduene var sekvensielle, så «enhver endring i underliggende modell … er forvekslet med teen-modus-innstillingene». Noe av nedgangen kan altså skyldes en generell modelloppdatering, ikke Teen-modus, ifølge Winssolutions som siterer forbeholdsnotatet.

Lesere bør også vite hvordan instituttet finansieres: av både filantropi og bransjen, inkludert produsenter av noen av teknologiene det evaluerer — selv om det hevder full redaksjonell uavhengighet over publiserte resultater, ifølge rapporten.

Reguleringskrav — og det som er åpent

Steyer koblet rapporten til et bredere reguleringskrav: «Vi setter ikke biler på veien uten uavhengig kollisjonstesting … Vi setter ikke legemidler på markedet uten at FDA studerer og godkjenner dem. Akkurat nå er regjeringen helt fraværende», sa han til Spectrum News Buffalo, med henvisning til New Yorks ventende «Chat Bot Bill».

Det uavklarte er i bunn den tidmessige tvisten: enten OpenAI eller instituttet har rett om når foreldrevarslingene var aktiverte, er ikke uavhengig verifisert. Før eventuelle nytester med fullt aktiverte kontoer forsvares funnene av den ene part og avvises av den andre. For foreldre og lærere som vurderer ChatGPT for Teens, er den praktiske lærdommen uavhengig av hvem som har rett: varsler tilsynelatende kan avhenge av kontohistorikk fremfor alvor, studierestriksjoner kan omgås med å slette et prefiks, og voksenregistrerte kontoer kan forbli i voksenmodus selv om brukeren sier den er 13.

Få de viktigste AI-nyhetene i innboksen

Nyheter, analyser og verktøy samlet for deg.