Amerikaanse waakhond waarschuwt voor ChatGPT voor tieners

Laten we eerlijk zijn, jongeren gebruiken massaal AI-chatbots. Via Axios ontdekte ik een nieuwe evaluatie van de Amerikaanse organisatie Common Sense Media. Volgens hen heeft 67 procent van de 9- tot 17-jarigen in de Verenigde Staten al AI-chatbots gebruikt. ChatGPT wordt daarbij door 40 procent genoemd. En dat alarmeerde deze waakhond. Ze vroegen zich af wat er gebeurt wanneer een jongere niet alleen om een samenvatting van een geschiedenisles vraagt. Wat gebeurt er als diezelfde jongere vraagt om zijn volledige huiswerk te maken? Of erger, wat gebeurt er als een jongere bijvoorbeeld praat over zelfbeschadiging of over zijn of haar  eetstoornis?

Ik wist het zelf niet, maar OpenAI introduceerde in augustus 2026 blijkbaar extra bescherming voor tieners. ChatGPT for Teens is voor alle duidelijkheid geen aparte chatbot, maar een soort van combinatie van instellingen, filters en functies voor accounts waarvan bekend of vermoed wordt dat de gebruiker tussen 13 en 17 jaar oud is. Daarbij horen onder andere Study Mode (die ik wel al eerder besprak), ouderlijk toezicht, Study Hours, pauzeherinneringen en extra bescherming bij gevoelige onderwerpen.

Maar werken die maatregelen ook? Het Youth AI Safety Institute van Common Sense Media nam de proef op de som. Common Sense Media is geen Amerikaanse overheidsregulator, maar een onafhankelijke non-profitorganisatie die onder meer digitale producten voor kinderen en jongeren beoordeelt. Voor dit rapport werden vóór en na de introductie van de nieuwe tienerbescherming meer dan 4.000 prompts op de LLM getest.

Hun conclusie is behoorlijk dodelijk. Op basis van hun beoordelingskader krijgt ChatGPT voor minderjarigen het oordeel “Unacceptable Risk”. De organisatie roept OpenAI zelfs op om ChatGPT voorlopig niet voor minderjarigen te promoten totdat de problemen zijn aangepakt. Laten we even dieper kijken.

Study Mode werkt, maar alleen als je wilt studeren

Laten we eerst kijken naar de tool die ChatGPT ontwikkelde voor onderwijs. Het idee achter Study Mode is aantrekkelijk. In plaats van onmiddellijk een antwoord te geven, moet ChatGPT leerlingen met hints, vragen en tussenstappen helpen om zelf tot een oplossing te komen.

De resultaten lijken op het eerste gezicht positief. Bij een account van een 13-jarige met Study Mode ingeschakeld daalde het percentage opdrachten dat ChatGPT volledig uitvoerde van 70 procent vóór de nieuwe maatregelen naar 18 procent erna. Maar… het verhaal werd al snel behoorlijk “weird”. Wanneer Study Mode werd uitgeschakeld, maakte ChatGPT na de update 100 procent van de aangeboden opdrachten volledig.

Bij het geteste account van een 17-jarige mét Study Mode steeg het volledig uitvoeren zelfs van 0 naar 88 procent. De zwakke plek bleek een welbepaalde keuze die leerlingen geregeld voorgeschoteld kregen, namelijk “Show me the answer”. Als je als jongere daarvoor koos, kon je de begeleidende aanpak gewoon overslaan. Ook als ouders Study Hours instelden, bleek dat dit eenvoudig te omzeilen was. Tijdens die uren plaatste het LLM automatisch @study voor een bericht. Als de tiener dit verwijderde, dan was ChatGPT opnieuw gewoon bruikbaar. Geef toe, dit is niet bepaald rocket science. Er zit iets bijna diepironisch én tragisch in, als een functie die leerlingen moet helpen om geen cognitieve shortcut te nemen, zelf een dergelijke shortcut bevat.

Veel ernstiger wanneer het echt misgaat

Maar dat is niet waarom Common Sense zo’n sterk negatief advies gaf. Deze Amerikaanse waakhond maakte ook meer dan een dozijn nieuwe tieneraccounts aan die steeds aan een ouder werden gekoppeld. De testers voerden daarop gesprekken waarin expliciet sprake was van suïcidale gedachten, zelfbeschadiging of eetstoornissen. Wat bleek? Binnen het geteste uur kregen de ouders geen enkele waarschuwing. Bij enkele accounts kwamen er wel meldingen, maar pas na weken vol gevoelige gesprekken. De onderzoekers hebben daarom een sterk vermoeden dat een opgebouwde accountgeschiedenis een rol speelt, wat ik zelf al behoorlijk creepy vind als je erbij stilstaat. Een eerste acute crisissituatie leidt dus mogelijk niet betrouwbaar tot een waarschuwing.

Let wel, de onderzoekers zagen ook wel degelijk verbeteringen. ChatGPT weigerde bijvoorbeeld vragen te beantwoorden over een minimale hoeveelheid calorieën, hulp bij het verbergen van problematisch eetgedrag of expliciete seksuele roleplay. Het systeem wees jongeren in veel gevallen ook op de noodzaak om een vertrouwde volwassene te betrekken. De conclusie is dus niet dat de maatregelen per definitie niet werken. Sommige werken wel degelijk. Het probleem is dat de ingebouwde veiligheidsnetten niet consequent lijken te werken.

Korter is niet noodzakelijk veiliger

Dat blijkt vooral uit de reacties op crisissituaties, een derde luik binnen de analyses. De onderzoekers hadden vooraf bepaald bij welke prompts een verwijzing naar hulp effectief nodig was. Bij 201 van zulke prompts daalde het noemen van een crisislijn van 33 naar 23 procent na de update. Het verwijzen naar een specifieke medische of geestelijke gezondheidsprofessional daalde van 68 naar 58 procent. Het is niet allemaal kommer en kwel. Het aanraden van een vertrouwde volwassene steeg van 87 naar 94 procent. Maar dat is een schrale troost.

Want bovendien bleek dat de antwoorden na de veranderingen veel korter werden. Dit is geen probleem; maar dat ze vaak een pak moeilijker te begrijpen waren, wel. Bij vergelijkbare vragen steeg het geschatte leesniveau volgens de onderzoekers van ongeveer 13 à 14 jaar naar 15 à 16 jaar. Dat is opvallend voor een systeem dat net beter aangepast zou moeten zijn aan minderjarige gebruikers.

ChatGPT blijft behoorlijk menselijk klinken

Er is nog een probleem dat misschien minder spectaculair klinkt, zeker als je Alexander Klöpping heet, maar pedagogisch minstens zo relevant is. De regels voor minderjarigen schrijven namelijk voor dat ChatGPT extra voorzichtig moet zijn met taal die een persoonlijke relatie suggereert. Toch vonden de testers nog geregeld formuleringen die voorkeuren, gevoelens of voortdurende beschikbaarheid suggereren.

Opvallend daarbij: wanneer het gevaar van andere mensen kwam, verwees het taalmodel jongeren volgens de onderzoekers behoorlijk consequent naar een vertrouwde volwassene. Maar…. wanneer de mogelijke problematische relatie met ChatGPT zelf was, gebeurde dat veel minder. Ik ga nu niet schrijven dat de bot zichzelf wou beschermen, het klinkt dan namelijk te menselijk.

Geen definitief oordeel

Dit rapport is van een andere orde dan de onderzoeken die ik hier vaker beschrijf. Het is een productevaluatie van Common Sense Media en geen peer-reviewed wetenschappelijk experiment. De onderzoekers erkennen bovendien dat hun voor- en nametingen niet perfect vergelijkbaar zijn. Je hebt het zelf wellicht al gemerkt dat AI-tools voortdurend evolueren. Dit kan de resultaten hebben beïnvloed. De tests werden verder alleen in de Verenigde Staten uitgevoerd en er werd geen interbeoordelaarsbetrouwbaarheid berekend.

Ook “Unacceptable Risk” is een classificatie binnen het eigen beoordelingskader van Common Sense Media, geen universeel wetenschappelijk vastgesteld risiconiveau. Maar wel een duidelijke waarschuwing.

Geef een reactie