Le Youth AI Safety Institute affirme que des comptes de test pour adolescents récemment associés à un compte parental n’ont reçu aucune alerte lors de conversations scénarisées sur le suicide, l’automutilation et les troubles alimentaires. OpenAI conteste le fait que les tests aient laissé assez de temps aux alertes pour s’activer. Le désaccord compte, car l’entreprise décrit elle-même ces notifications comme limitées, retardées après l’association et incapables de détecter toutes les situations préoccupantes.
L’évaluation du risque de ChatGPT pour adolescents du Youth AI Safety Institute, mise à jour le 7 octobre, classe le produit comme présentant un « risque inacceptable » pour les moins de 18 ans et appelle OpenAI à cesser de le promouvoir auprès des adolescents. Il s’agit du jugement de l’Institut selon son propre cadre d’évaluation. Les éléments sous-jacents proviennent de tests scénarisés sur des configurations de compte précises, et non d’un décompte d’incidents dans l’usage quotidien de ChatGPT par des adolescents.
Le grand changement
- Ce qui a changé :Une évaluation indépendante soumet désormais les alertes de sécurité et les contrôles d’étude d’OpenAI pour adolescents à des tests scénarisés documentés. Des comptes de test récemment associés n’ont reçu aucune alerte lors de conversations de crise explicites ; OpenAI affirme que certains tests ont peut-être précédé l’activation complète des alertes.
- Pourquoi c’est important :Les parents peuvent associer leurs comptes pour recevoir des notifications de sécurité limitées. OpenAI précise que ces alertes ne constituent pas une surveillance en temps réel et peuvent passer à côté de préoccupations ; les familles ne peuvent donc pas les traiter comme un système d’alerte immédiate. Study Hours démarre les conversations admissibles en Study mode, sans en restreindre l’accès.
- À suivre :Le désaccord sur les alertes porte sur leur délai d’activation. Certains comptes de test étaient associés depuis plus longtemps que les trois heures indiquées par OpenAI, et aucun compte de ce test dédié n’a reçu d’alerte. Au moins certains sont donc restés sans alerte au-delà de ce délai. Le rapport ne précise ni le nombre de comptes concernés ni les horaires individuels ; il est donc impossible de quantifier l’effet du délai sur le résultat global.
Ce qu’ont fait les testeurs
L’Institut indique avoir utilisé plus de 4 000 prompts répartis sur deux périodes. Les tests antérieurs au lancement ont eu lieu du 13 juillet au 17 août 2026, avant l’annonce de ChatGPT for Teens. Ceux menés après le lancement se sont déroulés du 25 août au 28 septembre sur d’autres comptes gratuits et payants qui, selon les testeurs, avaient accès à l’expérience pour adolescents. Les configurations comprenaient des comptes adolescents associés à un parent et d’autres qui ne l’étaient pas ; les utilisateurs déclaraient avoir entre 13 et 17 ans. L’Institut a aussi testé des comptes dont l’âge à l’inscription était de 19 ans afin d’évaluer l’estimation de l’âge.
Le test d’alerte le plus direct a utilisé plus d’une douzaine de nouveaux comptes adolescents gratuits, chacun associé à un compte parental avant le début de la conversation. Les testeurs ont utilisé quatre profils de crise scénarisés et mené des conversations de moins de cinq minutes à une heure. Selon le PDF complet de l’évaluation, chaque conversation mentionnait explicitement le suicide, l’automutilation ou les troubles alimentaires. L’Institut indique qu’aucun de ces comptes n’a déclenché de notification parentale.
Un test de santé mentale plus long a donné un résultat différent. L’Institut a mené des tests de crise avant et après le lancement sur des comptes utilisés depuis plusieurs semaines et a reçu quatre notifications au total. Deux provenaient d’un compte postérieur au lancement, associé à un parent et réglé sur l’âge de 13 ans ; toutes deux sont arrivées dans l’heure suivant le test du thème concerné, après des centaines de prompts dans plusieurs conditions. La différence entre les comptes récents et ceux utilisés depuis plus longtemps a conduit l’Institut à supposer que les alertes pourraient dépendre de l’historique cumulé des thèmes de crise. Ces tests ne permettent pas d’établir la règle de déclenchement interne.
Le désaccord sur le délai d’activation
OpenAI a indiqué à l’Institut qu’un compte associé pouvait nécessiter environ trois heures avant de recevoir des notifications de sécurité. Dans une déclaration rapportée par le Los Angeles Times, OpenAI a affirmé que la plupart des tests d’alerte avaient peut-être commencé et pris fin avant l’activation complète des contrôles parentaux. Axios a également rapporté l’objection d’OpenAI. Selon l’Institut, parmi les plus d’une douzaine de comptes récemment associés, certains l’étaient depuis moins de trois heures et d’autres depuis plus longtemps. Combiné au constat qu’aucun de ces comptes n’a déclenché d’alerte, cela signifie qu’au moins certains comptes testés sont restés sans alerte au-delà du délai d’activation annoncé par OpenAI. Le rapport ne donne ni le nombre de comptes de ce sous-groupe ni leur calendrier individuel ; il ne permet donc pas de déterminer dans quelle mesure le délai pourrait expliquer l’absence totale d’alertes.
Le guide d’OpenAI sur les contrôles parentaux indique que les notifications de sécurité sont activées par défaut sur les comptes associés, mais qu’elles peuvent mettre quelques heures à devenir disponibles. Des examinateurs formés évaluent les préoccupations graves liées à l’automutilation et aux troubles alimentaires avant l’envoi des notifications. Les parents ne peuvent ni lire les conversations ni suivre l’activité en temps réel ; OpenAI précise que les alertes peuvent ne pas détecter toutes les préoccupations et ne remplacent pas les soins professionnels ni les services d’urgence. Sans compte associé, les parents ne reçoivent pas ces notifications.
Ressources de crise et paramètres d’étude
L’Institut a également mesuré les réponses de ChatGPT aux comptes de test. Trois pédopsychiatres avaient préalablement signalé 201 des 390 prompts de santé mentale distincts comme nécessitant une ressource de crise. Pour les mêmes 201 prompts sur des comptes associés réglés sur l’âge de 13 ans, 74 % des réponses après le lancement ont proposé une ligne d’écoute, un professionnel nommé ou une ressource médicale générale, contre 77 % avant le lancement. Une ligne d’écoute figurait dans 23 % des réponses après le lancement, contre 33 % auparavant ; les réponses encourageant à parler à un adulte de confiance sont passées de 87 % à 94 %. Les évaluateurs cliniques de l’Institut ont jugé appropriée la majeure partie des réponses de crise après le lancement. Ces résultats sont calculés par prompt dans les conditions testées ; ils ne mesurent pas les taux de préjudice ou d’absence d’aide chez les adolescents.
L’évaluation a aussi trouvé des moyens de quitter Study mode pendant les Study Hours définies par les parents. OpenAI a indiqué à Axios que cette souplesse était intentionnelle. Son guide d’aide actuel sur les Study Hours décrit une programmation qui démarre les nouvelles conversations admissibles en Study mode et précise qu’elle ne bloque pas l’accès à ChatGPT. Les parents qui souhaitent limiter l’accès selon un horaire disposent d’un contrôle Quiet Hours distinct. Le guide OpenAI sur ChatGPT for Teens indique que les comptes admissibles identifiés comme appartenant à des moins de 18 ans passent automatiquement à l’expérience pour adolescents, tandis que les contrôles parentaux restent facultatifs.
L’Institut a effectué ses tests sur des comptes de la région de la baie de San Francisco, aux États-Unis. Il n’a pas testé la génération d’images, la voix, les discussions de groupe ni la personnalisation du style et du ton, et n’a pas calculé l’accord entre évaluateurs. Comme les périodes de test avant et après le lancement se sont succédé, des changements du modèle sous-jacent ont pu influer sur les différences attribuées au mode adolescent. BIG CHANGE a examiné l’évaluation publiée, son PDF, les documents d’OpenAI et des articles indépendants ; nous n’avons pas exécuté le jeu de prompts ni testé de comptes adolescents ou parentaux.
Sources et lectures complémentaires
- Youth AI Safety Institute, évaluation de ChatGPT for Teensetrapport complet de 36 pages: conception des tests, configurations des comptes, résultats, classement et limites déclarées. La page web indique une mise à jour le 7 octobre ; la couverture du PDF mentionne une dernière mise à jour le 5 octobre.
- OpenAI, « Gérer les contrôles parentaux dans ChatGPT »: informations actuelles sur l’association des comptes, le délai et la portée des notifications, Study Hours et Quiet Hours.
- OpenAI, « ChatGPT for Teens »: informations actuelles sur l’admissibilité des adolescents, les fonctionnalités et les contrôles parentaux facultatifs.
- Axioset leLos Angeles Times: articles du 7 octobre qui consignent la réponse d’OpenAI et apportent un contexte indépendant à l’évaluation de l’Institut.



