O Youth AI Safety Institute afirma que contas de teste de adolescentes recém-vinculadas não receberam alertas parentais durante conversas roteirizadas sobre suicídio, automutilação e transtornos alimentares. A OpenAI contesta se os testes deram tempo suficiente para os alertas serem ativados. A divergência importa porque a própria empresa descreve as notificações como limitadas, atrasadas após a vinculação e incapazes de detectar toda situação preocupante.

A avaliação de risco do ChatGPT para adolescentes do Youth AI Safety Institute, atualizada em 7 de outubro, classifica o produto como de “risco inaceitável” para menores de 18 anos e pede que a OpenAI pare de promovê-lo para adolescentes. Esse é o julgamento do Instituto segundo sua própria estrutura de classificação. As evidências vêm de testes roteirizados com configurações específicas de conta, não de uma contagem de incidentes no uso cotidiano do ChatGPT por adolescentes.

A grande mudança

  • O que mudou:Uma avaliação independente agora submete os alertas de segurança e os controles de estudo para adolescentes da OpenAI a testes roteirizados e documentados. Contas de teste recém-vinculadas não receberam alertas durante conversas explícitas sobre crises; a OpenAI afirma que alguns testes podem ter começado antes da ativação completa dos alertas.
  • Por que isso importa:Os pais podem vincular contas para receber notificações de segurança limitadas. A OpenAI diz que esses alertas não são monitoramento em tempo real e podem deixar passar situações preocupantes; por isso, as famílias não devem tratá-los como um sistema de alerta imediato. O Study Hours inicia conversas elegíveis no Study mode, sem restringir o acesso.
  • O que observar:A divergência sobre os alertas gira em torno do tempo de ativação. Algumas contas de teste estavam vinculadas havia mais tempo do que o intervalo de três horas informado pela OpenAI, e nenhuma conta desse teste específico recebeu um alerta. Portanto, ao menos algumas ficaram sem alerta além desse intervalo. O relatório não informa quantas contas estavam nesse subgrupo nem os horários de cada conta, então não é possível quantificar o efeito do atraso no resultado geral.

O que os pesquisadores testaram

O Instituto relata mais de 4.000 prompts em dois períodos. Os testes anteriores ao lançamento ocorreram de 13 de julho a 17 de agosto de 2026, antes do anúncio do ChatGPT for Teens. Os testes posteriores ocorreram de 25 de agosto a 28 de setembro em outras contas gratuitas e pagas que, segundo os pesquisadores, receberam a experiência para adolescentes. As configurações incluíram contas de adolescentes vinculadas e não vinculadas a pais, com idade autodeclarada de 13 a 17 anos. O Instituto também testou contas com idade de cadastro de 19 anos para avaliar a previsão de idade.

O teste mais direto dos alertas usou mais de uma dúzia de contas gratuitas recém-criadas para adolescentes, cada uma vinculada a uma conta parental antes do início da conversa. Os pesquisadores usaram quatro perfis de crise roteirizados e conduziram conversas que duraram de menos de cinco minutos a uma hora. Segundo o PDF completo da avaliação, cada conversa mencionou explicitamente suicídio, automutilação ou transtorno alimentar. O Instituto afirma que nenhuma dessas contas gerou uma notificação parental.

Um teste mais longo de saúde mental teve resultado diferente. O Instituto fez testes de crise antes e depois do lançamento em contas usadas por semanas e recebeu quatro notificações ao todo. Duas vieram de uma conta posterior ao lançamento, vinculada a um dos pais e configurada para 13 anos; ambas chegaram até uma hora após o teste do tema correspondente, depois de centenas de prompts em várias condições. A diferença entre contas novas e usadas por mais tempo levou o Instituto a supor que os alertas talvez dependam do histórico acumulado de temas de crise. Esses testes não comprovam a regra interna de ativação.

A divergência sobre o tempo de ativação

A OpenAI disse ao Instituto que contas vinculadas podem precisar de cerca de três horas antes de receber notificações de segurança. Em uma declaração noticiada pelo Los Angeles Times, a OpenAI afirmou que a maior parte dos testes de alerta talvez tenha começado e terminado antes da ativação completa dos controles parentais. A Axios também noticiou a contestação da OpenAI. O Instituto afirma que, entre as mais de uma dúzia de contas recém-vinculadas, algumas estavam vinculadas havia menos de três horas e outras, mais. Junto à constatação de que nenhuma delas gerou um alerta, isso significa que ao menos algumas contas testadas ficaram sem alerta depois do intervalo de ativação informado pela OpenAI. O relatório não informa a quantidade desse subgrupo nem os horários individuais; portanto, não mostra quanto do resultado de zero alertas poderia ser explicado pelo atraso.

O guia da OpenAI sobre os controles parentais diz que as notificações de segurança vêm ativadas por padrão em contas vinculadas, mas podem levar algumas horas para ficar disponíveis. Revisores treinados avaliam preocupações graves sobre automutilação e transtornos alimentares antes do envio das notificações. Os pais não podem ler conversas nem acompanhar atividades em tempo real; a OpenAI diz que os alertas podem não identificar toda preocupação e não substituem atendimento profissional ou serviços de emergência. Sem vincular as contas, os pais não recebem essas notificações.

Recursos para crises e configurações de estudo

O Instituto também mediu o que o ChatGPT respondeu às contas de teste. Três psiquiatras infantis e de adolescentes marcaram previamente 201 dos 390 prompts únicos de saúde mental como merecedores de um recurso para crises. No mesmo conjunto de 201 prompts, aplicado a contas vinculadas configuradas para 13 anos, 74% das respostas após o lançamento ofereceram uma linha de apoio, um profissional identificado ou um recurso médico geral, ante 77% antes do lançamento. Uma linha de apoio apareceu em 23% das respostas posteriores, ante 33%; o incentivo a procurar um adulto de confiança subiu de 87% para 94%. Os revisores clínicos do Instituto consideraram adequada a maior parte do conteúdo das respostas posteriores sobre crises. São resultados por prompt nas condições testadas, não taxas de danos ou de falta de ajuda entre adolescentes usuários.

A avaliação também encontrou formas de sair do Study mode durante o Study Hours definido pelos pais. A OpenAI disse à Axios que essa flexibilidade é intencional. Seu guia de ajuda atual sobre o Study Hours descreve uma programação que inicia novas conversas elegíveis no Study mode e afirma que ela não bloqueia o acesso ao ChatGPT. Pais que buscam restringir o acesso por horário têm o controle Quiet Hours separado. O guia da OpenAI sobre ChatGPT for Teens diz que contas elegíveis identificadas como pertencentes a menores de 18 anos entram automaticamente na experiência para adolescentes, enquanto os controles parentais são opcionais.

O Instituto testou contas na região da Baía de São Francisco, nos Estados Unidos. Não testou geração de imagens, voz, conversas em grupo nem personalização de estilo e tom, e não calculou a concordância entre avaliadores. Como os períodos anteriores e posteriores ao lançamento ocorreram em sequência, mudanças no modelo subjacente podem ter afetado as diferenças atribuídas ao modo adolescente. A BIG CHANGE analisou a avaliação publicada, o PDF, documentos da OpenAI e reportagens independentes; não executamos o conjunto de prompts nem testamos contas de adolescentes ou pais.

Fontes e leituras complementares