Youth AI Safety Institute는 새로 연결한 청소년 테스트 계정들이 자살, 자해, 섭식 장애를 다룬 대본형 대화 중 부모 알림을 받지 못했다고 밝혔습니다. OpenAI는 해당 테스트에 알림이 활성화될 충분한 시간이 주어졌는지 이의를 제기합니다. 이 논쟁은 중요합니다. 회사 자체 설명에 따르면 알림 기능은 제한적이고 계정 연결 후 활성화까지 지연될 수 있으며 모든 우려 상황을 포착하지 못하기 때문입니다.
연구소의 ChatGPT 청소년 위험 평가는 10월 7일 업데이트되어 18세 미만 사용자에게 제품을 “수용할 수 없는 위험”으로 평가하고 OpenAI에 청소년 대상 마케팅 중단을 촉구합니다. 이는 연구소 자체 평가 기준에 따른 판단입니다. 근거는 특정 계정 설정에서 진행한 대본형 테스트이며, 청소년이 일상에서 ChatGPT를 사용하며 겪은 사건의 수가 아닙니다.
주요 변화
- 무엇이 바뀌었나:독립 평가가 이제 OpenAI의 청소년 안전 알림과 학습 제어 기능을 문서화된 대본형 테스트로 점검합니다. 새로 연결한 테스트 계정들은 명시적인 위기 대화 중 알림을 받지 못했습니다. OpenAI는 일부 테스트가 알림이 완전히 활성화되기 전에 진행됐을 수 있다고 말합니다.
- 왜 중요한가:부모는 계정을 연결해 제한적인 안전 알림을 받을 수 있습니다. OpenAI는 알림이 실시간 모니터링이 아니며 우려 상황을 놓칠 수 있다고 설명하므로, 가족은 이를 즉시 경고하는 시스템으로 여겨서는 안 됩니다. Study Hours는 자격을 갖춘 새 대화를 Study mode로 시작하지만 이용을 제한하지는 않습니다.
- 앞으로 볼 점:알림 논쟁의 핵심은 활성화 시점입니다. 일부 테스트 계정은 OpenAI가 밝힌 3시간 간격보다 오래 연결되어 있었지만, 해당 전용 테스트에서 알림을 받은 계정은 없었습니다. 따라서 일부 계정은 그 간격이 지난 뒤에도 알림을 받지 못했습니다. 보고서는 이 하위 집단의 규모나 계정별 시점을 공개하지 않아 지연이 전체 결과에 미쳤을 가능성을 수치화할 수 없습니다.
테스터들이 진행한 내용
연구소는 두 시기에 걸쳐 4,000개가 넘는 프롬프트를 사용했다고 보고합니다. 출시 전 테스트는 ChatGPT for Teens 발표 전인 2026년 7월 13일부터 8월 17일까지 진행됐습니다. 출시 후 테스트는 8월 25일부터 9월 28일까지 진행됐으며, 테스터들은 추가 무료 및 유료 계정이 청소년 경험에 등록되어 있었다고 말했습니다. 설정에는 연결된 청소년 계정과 연결되지 않은 청소년 계정이 포함됐고, 자기 보고 연령은 13~17세였습니다. 연구소는 연령 예측을 위해 19세로 등록된 계정도 테스트했습니다.
가장 직접적인 알림 테스트에서는 새로 만든 무료 등급 청소년 계정 12개 이상을 사용했고, 각 계정은 대화 시작 전에 부모 계정과 연결됐습니다. 테스터들은 네 가지 대본형 위기 인물을 활용해 5분 미만부터 최대 1시간까지 대화를 진행했습니다. 모든 대화에는 자살, 자해 또는 섭식 장애에 대한 명시적인 언급이 포함됐다고 전체 평가 PDF는 전합니다. 연구소는 이 계정들에서 부모 알림이 한 건도 발생하지 않았다고 밝혔습니다.
더 긴 별도의 정신 건강 테스트에서는 다른 결과가 나왔습니다. 몇 주 동안 사용된 계정으로 출시 전후 위기 테스트를 진행해 연구소는 총 네 건의 알림을 받았습니다. 두 건은 출시 후 부모와 연결하고 13세로 설정한 계정에서 여러 조건에 걸쳐 수백 개 프롬프트를 진행한 뒤 도착했으며, 각각 해당 주제 테스트 후 한 시간 안에 왔습니다. 새 계정과 장기간 사용한 계정의 차이를 근거로 연구소는 알림이 누적된 위기 주제 이력에 좌우될 수 있다고 추정했습니다. 테스트로는 내부 발동 규칙을 확인할 수 없습니다.
활성화 시점 논쟁
OpenAI는 연결된 계정이 안전 알림을 받기까지 약 3시간이 필요하다고 연구소에 말했습니다. 로스앤젤레스 타임스가 전한 성명에서 OpenAI는 알림 테스트 대부분이 부모 제어 기능이 완전히 활성화되기 전에 시작되고 끝났을 수 있다고 밝혔습니다. 악시오스는 OpenAI의 이의도 보도했습니다. 연구소는 새로 연결한 계정 12개 이상 중 일부는 연결 후 3시간이 지나지 않았고 일부는 그보다 오래됐다고 말합니다. 해당 계정들에서 알림이 한 건도 없었다는 결과와 함께 보면, 최소 일부 테스트 계정은 OpenAI가 밝힌 활성화 간격이 지난 뒤에도 알림을 받지 못한 셈입니다. 보고서에는 그 하위 집단의 수나 계정별 연결 및 테스트 시점이 없어 지연이 전체 무알림 결과를 어느 정도 설명할지 판단할 수 없습니다.
OpenAI의 부모 제어 안내에 따르면 연결된 계정에서는 안전 알림이 기본으로 켜져 있지만 이용 가능해지기까지 몇 시간이 걸릴 수 있습니다. 심각한 자해 및 섭식 장애 우려는 알림이 전송되기 전에 훈련받은 검토자가 평가합니다. 부모는 대화를 읽거나 실시간 활동을 지켜볼 수 없습니다. OpenAI는 알림이 모든 우려 상황을 알아차리지 못할 수 있으며 전문적인 돌봄이나 응급 서비스를 대신하지 않는다고 말합니다. 계정이 연결되어 있지 않으면 부모는 이런 알림을 받지 않습니다.
위기 자원 및 학습 설정
연구소는 테스트 계정에 ChatGPT가 어떤 답을 했는지도 측정했습니다. 아동·청소년 정신과 전문의 세 명은 고유한 정신 건강 프롬프트 390개 중 201개를 사전에 위기 자원이 필요한 내용으로 표시했습니다. 부모와 연결하고 13세로 설정한 계정에서 같은 201개 프롬프트를 실행했을 때 출시 후 응답은 74%에서 상담 전화, 특정 전문가 또는 일반 의료 자원을 제시했습니다. 출시 전에는 77%였습니다. 상담 전화는 출시 후 응답의 23%에서 나와 출시 전 33%보다 낮았고, 신뢰할 수 있는 성인에게 말하라고 권한 비율은 87%에서 94%로 올랐습니다. 연구소의 임상 검토자들은 출시 후 위기 응답의 상당 부분이 내용 면에서 타당했다고 말했습니다. 이는 테스트 조건에서 프롬프트 단위로 나온 결과이지, 청소년 사용자 사이의 피해나 도움 누락 비율이 아닙니다.
평가에서는 부모가 설정한 Study Hours 중 Study mode를 벗어나는 방법도 발견했습니다. OpenAI는 악시오스에 이런 유연성은 의도된 것이라고 말했습니다. OpenAI의 최신 도움말 안내는 Study Hours를 자격을 갖춘 새 대화가 Study mode로 시작되도록 하는 일정으로 설명하며, ChatGPT 접근을 차단하지 않는다고 명시합니다. 일정에 따른 접근 제한을 원하는 부모를 위한 별도의 Quiet Hours 제어 기능도 있습니다. OpenAI의 ChatGPT 청소년 안내는 자격을 갖춘 18세 미만 판정 계정이 자동으로 청소년 경험에 들어가며 부모 제어는 선택 사항이라고 설명합니다.
연구소는 미국 샌프란시스코 베이 지역의 계정을 테스트했습니다. 이미지 생성, 음성, 그룹 채팅, 말투 및 스타일 맞춤 설정은 시험하지 않았고 평가자 간 일치도도 계산하지 않았습니다. 전후 기간이 순차적으로 진행됐기 때문에 기반 모델의 변화가 청소년 모드에 기인한 차이에 영향을 미쳤을 수 있습니다. BIG CHANGE는 공개된 평가와 PDF, OpenAI 문서, 독립 보도를 검토했지만 프롬프트 세트를 실행하거나 청소년 또는 부모 계정을 테스트하지 않았습니다.
출처 및 더 읽을거리
- Youth AI Safety Institute, ChatGPT 청소년 위험 평가및 전체 36쪽 보고서: 테스트 설계, 계정 구성, 결과, 평가 등급과 명시된 한계. 웹페이지에는 10월 7일 업데이트로 표시되어 있고 PDF 표지에는 마지막 업데이트가 10월 5일로 적혀 있습니다.
- OpenAI, ChatGPT 부모 제어 관리: 계정 연결, 알림 시점과 범위, Study Hours 및 Quiet Hours에 관한 최신 설명.
- OpenAI, ChatGPT for Teens: 자격 조건, 청소년 기능, 선택형 부모 제어에 관한 최신 설명.
- 악시오스및 로스앤젤레스 타임스: 10월 7일 보도로, OpenAI의 응답을 담고 연구소 평가에 독립적인 맥락을 제공합니다.



