Youth AI Safety Institute navodi da novo povezani testni nalozi tinejdžera nisu dobili roditeljska upozorenja tokom scenarijskih razgovora o samoubistvu, samopovređivanju i poremećajima ishrane. OpenAI osporava da li su ti testovi ostavili dovoljno vremena da upozorenja postanu aktivna. Ovo neslaganje je važno jer sama kompanija kaže da su obaveštenja ograničena, da kasne nakon povezivanja i da ne mogu da obuhvate svaku zabrinjavajuću situaciju.

Izveštaj Instituta pod naslovom procena rizika ChatGPT-a za tinejdžereažurirana 7. oktobra, ocenjuje proizvod kao „neprihvatljiv rizik” za korisnike mlađe od 18 godina i poziva OpenAI da prestane da ga reklamira tinejdžerima. To je procena Instituta prema njegovom sopstvenom okviru za ocenjivanje. Dokazi potiču iz scenarijskih testova određenih podešavanja naloga, a ne iz broja incidenata među tinejdžerima koji svakodnevno koriste ChatGPT.

Velika promena

  • Šta se promenilo:Nezavisna procena sada proverava bezbednosna upozorenja i kontrole za učenje za tinejdžere u OpenAI proizvodu kroz dokumentovane, scenarijske testove. Novo povezani testni nalozi nisu dobili upozorenja tokom razgovora o eksplicitnim kriznim temama; OpenAI kaže da su neki testovi možda počeli pre potpune aktivacije upozorenja.
  • Zašto je važno:Roditelji mogu da povežu naloge i primaju ograničena bezbednosna obaveštenja. OpenAI kaže da ta upozorenja nisu praćenje u realnom vremenu i da mogu da propuste zabrinjavajuće situacije, pa porodice ne mogu da ih smatraju sistemom za trenutno uzbunjivanje. Study Hours pokreće kvalifikovane nove razgovore u režimu Study mode, bez ograničavanja pristupa.
  • Na šta obratiti pažnju:Spor oko upozorenja odnosi se na vreme aktivacije. Neki testni nalozi bili su povezani duže od intervala od tri sata koji navodi OpenAI, a nijedan nalog u tom posebnom testu nije dobio upozorenje. To znači da su bar neki ostali bez upozorenja i nakon isteka tog intervala. U izveštaju se ne navode broj naloga u toj podgrupi ni vremena po pojedinačnom nalogu, pa nije moguće izmeriti mogući uticaj kašnjenja na ukupan rezultat.

Šta su testeri radili

Institut navodi da je tokom dva perioda upotrebljeno više od 4.000 upita. Testovi pre lansiranja trajali su od 13. jula do 17. avgusta 2026, pre najave ChatGPT for Teens. Testovi nakon lansiranja sprovedeni su od 25. avgusta do 28. septembra na dodatnim besplatnim i plaćenim nalozima za koje su testeri rekli da su uključeni u tinejdžersko iskustvo. Podešavanja su obuhvatila povezane i nepovezane tinejdžerske naloge, sa samoprijavljenim uzrastom od 13 do 17 godina. Institut je testirao i naloge registrovane kao da pripadaju osobama od 19 godina radi procene predviđanja uzrasta.

Najdirektniji test upozorenja koristio je više od desetak novootvorenih tinejdžerskih naloga u besplatnom paketu, svaki povezan sa roditeljskim nalogom pre početka razgovora. Testeri su koristili četiri scenarijska krizna profila i vodili razgovore od manje od pet minuta do najviše jednog sata. Svaki razgovor sadržao je eksplicitna otkrivanja o samoubistvu, samopovređivanju ili poremećajima ishrane, prema celom PDF izveštaju. Institut navodi da nijedan od tih naloga nije proizveo roditeljsko obaveštenje.

Drugi, duži test mentalnog zdravlja dao je drugačiji rezultat. U kriznim testovima pre i posle lansiranja, sprovedenim na nalozima korišćenim nedeljama, Institut je ukupno primio četiri obaveštenja. Dva su stigla na nalog nakon lansiranja, povezan sa roditeljem i podešen na uzrast od 13 godina, posle stotina upita u više uslova; oba su stigla u roku od sat vremena od testiranja odgovarajuće teme. Razlika između novih i dugotrajnije korišćenih naloga navela je Institut da pretpostavi kako upozoravanje možda zavisi od akumulirane istorije kriznih tema. Testovi ne utvrđuju interno pravilo za aktiviranje upozorenja.

Spor oko aktivacije

OpenAI je rekao Institutu da povezanim nalozima treba približno tri sata pre nego što mogu da primaju bezbednosna obaveštenja. U izjavi koju je preneo Los Angeles Times, OpenAI je rekao da je najveći deo testiranja upozorenja možda počeo i završen pre nego što su roditeljske kontrole bile potpuno aktivne. Axios je takođe preneo prigovor OpenAI-ja. Institut kaže da su neki od više od desetak novo povezanih naloga bili povezani kraće od tri sata, a neki duže. U kombinaciji sa nalazom da nijedan od tih naloga nije dobio upozorenje, to znači da su bar neki testirani nalozi ostali bez upozorenja i nakon intervala za aktivaciju koji navodi OpenAI. Izveštaj ne navodi broj naloga u toj podgrupi ni vreme povezivanja i testiranja za svaki nalog, pa ne pokazuje koliki deo ukupnog rezultata bez upozorenja može da se objasni kašnjenjem.

OpenAI-jev vodič za roditeljske kontrole kaže da su bezbednosna obaveštenja podrazumevano uključena na povezanim nalozima, ali da može proći nekoliko sati pre nego što postanu dostupna. Obučeni recenzenti procenjuju ozbiljne slučajeve samopovređivanja i poremećaja ishrane pre slanja obaveštenja. Roditelji ne mogu da čitaju razgovore niti da prate aktivnost u realnom vremenu; OpenAI kaže da upozorenja možda neće prepoznati svaku zabrinjavajuću situaciju i da ne zamenjuju stručnu pomoć ni hitne službe. Bez povezanih naloga roditelji ne dobijaju ova obaveštenja.

Resursi za krizu i podešavanja za učenje

Institut je merio i šta je ChatGPT govorio testnim nalozima. Tri dečja i adolescentna psihijatra unapred su označila 201 od 390 jedinstvenih upita o mentalnom zdravlju kao upite koji zahtevaju krizni resurs. U istom skupu od 201 upita, postavljenih na povezanim nalozima sa uzrastom 13 godina, odgovori nakon lansiranja ponudili su telefonsku liniju za pomoć, imenovanog stručnjaka ili opšti medicinski resurs u 74% slučajeva, u poređenju sa 77% pre lansiranja. Telefonska linija se pojavila u 23% odgovora nakon lansiranja, naspram 33%; ohrabrivanje da se obrate odrasloj osobi od poverenja poraslo je sa 87% na 94%. Klinički recenzenti Instituta ocenili su da je veći deo sadržaja kriznih odgovora nakon lansiranja bio dobar. Ovo su rezultati po upitu u testiranim uslovima, a ne stope povreda ili uskraćene pomoći među tinejdžerima.

Procena je takođe našla načine da se napusti Study mode tokom roditeljski podešenih Study Hours. OpenAI je rekao Axios-u da je ta fleksibilnost namerna. Njegov aktuelni vodič za pomoć opisuje Study Hours kao raspored koji pokreće kvalifikovane nove razgovore u režimu Study mode i navodi da ne blokira pristup ChatGPT-u. Roditelji koji žele vremensko ograničenje pristupa imaju zasebnu kontrolu Quiet Hours. OpenAI-jev vodič za ChatGPT za tinejdžere kaže da kvalifikovani nalozi prepoznati kao nalozi osoba mlađih od 18 godina automatski ulaze u tinejdžersko iskustvo, dok su roditeljske kontrole opcionalne.

Institut je testirao naloge iz oblasti San Franciska u SAD. Nije testirao generisanje slika, glas, grupne razgovore ni personalizaciju stila i tona, niti je izračunao međusobnu saglasnost ocenjivača. Pošto su periodi pre i posle bili uzastopni, promene osnovnog modela mogle su da doprinesu razlikama pripisanim tinejdžerskom režimu. BIG CHANGE je pregledao objavljenu procenu, njen PDF, dokumentaciju OpenAI-ja i nezavisno izveštavanje; nije pokretao skup upita niti testirao tinejdžerske ili roditeljske naloge.

Izvori i dodatno čitanje