AI-translated from English; not yet reviewed by a fluent editor.

# Hinihiling ng mga dating mananaliksik sa kaligtasan ng OpenAI na protektahan ng mga oversight body ang pakikipagtulungan sa labas

> Hinihimok ng tatlong tinanggal na mananaliksik ng OpenAI ang mga oversight body na protektahan ang gawaing pangkaligtasan sa labas at linawin ang mga tuntunin para sa mga empleyado. Tinututulan ng OpenAI ang salaysay nila tungkol sa mga pagtanggal.

By BIG CHANGE Editorial

Published: 2026-10-09T04:59:01.631Z
Updated: 2026-10-09T04:59:01.631Z
Canonical: https://bigchange.ai/blog/openai-researchers-letter-outside-safety-evaluators

![A blank ivory letter sheet lies open over three aligned pages on a warm ivory background.](https://bigchange.ai/api/media/file/openai-monitorability-letter-hero-v2.png)
Conceptual illustration of the researchers’ public open letter calling for clear rules for outside safety work. It does not reproduce the letter or depict internal events or a model assessment. AI-generated illustration by BIG CHANGE.

Hiniling ng tatlong dating mananaliksik sa kaligtasan ng OpenAI sa mga oversight body ng kumpanya na panatilihin ang independiyenteng gawaing pangkaligtasan at linawin kung paano maaaring magbahagi ng impormasyon ang mga empleyado sa mga panlabas na evaluator. Sa isang [bukas na liham na inilathala noong Oktubre 8](https://mikitabalesni.com/letter/letter.pdf), kinontra nina Tomek Korbak, Jasmine Wang at Mikita Balesni ang salaysay ng misconduct na sumunod sa pagkakatanggal nila. Sinabi ng OpenAI sa TechCrunch na nakakita ang isang imbestigasyon ng padron ng maling paghawak sa impormasyon ng pananaliksik na higit pa sa pagbabahagi nito sa isang panlabas na grupong tagasuri. Hindi inilalahad ng liham at ng ulat ng TechCrunch ang mismong tala ng imbestigasyon o ang partikular na mga patakarang sangkot.

Pagtindig ng tatlong apektadong tao ang liham. Sinasabi nilang naniniwala silang pasok sa kanilang mga trabaho at sa mga nakagawian sa OpenAI ang pakikipagtulungan nila sa mga panlabas na grupo. Itinatanggi nilang sila ang pinagmulan ng isang pagtagas sa The Information tungkol sa mga arkitekturang diumano'y mas mahirap subaybayan. Inilalarawan ng mga pahayag na iyon ang salaysay nila sa mga pangyayari, hindi mga konklusyong itinatag ng isang independiyenteng pagsisiyasat.

## Ang malaking pagbabago

- **Ano ang nagbago:**Hiniling ng mga mananaliksik sa Safety and Security Committee, Safety Advisory Group at Mission Advisory Council ng OpenAI na tugunan kung paano makikipagtulungan ang mga empleyado sa mga independiyenteng evaluator ng kaligtasan habang iginagalang ang pagiging kumpidensiyal.
- **Bakit ito mahalaga:**Hinihiling ng liham na patuloy na makapasok ang mga auditor, maprotektahan ang monitorability ng mga modelo, at magkaroon ng malinaw na tuntunin sa pakikipagtulungan sa labas. Saklaw ng mga kahilingang ito kapwa ang impormasyong matatanggap ng mga panlabas na evaluator at ang mga hangganang dapat sundin ng mga empleyado sa pagbabahagi nito.
- **Ano ang dapat bantayan:**Ayon sa iniulat na tugon ng OpenAI, sumunod ang mga pagtanggal sa mga paglabag sa patakaran at walang kaugnayan sa pagsasabi ng mga alalahanin sa kaligtasan. Hindi tinutukoy sa tugon, gaya ng iniulat ng TechCrunch, ang mga partikular na patakaran o ebidensiya sa likod ng mga pasya.

## Ano raw ang nangyari ayon sa mga mananaliksik

Sinabi ni Korbak na naging contact person siya ng panlabas na evaluator na METR habang iniimbestigahan ang isang insidente sa OpenAI agent na kinasangkutan ng Hugging Face. Ayon sa liham, walang naitatag na huwaran ang imbestigasyon at binubuo pa noon ang mga panloob na pamamaraan nito. Sinabi nitong sinubukan niyang sumunod sa mga patakarang umiiral noon habang nakikipag-usap sa mga panlabas na katrabaho.

Sinabi ni Balesni na nagtrabaho siya sa mga kasunduang magkakaugnay ang mga kumpanya tungkol sa kakayahang subaybayan ang pangangatwiran ng mga modelo. Ayon sa liham, tinalakay niya ang gawaing iyon sa mga miyembro ng board at ehekutibo, kumonsulta sa kanyang reporting line at nag-alis ng sensitibong detalye bago magbahagi ng materyal. Sinabi ni Wang na ipinagkaloob sa kanya ang access sa email ng isang ehekutibo para sa recruitment; matapos niyang aksidenteng mabuksan ang isang sensitibong email, agad niya itong iniulat at muling hiniling sa IT na alisin ang access. Wala sa mga salaysay na ito ang nagtatatag ng natuklasan ng imbestigasyon ng OpenAI.

## Mga kahilingan at tugon ng kumpanya

Tatlong rekomendasyon ang liham. Una, dapat tuparin ng OpenAI ang isang pampublikong pangako, na iniuugnay ng mga mananaliksik kay Sam Altman, na patuloy na bigyan ng access ang mga independiyenteng evaluator. Nag-aalala silang maaaring lumiit ang pakikipagtulungan sa METR o iba pang auditor dahil sa mga pagtanggal. Ikalawa, hinihiling nila sa OpenAI at iba pang developer ng frontier model na iwasan ang mga pagbabagong lalo pang magpapababa sa monitorability habang umaasa rito ang gawaing pangkaligtasan. Partikular na binabanggit ng liham ang pagsubaybay sa chain-of-thought reasoning; hindi nito pinatutunayan ang nasukat na pagbaba sa isang pinangalanang modelo. Ikatlo, hinihiling nilang muling pagtibayin ng OpenAI ang malayang pagtalakay sa kaligtasan at ilathala ang malinaw na pamamaraan para sa pakikipagtulungan sa mga panlabas na organisasyon.

Hindi pa naglabas ang OpenAI ng pormal na tugon sa liham, ayon sa [ulat ng TechCrunch noong Oktubre 8](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/). Sinabi ng publikasyon na itinanggi ng isang panloob na memo na ibinahagi rito na paghihiganti sa pagsasalita ang mga pagtanggal at sinuportahan nito ang mga rekomendasyon ng mga mananaliksik. Hiwalay na sinabi ng isang tagapagsalita sa TechCrunch na nakakita ang imbestigasyon ng padron ng misconduct sa paghawak ng impormasyon ng pananaliksik na higit pa sa pagbabahagi sa labas. Ayon sa TechCrunch, hindi sinagot ng OpenAI ang mga tanong nito tungkol sa partikular na mga patakaran, mga pangyayari sa pagtanggal, o proteksiyon para sa mga empleyadong nakikipagtulungan sa mga panlabas na evaluator.

Ipinakikita ng pampublikong tala na may pagkakasundo sa prinsipyo tungkol sa halaga ng panlabas na gawaing pangkaligtasan, kasabay ng pagtatalo kung paano ito isinagawa ng tatlong empleyadong ito. Hindi napapatunayan ng liham ang mga pahintulot o intensiyon ng mga lumagda, at hindi sapat ang mga pahayag na iniulat mula sa kumpanya upang masuri ng mga mambabasa ang mga paratang na paglabag. Kailangan pa ring linawin ng mga oversight body ng OpenAI kung anong mga tuntunin ang sasaklaw sa ganitong pakikipagtulungan at kung anong access ang ibibigay sa mga independiyenteng auditor.

## Mga sanggunian at karagdagang babasahin

- [Korbak, Wang at Balesni, “Hindi kayang gawing ligtas ng OpenAI ang AI nang mag-isa”](https://mikitabalesni.com/letter/letter.pdf), bukas na liham na inilathala noong Oktubre 8, 2026. Pangunahing sanggunian ito para sa salaysay ng mga may-akda at sa tatlong rekomendasyon nila. Mga pahayag ng mga interesadong panig ang paglalarawan nila sa mga panloob na pangyayari, pahintulot at gawaing may kinalaman sa mga modelo.
- [Rebecca Bellan, TechCrunch](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/), Oktubre 8, 2026. Iniuulat nito ang tugon ng tagapagsalita ng OpenAI at ng panloob na memo, pati ang mga tanong na hindi sinagot ng kumpanya. Pinatutunayan nito kung ano ang sinabi ng bawat panig, hindi ang pinagtatalunang asal mismo.

## Sources

- [Korbak, Wang at Balesni, “Hindi kayang gawing ligtas ng OpenAI ang AI nang mag-isa”](https://mikitabalesni.com/letter/letter.pdf) — Pangunahing liham; iniuugnay sa mga lumagda ang mga pinagtatalunang pahayag tungkol sa mga panloob na pangyayari.
- [Kinontra ng mga dating safety researcher ng OpenAI ang mga paratang ng misconduct at nagbabala sa nakapipigil na epekto](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/) — Ulat ni Rebecca Bellan tungkol sa liham at mga tugon ng tagapagsalita at memo ng OpenAI.
