OpenAI के तीन पूर्व सुरक्षा शोधकर्ताओं ने कंपनी के निगरानी निकायों से स्वतंत्र सुरक्षा कार्य को बनाए रखने और यह स्पष्ट करने का अनुरोध किया कि कर्मचारी बाहरी मूल्यांकनकर्ताओं के साथ जानकारी कैसे साझा कर सकते हैं। 8 अक्टूबर को प्रकाशित एक खुले पत्र में Tomek Korbak, Jasmine Wang और Mikita Balesni ने अपनी बर्खास्तगी के बाद सामने आए कदाचार के विवरण को चुनौती दी। OpenAI ने TechCrunch को बताया कि जांच में शोध संबंधी जानकारी को गलत तरीके से संभालने का एक पैटर्न मिला, जो उसे बाहरी मूल्यांकन समूह के साथ साझा करने से आगे जाता था। पत्र और TechCrunch की रिपोर्ट में जांच का मूल रिकॉर्ड या संबंधित विशिष्ट नीतियां नहीं दी गई हैं।

यह पत्र प्रभावित तीन लोगों का पक्ष रखता है। उनका कहना है कि उन्हें लगता था कि बाहरी समूहों के साथ उनका काम उनकी भूमिकाओं और OpenAI की कामकाजी परंपराओं के दायरे में था। वे The Information को कथित रूप से कम निगरानी योग्य मॉडल संरचनाओं के बारे में जानकारी लीक करने का स्रोत होने से इनकार करते हैं। ये बयान घटनाओं का उनका विवरण हैं, किसी स्वतंत्र जांच से स्थापित निष्कर्ष नहीं।

बड़ा बदलाव

  • क्या बदला:शोधकर्ताओं ने OpenAI की सुरक्षा एवं संरक्षण समिति, सुरक्षा सलाहकार समूह और मिशन सलाहकार परिषद से यह स्पष्ट करने को कहा है कि गोपनीयता का सम्मान करते हुए कर्मचारी स्वतंत्र सुरक्षा मूल्यांकनकर्ताओं के साथ कैसे काम कर सकते हैं।
  • यह क्यों मायने रखता है:पत्र में ऑडिटरों की निरंतर पहुंच, मॉडलों की निगरानी-योग्यता की रक्षा और बाहरी सहयोग के स्पष्ट नियमों की मांग है। ये अनुरोध बाहरी मूल्यांकनकर्ताओं को मिलने वाली जानकारी और उसे साझा करते समय कर्मचारियों द्वारा माननी वाली सीमाओं—दोनों से जुड़े हैं।
  • आगे क्या देखें:OpenAI की बताई गई प्रतिक्रिया कहती है कि बर्खास्तगी नीति उल्लंघनों के बाद हुई और सुरक्षा संबंधी चिंता उठाने से उसका संबंध नहीं था। TechCrunch के अनुसार, प्रतिक्रिया में उन विशिष्ट नीतियों या निर्णयों के पीछे के साक्ष्यों की पहचान नहीं की गई।

शोधकर्ताओं के अनुसार क्या हुआ

Korbak का कहना है कि Hugging Face से जुड़े OpenAI एजेंट की एक घटना की जांच के दौरान वे बाहरी मूल्यांकनकर्ता METR के संपर्क व्यक्ति थे। पत्र के अनुसार, इस जांच का कोई स्थापित उदाहरण नहीं था और उस समय आंतरिक प्रक्रियाएं विकसित की जा रही थीं। पत्र कहता है कि बाहरी सहयोगियों से बात करते समय उन्होंने उस समय लागू नीतियों के भीतर काम करने की कोशिश की।

Balesni का कहना है कि उन्होंने मॉडलों के तर्क की निगरानी की क्षमता से जुड़े कंपनियों के बीच के वादों पर काम किया। पत्र के अनुसार, उन्होंने बोर्ड सदस्यों और अधिकारियों से इस काम पर चर्चा की, अपनी रिपोर्टिंग श्रृंखला से पुष्टि की और सामग्री साझा करने से पहले संवेदनशील विवरण हटाए। Wang कहती हैं कि भर्ती के लिए एक अधिकारी के ईमेल तक पहुंच उन्हें सौंपी गई थी; गलती से एक संवेदनशील ईमेल खोलने के बाद उन्होंने तुरंत इसकी सूचना दी और IT से फिर पहुंच हटाने को कहा। इनमें से कोई भी विवरण OpenAI जांच के निष्कर्ष स्थापित नहीं करता।

मांगें और कंपनी की प्रतिक्रिया

पत्र में तीन सिफारिशें हैं। पहली, OpenAI को एक सार्वजनिक वादे को पूरा करना चाहिए—जिसका श्रेय शोधकर्ता Sam Altman को देते हैं—और स्वतंत्र मूल्यांकनकर्ताओं को लगातार पहुंच देनी चाहिए। उन्हें चिंता है कि बर्खास्तगी से METR या अन्य ऑडिटरों के साथ काम सीमित हो सकता है। दूसरी, वे OpenAI और अन्य उन्नत मॉडल निर्माताओं से ऐसे बदलावों से बचने को कहते हैं जो निगरानी-योग्यता को और घटाएं, जबकि सुरक्षा कार्य उस पर निर्भर है। पत्र विशेष रूप से chain-of-thought तर्क की निगरानी का उल्लेख करता है; यह किसी नामित मॉडल में मापी गई गिरावट स्थापित नहीं करता। तीसरी, वे OpenAI से सुरक्षा पर खुली चर्चा का समर्थन फिर से जताने और बाहरी संगठनों के साथ काम के स्पष्ट तरीके प्रकाशित करने को कहते हैं।

OpenAI ने पत्र का औपचारिक जवाब नहीं दिया है, ऐसा TechCrunch की 8 अक्टूबर की रिपोर्ट कहती है। उस प्रकाशन के अनुसार, उसके साथ साझा किए गए एक आंतरिक ज्ञापन ने इस बात से इनकार किया कि बर्खास्तगी सार्वजनिक रूप से बोलने का बदला थी और शोधकर्ताओं की सिफारिशों से सहमति जताई। अलग से, एक प्रवक्ता ने TechCrunch को बताया कि जांच में शोध जानकारी के प्रबंधन में ऐसा कदाचार मिला जो बाहरी साझाकरण से आगे जाता था। TechCrunch कहता है कि OpenAI ने विशिष्ट नीतियों, बर्खास्तगी की परिस्थितियों या बाहरी मूल्यांकनकर्ताओं के साथ काम करने वाले कर्मचारियों की सुरक्षा पर उसके सवालों का जवाब नहीं दिया।

सार्वजनिक रिकॉर्ड में बाहरी सुरक्षा कार्य के महत्व पर सैद्धांतिक सहमति दिखती है, साथ ही इस बात पर विवाद है कि इन तीन कर्मचारियों ने इसे कैसे किया। पत्र अपने लेखकों की अनुमति या इरादों की पुष्टि नहीं कर सकता, और कंपनी के बताए गए बयान पाठकों को कथित उल्लंघनों का आकलन करने नहीं देते। OpenAI के निगरानी निकायों को अभी तय करना है कि ऐसे सहयोग पर कौन से नियम लागू होंगे और स्वतंत्र ऑडिटरों को कितनी पहुंच मिलेगी।

स्रोत और आगे पढ़ें

  • Korbak, Wang और Balesni, “OpenAI अकेले AI को सुरक्षित नहीं बना सकता”, 8 अक्टूबर 2026 को प्रकाशित खुला पत्र। लेखकों के विवरण और उनकी तीन सिफारिशों का प्राथमिक स्रोत। आंतरिक घटनाओं, अनुमतियों और मॉडल कार्य के बारे में उनका वर्णन हितधारकों के दावे हैं।
  • Rebecca Bellan, TechCrunch, 8 अक्टूबर 2026। OpenAI के प्रवक्ता और आंतरिक ज्ञापन की प्रतिक्रियाओं तथा कंपनी द्वारा अनुत्तरित सवालों की रिपोर्ट। यह पुष्टि करता है कि दोनों पक्षों ने क्या कहा, न कि विवादित आचरण को।