OpenAI نے 5 اکتوبر کو textGrain کا اعلان کیا، جو ایک غیر مرئی واٹرمارک ہے اور اس کے ماڈلز کے منتخب کردہ الفاظ کے شماریاتی انداز کو بدلتا ہے۔ کمپنی کے مطابق یورپی یونین کے متن کے ماخذ سے متعلق قواعد کے جواب میں اسے مرحلہ وار جاری کیا جا رہا ہے۔ مطابقت رکھنے والا ڈیٹیکٹر کسی عبارت میں یہ انداز تلاش کر سکتا ہے، مگر نتیجہ صرف محدود اشارہ دیتا ہے کہ آیا OpenAI کے نظام نے متن تیار یا پراسیس کیا تھا۔

بڑی تبدیلی

  • کیا بدلا: OpenAI متن کے ماخذ کی تحقیق سے آگے بڑھ کر محدود اجرا کی طرف جا رہا ہے۔ یورپی یونین میں اہل ChatGPT اور Codex آؤٹ پٹ پر آنے والے ہفتوں میں واٹرمارک لگے گا؛ منتخب API صارفین اسے اب دنیا بھر میں فعال کر سکتے ہیں۔
  • یہ کیوں اہم ہے: AI متن کا جائزہ لینے والی تنظیموں کو مستقبل میں الفاظ کے اندر سرایت شدہ اشارہ مل سکتا ہے۔ OpenAI کے شائع کردہ نتائج بتاتے ہیں کہ ڈیٹیکٹر کے نتیجے کو سیاق و سباق کی ضرورت کیوں ہے: مختصر یا سخت پابندیوں والی عبارتیں اور ترمیم شدہ متن شناخت سے بچ سکتے ہیں، جبکہ غلط مثبت نتائج بھی ممکن ہیں۔
  • آگے کیا دیکھنا ہے: فوری آزمائش یہ ہے کہ مختلف طوالت، موضوعات اور زبانوں کے متن میں عام استعمال کے دوران یہ اشارہ کتنی قابلِ اعتماد طریقے سے برقرار رہتا ہے۔ ان حدود کا جائزہ لیتے ہوئے OpenAI ڈیٹیکٹر تک رسائی منظور شدہ محققین اور ماہر اداروں تک محدود رکھ رہا ہے۔

دو اجرا، رسائی کے الگ طریقے

OpenAI کا کہنا ہے کہ آنے والے ہفتوں میں وہ یورپی یونین کے تمام پلانز میں موجود اہل ChatGPT اور Codex کے ٹیکسٹ آؤٹ پٹ میں textGrain شامل کرے گا۔ یہ طے شدہ علاقائی اجرا ہے، یہ دعویٰ نہیں کہ آج یورپی یونین کا ہر جواب واٹرمارک شدہ ہے۔ API کے لیے دنیا بھر کے صارفین 5 اکتوبر سے منتخب ماڈلز پر اسے فعال کرنے کا انتخاب کر سکتے ہیں؛ واٹرمارکنگ پہلے سے بند ہوتی ہے۔ OpenAI کے مطابق صارفین اسے پروجیکٹ یا ادارے کی ترتیبات میں فعال کر کے معاون ماڈلز منتخب کر سکتے ہیں۔ اہل ماڈلز کی فہرست انہی ترتیبات میں دکھائی دیتی ہے اور بدل سکتی ہے۔

TextGrain ممکنہ الفاظ یا لفظی حصوں، جنہیں ٹوکن کہا جاتا ہے، میں سے ماڈل کے انتخاب کے ذریعے کام کرتا ہے۔ OpenAI کے مطابق ایک خفیہ کلید تخلیق کے دوران ان انتخاب میں معمولی تبدیلیوں کی رہنمائی کرتی ہے۔ اس کے بعد مماثل کلید اور ترتیبات والا ڈیٹیکٹر دیکھتا ہے کہ عبارت میں بننے والا شماریاتی انداز موجود ہے یا نہیں۔ واٹرمارک کوئی پوشیدہ حرف، خالی جگہ یا نظر آنے والی رموزِ اوقاف شامل نہیں کرتا۔ اس لیے متن نقل کرتے وقت الگ میٹا ڈیٹا ساتھ رکھنا ضروری نہیں، لیکن الفاظ جوں کے توں رکھنے سے قابلِ شناخت اشارے کی ضمانت نہیں ملتی۔

یہ فرق یہ بھی محدود کرتا ہے کہ عبارت کون جانچ سکتا ہے۔ OpenAI ٹیکسٹ ڈیٹیکٹر کے لیے درخواستیں قبول کر رہا ہے، ابتدا میں منظور شدہ محققین اور ماہر اداروں سے۔ آغاز پر ڈیٹیکٹر عوام کے لیے نہیں کھولا جائے گا۔ معاون تصاویر اور آڈیو کے لیے اس کے عوامی تصدیقی ٹول الگ ہیں؛ ان سے textGrain کی کھلی جانچ ممکن نہیں۔

اشارہ نظرانداز ہو سکتا ہے یا غلط طور پر شناخت کیا جا سکتا ہے

OpenAI ایک جائزے میں شناخت کی شرحیں 1% کی ہدفی غلط مثبت شرح پر رپورٹ کرتا ہے۔ نفسیات کی عبارتوں میں اس کے ڈیٹیکٹر نے 200 ٹوکن کے تقریباً 80% نمونوں اور 400 ٹوکن کے تقریباً 95% نمونوں میں واٹرمارک تلاش کیا۔ کمپنی کا کہنا ہے کہ ریاضی میں شناخت نمایاں طور پر کم تھی، جہاں الفاظ کے انتخاب کی آزادی کم ہوتی ہے۔ یہ مخصوص حالات میں کمپنی کے جائزے کے نتائج ہیں، حقیقی دنیا میں ملنے والے متن کی کامیابی کی پیمائش نہیں۔

400 ٹوکن کی عبارتوں پر کمپنی کے ایک اور ٹیسٹ میں ترامیم سے اشارہ کمزور ہوا: 10% الفاظ کو مترادفات سے بدلنے پر شناخت تقریباً 92% سے گھٹ کر 66% رہ گئی؛ 25% بدلنے پر 17% رہ گئی۔ OpenAI کی دستاویزات میں ترجمہ، وسیع پیمانے پر بازنویسی، مختصر جوابات اور کوڈ کو بھی مشکل صورتیں بتایا گیا ہے۔ کمپنی کے مطابق زبان کے لحاظ سے شناخت مختلف ہوتی ہے۔ اس لیے منفی نتیجہ یہ ثابت نہیں کرتا کہ متن کسی انسان نے لکھا۔ عبارت بہت مختصر یا تبدیل شدہ ہو سکتی ہے، اجرا سے پہلے تیار ہوئی ہو سکتی ہے، یا ایسے ماڈل یا پراڈکٹ سے بنی ہو سکتی ہے جس پر واٹرمارک لاگو نہیں ہوتا۔

مثبت نتیجے کی بھی حدود ہیں۔ ڈیٹیکٹر غلطی سے واٹرمارک کی موجودگی بتا سکتا ہے۔ اگر اسے اشارہ ملے تو OpenAI کے مطابق یہ اس بات کا ثبوت ہے کہ اس کے نظام نے غالباً عبارت کا کم از کم کچھ حصہ تیار یا پراسیس کیا۔ اس سے کسی شخص کی شراکت کی مقدار نہیں ناپی جا سکتی، اکاؤنٹ یا پرامپٹ کی شناخت نہیں ہوتی، اور یہ طے نہیں ہوتا کہ متن کس نے لکھا، اس کا مالک کون ہے یا ذمہ دار کون ہے۔ یہ بھی تصدیق نہیں ہو سکتی کہ عبارت درست ہے۔ صرف نتیجے سے ٹول استعمال کرنے والے شخص کی شناخت ممکن نہیں۔

OpenAI مزید جائزے کا ارادہ رکھتا ہے اور کہتا ہے کہ وہ textGrain کو اوپن سورس ٹیکنالوجی کے طور پر جاری کرنا چاہتا ہے۔ فی الحال عملی تبدیلی محدود ہے: OpenAI کے کچھ نئے تیار کردہ متن میں مشین سے پڑھے جانے والا اشارہ ہوگا، جبکہ اس کا معائنہ کرنے کے طریقے اور اس سے اخذ ہونے والے نتائج محدود رہیں گے۔ یہ تحریر OpenAI کے اعلان اور معاون دستاویزات پر مبنی ہے؛ BIG CHANGE نے واٹرمارک شدہ متن تیار نہیں کیا اور نہ ہی ڈیٹیکٹر چلایا۔