أعلنت OpenAI عن textGrain في 5 أكتوبر، وهي علامة مائية غير مرئية تغيّر النمط الإحصائي للكلمات التي تختارها نماذجها. وتقول الشركة إنها بدأت طرحاً تدريجياً استجابةً لقواعد الاتحاد الأوروبي بشأن مصدر النصوص. يستطيع كاشف متوافق البحث عن هذا النمط في مقطع، لكن النتيجة لا تقدم سوى مؤشر محدود على ما إذا كان نظام من OpenAI قد أنشأ النص أو عالجه.
التغيير الأبرز
- ما الذي تغيّر: تنتقل OpenAI من التعامل مع مصدر النصوص بوصفه موضوعاً بحثياً إلى إتاحة محدودة. وستحصل مخرجات ChatGPT وCodex المؤهلة في الاتحاد الأوروبي على علامة مائية خلال الأسابيع المقبلة؛ ويمكن لبعض عملاء API تفعيلها الآن حول العالم.
- لماذا يهم ذلك: قد تحصل المؤسسات التي تقيّم النصوص المولّدة بالذكاء الاصطناعي مستقبلاً على إشارة مضمّنة في الصياغة نفسها. وتوضح النتائج المنشورة من OpenAI أهمية وضع نتيجة الكاشف في سياقها: فقد تفلت المقاطع القصيرة أو شديدة التقييد، والنصوص المعدّلة، من الكشف، كما تظل النتائج الإيجابية الكاذبة ممكنة.
- ما الذي ينبغي متابعته: الاختبار الفوري هو مدى موثوقية بقاء الإشارة أثناء الاستخدام المعتاد عبر أطوال وموضوعات ولغات مختلفة. وتقيّد OpenAI الوصول إلى الكاشف بالباحثين المعتمدين والمؤسسات المتخصصة بينما تقيّم هذه الحدود.
إطلاقان مختلفان وإمكانية وصول متفاوتة
تقول OpenAI إنها ستضيف textGrain إلى مخرجات ChatGPT وCodex النصية المؤهلة ضمن جميع الخطط في الاتحاد الأوروبي خلال الأسابيع المقبلة. هذا طرح إقليمي مخطط له، وليس ادعاءً بأن كل رد في الاتحاد الأوروبي يحمل علامة مائية اليوم. وبالنسبة إلى API، يستطيع العملاء حول العالم اختيار تفعيلها في نماذج محددة ابتداءً من 5 أكتوبر؛ وتكون العلامة المائية معطّلة افتراضياً. وتقول OpenAI إن العملاء يمكنهم تفعيلها من إعدادات المشروع أو المؤسسة واختيار النماذج المدعومة. وتظهر قائمة النماذج المؤهلة في تلك الإعدادات وقد تتغير.
تعمل تقنية TextGrain عبر اختيارات النموذج من بين كلمات أو أجزاء كلمات محتملة، تُعرف باسم الرموز. وتقول OpenAI إن مفتاحاً سرياً يوجّه تغييرات طفيفة في هذه الاختيارات أثناء التوليد. ثم يتحقق كاشف يستخدم المفتاح والإعدادات المطابقة مما إذا كان المقطع يحتوي على النمط الإحصائي الناتج. ولا تضيف العلامة المائية أحرفاً مخفية أو مسافات أو علامات ترقيم ظاهرة. لذلك لا يتطلب نسخ النص نقل بيانات وصفية منفصلة، لكن إبقاء الكلمات كما هي لا يضمن إمكانية اكتشاف الإشارة.
ويحد هذا التمييز أيضاً من الأشخاص القادرين على فحص مقطع. وتقبل OpenAI طلبات استخدام كاشف النصوص، في البداية من الباحثين المعتمدين والمؤسسات المتخصصة. ولن تتيح الكاشف للجمهور عند إطلاقه. أما أدوات التحقق العامة لديها للصور والصوت المدعومين فهي منفصلة، ولا تتيح فحص textGrain للجميع.
قد لا تُكتشف الإشارة أو قد يُبلّغ عنها خطأً
أبلغت OpenAI عن معدلات كشف عند معدل مستهدف للإيجابيات الكاذبة يبلغ 1% في أحد التقييمات. وفي المقاطع المتعلقة بعلم النفس، وجد الكاشف علامة مائية في نحو 80% من العينات المكوّنة من 200 رمز، ونحو 95% من عينات 400 رمز. وتقول الشركة إن الكشف كان أقل بكثير في الرياضيات، حيث تقل حرية اختيار الصياغة. هذه نتائج تقييم أجرته الشركة في ظروف محددة، وليست معدل نجاح مقاساً للنصوص التي تظهر في الواقع.
وفي اختبار آخر للشركة على مقاطع من 400 رمز، أضعفت التعديلات الإشارة: إذ خفّض استبدال 10% من الكلمات بمرادفات معدل الكشف من نحو 92% إلى 66%؛ وخفّض استبدال 25% النسبة إلى 17%. كما تشير وثائق OpenAI إلى أن الترجمة وإعادة الصياغة على نطاق واسع والإجابات القصيرة والرموز البرمجية حالات أصعب. وتقول الشركة إن الكشف يختلف باختلاف اللغة. لذلك لا تثبت النتيجة السلبية أن إنساناً كتب النص. فقد يكون المقطع قصيراً جداً أو معدّلاً أو أُنتج قبل بدء الطرح أو أنشأه نموذج أو منتج لا تشملها العلامة المائية.
للنتيجة الإيجابية حدود أيضاً. فقد يبلّغ الكاشف خطأً عن وجود علامة مائية. وعند العثور على إشارة، تقول OpenAI إن ذلك دليل على أن نظامها أنشأ على الأرجح جزءاً واحداً على الأقل من المقطع أو عالجه. ولا تقيس النتيجة مقدار مساهمة شخص، ولا تحدد حساباً أو موجّهاً، ولا تحسم من كتب النص أو يملكه أو يتحمل مسؤوليته. كما لا تتحقق من دقة المقطع. ولا تكشف النتيجة وحدها عن الشخص الذي استخدم أداة.
تخطط OpenAI لإجراء مزيد من التقييم، وتقول إنها تنوي إصدار textGrain كتقنية مفتوحة المصدر. أما الآن، فالتغيير العملي أضيق نطاقاً: ستحمل بعض النصوص الجديدة التي تنشئها OpenAI إشارة قابلة للقراءة آلياً، بينما تظل وسائل فحصها والاستنتاجات التي تدعمها محدودة. يستند هذا التقرير إلى إعلان OpenAI ووثائق المساعدة الخاصة بها؛ ولم تُنشئ BIG CHANGE نصاً يحمل علامة مائية ولم تشغّل الكاشف.



