ستضيف OpenAI علامات مائية غير مرئية إلى نص ChatGPT في الاتحاد الأوروبي. لا توجد أحرف خاصة مطلوبة. وقد تصبح غير صالحة بعد إعادة كتابتها.

📅 2026-10-06

الملخص:

تضيف OpenAI تدريجيًا علامات مائية غير مرئية إلى النصوص التي تم إنشاؤها بواسطة ChatGPT وCodex في الاتحاد الأوروبي لتلبية متطلبات قانون الذكاء الاصطناعي للاتحاد الأوروبي بشأن وضوح المحتوى الناتج عن الذكاء الاصطناعي. قالت OpenAI إن تقنية وضع العلامات المائية النصية هذه والتي تسمى textGrain لا تضيف أحرفًا مخفية أو مسافات غير مرئية أو علامات ترقيم خاصة إلى المقالة. وبدلاً من ذلك، يقوم بضبط طريقة اختيار الكلمات عندما يقوم النموذج بإنشاء نص، مما يشكل ميزة إحصائية في النص بأكمله لا يمكن اكتشافها مباشرة بالعين البشرية ولكن يمكن التعرف عليها بواسطة الآلة.

1780081657_chatgpt_logo.webp

وفقًا للمعلومات الصادرة عن OpenAI، فإن متطلبات الشفافية ذات الصلة بقانون الذكاء الاصطناعي للاتحاد الأوروبي ستدخل حيز التنفيذ في 2 أغسطس 2026. يُطلب من موفري خدمات الذكاء الاصطناعي التوليدي أن يكون لديهم محتوى تم إنشاؤه بواسطة الذكاء الاصطناعي مع علامات يمكن التعرف عليها آليًا. لذلك تخطط OpenAI لطرح العلامات المائية النصية تدريجيًا لمستخدمي ChatGPT وCodex المؤهلين في الاتحاد الأوروبي في الأسابيع القليلة المقبلة، وسيغطي هذا النشر جميع حزم ChatGPT، وليس فقط المستخدمين الذين يدفعون.

يختلف هذا النوع من العلامات المائية عن "النص المخفي" بالمعنى التقليدي. عندما يقوم المستخدمون بنسخ المحتوى الذي تم إنشاؤه بواسطة ChatGPT، لن يتم نسخ حرف مخفي في نفس الوقت، ولن يتم العثور على رموز خاصة في النص. ما يغيره textGrain فعليًا هو احتمال الاختيار العشوائي للنموذج عند مواجهة عدة كلمات محتملة. قد تكون التغييرات في كلمة واحدة غير قابلة للاكتشاف تمامًا، ولكن عند دمج عدد كبير من الكلمات، قد يتم تشكيل نمط إحصائي يمكن لنظام الكشف التعرف عليه.

ذكرت شركة OpenAI أن ميزة هذا التصميم هي أنه لا يغير بشكل كبير إخراج النص العادي. وجدت اختبارات الشركة أن الاختلاف في أداء النموذج بين إضافة علامات مائية وبدون إضافة علامات مائية كان ضمن نطاق تقلبات الاختبار الطبيعي، كما أن التأثير على سرعة إنشاء النص كان صغيرًا جدًا أيضًا. أثناء الاختبار الداخلي السابق لـ ChatGPT الذي أجرته OpenAI، لم تجد أن وظيفة العلامة المائية أدت إلى زيادة في تعليقات المستخدمين السلبية.

ومع ذلك، اعترفت OpenAI أيضًا بأن العلامات المائية النصية ليست طريقة موثوقة بنسبة 100% لتحديد محتوى الذكاء الاصطناعي. هناك نوعان من الأخطاء المحتملة في اكتشاف العلامة المائية. الأول هو أن النص الذي لا يحتوي على علامة مائية يتم الحكم عليه بشكل خاطئ على أنه يحتوي على علامة مائية، والآخر هو أن النص يحتوي بالفعل على علامة مائية، لكن نظام الكشف لا يتعرف عليها.

يعد طول النص أيضًا عاملاً مهمًا يؤثر على نتائج الاكتشاف. يحتوي النص الأقصر على مساحة أقل للنموذج لضبط اختيار الكلمات، مما يزيد من صعوبة تكوين إشارة إحصائية مستقرة. تُظهر القواعد التي نشرتها OpenAI أيضًا أنه وفقًا لمواصفات شفافية الاتحاد الأوروبي للذكاء الاصطناعي، لا يلزم إخراج أقل من 200 رمز مميز وحوالي 150 كلمة إنجليزية ومقتطفات التعليمات البرمجية لإضافة علامات مائية نصية.

توجد أيضًا اختلافات في نتائج الاكتشاف بين اللغات المختلفة. قامت OpenAI باختبار جميع اللغات الرسمية الـ 24 للاتحاد الأوروبي. ومع الحفاظ على نسبة إيجابية كاذبة قدرها 1%، وصلت نسبة الكشف باللغة الإسبانية إلى حد أقصى قدره 69%، بينما بلغت نسبة الكشف باللغة الرومانية 42.2% فقط. بالنسبة للغات ذات تأثيرات الكشف الضعيفة، يمكن لـ OpenAI زيادة قوة العلامة المائية لتعزيز قدرات الكشف.

وهذا يعني أنه لا يمكن فهم textGrain على أنها تقنية يمكنها إثبات أنها تم إنشاؤها بواسطة ChatGPT بنسبة 100% عندما ترى العلامة المائية. يوضح OpenAI أنه حتى لو لم يتم تعديل النص الأصلي، فليس هناك ضمان بأن نظام الكشف سيكون قادرًا على اكتشاف العلامة المائية، خاصة عندما يكون النص قصيرًا أو يكون نطاق الكلمات القابلة للتحديد صغيرًا.

وفي الوقت نفسه، هناك اختلافات واضحة بين العلامات المائية النصية وأجهزة كشف النص بالذكاء الاصطناعي الموجودة حاليًا في السوق. تستخدم أدوات الكشف عن الذكاء الاصطناعي التابعة لجهات خارجية، مثل Pangram، بشكل أساسي المصنفات لتحديد ما إذا كان من المحتمل إنشاء جزء من النص بواسطة الذكاء الاصطناعي من خلال تحليل اختيار الكلمات وبنية الجملة وميزات اللغة الأخرى. تقوم هذه الطريقة بتحليل النص بعد إنشائه، بينما يترك textGrain مباشرة إشارة إحصائية يمكن قراءتها آليًا أثناء عملية إنشاء النص.

تعتقد شركة OpenAI أن هذا النهج يتماشى بشكل أكبر مع متطلبات قانون الاتحاد الأوروبي للذكاء الاصطناعي فيما يتعلق بإشارات التعريف "المضمنة".

لم تعتمد OpenAI بشكل مباشر Google DeepMind's SynthID أو غيرها من حلول العلامات المائية النصية الموجودة، ولكنها طورت textGrain من تلقاء نفسها. وقالت الشركة إن التكنولوجيا التي طورتها بنفسها تسمح لها بضبط التوازن بشكل أكثر مرونة بين إمكانية اكتشاف العلامات المائية وتنوع مخرجات النماذج. في الاختبار الداخلي، تعرفت شركة textGrain على النص الذي يحمل علامة مائية بمعدل يساوي أو أعلى من الحلول الأخرى التي اختبرتها الشركة، بما في ذلك SynthID للنص.

تخطط OpenAI أيضًا لفتح تقنية textGrain مفتوحة المصدر، على أمل أن تتمكن المؤسسات البحثية والشركات الأخرى من استخدام هذه التكنولوجيا لمزيد من البحث وتحسين التعرف على مصدر نص الذكاء الاصطناعي. ومع ذلك، لن تقوم OpenAI بفتح كاشف العلامات المائية النصية للجمهور على الفور، ولكنها ستوفر أولاً قنوات التطبيق للباحثين والمؤسسات المهنية المعتمدة.

يمكن لهؤلاء الباحثين والمؤسسات المعتمدة استخدام أدوات الكشف الخاصة بـ OpenAI لتحديد ما إذا كان جزء من النص يحتوي على علامة مائية تم إنشاؤها بواسطة OpenAI، ولكن نتائج الاكتشاف لن تكشف عن هوية المستخدم أو الكلمات السريعة أو سجلات الدردشة المقابلة للمحتوى الذي تم إنشاؤه. تعتقد OpenAI أنه نظرًا لأن التكنولوجيا الحالية لا تزال تنطوي على مخاطر النتائج الإيجابية الكاذبة والسلبيات الكاذبة، فإن فتح أدوات الكشف مباشرة للجميع قد يؤدي إلى الإفراط في تفسير نتائج اكتشاف العلامة المائية.

من الجدير بالذكر أن OpenAI لا تخطط لتمكين العلامات المائية النصية افتراضيًا على مستوى العالم هذه المرة. ذكرت الشركة أن العلامات المائية النصية لـ ChatGPT و Codex سيتم طرحها تدريجيًا لمنطقة الاتحاد الأوروبي فقط في هذه المرحلة. سيسمح هذا النشر الإقليمي لـ OpenAI بمراقبة الأداء في بيئات الاستخدام الحقيقية وضبط التكنولوجيا بناءً على التعليقات الفعلية.

بالنسبة لمطوري واجهة برمجة التطبيقات، يختلف الوضع. بدأت OpenAI في السماح لعملاء واجهة برمجة التطبيقات العالمية (API) بتشغيل وظيفة العلامة المائية النصية بشكل نشط لبعض الطرز، ولكنها لا تزال متوقفة عن التشغيل افتراضيًا. وهذا يعني أنه يمكن للشركات أن تقرر ما إذا كانت تريد وضع علامة مائية على النص الذي تم إنشاؤه من خلال واجهات برمجة التطبيقات (API) بناءً على متطلبات الشفافية الخاصة بها.

تقوم OpenAI أيضًا بالتنسيق مع شركاء الخدمة السحابية، على أمل أنه في الأسابيع القليلة المقبلة، سيتلقى المحتوى المؤهل الذي تم إنشاؤه عن طريق استدعاء نماذج OpenAI من خلال هذه المنصات السحابية أيضًا إشارات المصدر المقابلة.

ومع ذلك، لن تحل العلامات المائية النصية محل طرق تحديد محتوى الذكاء الاصطناعي الأخرى. تؤكد OpenAI على أن معلومات المصدر مثل العلامات المائية المقروءة آليًا وC2PA لا يمكن أن تحل محل البيانات العامة مثل تسميات الذكاء الاصطناعي المرئية واللافتات الفورية التي يتطلبها القانون أو النظام الأساسي. يقومون بحل مشاكل مصدر المحتوى على مستويات مختلفة.

بالنسبة للمستخدمين العاديين، فإن الشيء الأكثر أهمية في هذا التغيير هو: إذا كنت في الاتحاد الأوروبي وتستخدم ChatGPT لإنشاء نص طويل، فمنذ الوقت الذي يغطي فيه نظام العلامة المائية حسابك رسميًا، قد يحتوي المحتوى الذي تم إنشاؤه بالفعل على إشارات مصدر غير مرئية للعين المجردة. عادةً لن يؤدي النسخ المباشر للنص الأصلي إلى تدمير هذه الإشارة، ولكن إذا تمت إعادة كتابة النص أو إعادة صياغته أو ترجمته بشكل كبير، فقد تنخفض إمكانية اكتشاف العلامة المائية بشكل كبير.

تعترف شركة OpenAI أيضًا بهذا القيد صراحةً. توجد إشارة textGrain في اختيار الكلمات للنموذج، وليس كحرف غير مرئي مرتبط بشكل مستقل بالملف النصي. ولذلك، فإن إعادة كتابة النص بشكل كافٍ قد يؤدي إلى تدمير النمط الإحصائي الأصلي. ولهذا السبب تؤكد OpenAI على أن العلامات المائية النصية أكثر ملاءمة حاليًا كإشارة حكم المصدر ولا يمكن اعتبارها "شهادة تعريف الذكاء الاصطناعي" موثوقة تمامًا.

بشكل عام، أطلقت OpenAI textGrain في الاتحاد الأوروبي هذه المرة بشكل أساسي للتكيف مع المتطلبات التنظيمية الجديدة التي فرضها قانون الذكاء الاصطناعي. كما يمثل أيضًا أن تحديد مصدر النص الناتج عن الذكاء الاصطناعي يتطور من "العلامات التعريفية" التقليدية إلى إشارات يمكن التعرف عليها بواسطة الآلة. لن يغير النص الذي يراه المستخدمون، ولن تظهر أحرف غامضة عند نسخ النص، ولكنه سيسمح للأنظمة التي لديها أذونات الكشف بمحاولة تحديد ما إذا كان جزء من المحتوى يأتي من نموذج OpenAI.

ومع ذلك، نظرًا لأن العلامات المائية النصية لا تزال تواجه مشكلات مثل الاختلافات اللغوية، وقيود طول النص، وضعف الإشارة بعد إعادة الكتابة، فهي حاليًا أكثر ملاءمة كدليل مساعد في نظام تتبع محتوى الذكاء الاصطناعي، بدلاً من استخدامها بمفردها لتحديد ما إذا كانت المقالة "مكتوبة بواسطة الذكاء الاصطناعي".

الوسوم ذات الصلة

مقالات مشابهة

التعليقات

0/500
Captcha (click to refresh)
لا توجد تعليقات