اقتصاد وتكنولوجيا

قريباً.. علامة مائية تكشف النصوص المكتوبة بـ”تشات جي بي تي”

تعتزم شركة أوبن إيه آي خلال الأسابيع المقبلة إضافة علامة مائية غير مرئية إلى النصوص المؤهلة التي ينتجها ChatGPT وCodex داخل الاتحاد الأوروبي، في خطوة تهدف إلى تعزيز إمكانية التحقق من المحتوى المُنشأ بالذكاء الاصطناعي، رغم أن اختبارات الشركة أظهرت أن تعديل النص واستبدال الكلمات بمرادفات يمكن أن يضعف فعالية العلامة المائية بشكل كبير.

وأوضحت أوبن إيه آي أن مستخدمي واجهة برمجة التطبيقات (API) حول العالم أصبح بإمكانهم، اعتبارًا من 5 أكتوبر، تفعيل العلامة المائية بشكل اختياري على نماذج محددة، لكنها ستظل معطلة افتراضيًا. وفي المقابل، لن تكون أداة اكتشاف العلامة المائية متاحة للعامة عند إطلاقها، إذ سيقتصر الوصول إليها في البداية على الباحثين المعتمدين والمنظمات المتخصصة.

ما الذي سيُطبق وأين؟

ستصل العلامة المائية الخاصة بنصوص ChatGPT وCodex إلى المستخدمين المؤهلين في جميع خطط ChatGPT داخل الاتحاد الأوروبي فقط، بينما لن تصبح العلامة المائية النصية في الوقت الحالي ميزة افتراضية على مستوى العالم.

ولم تحدد أوبن إيه آي في تحديث 5 أكتوبر النماذج التي ستشملها خاصية التفعيل الاختياري عبر API، كما لم توضح ما إذا كان بإمكان مستخدمي ChatGPT في الاتحاد الأوروبي تعطيل العلامة المائية.

وقالت الشركة إنها تعمل مع شركاء في مجال الحوسبة السحابية لإضافة العلامة المائية إلى مخرجات نماذجها التي يتم تقديمها من خلال خدمات هؤلاء الشركاء خلال الأسابيع المقبلة.

لماذا الاتحاد الأوروبي وفي هذا التوقيت؟

بدأ تطبيق قواعد الشفافية الواردة في المادة 50 من قانون الذكاء الاصطناعي الأوروبي في 2 أغسطس 2026. وأوضحت المفوضية الأوروبية أن أنظمة الذكاء الاصطناعي التي طُرحت في السوق قبل هذا التاريخ لديها مهلة حتى 2 ديسمبر للامتثال لمتطلبات وضع العلامات والكشف عن المحتوى.

كما يوفر قانون الممارسات الطوعي بشأن شفافية المحتوى المُنشأ بالذكاء الاصطناعي وسيلة اختيارية للمؤسسات لإظهار امتثالها لهذه القواعد. وبحلول نهاية يوليو، كانت نحو 190 مؤسسة قد وقعت على القانون، فيما أعلنت أوبن إيه آي دعمها له في يونيو.

وقالت الشركة إن قصر طرح العلامة المائية على الاتحاد الأوروبي يمنحها فرصة للتعلم من الاستخدام الفعلي والحصول على ملاحظات المستخدمين قبل توسيع نطاقها.

وكانت أوبن إيه آي قد قررت في أغسطس 2024 عدم تطبيق العلامة المائية على النصوص التي ينتجها ChatGPT، بعدما أظهر استطلاع أجرته الشركة أن نحو 30% من مستخدمي ChatGPT قالوا إنهم سيستخدمون الخدمة بشكل أقل إذا جرى تطبيق العلامة المائية.

ماذا أظهرت اختبارات أوبن إيه آي؟

تعتمد الطريقة التي أطلقت عليها أوبن إيه آي اسم textGrain على إضافة إشارة إحصائية إلى الطريقة التي يختار بها النموذج الكلمات، بحيث يمكن لأداة الكشف البحث عن هذه الإشارة داخل النص.

وعند ضبط معدل النتائج الإيجابية الكاذبة المستهدف عند 1%، تمكنت أداة الكشف من العثور على العلامة المائية في نحو 80% من المقاطع التي يبلغ طولها 200 رمز، ونحو 95% من المقاطع التي يبلغ طولها 400 رمز، وذلك في محتوى من مجالات مثل علم النفس.

لكن الشركة سجلت معدلات أقل بكثير في مجالات مثل الرياضيات، حيث تكون الخيارات المتاحة أمام النموذج في اختيار الكلمات أكثر محدودية.

وكانت قواعد الممارسات الأوروبية لا تشترط وضع علامة مائية على النصوص الحرة التي يقل طولها عن 200 رمز، وهو ما يجعل 200 رمز أقصر طول للنصوص التي عرضت أوبن إيه آي نتائج اختبارها بشأنها.

وأظهرت اختبارات أخرى أن تعديل النص يمكن أن يضعف الإشارة المائية بصورة كبيرة. ففي مقاطع إنجليزية يبلغ طولها 400 رمز، أدى استبدال 10% من الكلمات بمرادفات إلى انخفاض معدل اكتشاف العلامة من نحو 92% إلى 66%.

وعندما ارتفعت نسبة الكلمات المستبدلة إلى 25%، انخفض معدل الاكتشاف إلى 17%.

وأُجريت الاختبارات باستخدام إجابات عن أسئلة من مجموعة بيانات ELI5.

وقالت أوبن إيه آي إن تقنية textGrain حققت أداءً مساويًا أو أفضل من الطرق الأخرى التي اختبرتها، ومن بينها تقنية SynthID المخصصة للنصوص.

ومع ذلك، أكدت الشركة أن النجاح في ظروف الاختبار المثالية لا يعني بالضرورة أن التقنية ستكون موثوقة بالدرجة نفسها في الاستخدامات اليومية. كما أظهرت اختبارات الأداء التي أجرتها أوبن إيه آي فروقًا محدودة أو معدومة بين الحالات التي كانت فيها العلامة المائية مفعلة وتلك التي كانت معطلة.

من يستطيع التحقق من العلامة المائية؟

يمكن للباحثين والمنظمات المتخصصة طلب الوصول إلى أداة الكشف الخاصة بأوبن إيه آي، على أن يتم تقييم الطلبات في البداية كل حالة على حدة وفقًا لقواعد الممارسات الأوروبية.

وتوضح الأداة ما إذا كانت قد اكتشفت علامة مائية تابعة لأوبن إيه آي، لكنها لا تكشف هوية المستخدمين ولا تعرض الأسئلة أو المحادثات التي أدت إلى إنتاج النص.

وقالت أوبن إيه آي إن أداة الكشف لن تكون متاحة للجمهور عند إطلاقها بسبب مخاطر عدم اكتشاف بعض العلامات المائية، إلى جانب احتمال ظهور نتائج إيجابية كاذبة.

وفي المقابل، تظل أدوات التحقق من الصور والصوت عبر موقع أوبن إيه آي وخدمة Content Provenance API متاحة للجميع.

وكانت الشركة قد أوضحت في تحديث صدر عام 2024 أنه حتى مع انخفاض معدل النتائج الإيجابية الكاذبة، فإن تطبيق أداة الكشف على كميات ضخمة من النصوص قد يؤدي إلى عدد كبير من النتائج الإيجابية الكاذبة.

وشددت أوبن إيه آي أيضًا على أن وجود العلامة المائية لا يحدد مقدار مساهمة الإنسان في كتابة النص، كما أن غيابها لا يثبت أن الإنسان هو من كتب النص.

مقارنة مع أنثروبيك

تختلف سياسة أوبن إيه آي عن شركة أنثروبيك، التي تضع علامات على النصوص الصادرة عن نماذج Claude المدعومة على مستوى العالم، وفقًا لصفحة الدعم الخاصة بها.

وتقول أنثروبيك إن السبب في تطبيقها عالميًا هو أنها لا تمتلك حتى الآن طريقة فعالة ومستدامة لحصر العلامة المائية حسب المناطق الجغرافية.

وبالنسبة إلى أوبن إيه آي، تقتصر العلامة المائية حاليًا على نصوص ChatGPT وCodex المؤهلة داخل الاتحاد الأوروبي، بينما يمكن لمستخدمي API تفعيلها اختياريًا على نماذج محددة، مع بقائها معطلة افتراضيًا.

أما أنثروبيك فتضع العلامة على النماذج المدعومة لديها، والتي تحددها الشركة بالاسم.

وتستخدم أوبن إيه آي تقنية textGrain الخاصة بها، بينما تعتمد أنثروبيك نسخة من تقنية SynthID-Text التابعة لجوجل ديب مايند.

وفي ما يتعلق بأدوات الكشف، تتيح أوبن إيه آي الوصول إليها للباحثين المعتمدين والمنظمات المتخصصة بعد تقديم طلب، بينما توفر أنثروبيك معاينة خاصة للمنظمات المؤهلة، بما فيها الجهات التنظيمية ووسائل الإعلام والباحثون، إلى جانب المؤسسات التي تتحقق من امتثالها الخاص.

كما نشرت أوبن إيه آي نتائج محددة حول تأثير تعديل النص، حيث أظهرت اختبارات أن استبدال 10% من الكلمات بمرادفات خفّض قدرة الكشف من نحو 92% إلى 66%، بينما أدى استبدال 25% منها إلى هبوطها إلى 17%. وفي المقابل، لم تنشر أنثروبيك أرقامًا مماثلة في شرحها، لكنها أشارت إلى أن التعديلات البسيطة قد لا تزيل العلامة بالكامل، بينما يمكن لإعادة الكتابة الكاملة أن تفعل ذلك.

ما أهمية الخطوة؟

قد تواجه المؤسسات التي يعمل موظفوها في دول مختلفة أو يستخدمون خدمات ChatGPT اختلافًا في وجود العلامة المائية بحسب موقع إنتاج النص. فعلى سبيل المثال، قد تنتج فرق تعمل من برلين نصوصًا تحمل العلامة المائية، بينما تنتج فرق أخرى في تورنتو نصوصًا من الخدمة نفسها دونها.

ويحذر هذا الوضع من التعامل مع نتيجة الكشف باعتبارها دليلًا قاطعًا على هوية مؤلف النص، إذ تؤكد أوبن إيه آي أن العلامة المائية لا تستطيع تحديد مقدار مساهمة الإنسان في إنتاج المحتوى.

وقالت الشركة إنها تخطط لتوسيع نطاق الوصول إلى أداة الكشف عندما ترى أن النتائج يمكن تفسيرها بصورة مسؤولة. ومع بدء تطبيق العلامة المائية في الاتحاد الأوروبي خلال الأسابيع المقبلة، قد تبدأ الفرق التي تعمل مع موظفين أو عمليات داخل الاتحاد الأوروبي في إنتاج محتوى يحمل هذه العلامة، بينما سيظل التحقق منه متاحًا في البداية للباحثين والمنظمات المتخصصة المعتمدة.

مقالات ذات صلة

زر الذهاب إلى الأعلى