كاشف فراونهوفر الجديد يهدف إلى أكثر من مجرد الإشارة إلى التزييف
قدم باحثون في معهد فراونهوفر الألماني لأنظمة البصريات والتقنيات واستغلال الصور نظامًا يسمى RealorRender، مصممًا للمساعدة في التمييز بين الصور الأصلية والصور المولدة بالذكاء الاصطناعي (التزييف العميق). ويأتي المشروع في وقت أصبحت فيه الصور المتلاعب بها أصعب على الأشخاص تمييزها بالعين المجردة وأسهل إنتاجًا على نطاق واسع، مما يزيد الضغط على الحكومات والمنصات وفرق الأمن لإيجاد أدوات يمكنها العمل بموثوقية في الظروف الواقعية.
إن الحاجة إلى كشف أفضل واضحة. تشير المادة المصدرية للإعلان إلى موجة سريعة النمو من الاستخدامات الضارة، بما في ذلك التحرش والاستمالة والابتزاز الجنسي والإذلال والاحتيال وأشكال أخرى من الإساءة. كما تستشهد ببيانات من تقارير الحكومة البريطانية وتحقيق عام 2023 حول التزييف العميق الجنسي، مما يؤكد أن المشكلة ليست افتراضية أو هامشية. تُستخدم الصور الاصطناعية بالفعل بطرق تسبب ضررًا شخصيًا مباشرًا، خاصة للنساء والفتيات، بينما تؤدي أيضًا إلى تآكل الثقة في الأدلة الرقمية على نطاق أوسع.
مشكلة الثقة الأوسع هذه لا تقل أهمية عن أي فئة إساءة منفردة. بمجرد أن يصبح إنشاء صور مزيفة مقنعة أمرًا سهلاً، يمكن أن تصبح كل صورة قابلة للطعن. قد يتم رفض صورة حقيقية باعتبارها اصطناعية، بينما يمكن أن تنتشر صورة ملفقة لفترة كافية لتشكيل الرأي العام قبل أن يتحداها أحد. في هذه البيئة، لا تكمن قيمة نظام الكشف فقط في إنتاج تسمية، بل في ما إذا كان يمكنه مساعدة المحققين والمشرفين والمطورين على فهم سبب وصوله إلى هذا الاستنتاج.
طريقة هجينة بدلاً من مصنف بسيط
السمة الرئيسية لنظام RealorRender هي أنه لا يعتمد على خدعة كشف واحدة فقط. وفقًا لمعهد فراونهوفر IOSB، يجمع النظام بين التصنيف بالتعلم العميق وتقييم يعتمد على مدى قدرة نموذج توليدي على إعادة بناء الصورة قيد المراجعة. من الناحية العملية، يحاول الكاشف أولاً إعادة بناء الصورة باستخدام مولد صور بالذكاء الاصطناعي. ثم يستخدم نموذج ذكاء اصطناعي آخر لتصنيف النتيجة وحساب خطأ إعادة البناء، مما ينتج دقة تقديرية للتعرف كنسبة مئوية.
هذا يجعل النهج ملحوظًا لسببين. أولاً، يعامل الكشف كمسألة هجينة بدلاً من حكم بنعم أو لا من نموذج صندوق أسود. ثانيًا، صُمم لتقديم تفسير لقراره، بما في ذلك مناطق مميزة تشير إلى المكان الذي وجد فيه النظام أدلة متوافقة مع التزييف العميق. بالنسبة للفرق التي تنشر مثل هذه الأدوات، قد تكون هذه القابلية للتفسير بنفس أهمية الدقة الخام، لأنها توفر طريقة لفحص أوضاع الفشل وتحسين النموذج بمرور الوقت.
وصف العالم الكبير في فراونهوفر أندرياس سبيكر سير العمل في النص المصدر: إعادة بناء الصورة، ثم تشغيل التصنيف، ثم استخدام خطأ إعادة البناء كجزء من الحساب النهائي. يشير هذا الوصف إلى أن النظام يبحث عن تباينات مميزة بين كيفية إعادة إنتاج نموذج توليدي للصورة وما هو موجود في الأصل. عندما يتوافق نمط التباين مع التوليد الاصطناعي، يمكن للكاشف تسجيل الصورة وفقًا لذلك.
لماذا تعتبر قابلية التفسير مهمة في كشف التزييف العميق
أصبحت قابلية التفسير أحد التحديات المركزية في أدوات أمن الذكاء الاصطناعي. يمكن للعديد من الكاشفات إنتاج درجة ثقة، لكن درجة الثقة وحدها لا تساعد بالضرورة المراجع البشري في تحديد ما يجب فعله بعد ذلك. إذا كان بإمكان النظام تحديد مناطق محددة تبدو متلاعبًا بها، يمكن للمطورين تدقيق الأداء بشكل أكثر فعالية ويمكن للمستخدمين اكتساب ثقة أكبر في النتيجة. هذا مهم بشكل خاص في سياقات مثل الصحافة ودعم إنفاذ القانون والإشراف على المحتوى والأدلة الرقمية، حيث قد تحمل القرارات عواقب قانونية أو تتعلق بالسمعة.
هناك أيضًا فائدة عملية. تتطور طرق توليد التزييف العميق بسرعة، وغالبًا ما تعاني الكاشفات عندما يتم تدريبها بشكل ضيق للغاية على آثار الأمس. يمكن لنظام أكثر شفافية أن يجعل التكيف أسهل من خلال إظهار الأنماط التي يستخدمها فعليًا، بدلاً من إخفاء كل التفكير في مخرجات احتمالية واحدة. يتم وضع RealorRender في هذا الاتجاه: ليس مجرد إنذار، بل كأداة للتحقيق في أساس الإنذار.
لا يدعي النص المصدر أن RealorRender يحل مشكلة التزييف العميق تمامًا، وهذا التحفظ مهم. يظل الكشف سباق تسلح. المولدات الأفضل تجبر الكاشفات على التحسن، والكاشفات الأقوى تدفع أدوات الصور الاصطناعية إلى إزالة الآثار المميزة. ومع ذلك، فإن الأدوات التي تضيف قابلية للتفسير وتجمع بين طرق تحليلية متعددة قد تكون أكثر مرونة من الأنظمة المبنية حول توقيع ضيق واحد.
الضغط السياسي يرتفع جنبًا إلى جنب مع العمل التقني
يأتي الإعلان أيضًا وسط نشاط سياسي متزايد. يشير المصدر إلى أن الوزراء البريطانيين تعهدوا باتخاذ إجراءات تهدف إلى تقليل تعرض الأطفال لصور عارية على الهواتف. يتحدث هذا عن إلحاح القضية، لكنه يسلط الضوء أيضًا على فجوة بين الأهداف السياسية والتنفيذ التقني. من الصعب تنفيذ القواعد ضد إنشاء أو مشاركة محتوى ضار إذا كانت المنصات والمؤسسات تفتقر إلى طرق موثوقة لتحديد المواد الاصطناعية بسرعة وبشكل متسق.
هنا يمكن أن تصبح أنظمة مثل RealorRender ذات صلة خارج المختبر. يمكن للكاشف العملي دعم الإشراف على المنصات، وأنظمة السلامة المدرسية وأماكن العمل، وفرز إنفاذ القانون، وخطوط أنابيب المراجعة الجنائية. يمكن أن يساعد أيضًا في وضع معايير داخلية أفضل للتعامل مع الوسائط المشبوهة، خاصة عندما لا يكون السؤال مجرد ما إذا كانت الصورة مزيفة، بل ما نوع التلاعب الذي قد حدث.
ومع ذلك، تبقى أسئلة النشر. لا يوفر النص المصدر مقارنات معيارية أو عتبات تشغيل أو نتائج ميدانية واسعة النطاق. بدون هذه التفاصيل، من السابق لأوانه الحكم على مدى جودة أداء RealorRender عبر أنواع الصور المختلفة، ومستويات الضغط، وخطوط أنابيب التحرير، أو نماذج التوليد الجديدة الناشئة. غالبًا ما تحدد هذه العوامل ما إذا كانت الأداة البحثية الواعدة تصبح أداة تشغيلية موثوقة.
ما الذي تشير إليه هذه التطورات
الأهمية الأعمق لنظام RealorRender هي أن كشف التزييف العميق يتحرك نحو أنظمة تجمع بين التصنيف وأدوات الاستدلال. يعكس هذا فهمًا أكثر نضجًا للمشكلة. في عالم مشبع بالوسائط الاصطناعية، سيحتاج الناس إلى أدوات تفعل أكثر من مجرد إصدار تحذيرات. سيحتاجون إلى أنظمة يمكنها المساعدة في شرح وتوثيق والدفاع عن الاستنتاج.
يشير عمل فراونهوفر IOSB إلى أن المرحلة التالية من الكشف قد تُعرَّف من خلال هذا المزيج من الدقة التقنية وقابلية التفسير البشري. إذا ثبت أن النهج قوي خارج الإعدادات الخاضعة للرقابة، فقد يعزز كيفية استجابة المؤسسات للصور المتلاعب بها في وقت ترتفع فيه التكلفة الاجتماعية للخطأ بسرعة.
هذا المقال مبني على تقرير من New Atlas. اقرأ المقال الأصلي.
Originally published on newatlas.com


