أعلنت شركة OpenAI أنها أحبطت حملة منسقة استهدفت استخراج قدرات واستدلالات محمية من نماذجها، في نشاط قالت إنه يندرج ضمن ما يعرف بـ"التقطير العدائي"، أي استخدام مخرجات نموذج متقدم بصورة غير مصرح بها لتدريب أو تحسين نموذج آخر.
وبحسب الشركة، بدأ النشاط في الأول من يوليو بوتيرة محدودة، قبل أن يسجل ذروته يومي 24 و25 من الشهر نفسه، مع نحو 16 ألف طلب من أكثر من 4 آلاف مستخدم. وأظهرت التحقيقات لاحقاً وجود أنماط مرتبطة بالنشاط ضمن مجموعة تجاوزت 15 ألف مستخدم، قبل أن يتم تعطيله بالكامل بحلول 28 يوليو.
وأكدت OpenAI أن الحملة لم تتضمن اختراقاً لقواعد بياناتها أو الوصول المباشر إلى محادثات المستخدمين المخزنة، وإنما اعتمدت على التلاعب بتفاعلات النماذج بهدف إظهار أجزاء من الاستدلال المحمي بصورة قابلة للاستخراج والتحليل.
وقالت الشركة إنها تنسب جزءاً أساسياً من النشاط إلى أفراد مرتبطين بشركة Moonshot AI، المطورة لنظام Kimi، لكنها أوضحت أنها لا تستطيع الجزم بأن جميع المشاركين في الحملة ينتمون إلى جهة واحدة.
وحذرت OpenAI من أن هذا النوع من الهجمات قد يشكل مخاطر تتعلق بالسلامة والأمن، لأنه قد يسمح بنقل قدرات متقدمة إلى نماذج أخرى دون نقل إجراءات الحماية نفسها، مشيرة إلى أنها عززت إجراءاتها الدفاعية وشاركت معلومات مع شركاء في قطاع الذكاء الاصطناعي.
استعمال المضامين بموجب بند 27 أ لقانون الحقوق الأدبية لسنة 2007، يرجى ارسال رسالة الى:
[email protected]
OpenAI تكشف تفاصيل محاولة منظمة لتقليد قدرات نماذجها
أعلنت شركة OpenAI أنها أحبطت حملة منسقة استهدفت استخراج قدرات واستدلالات محمية من نماذجها، في نشاط قالت إنه يندرج ضمن ما يعرف بـ"التقطير العدائي"، أي استخدام مخرجات نموذج متقدم بصورة غير مصرح بها لتدريب أو تحسين نموذج آخر. وبحسب الشركة، بدأ النشاط في الأ
