أنثروبيك ترصد 200 مليون محاولة لتقطير قدرات نموذج كلود
كشفت شركة أنثروبيك عن رصدها حملات إلكترونية واسعة استهدفت نماذج الذكاء الاصطناعي التابعة لها، وقالت إن شركات صينية متخصصة في المجال حاولت استخراج قدرات متقدمة من نموذج كلود عبر تقنيات تعرف باسم «تقطير النماذج» (Distillation).
حملات إلكترونية واسعة
واتهمت الشركة كلاً من علي بابا ومونشوت وديب سيك بالمشاركة في عمليات متطورة هدفت إلى تجاوز أنظمة الحماية والوصول إلى قدرات النماذج الأميركية المتقدمة، في ظل تصاعد حدة المنافسة العالمية في مجال الذكاء الاصطناعي.
وقالت أنثروبيك، في تقرير نشرته الخميس، إن هذه العمليات شهدت تصعيدًا ملحوظًا خلال الأشهر الماضية، واستهدفت قدرات رئيسية في نموذج كلود، من بينها الذكاء الاصطناعي الوكيل، واستخدام الأدوات، والبرمجة، وتحليل البيانات، والاستدلال المنطقي.
أساليب جديدة للتحايل على أنظمة الحماية
وأوضحت الشركة أن مختبرات غير مصرح لها طورت خلال الفترة الأخيرة طرقًا أكثر تعقيدًا لتجاوز دفاعاتها، بهدف استخلاص قدرات نماذج الذكاء الاصطناعي الأميركية المتقدمة واستخدامها في تطوير نماذج أخرى.
وتأتي هذه التطورات بعد أن كشفت أنثروبيك في فبراير الماضي عن هجمات لتقطير النماذج، فيما أعلنت OpenAI في وقت سابق عن نشاط مماثل، وربطته تحديدًا بشركة ديب سيك.
إلا أن الحملات التي رصدتها أنثروبيك مؤخرًا اتسمت، بحسب الشركة، بنطاق أكبر وأكثر عدوانية، بعدما سجلت نحو 200 مليون تفاعل مرتبط بمحاولات تقطير قدرات كلود، موزعة على 5 حملات منفصلة.
كيف تعمل عمليات تقطير النماذج؟
تعتمد تقنية تقطير النماذج بشكل عام على محاولة جمع مخرجات النماذج المتقدمة واستخلاص معلومات مرتبطة بآلية استدلالها، بما في ذلك ما يعرف بـسلسلة التفكير (Chain of Thought).
ويمكن استخدام البيانات الناتجة عن هذه العملية في تدريب نموذج أصغر على مهارات الاستدلال العامة، من خلال تقنية الضبط الدقيق الخاضع للإشراف (Supervised Fine-Tuning).
حيلة ترجمة لاستخراج آثار التفكير
ولا تعرض أنثروبيك للمستخدمين عادةً سلسلة التفكير الداخلية الكاملة لنماذجها، وإنما تقدم ما تسميه «ملخص التفكير»، الذي يوضح بصورة عامة كيفية الوصول إلى الإجابة.
لكن الشركة قالت إن الحملات التي اكتشفتها تضمنت حيلًا مصممة لدفع نموذج كلود إلى الكشف مباشرة عن آثار مرتبطة بعملية التفكير الداخلية.
وفي إحدى المحاولات، جرى تقديم الطلب للنموذج على أنه مهمة ترجمة، مع مطالبته بالتصرف كمترجم خبير وتحويل «ذاكرة العمل السابقة» إلى اليابانية بصورة طبيعية ودقيقة، باستخدام كاتاكانا فقط.
وقالت أنثروبيك إن الأسلوب استهدف إخفاء الغرض الفعلي من الطلب، عبر تقديم محاولة استخراج البيانات الحساسة في صورة مهمة ترجمة تبدو طبيعية.

