التقطير غير المشروع للنماذج · GTG-16006

ادعاءات التقرير بشأن استخراج القدرات من Zhipu / Z.ai: قضية GTG-16006

إشعار المصدر

هذه الصفحة هي ترجمة من الصينية إلى العربية للمحتوى من الصفحات 150-151 من تقرير Anthropic لسبتمبر 2026. جميع البيانات المتعلقة بشركات معينة هي ادعاءات من جانب Anthropic وحده؛ ولم يقم هذا الموقع بالتحقق منها بشكل مستقل ولا تشكل إدانة بوقوع مخالفة قانونية.

وفقًا لتقرير من Anthropic، قامت Zhipu (العلامة التجارية الخارجية Z.ai) بتشغيل خط أنابيب لاستخراج سلسلة التفكير ضد Claude، حيث أعادت تغذية مسارات الاستدلال الملتقطة من Claude إلى Claude لتنظيفها واستخدامها في تدريب نموذج GLM الخاص بها. ويشير التقرير إلى أنه خلال 10 أيام، قامت Zhipu بتشغيل خط أنابيب الاستخراج ضد Opus 4.8 عبر 273 حسابًا احتياليًا، مسجلة 770 ألف تبادل. كما يزعم التقرير أن Zhipu قامت بتقطير القدرات السيبرانية للنماذج الرائدة الأمريكية. كل ما سبق هو ادعاءات من الناشر ولم يتم التحقق منها بشكل مستقل من قبل هذا الموقع.

ما الذي حدث

قامت Zhipu (العلامة التجارية الخارجية Z.ai) بتشغيل خط أنابيب لاستخراج سلسلة التفكير ضد Claude، حيث أعادت تغذية مسارات الاستدلال الملتقطة من Claude إلى Claude لتنظيفها واستخدامها في تدريب نموذج GLM الخاص بها. في غضون 10 أيام فقط، قامت Zhipu بتشغيل خط أنابيب استخراج CoT ضد Claude Opus 4.8 من خلال التناوب بين 273 حسابًا احتياليًا للالتفاف على قيود النموذج لدينا. ثم سجلت Zhipu مسارات استدلال Claude. خلال فترة الـ10 أيام في يونيو، أحصينا 770,609 تبادلًا مرت عبر منظف استخراج CoT. كما نسبنا أكثر من 3 ملايين تبادل إلى Zhipu خلال نفس الفترة، استُخدم معظمها لتنظيف مخرجات التقطير.

استخدمت Zhipu أيضًا Claude لتحسين خط أنابيب ما بعد التدريب الخاص بها، حيث استخدمت Claude للحكم على مخرجات النموذج ولتنظيف وتوحيد سجلات الاستدلال التي تم جمعها للتقطير. كما استُخدم Claude لتصنيف وتصفية بيانات التدريب، بالإضافة إلى كتابة المهام وتقديم الحلول وتنفيذ الاختبارات. قد تستخدم Zhipu هذه المخرجات في جميع أنحاء خط أنابيب التدريب الخاص بها.

في الآونة الأخيرة، قبل إصدار نموذج GLM 5.3، حددنا حملة تستهدف القدرات السيبرانية للنماذج الرائدة الأمريكية. استخدم باحثو Zhipu مجموعات بيانات عامة عن الثغرات لتطوير تحديات متنوعة من نوع "الاستيلاء على العلم". ولحلها، أطلقت Zhipu بعد ذلك هجوم تقطير ضد النموذج الأعلى لمختبر أمريكي رائد آخر. وكان نموذج Claude Opus 4.6 الخاص بنا مستهدفًا تحديدًا في هذا الهجوم التقطيري، بشكل أساسي لتقييم وتصنيف ردود نموذج أمريكي رائد آخر.

حاولت Zhipu في البداية استهداف القدرات السيبرانية لنموذج Fable من Anthropic. لقد عزز Fable — وهو النموذج الأعلى قابلية للوصول العام من Anthropic — إجراءات الحماية السيبرانية، مما جعل من الصعب على المقطّرين المحتملين استهداف القدرات السيبرانية لـ Fable. وبعد أن قللت إجراءات الحماية السيبرانية لـ Anthropic من فعالية هجمات Zhipu، تخلى Zhipu في النهاية عن محاولات استهداف Fable. ولاحظنا أن موظفي Zhipu انتقلوا بعد ذلك إلى Opus 4.6 والنموذج الرائد لمختبر ذكاء اصطناعي أمريكي آخر، بشكل صريح لأنهم قاموا بتقييم أن هذه الإجراءات أضعف.

حجم هجمات التقطير المنسوبة إلى Zhipu على مدار 17 يومًا من يونيو إلى يوليو 2026: لوحظ أكثر من 3.4 مليون تبادل.

ماذا فعل الذكاء الاصطناعي في هذه القضية

قامت Zhipu بتشغيل خط أنابيب لاستخراج سلسلة التفكير ضد Claude، حيث أعادت تغذية مسارات الاستدلال الملتقطة إلى Claude لتنظيفها.

استخدمت Zhipu Claude للحكم على مخرجات النموذج، وتنظيف وتوحيد سجلات الاستدلال، وتصنيف وتصفية بيانات التدريب.

أطلقت Zhipu هجمات تقطير ضد القدرات السيبرانية للنماذج الرائدة الأمريكية، باستخدام Claude لتقييم وتصنيف ردود النماذج الأخرى.

ما الذي رصده التقرير

يؤكد التقرير أن Zhipu شغلت خط أنابيب استخراج CoT ضد Claude، مسجلة 770 ألف تبادل عبر 273 حسابًا احتياليًا خلال 10 أيام.

يؤكد التقرير أن Zhipu استخدمت Claude لتحسين خط أنابيب ما بعد التدريب، بما في ذلك الحكم على مخرجات النموذج، وتنظيف سجلات الاستدلال، وتصنيف بيانات التدريب.

يؤكد التقرير أن Zhipu أطلقت هجمات تقطير ضد القدرات السيبرانية للنماذج الرائدة الأمريكية، مستهدفة في البداية Fable قبل الانتقال إلى Opus 4.6 ونموذج مختبر أمريكي آخر.

يؤكد التقرير أكثر من 3.4 مليون تبادل منسوب إلى Zhipu على مدار 17 يومًا من يونيو إلى يوليو 2026.

المؤكد وغير المؤكد

مؤكد

  • يزعم التقرير أن Zhipu شغلت خط أنابيب لاستخراج سلسلة التفكير ضد Claude لتدريب نموذج GLM الخاص بها
  • يزعم التقرير أن Zhipu سجلت 770 ألف تبادل عبر 273 حسابًا احتياليًا خلال 10 أيام
  • يزعم التقرير أن Zhipu استخدمت Claude لتحسين خط أنابيب ما بعد التدريب، بما في ذلك الحكم على مخرجات النموذج وتنظيف سجلات الاستدلال
  • يزعم التقرير أن Zhipu أطلقت هجمات تقطير ضد القدرات السيبرانية للنماذج الرائدة الأمريكية

غير مؤكد

  • لا يذكر التقرير ما هي النسبة المئوية لسجلات الاستدلال المستخرجة التي دخلت فعليًا في التدريب النهائي لنموذج GLM
  • لا يقدم التقرير قياسات يمكن التحقق منها بشكل مستقل لمكاسب القدرة الناتجة لنموذج GLM
  • لا يتضمن التقرير رد Zhipu على هذه الادعاءات

استجابة المنصة

تشير Anthropic إلى أنها حظرت الحسابات المعنية ونشرت إجراءات لاكتشاف وإعاقة إساءة الاستخدام المستقبلية.

حدود الاستجابة:لا يمكن لحظر الحسابات استعادة سجلات الاستدلال التي تم استخراجها بالفعل؛ ولا يذكر التقرير ما إذا كانت Zhipu قد أوقفت أنشطة التقطير الخاصة بها.

الخلاصات

  • يمكن لخطوط أنابيب استخراج سلسلة التفكير استخراج سجلات استدلال النموذج على نطاق واسع لتدريب النماذج المنافسة.
  • يعد التناوب بين الحسابات الاحتيالية تكتيكًا شائعًا للالتفاف على قيود النموذج.
  • تُظهر هجمات التقطير ضد القدرات السيبرانية أن قوة إجراءات الحماية الأمنية للنموذج تؤثر على احتمالية استهدافه.

المصادر