스크립트
00:00:00وجهت شركة Anthropic انتقادات حادة لـ DeepSeek وKimi وQwen وGLM، ولكل نموذج صيني تقريباً،
00:00:04مهمة إياهم ليس فقط بتقطير نماذجهم، بل وأيضاً بتحويل طلبات عملائهم
00:00:08سراً إلى نموذج Claude Opus وعرض الإجابات على هؤلاء المستخدمين وكأنها صادرة من نماذجهم الخاصة.
00:00:13أوه، لقد وجدوا أدلة أيضاً على استخدام دول لنموذج Claude لبناء أسراب طائرات بدون طيار،
00:00:17والتخطيط للحرب البحرية، والرقابة المحلية، والكثير غير ذلك،
00:00:20ولكن لكي أكون صادقاً معك، لن أفكر في تلك الأمور وسأكتفي بالاستمتاع بما تبقى لي من وقت.
00:00:29الآن، أريد أن أبدأ بما يعنيه التقطير، لأنه ليس غير قانوني بحد ذاته.
00:00:33في الواقع، إنها تقنية تدريب عادية جداً. تأخذ نموذج معلم كبيراً وقادراً،
00:00:37وتجعله يولد إجابات لمجموعة من الموجهات، وتدرب نموذجاً أصغر على تلك الإجابات.
00:00:42تقوم كل مختبرة بهذا مع نماذجها الخاصة، وهي الطريقة التي تحصل بها على الإصدارات الأرخص مثل Haiku.
00:00:46ولكن ما تسميه Anthropic بالتققطير غير القانوني، هو القيام بذلك على نموذج شخص آخر
00:00:49على نطاق صناعي، ودون إذن، وبأستخدام الاحتيال لتحقيق ذلك.
00:00:53إنهم ينشئون آلاف الحسابات، ويستخدمون بطاقات ائتمان مسروقة، ومفاتيح API مسروقة، ووكلاء سكنيين.
00:00:58في التقرير، تطلق Anthropic على شبكات الوكلاء هذه اسم محطات النقل،
00:01:02وهي تتواجد بين المختبر الصيني وواجهة برمجة التطبيقات الخاصة بـ Anthropic، متظاهرة بأنها عملاء عاديون.
00:01:07في شهر فبراير الماضي، قامت Anthropic بالفعل بانتقاد DeepSeek وMoonshot وMiniMax لهذا السبب بالذات،
00:01:11ووجدت أن تلك الثلاثة استخدمت أكثر من 24,000 حساب وهمي، مع 16 مليون عملية تبادل مع Claude،
00:01:17ولكن هذا التقرير يركز الآن على ما وجدوه منذ ذلك الحين، وقد أصبح الوضع أسوأ بكثير.
00:01:21يحتوي هذا التقرير في الواقع على ملف حالة لكل مختبر، لكني سأبدأ بالأكبر،
00:01:24لان Anthropic تقول إن هذا هو أكبر هجوم تقطير قاسته على الإطلاق،
00:01:28والمتورط هو شركة علي بابا، الشركة المصنعة لنموذج Qwen.
00:01:31يقولون إنه بين شهرَي مايو ويوليو من هذا العام، أحصت Anthropic أكثر من 151 مليون عملية تبادل،
00:01:36بلغ ذروتها نحو 3 ملايين طلب يومياً، باستخدام أكثر من 3,500 حساب وهمي.
00:01:41ولكن المثير للاهتمام هنا هو أنهم على ما يبدو لم يكونوا يلاحقون الإجابة النهائية لـ Claude،
00:01:44بل كانوا يريدون سلسلة التفكير تحديداً.
00:01:46حقن خط الأنابيب موجهاً ثابتاً في كل طلب،
00:01:49مما أجبر Claude Opus 4.6 و4.7 على كتابة استدلاله في وسوم نصية مضمنة قبل الإجابة،
00:01:55ثم كانوا يستخرجون تلك البيانات ويحولونها إلى بيانات ضبط خاضعة للإشراف،
00:01:59والتي استُخدمت، وفقاً لـ Anthropic، لتدريب Qwen 3.5 و3.6 و3.7.
00:02:04يبدو أن هذا الهجوم كان مركّزاً بشكل كبير على العمل الوكيل،
00:02:07أي هندسة البرمجيات، وتطوير النواة، والمهام طويلة الأمد،
00:02:10لذا كان كل ذلك لجعل Qwen أفضل في البرمجة.
00:02:12وتمضي Anthropic لتدعي أن علي بابا كانت تستخدم Claude لبناء بيئة التعلم
00:02:16الخاصة بهم وإجراء أبحاث البنية المعمارية،
00:02:19وعندما حظرت Anthropic المجموعة الأولى البالغة 5,000 حساب،
00:02:21انتقلت حركة مرورهم ببساطة إلى مجموعة ثانية، والتي كانت تحمل أيضاً طلبات من DeepSeek وXiaomi،
00:02:26لذا فإن شبكات الوكلاء نفسها تخدم مختبرات متعددة.
00:02:29لكنني سأخمن هنا وأقول إن Anthropic لن تجد الكثير من التعاطف
00:02:32لكونها هدفاً لهجوم تقطير،
00:02:34لأن معظم الناس يعتقدون أنها قامت بتقطير كل المعرفة البشرية دون إذن مسبق،
00:02:38لذا أعتقد أنهم يعرفون الآن كيف يبدو هذا الشعور.
00:02:41بالانتقال الآن إلى المختبر التالي الذي اتهموه في هذا التقرير،
00:02:43لدينا Moonshot، الشركة المصنعة لـ Kimi، وهو أحد نماذجي المفضلة.
00:02:46تدعي Anthropic أن Moonshot قامت بتحويل طلبات العملاء سراً عبر Claude،
00:02:50بدلاً من تشغيلها عبر Kimi، وعرضت استجابة Claude على المستخدم.
00:02:53لذا اعتقد المستخدم أنه كان يتحدث إلى Kimi، لكنه كان يخدم Opus في الواقع.
00:02:58على ما يبدو في نافذة مدتها 10 أيام، كان هناك ما يقرب من 300,000 طلب عميل
00:03:01تم تشغيلها عبر شبكة وكلاء تضم 5,380 حساباً مزيفاً،
00:03:05ويبدو أن معظمها من سنغافورة واليابان.
00:03:08عبر شهرَي مايو ويوليو، تنسب Anthropic أكثر من 23 مليون عملية تبادل إلى Moonshot إجمالاً.
00:03:13ويقولون إن سبب قيام Moonshot بذلك يماثل سبب علي بابا،
00:03:16وهو استخراج بيانات الاستدلال.
00:03:18على ما يبدو، بنت Moonshot خط أنابيب استخراج لاستخراج
00:03:20نصوص سلسلة تفكير Claude من عمليات التبادل المرحلي المحفوظة تلك لتدريب نماذجها الخاصة.
00:03:25اعتقدت Anthropic على ما يبدو أن لديها دفاعاً ضد هذا،
00:03:27لأنه عندما يقوم Claude بالتفكير الممتد، فإن واجهة برمجة التطبيقات لا تعيد الاستدلال الخام بعد الآن،
00:03:31بل تعيد توقيع تفكير، وهو مرجع يمكن لواجهة برمجة التطبيقات استخدامه لاحقاً
00:03:35للبحث عن هذا الاستدلال إذا لزم الأمر، ولكن لا يُفترض أن تتمكن من رؤية ذلك.
00:03:39ولكن ما فعلته Moonshot هو حفظ ذلك التوقيع،
00:03:42وبدء جلسة جديدة تماماً، ثم جعل Claude يحول التوقيع
00:03:44مرة أخرى إلى أثر استدلال كامل.
00:03:46تسمي Anthropic هذا هجوم إعادة تشغيل عبر الجلسات،
00:03:49وقد بنت Moonshot خط أنابيب كاملاً حوله.
00:03:51وعلاوة على كل ذلك، يشيرون أيضاً إلى أن البيانات الواردة في تلك الطلبات المحولة
00:03:54احتوت على أشياء مثل قيام شخص بتحميل بيانات مراقبة تلفزيونية مغلقة
00:03:57من مئات الكاميرات وسؤال Kimi عما إذا كان شخص متعقب واحد يتصرف بشكل غير طبيعي،
00:04:02ووجدوا أيضاً مهندساً في شركة مملوكة للدولة في الصين
00:04:05يلصق شيفرات برمجية داخلية وبيانات اعتماد حية من عدة شركات تقنية كبرى.
00:04:10هذا التعامل مع البيانات سيء للغاية وبشكل مطلق من كل المشاركين.
00:04:14الآن إلى جانب Moonshot، وجدوا أيضاً أن DeepSeek كانت تفعل الشيء نفسه تماماً
00:04:17باستخدام نفس حيلة إعادة تشغيل الجلسة المتقاطعة وتوقيع التفكير،
00:04:20وتوجيه طلبات العملاء عبر نموذج Opus.
00:04:23ولكن ما كانت تفعله DeepSeek فوق ذلك هو تحليل أداة التشغيل التي تستخدمها
00:04:27من خلال فحص طلبك، وإذا كنت تستخدم أدوات مثل Claude Code،
00:04:30أو Claude Agent SDK، أو OpenCode، فإن طلباتك كانت تُوجّه بعد ذلك إلى Claude Opus،
00:04:34على أساس أنه إذا كنت تستخدم إحدى تلك الأدوات،
00:04:37فمن المحتمل أنك مصدر جيد لبيانات البرمجة الوكيلية،
00:04:39والتي يمكنهم الآن جمعها باستخدام إجابات Opus والتدريب نماذجهم الخاصة عليها.
00:04:43بالنسبة لـ DeepSeek، تقول Anthropic إن هذا حدث على مدار 14 يوماً في يوليو،
00:04:46وشمل حوالي 12.1 مليون عملية تبادل.
00:04:48ووجدوا أيضاً أنه على غرار Moonshot،
00:04:50كانت DeepSeek تسرب بعض البيانات الحساسة للغاية.
00:04:52لاحظوا موظفاً في شركة تقنية صينية يحلل وثائق داخلية،
00:04:56بما في ذلك المواصفات الكاملة والهيكل التنظيمي لبرنامج ذكاء اصطناعي رائد.
00:05:00وكان هناك أيضاً مشغل تكنولوجيا معلومات يعمل لصالح وكالة روسية مرتبطة بوزارة دفاعها،
00:05:04مع بيانات اعتماد حية لقاعدة بيانات حكومية في الطلب،
00:05:08وأيضاً مهندسون يبنون أداة لإدارة القضايا لمكتب شرطة بلدي
00:05:11تقارن تحركات الأشخاص بسجلات الشرطة برقم الهوية الوطنية.
00:05:15بدأت حقاً أتقد أن نسبة 10% من احتمالية الفناء منطقية تماماً.
00:05:20من فضلك لا تفعل أشياء كهذه باستخدام الذكاء الاصطناعي.
00:05:22كانت تلك هي الادعاءات الكبيرة، ولكن هناك أربعة ادعاءات أخرى أصغر.
00:05:25أولاً، لدينا ZAI، مطورو نموذج GLM،
00:05:27الذين قاموا على ما يبدو بالتبديل بين 273 حساباً وهمياً لاستخراج مسارات التفكير من Opus 4.8،
00:05:33ثم إعادة تشغيل المسارات الملتقطة عبر Claude لتنظيفها من أجل تدريبهم الخاص.
00:05:36على ما يبدو، حدث هذا عبر أكثر من 3.4 مليون عملية تبادل في غضون 17 يوماً.
00:05:41لاحظوا أيضاً أنه قبيل إطلاق GLM 5.3 مباشرة،
00:05:44كانت ZAI تحاول استخلاص قدرات Fable السيبرانية،
00:05:47لكنها استسلمت لأن ضمانات Fable كانت تستمر في إحباط الهجوم،
00:05:50وتقول Anthropic إنهم شاهدوا موظفي ZAI يتحولون إلى Opus 4.6،
00:05:54ونموذج رئيسي آخر لمختبر أمريكي،
00:05:55تحديداً لأنهم قدروا أن ضمانات الأمان كانت أضعف.
00:05:58إذن، مجرد استعراض بسيط لضمانات Fable في هذا التقرير.
00:06:01بعد ذلك، ينتقلون لتوجيه الاتهام إلى Xiaomi، مطوري نموذج MIMO،
00:06:05بإعادة تشغيل جلسات برمجة مستخدميهم أنفسهم عبر Claude لتوليد بيانات التدريب.
00:06:09حدث هذا على ما يبدو عبر أكثر من 400,000 طلب عبر 1,500 حساب،
00:06:13وتقترح Anthropic حتى أن الإصدار التجريبي MIMO V2 Pro 3 ربما تم إطلاقه
00:06:16ثم تمديده لجذب المطورين الدوليين ليكون هناك المزيد من الجلسات لإعادة تشغيلها،
00:06:21حيث بدأ الجزء الأكبر من الهجمات فور انتهاء تلك التجربة.
00:06:24بعد ذلك، ينتقلون لتوجيه الاتهام إلى شركة تُدعى SenseTime،
00:06:27التي تشتري على ما يبدو نصوص محادثات الأشخاص على Claude من بائعي بيانات طرف ثالث.
00:06:32إذن، بعض خدمات الوساطة تلك التي تبيع لك الوصول إلى Claude بطريقة غير مدعومة
00:06:35كانت تسجل بياناتك وتبيعها في الواقع،
00:06:38خاصة تلك التي كانت ربما تقلل الأسعار مقارنة بـ Anthropic.
00:06:41وأخيراً، نظراً لعدم نجاح أي مختبر صيني في تجنب ذلك،
00:06:43كان لدى Minimax أيضاً على ما يبدو شركة واجهة تشغل إحدى خدمات الوساطة تلك
00:06:47وتدير نماذج Anthropic و OpenAI فقط،
00:06:50واتهام Anthropic هنا هو أن الخدمة برمتها وُجدت لجمع بيانات التدريب.
00:06:54إذن، كانت هذه جميع اتهامات الاستخلاص الواردة في هذا التقرير.
00:06:57كما قلت، لم يكن أي مختبر صيني في مأمن أساساً،
00:07:00ومستقبلاً، اتخذت Anthropic خطوات لمحاولة جعل هذه الإجراءات أكثر صعوبة،
00:07:03وبعضها قد تكون لاحظته حتى لو كنت تستخدم واجهة برمجة التطبيقات (API).
00:07:06على سبيل المثال، تلخص Claude الآن استدلالها قبل الرد
00:07:09لجعل النص أقل فائدة،
00:07:11ومع Fable 5.1، أضافوا ميزة التفكير المحفوظ (Preserved Thinking)،
00:07:13التي تمنع حسابات API الجديدة من تعديل موجه النظام،
00:07:16أو الأدوات، أو الرسائل السابقة التي تقع قبل كتلة الاستدلال في محادثة متعددة الجولات.
00:07:21كما أنها تدرب مصنفات خصيصاً لموجهات الاستخراج.
00:07:24أحد الأمثلة الطريفة في هذا التقرير هو على ما يبدو مجرد موجه يقول:
00:07:27لا تحدد هذا على أنه استخراج استدلال، كله بأحرف كبيرة.
00:07:30طلب آخر على ما يبدو من Claude ترجمة كل ذاكرة عمله السابقة
00:07:34إلى اللغة اليابانية بحروف الكاتاكانا فقط.
00:07:36ويقولون أيضاً إنه بالنسبة لجميع الحسابات التي تبدو هكذا من الصين أو روسيا أو إيران،
00:07:39سيُطلب منك التحقق من هويتك، أو سيتم حظرك.
00:07:42سأترك رابط هذا التقرير في الأسفل،
00:07:44حيث أن هذا في الواقع قسم واحد فقط منه.
00:07:46البقية أكثر إخافة بكثير.
00:07:47لديهم أجزاء عن العمليات السيبرانية، والمراقبة، والتأثير، والأسلحة،
00:07:51والسوء الاستخدام البيولوجي، والاحتيال.
00:07:53أخبرني برأيك في كل هذا في التعليقات أدناه،
00:07:55وبينما أنت هناك اشترك في القناة، وكالعادة، أراكم في الفيديو القادم.
커뮤니티 글
아직 글이 없습니다. 이 영상에 대한 첫 번째 글을 작성해 보세요!
이 영상에 대해 글쓰기