ديب سيك وكيمي أرسلا تعليماتك سرًا إلى كلود

BBetter Stack
컴퓨터/소프트웨어경제 뉴스AI/미래기술

스크립트

00:00:00وجهت شركة Anthropic انتقادات حادة لـ DeepSeek وKimi وQwen وGLM، ولكل نموذج صيني تقريباً،
00:00:04مهمة إياهم ليس فقط بتقطير نماذجهم، بل وأيضاً بتحويل طلبات عملائهم
00:00:08سراً إلى نموذج Claude Opus وعرض الإجابات على هؤلاء المستخدمين وكأنها صادرة من نماذجهم الخاصة.
00:00:13أوه، لقد وجدوا أدلة أيضاً على استخدام دول لنموذج Claude لبناء أسراب طائرات بدون طيار،
00:00:17والتخطيط للحرب البحرية، والرقابة المحلية، والكثير غير ذلك،
00:00:20ولكن لكي أكون صادقاً معك، لن أفكر في تلك الأمور وسأكتفي بالاستمتاع بما تبقى لي من وقت.
00:00:29الآن، أريد أن أبدأ بما يعنيه التقطير، لأنه ليس غير قانوني بحد ذاته.
00:00:33في الواقع، إنها تقنية تدريب عادية جداً. تأخذ نموذج معلم كبيراً وقادراً،
00:00:37وتجعله يولد إجابات لمجموعة من الموجهات، وتدرب نموذجاً أصغر على تلك الإجابات.
00:00:42تقوم كل مختبرة بهذا مع نماذجها الخاصة، وهي الطريقة التي تحصل بها على الإصدارات الأرخص مثل Haiku.
00:00:46ولكن ما تسميه Anthropic بالتققطير غير القانوني، هو القيام بذلك على نموذج شخص آخر
00:00:49على نطاق صناعي، ودون إذن، وبأستخدام الاحتيال لتحقيق ذلك.
00:00:53إنهم ينشئون آلاف الحسابات، ويستخدمون بطاقات ائتمان مسروقة، ومفاتيح API مسروقة، ووكلاء سكنيين.
00:00:58في التقرير، تطلق Anthropic على شبكات الوكلاء هذه اسم محطات النقل،
00:01:02وهي تتواجد بين المختبر الصيني وواجهة برمجة التطبيقات الخاصة بـ Anthropic، متظاهرة بأنها عملاء عاديون.
00:01:07في شهر فبراير الماضي، قامت Anthropic بالفعل بانتقاد DeepSeek وMoonshot وMiniMax لهذا السبب بالذات،
00:01:11ووجدت أن تلك الثلاثة استخدمت أكثر من 24,000 حساب وهمي، مع 16 مليون عملية تبادل مع Claude،
00:01:17ولكن هذا التقرير يركز الآن على ما وجدوه منذ ذلك الحين، وقد أصبح الوضع أسوأ بكثير.
00:01:21يحتوي هذا التقرير في الواقع على ملف حالة لكل مختبر، لكني سأبدأ بالأكبر،
00:01:24لان Anthropic تقول إن هذا هو أكبر هجوم تقطير قاسته على الإطلاق،
00:01:28والمتورط هو شركة علي بابا، الشركة المصنعة لنموذج Qwen.
00:01:31يقولون إنه بين شهرَي مايو ويوليو من هذا العام، أحصت Anthropic أكثر من 151 مليون عملية تبادل،
00:01:36بلغ ذروتها نحو 3 ملايين طلب يومياً، باستخدام أكثر من 3,500 حساب وهمي.
00:01:41ولكن المثير للاهتمام هنا هو أنهم على ما يبدو لم يكونوا يلاحقون الإجابة النهائية لـ Claude،
00:01:44بل كانوا يريدون سلسلة التفكير تحديداً.
00:01:46حقن خط الأنابيب موجهاً ثابتاً في كل طلب،
00:01:49مما أجبر Claude Opus 4.6 و4.7 على كتابة استدلاله في وسوم نصية مضمنة قبل الإجابة،
00:01:55ثم كانوا يستخرجون تلك البيانات ويحولونها إلى بيانات ضبط خاضعة للإشراف،
00:01:59والتي استُخدمت، وفقاً لـ Anthropic، لتدريب Qwen 3.5 و3.6 و3.7.
00:02:04يبدو أن هذا الهجوم كان مركّزاً بشكل كبير على العمل الوكيل،
00:02:07أي هندسة البرمجيات، وتطوير النواة، والمهام طويلة الأمد،
00:02:10لذا كان كل ذلك لجعل Qwen أفضل في البرمجة.
00:02:12وتمضي Anthropic لتدعي أن علي بابا كانت تستخدم Claude لبناء بيئة التعلم
00:02:16الخاصة بهم وإجراء أبحاث البنية المعمارية،
00:02:19وعندما حظرت Anthropic المجموعة الأولى البالغة 5,000 حساب،
00:02:21انتقلت حركة مرورهم ببساطة إلى مجموعة ثانية، والتي كانت تحمل أيضاً طلبات من DeepSeek وXiaomi،
00:02:26لذا فإن شبكات الوكلاء نفسها تخدم مختبرات متعددة.
00:02:29لكنني سأخمن هنا وأقول إن Anthropic لن تجد الكثير من التعاطف
00:02:32لكونها هدفاً لهجوم تقطير،
00:02:34لأن معظم الناس يعتقدون أنها قامت بتقطير كل المعرفة البشرية دون إذن مسبق،
00:02:38لذا أعتقد أنهم يعرفون الآن كيف يبدو هذا الشعور.
00:02:41بالانتقال الآن إلى المختبر التالي الذي اتهموه في هذا التقرير،
00:02:43لدينا Moonshot، الشركة المصنعة لـ Kimi، وهو أحد نماذجي المفضلة.
00:02:46تدعي Anthropic أن Moonshot قامت بتحويل طلبات العملاء سراً عبر Claude،
00:02:50بدلاً من تشغيلها عبر Kimi، وعرضت استجابة Claude على المستخدم.
00:02:53لذا اعتقد المستخدم أنه كان يتحدث إلى Kimi، لكنه كان يخدم Opus في الواقع.
00:02:58على ما يبدو في نافذة مدتها 10 أيام، كان هناك ما يقرب من 300,000 طلب عميل
00:03:01تم تشغيلها عبر شبكة وكلاء تضم 5,380 حساباً مزيفاً،
00:03:05ويبدو أن معظمها من سنغافورة واليابان.
00:03:08عبر شهرَي مايو ويوليو، تنسب Anthropic أكثر من 23 مليون عملية تبادل إلى Moonshot إجمالاً.
00:03:13ويقولون إن سبب قيام Moonshot بذلك يماثل سبب علي بابا،
00:03:16وهو استخراج بيانات الاستدلال.
00:03:18على ما يبدو، بنت Moonshot خط أنابيب استخراج لاستخراج
00:03:20نصوص سلسلة تفكير Claude من عمليات التبادل المرحلي المحفوظة تلك لتدريب نماذجها الخاصة.
00:03:25اعتقدت Anthropic على ما يبدو أن لديها دفاعاً ضد هذا،
00:03:27لأنه عندما يقوم Claude بالتفكير الممتد، فإن واجهة برمجة التطبيقات لا تعيد الاستدلال الخام بعد الآن،
00:03:31بل تعيد توقيع تفكير، وهو مرجع يمكن لواجهة برمجة التطبيقات استخدامه لاحقاً
00:03:35للبحث عن هذا الاستدلال إذا لزم الأمر، ولكن لا يُفترض أن تتمكن من رؤية ذلك.
00:03:39ولكن ما فعلته Moonshot هو حفظ ذلك التوقيع،
00:03:42وبدء جلسة جديدة تماماً، ثم جعل Claude يحول التوقيع
00:03:44مرة أخرى إلى أثر استدلال كامل.
00:03:46تسمي Anthropic هذا هجوم إعادة تشغيل عبر الجلسات،
00:03:49وقد بنت Moonshot خط أنابيب كاملاً حوله.
00:03:51وعلاوة على كل ذلك، يشيرون أيضاً إلى أن البيانات الواردة في تلك الطلبات المحولة
00:03:54احتوت على أشياء مثل قيام شخص بتحميل بيانات مراقبة تلفزيونية مغلقة
00:03:57من مئات الكاميرات وسؤال Kimi عما إذا كان شخص متعقب واحد يتصرف بشكل غير طبيعي،
00:04:02ووجدوا أيضاً مهندساً في شركة مملوكة للدولة في الصين
00:04:05يلصق شيفرات برمجية داخلية وبيانات اعتماد حية من عدة شركات تقنية كبرى.
00:04:10هذا التعامل مع البيانات سيء للغاية وبشكل مطلق من كل المشاركين.
00:04:14الآن إلى جانب Moonshot، وجدوا أيضاً أن DeepSeek كانت تفعل الشيء نفسه تماماً
00:04:17باستخدام نفس حيلة إعادة تشغيل الجلسة المتقاطعة وتوقيع التفكير،
00:04:20وتوجيه طلبات العملاء عبر نموذج Opus.
00:04:23ولكن ما كانت تفعله DeepSeek فوق ذلك هو تحليل أداة التشغيل التي تستخدمها
00:04:27من خلال فحص طلبك، وإذا كنت تستخدم أدوات مثل Claude Code،
00:04:30أو Claude Agent SDK، أو OpenCode، فإن طلباتك كانت تُوجّه بعد ذلك إلى Claude Opus،
00:04:34على أساس أنه إذا كنت تستخدم إحدى تلك الأدوات،
00:04:37فمن المحتمل أنك مصدر جيد لبيانات البرمجة الوكيلية،
00:04:39والتي يمكنهم الآن جمعها باستخدام إجابات Opus والتدريب نماذجهم الخاصة عليها.
00:04:43بالنسبة لـ DeepSeek، تقول Anthropic إن هذا حدث على مدار 14 يوماً في يوليو،
00:04:46وشمل حوالي 12.1 مليون عملية تبادل.
00:04:48ووجدوا أيضاً أنه على غرار Moonshot،
00:04:50كانت DeepSeek تسرب بعض البيانات الحساسة للغاية.
00:04:52لاحظوا موظفاً في شركة تقنية صينية يحلل وثائق داخلية،
00:04:56بما في ذلك المواصفات الكاملة والهيكل التنظيمي لبرنامج ذكاء اصطناعي رائد.
00:05:00وكان هناك أيضاً مشغل تكنولوجيا معلومات يعمل لصالح وكالة روسية مرتبطة بوزارة دفاعها،
00:05:04مع بيانات اعتماد حية لقاعدة بيانات حكومية في الطلب،
00:05:08وأيضاً مهندسون يبنون أداة لإدارة القضايا لمكتب شرطة بلدي
00:05:11تقارن تحركات الأشخاص بسجلات الشرطة برقم الهوية الوطنية.
00:05:15بدأت حقاً أتقد أن نسبة 10% من احتمالية الفناء منطقية تماماً.
00:05:20من فضلك لا تفعل أشياء كهذه باستخدام الذكاء الاصطناعي.
00:05:22كانت تلك هي الادعاءات الكبيرة، ولكن هناك أربعة ادعاءات أخرى أصغر.
00:05:25أولاً، لدينا ZAI، مطورو نموذج GLM،
00:05:27الذين قاموا على ما يبدو بالتبديل بين 273 حساباً وهمياً لاستخراج مسارات التفكير من Opus 4.8،
00:05:33ثم إعادة تشغيل المسارات الملتقطة عبر Claude لتنظيفها من أجل تدريبهم الخاص.
00:05:36على ما يبدو، حدث هذا عبر أكثر من 3.4 مليون عملية تبادل في غضون 17 يوماً.
00:05:41لاحظوا أيضاً أنه قبيل إطلاق GLM 5.3 مباشرة،
00:05:44كانت ZAI تحاول استخلاص قدرات Fable السيبرانية،
00:05:47لكنها استسلمت لأن ضمانات Fable كانت تستمر في إحباط الهجوم،
00:05:50وتقول Anthropic إنهم شاهدوا موظفي ZAI يتحولون إلى Opus 4.6،
00:05:54ونموذج رئيسي آخر لمختبر أمريكي،
00:05:55تحديداً لأنهم قدروا أن ضمانات الأمان كانت أضعف.
00:05:58إذن، مجرد استعراض بسيط لضمانات Fable في هذا التقرير.
00:06:01بعد ذلك، ينتقلون لتوجيه الاتهام إلى Xiaomi، مطوري نموذج MIMO،
00:06:05بإعادة تشغيل جلسات برمجة مستخدميهم أنفسهم عبر Claude لتوليد بيانات التدريب.
00:06:09حدث هذا على ما يبدو عبر أكثر من 400,000 طلب عبر 1,500 حساب،
00:06:13وتقترح Anthropic حتى أن الإصدار التجريبي MIMO V2 Pro 3 ربما تم إطلاقه
00:06:16ثم تمديده لجذب المطورين الدوليين ليكون هناك المزيد من الجلسات لإعادة تشغيلها،
00:06:21حيث بدأ الجزء الأكبر من الهجمات فور انتهاء تلك التجربة.
00:06:24بعد ذلك، ينتقلون لتوجيه الاتهام إلى شركة تُدعى SenseTime،
00:06:27التي تشتري على ما يبدو نصوص محادثات الأشخاص على Claude من بائعي بيانات طرف ثالث.
00:06:32إذن، بعض خدمات الوساطة تلك التي تبيع لك الوصول إلى Claude بطريقة غير مدعومة
00:06:35كانت تسجل بياناتك وتبيعها في الواقع،
00:06:38خاصة تلك التي كانت ربما تقلل الأسعار مقارنة بـ Anthropic.
00:06:41وأخيراً، نظراً لعدم نجاح أي مختبر صيني في تجنب ذلك،
00:06:43كان لدى Minimax أيضاً على ما يبدو شركة واجهة تشغل إحدى خدمات الوساطة تلك
00:06:47وتدير نماذج Anthropic و OpenAI فقط،
00:06:50واتهام Anthropic هنا هو أن الخدمة برمتها وُجدت لجمع بيانات التدريب.
00:06:54إذن، كانت هذه جميع اتهامات الاستخلاص الواردة في هذا التقرير.
00:06:57كما قلت، لم يكن أي مختبر صيني في مأمن أساساً،
00:07:00ومستقبلاً، اتخذت Anthropic خطوات لمحاولة جعل هذه الإجراءات أكثر صعوبة،
00:07:03وبعضها قد تكون لاحظته حتى لو كنت تستخدم واجهة برمجة التطبيقات (API).
00:07:06على سبيل المثال، تلخص Claude الآن استدلالها قبل الرد
00:07:09لجعل النص أقل فائدة،
00:07:11ومع Fable 5.1، أضافوا ميزة التفكير المحفوظ (Preserved Thinking)،
00:07:13التي تمنع حسابات API الجديدة من تعديل موجه النظام،
00:07:16أو الأدوات، أو الرسائل السابقة التي تقع قبل كتلة الاستدلال في محادثة متعددة الجولات.
00:07:21كما أنها تدرب مصنفات خصيصاً لموجهات الاستخراج.
00:07:24أحد الأمثلة الطريفة في هذا التقرير هو على ما يبدو مجرد موجه يقول:
00:07:27لا تحدد هذا على أنه استخراج استدلال، كله بأحرف كبيرة.
00:07:30طلب آخر على ما يبدو من Claude ترجمة كل ذاكرة عمله السابقة
00:07:34إلى اللغة اليابانية بحروف الكاتاكانا فقط.
00:07:36ويقولون أيضاً إنه بالنسبة لجميع الحسابات التي تبدو هكذا من الصين أو روسيا أو إيران،
00:07:39سيُطلب منك التحقق من هويتك، أو سيتم حظرك.
00:07:42سأترك رابط هذا التقرير في الأسفل،
00:07:44حيث أن هذا في الواقع قسم واحد فقط منه.
00:07:46البقية أكثر إخافة بكثير.
00:07:47لديهم أجزاء عن العمليات السيبرانية، والمراقبة، والتأثير، والأسلحة،
00:07:51والسوء الاستخدام البيولوجي، والاحتيال.
00:07:53أخبرني برأيك في كل هذا في التعليقات أدناه،
00:07:55وبينما أنت هناك اشترك في القناة، وكالعادة، أراكم في الفيديو القادم.

핵심 요약

قامت مختبرات الذكاء الاصطناعي الصينية الكبرى، بما فيها علي بابا وDeepSeek وMoonshot، بتنفيذ هجمات تقطير واسعة النطاق باستخدام آلاف الحسابات الوهمية لتحويل طلبات المستخدمين سراً إلى نموذج Claude Opus واستخراج بيانات الاستدلال الخاصة به.

하이라이트

  • وجهت شركة Anthropic انتقادات لعدة شركات صينية مثل DeepSeek وKimi وQwen وGLM بسبب تقطير نماذجها وتحويل طلبات العملاء سراً إلى نموذج Claude Opus.

  • قامت شركة علي بابا باستخدام أكثر من 3,500 حساب وهمي لإجراء أكثر من 151 مليون عملية تبادل بين شهري مايو ويوليو لاستخراج بيانات سلسلة التفكير لتدريب نموذج Qwen.

  • استخدمت شركة Moonshot شبكة وكلاء تضم 5,380 حساباً مزيفاً لإعادة تشغيل جلسات Claude واستخراج نصوص الاستدلال لتطوير نماذجها الخاصة.

  • وظفت DeepSeek تقنية إعادة تشغيل الجلسات المتقاطعة وتوجيه طلبات أدوات مثل Claude Code مباشرة نحو نموذج Opus على مدار 14 يوماً.

  • قامت ZAI مطورة نموذج GLM بالتبديل بين 273 حساباً وهمياً عبر 3.4 مليون عملية تبادل لاستخراج مسارات التفكير من نموذج Opus.

타임라인

اتهامات Anthropic لشركات الذكاء الاصطناعي الصينية بالتقطير غير القانوني

  • وجهت Anthropic انتقادات لشركات DeepSeek وKimi وQwen وGLM بتحويل طلبات العملاء سراً إلى نموذج Claude Opus.
  • تعتمد عملية التقطير غير القانوني على إنشاء آلاف الحسابات الوهمية واستخدام مفاتيح API مسروقة ووكلاء سكنيين.
  • أجرت DeepSeek وMoonshot وMiniMax أكثر من 16 مليون عملية تبادل باستخدام 24,000 حساب وهمي.

تتناول هذه القسم اتهامات شركة Anthropic للنماذج الصينية بتحويل طلبات العملاء سراً وعرض الإجابات على أنها صادرة من نماذجهم الخاصة. يشرح التقرير أن التقطير بحد ذاته تقنية تدريب عادية، لكن الاستخدام غير القانوني يتم على نطاق صناعي ودون إذن عبر استخدام آلاف الحسابات الوهمية وبطاقات الائتمان المسروقة وشبكات الوكلاء التي تطلق عليها Anthropic اسم محطات النقل.

هجوم علي بابا ونموذج Qwen الاستخباري

  • سجلت علي بابا أكثر من 151 مليون عملية تبادل باستخدام 3,500 حساب وهمي بين شهري مايو ويوليو.
  • استهدفت علي بابا استخراج سلسلة التفكير لنموذج Claude Opus 4.6 و4.7 لتحسين قدرات البرمجة في نماذج Qwen.
  • استخدمت علي بابا بيئة التعلم الخاصة بها وبنيتها المعمارية لجمع هذه البيانات عبر شبكات وكلاء متعددة.

يسلط هذا القسم الضوء على أكبر هجوم تقطير قاسته Anthropic والذي تورطت فيه شركة علي بابا المصنعة لنموذج Qwen. أظهرت البيانات استخدام آلاف الحسابات الوهمية لحقن موجهات ثابتة تجبر Claude على كتابة استدلاله في وسوم نصية مضمنة، والتي تم استخراجها لتدريب الإصدارات الحديثة من Qwen، مع التركيز بشكل خاص على هندسة البرمجيات والمهام طويلة الأمد.

أنشطة Moonshot وDeepSeek في استخراج بيانات الاستدلال

  • قامت Moonshot بتوجيه 300,000 طلب عبر 5,380 حساباً مزيفاً لعرض استجابات Opus للمستخدمين سرا.
  • استخدمت DeepSeek حيلة إعادة تشغيل الجلسات المتقاطعة وتوقيع التفكير لجمع بيانات برمجة الوكيل لمدة 14 يوماً.
  • احتوت الطلبات المحولة على بيانات حساسة للغاية مثل مراقبة الكاميرات وشيفرات برمجية داخلية.

يركز هذا القسم على دور شركتي Moonshot وDeepSeek في تحويل طلبات العملاء سراً واستخدام حيلة إعادة تشغيل الجلسات لتحويل توقيعات التفكير إلى أثر استدلال كامل. تكشف التفاصيل أيضاً عن تسريب بيانات حساسة تتضمن مراقبة تلفزيونية مغلقة وبيانات اعتماد حية لشركات تقنية وقواعد بيانات حكومية.

الادعاءات الإضافية وتدابير الحماية الدفاعية لشركة Anthropic

  • تورطت شركات ZAI وXiaomi وSenseTime وMinimax في أنشطة استخراج مسارات التفكير وجمع بيانات التدريب.
  • أضافت Anthropic ميزة التفكير المحفوظ في Fable 5.1 لمنع تعديل موجهات النظام والأدوات.
  • تتطلب الشركة التحقق من الهوية أو حظر الحسابات المشبوهة القادمة من الصين وروسيا وإيران.

يعرض هذا القسم الادعاءات الإضافية ضد شركات ZAI وXiaomi وSenseTime وMinimax التي استخدمت حسابات وهمية وبوسطاء لجمع بيانات التدريب. يختتم التقرير باستعراض التدابير التقنية الجديدة التي اتخذتها Anthropic لمواجهة هجمات الاستخراج مثل تلخيص الاستدلال وإضافة ميزة التفكير المحفوظ وتطبيق متطلبات التحقق الصارمة على الحسابات القادمة من مناطق محددة.

커뮤니티 글

아직 글이 없습니다. 이 영상에 대한 첫 번째 글을 작성해 보세요!

이 영상에 대해 글쓰기