هذا النموذج مفتوح المصدر تفوق للتو على Claude Fable 5

CChase AI
컴퓨터/소프트웨어경제 뉴스AI/미래기술

스크립트

00:00:00هل تفوق نموذج صيني مفتوح الوزن للتو على GPT 5.6 و Fable 5؟
00:00:05حسناً، إذا كنت قد تابعت يوتيوب أو تويتر في الـ 24 ساعة الماضية،
00:00:08فمن المحتمل أنك تعرضت لوابل من هذه المخططات التي تظهر أداء KimiK3 بشكل جيد،
00:00:13إن لم يكن أفضل، مما تقدمه شركتا Anthropic و OpenAI،
00:00:17وكل ذلك بجزء بسيط من التكلفة.
00:00:20لكن هل يجب أن تصدق الضجة؟
00:00:22حسناً، هذا بالضبط ما سنجيب عليه في فيديو اليوم
00:00:24حيث نلقي نظرة أعمق على ما تخبرنا به هذه المقاييس في الواقع،
00:00:28وسنقوم بإجراء اختبار مقارنة مباشرة بين GPT 5.6 و Fable 5 و K3
00:00:34في المجال الوحيد الذي يتفوق فيه KimiK3 على الجميع، وهو تصميم الواجهات الأمامية.
00:00:40لذا بنهاية هذا الفيديو، سنمتلك فكرة أفضل بكثير عما إذا كان KimiK3 هو الملك الجديد.
00:00:46فلنبدأ بالأرقام والمقاييس المتعلقة بـ KimiK3
00:00:49لأن هناك الكثير مما يمكننا استخلاصه فعلياً منها
00:00:51وهناك بعض الفروق الدقيقة التي تتجاوز هذه المخططات
00:00:53التي رأيتها منتشرة في كل مكان، وهما الأكثر شهرة.
00:00:57عندما نتحدث عن KimiK3، فهو نموذج مفتوح الوزن يضم 2.8 تريليون متغير.
00:01:02عندما نتحدث عن “مفتوح الوزن”، فنحن نتحدث عن “مفتوح المصدر”،
00:01:05هذا لا يعني أنه يمكنك تشغيله على جهاز الكمبيوتر الخاص بك.
00:01:07نحن نتحدث عن ملايين الدولارات من العتاد اللازم لتشغيل أحد هذه النماذج.
00:01:11لكن لا يزال من الرائع أنه مفتوح الوزن،
00:01:12حيث يمكننا رؤية كيفية ضبط جميع المتغيرات
00:01:15مقابل نماذج مثل Fable 5 أو GPT 5.6، حيث تظل تلك العمليات غير مرئية لنا.
00:01:20الآن، كيف هو أداؤه بناءً على الأرقام؟
00:01:23هذه البيانات تأتينا من Kimi ومختبر moonshot الخاص بهم،
00:01:27وهي تظهر منافسته، مرة أخرى، مع Fable 5 و GPT 5.6
00:01:31في جميع هذه المقاييس البرمجية الرئيسية.
00:01:34المخطط الآخر الذي رأيته منتشرًا هو هذا.
00:01:36هذا قادم من موقع arena.ai، وهو يقيس كود الواجهة الأمامية الخاص بهم.
00:01:40تعمل آلية هذا المقياس كالتالي: إذا ذهبت إلى arena.ai وطلبت منه،
00:01:44مرحبًا، أنشئ لي صفحة هبوط،
00:01:45سيعطيك استجابتين من نموذجين مختلفين،
00:01:49وأنت لا تعرف أيهما يتبع لأي نموذج.
00:01:50إنها مثل اختبار “بيبسي”، وتختار أيهما تفضل.
00:01:53وبمرور الوقت، نرى أيهما حصل على تصويت أعلى ضد منافسه.
00:01:57وفي الوقت الحالي، حقق Kimi K3 أداءً أفضل من أي نموذج آخر في هذا المجال.
00:02:01لكن افهم أن هذا أمر ذاتي جدًا.
00:02:03لذا عندما ننظر إلى هذين المخططين،
00:02:05ونقارن ذلك بالتكلفة بين هذه النماذج،
00:02:08نرى أن Kimi K3 رخيص للغاية أيضًا.
00:02:13تكلفة المدخلات هي 3 دولارات لكل مليون رمز مقارنة بـ Fable، التي تبلغ 10 دولارات،
00:02:17مقارنة بـ 5.6، والتي تبلغ 5 دولارات.
00:02:20إذًا فهي تكلف 60% من تكلفة 5.6،
00:02:23و30% من تكلفة Fable 5 للمدخلات.
00:02:26أما بالنسبة للمخرجات، فهي نصف تكلفة 5.6،
00:02:29و30% من تكلفة Fable 5.
00:02:32إذًا هو أرخص بكثير، وأداؤه جيد بنفس القدر إن لم يكن أفضل.
00:02:35إذًا ما الذي لا يعجبك فيه؟
00:02:36لكن هنا نحتاج إلى البدء في الغوص بعمق أكبر قليلاً
00:02:38فيما يتعلق بالتكلفة والسرعة.
00:02:40لأنه من السهل رؤية أن تكلفة المليون رمز هي 3 دولارات، وذاك بـ 10 دولارات.
00:02:43حسنًا، كم عدد الرموز التي يستخدمها بالفعل؟
00:02:45ليست كل النماذج متساوية من حيث كفاءة الرموز.
00:02:46في الواقع، هذه النماذج الصينية مفتوحة المصدر تميل إلى استهلاك كميات ضخمة من الرموز،
00:02:49مما يعني أنه بينما يبدو رخيصًا على الورق،
00:02:53ماذا يعني ذلك في الواقع؟
00:02:56وكيف يقارن بهؤلاء
00:02:57الذين يتمتعون بكفاءة عالية جدًا في استهلاك الرموز، مثل GPT 5.6؟
00:02:58حسنًا، إذا نظرنا إلى هذا من منظور التحليل الاصطناعي (artificial analysis)،
00:03:01وهو جهة قياس مستقلة،
00:03:03لديهم مقياس لتكلفة مهمة الذكاء.
00:03:05لذا، كم يكلف إكمال هذه المهام؟
00:03:09لذا، Kimi K3، هنا، يكلف 0.95 دولار.
00:03:11مقابل GPT 5.6، يكلف 1.04 دولار.
00:03:15إذًا فهو أغلى قليلاً.
00:03:20إذا نظرنا إلى 5.5 extra high، كما تعلم، فهو موجود هنا.
00:03:23إذا نظرنا إلى Terra، وهو GPT 5.6 على أقصى إعدادات،
00:03:26فهو نصف سعر Kimi K3.
00:03:29الآن، مقارنة بـ Claude، حسنًا، إنه مكلف جدًا.
00:03:30Fable 5 يكلف 2.75 دولار.
00:03:35إذًا توفير التكلفة هذا ينطبق بالتأكيد
00:03:38عندما نقارن Fable بـ Kimi K3.
00:03:40ولكن عندما نقارنه بـ 5.6، لا يوجد فرق كبير.
00:03:42نحن نتحدث عن 10% أو أقل.
00:03:46وفي الواقع، هناك حالات معينة يكون فيها Terra،
00:03:49بعض هذه النماذج الأصغر في نطاق 5.6،
00:03:51هي في الواقع نصف تكلفة Kimi K3.
00:03:54الآن، الشيء الآخر الذي نريد ملاحظته هو الوقت،
00:03:56لأن الوقت هو بالتأكيد عملة
00:03:58نريد الانتباه إليها.
00:03:59تاريخيًا، هذه النماذج مفتوحة المصدر من الصين بطيئة.
00:04:01ويمكنك رؤية ذلك هنا.
00:04:04أبطأ نموذج في المجموعة هو Kimi K2.6 القديم.
00:04:05الآن، تحسن Kimi K3 بشكل ملحوظ.
00:04:09في هذا المخطط، يستغرق ست دقائق.
00:04:12إذا قارنا ذلك بـ Fable 5،
00:04:14فإن Fable 5 يستغرق خمس دقائق، و 5.6 يستغرق 4.7 دقائق.
00:04:17إذًا، كما تعلم، هو أقل كفاءة في الرموز وأبطأ.
00:04:21ولكن بشكل عام، هو أرخص بكثير من Fable 5
00:04:27وبمستوى مماثل لـ 5.6.
00:04:32الآن، آخر مقياس أريد التحدث عنه
00:04:34هو مؤشر المعرفة الشاملة (omniscience index).
00:04:35هذا يقيس الهلوسة.
00:04:37إنهم يعطون النموذج سلسلة من الأسئلة الصعبة للغاية
00:04:39التي قد يعرف إجابتها أو قد لا يعرفها.
00:04:42ويتم تقييمه بناءً على: هل كانت الإجابة صحيحة؟
00:04:44هل كانت خاطئة؟
00:04:46أم هل قال: لا أعرف؟
00:04:47تحصل على نقطة إذا كانت الإجابة صحيحة.
00:04:49وتفقد نقطة إذا كانت خاطئة.
00:04:50وتحصل على صفر إذا قال فقط: لا أعرف.
00:04:52ويمكننا أن نرى هنا، وهذا من أصل 100،
00:04:54حقق Fable 5 أفضل أداء بـ 40 نقطة.
00:04:57بينما يتأخر 5.6 كثيرًا بـ 22 نقطة.
00:05:00أما Kimi K3 فهو عند 18 نقطة.
00:05:03وأعتقد أن هذا المقياس مهم حقًا
00:05:06إذا كنت تستخدم هذه الوكلاء في سياق
00:05:08يتطلب الكثير من الفروق الدقيقة
00:05:10ويوجد فيه الكثير من المناطق الرمادية.
00:05:11لذا عندما نجمع كل هذه المقاييس معًا
00:05:13في المجمل، أعتقد أن ما يجب أن نستنتجه
00:05:14هو أن Kimi K3 قوي للغاية على الورق.
00:05:16ومع ذلك، عندما نتحدث عن مدى رخص سعره،
00:05:19فإن هذا مبالغ فيه نوعًا ما،
00:05:21خاصة عند مقارنته بنماذج GPT
00:05:23التي تتميز بكفاءة فائقة في استهلاك الرموز.
00:05:25علاوة على ذلك، Kimi K3 أبطأ قليلاً أيضًا.
00:05:27لذا يصبح السؤال فقط
00:05:30عن أي من تلك الأشياء الثلاثة هو الأهم بالنسبة لك
00:05:32فيما يتعلق بالقوة والتكلفة والسرعة.
00:05:34والآن لننتقل إلى الواجهة
00:05:38ونختبر الفرق بين هذه النماذج الثلاثة.
00:05:39لذا هنا على اليسار،
00:05:40لدي Fable 5 يعمل داخل Claude Code.
00:05:42وعلى اليمين، لدي Kimi K3
00:05:45يعمل أيضًا داخل Claude Code.
00:05:46وفي الخلف، لدي Codex.
00:05:49إذًا هذه هي المطالبة التي سأعطيها لهم.
00:05:51وأنا أخبره أنني أريد بناء
00:05:54لوحة معلومات سفر تعتمد على كرة أرضية ثلاثية الأبعاد
00:05:55تبدو وكأنها مشهد من فيلم خيال علمي خاص بي،
00:05:57وليس مجرد موقع ويب.
00:05:59أخبره أنني أريد بشكل أساسي
00:06:01جعله مشهدًا بصريًا مذهلاً.
00:06:02وأريده أن يصبح مبدعًا نوعًا ما.
00:06:04في الواقع، أقول له فاجئني
00:06:06بفكرة واحدة على الأقل لم أرها من قبل.
00:06:08أحاول ألا أكون محددًا جدًا في هذه المطالبة
00:06:10لأنني أريد نوعًا ما رؤية
00:06:13كيف تتباعد هذه النماذج
00:06:14وما الذي سيبنونه لي بالفعل.
00:06:15إذًا لنضعهم في الاختبار.
00:06:16حسنًا، لقد انتهى الثلاثة
00:06:20من بناء مواقعهم.
00:06:22لذا سنقوم باستعراضها جميعًا.
00:06:23وفي النهاية،
00:06:24سنقارن التكلفة الفعلية،
00:06:25وكمية الرموز المستخدمة، والوقت.
00:06:28فلنبدأ بـ Kimi K3.
00:06:30إذًا لنبدأ.
00:06:34ها نحن ذا.
00:06:35لدينا كرة أرضية ثلاثية الأبعاد.
00:06:37يمكنني التكبير والتصغير.
00:06:38يمكنني تحريكها.
00:06:41ليست بدقة عالية جدًا،
00:06:43لكن هذا لا بأس به.
00:06:43إذا نقرت على شيء مثل مدينة مكسيكو سيتي،
00:06:46لا يحدث شيء حقًا.
00:06:51ماذا أيضًا؟
00:06:51يحتوي على بعض النقاط الأخرى هنا،
00:06:53مثل كيب تاون.
00:06:55هنا على اليسار،
00:06:56يظهر بعض المسارات النشطة.
00:06:58إذًا إذا نقرت على مسار نشط مثل طوكيو،
00:07:01فهو ينقلني إليها بالفعل.
00:07:02ثم هنا على الجانب الأيمن،
00:07:04سأنتقل قليلاً.
00:07:05يمكننا رؤية، كما تعلم،
00:07:07الوقت،
00:07:08والطقس،
00:07:09أفضل وقت للسفر إلى هناك،
00:07:10الدخول،
00:07:11ثم نوعًا ما
00:07:12كم يكلف ذلك حاليًا.
00:07:16وبينما أنقر على الأشياء هنا على اليسار،
00:07:19كما تعلم،
00:07:20ينقلني إلى هذه المدن المختلفة
00:07:21بالإضافة إلى جميع إحصائياتها.
00:07:23إذًا بشكل عام،
00:07:24رائع جدًا.
00:07:24ويمكنك رؤية كيف أن لديها أيضًا الأرض
00:07:26مقسومة نوعًا ما إلى،
00:07:29كما تعلم،
00:07:29نهار مقابل ليل وكل ذلك.
00:07:31إذًا بشكل عام،
00:07:31يبدو الأمر رائعًا.
00:07:32الآن لنلق نظرة على Fable 5.
00:07:34إذًا مباشرة،
00:07:36أود أن أقول إن هذه الرسومات
00:07:38تبدو أنظف قليلاً،
00:07:39أليس كذلك؟
00:07:39إذا قارنا هذين الاثنين،
00:07:40هذا يبدو أكثر وضوحًا قليلاً.
00:07:43لدينا أيضًا بعض الإضاءة،
00:07:44وهو أمر رائع.
00:07:45لدينا ذلك التقسيم
00:07:46بين النهار،
00:07:46والليل،
00:07:47ولكن يمكنني فعليًا،
00:07:49لدي عجلة تمرير،
00:07:51شيء صغير هنا
00:07:52حيث يمكنني التبديل بين النهار والليل،
00:07:55وهو أمر رائع حقاً.
00:07:57لا يمكنني التكبير إلى أبعد من ذلك،
00:08:00ولكن يمكنني رؤية المزيد من هذه المدن
00:08:02وتبدو بدقة أعلى قليلاً.
00:08:04لذا إذا نقرت على واحدة منها،
00:08:06صحيح،
00:08:06نفس الشيء كما من قبل،
00:08:08تظهر بعض الإحصائيات.
00:08:09خطوط الطول والعرض تظهر الظروف
00:08:11من حيث الطقس والوقت
00:08:12ونوع التكلفة.
00:08:15تُظهر تكلفة العودة،
00:08:16على الرغم من أنني لست متأكداً تماماً
00:08:17من أين تأتي هذه التكلفة فعلياً.
00:08:19إذا نقرت هنا على اليسار،
00:08:21نفس الشيء تقريباً،
00:08:22ينقلني إلى تلك المدينة.
00:08:24يمكنني رؤية بعض الإحصائيات
00:08:25بالإضافة إلى التكلفة المتوقعة.
00:08:27أعتقد بشكل عام،
00:08:29من حيث مستوى صقل واجهة المستخدم
00:08:33بين الاثنين،
00:08:34أعتقد أنني أفضل
00:08:36ما قدمته “Fable 5”،
00:08:38خاصة هذا النوع من
00:08:40كما تعلم،
00:08:41ميزة التبديل بين النهار والليل
00:08:42الموجودة فيها.
00:08:44والمثير للاهتمام،
00:08:45يبدو أنه
00:08:46عندما أغير التوقيت خلال اليوم،
00:08:48يمكنك رؤية أنه يقوم بتحديث
00:08:48التكلفة
00:08:50على الجانب الأيمن
00:08:51بناءً على الوقت الذي
00:08:52ستصل فيه فعلياً إلى هناك.
00:08:53لذا فهو جيد جداً.
00:08:55والآن دعونا نلقي نظرة على GPT 5.6.
00:08:56إذن، الانطباعات الأولية،
00:08:59تبدو خطوة إلى الوراء
00:09:01مقارنة بما رأيناه
00:09:02مع Kimi K3
00:09:03و Fable
00:09:04فيما يتعلق بالكرة الأرضية نفسها.
00:09:04هذه الكرات الأرضية
00:09:06تحتوي بالتأكيد على المزيد من التفاصيل
00:09:07وهي تبدو أكثر إبهاراً بصرياً.
00:09:09هذا،
00:09:09أعتقد أنهم اتجهوا نحو
00:09:11مظهر الخيال العلمي.
00:09:11الذي يحتوي على أشياء عشوائية،
00:09:12إنه مثل،
00:09:15هل من المفترض أن تكون هذه؟
00:09:17حسناً.
00:09:17إذن، نفس الشيء
00:09:19إذا نقرت على مدن معينة هنا
00:09:20مثل سنغافورة،
00:09:21تظهر هذه النافذة المنبثقة،
00:09:23لكنها تغطي
00:09:24الكرة الأرضية نفسها
00:09:24وكل شيء مكتوب بخط صغير جداً،
00:09:26إنه يصعب قراءته.
00:09:27لدي هنا في الأسفل
00:09:29ميزة التبديل بين النهار والليل
00:09:31مثل التي كانت لدينا
00:09:33مع Fable 5،
00:09:35لكنها ليست جيدة بنفس القدر.
00:09:36وعندما يكون الوقت ليلاً،
00:09:37لا يمكنك حتى رؤية
00:09:39القارة نفسها.
00:09:42أعتقد أن تلك الأضواء
00:09:43من المفترض أن تكون مدناً.
00:09:44إذا نقرت هنا على اليسار،
00:09:45نعم،
00:09:46مثلما حدث من قبل
00:09:47ينقلنا إلى تلك المدن الفعلية.
00:09:49ولكن مرة أخرى،
00:09:50يبدو الأمر بالتأكيد كخطوة إلى الوراء
00:09:51مقارنة بآخر نموذجين رأيناهما.
00:09:53لذا بشكل عام،
00:09:53عند مقارنة هذه الثلاثة،
00:09:54سأضع Fable 5 في المقدمة.
00:09:56وليس بعيداً خلفها،
00:09:56سأضع Kimi K3
00:09:57ثم في المركز الثالث،
00:10:00سأضع GPT 5.6.
00:10:02والآن دعونا نقارن بين الرموز،
00:10:04الوقت والتكلفة
00:10:05لأننا رأينا النتيجة النهائية،
00:10:07ولكن ماذا دفعنا فعلياً مقابل ذلك؟
00:10:09لذا كان لدينا Kimi،
00:10:10وكان لدينا Fable
00:10:11ثم كان لدينا Codex،
00:10:13والذي سأرمز له بحرف X.
00:10:15إذن فيما يتعلق بالرموز،
00:10:16كانت Kimi هي الأكثر استهلاكاً بفارق كبير.
00:10:17استهلكت 21.5 مليون رمز
00:10:19للوصول إلى تلك النتيجة.
00:10:21وفيما يتعلق بالوقت،
00:10:24استغرقت ساعة
00:10:26و33 دقيقة.
00:10:30أي أكثر من 90 دقيقة
00:10:31لإنشاء ذلك
00:10:33بـ 21.5 مليون رمز.
00:10:35التكلفة، وهذه الأرقام
00:10:37جميعها من Open Router،
00:10:39كانت 8.66 دولاراً.
00:10:39الآن دعونا نتحدث عن Fable.
00:10:42فيما يتعلق بالرموز،
00:10:42استهلكت 3.5 مليون.
00:10:43من منصة Open Router،
00:10:44استغرقت 17 دقيقة فقط
00:10:47وكانت التكلفة الإجمالية
00:10:4911.64 دولاراً.
00:10:50لذا مرة أخرى،
00:10:53ما الذي تحدثت عنه
00:10:55في البداية؟
00:10:56تحدثنا عن السرعة
00:10:58وكفاءة الرموز.
00:11:00Kimi K3 متأخرة بوضوح
00:11:02عن Fable
00:11:02في هذا الصدد،
00:11:03خاصة عندما يتعلق الأمر
00:11:04بالوقت.
00:11:06وعندما نظرنا
00:11:07إلى تكلفة الرموز
00:11:09لكل مليون،
00:11:09كان يبدو وكأن،
00:11:11أوه،
00:11:11إنها تكلف ثلث تكلفة
00:11:12Fable.
00:11:14حسناً،
00:11:15في الواقع،
00:11:16ليس كثيراً.
00:11:16لا تزال أرخص من Fable.
00:11:17لا تفهموني خطأ،
00:11:18ولكن ليست بكفاءة.
00:11:19ثم كان لدينا Codex،
00:11:20الذي كنت نوعاً ما
00:11:20خائباً من نتائجه
00:11:22بكل صراحة.
00:11:23استهلك 5.6 مليون رمز.
00:11:25أما بالنسبة للوقت،
00:11:26فقد استغرق 25 دقيقة
00:11:27وكانت تكلفته الإجمالية
00:11:285.66 دولاراً.
00:11:28إذا كنت تتساءل
00:11:29عن الرموز
00:11:32والتكلفة
00:11:33ولماذا لا تتطابق
00:11:35بدقة مع المدخلات
00:11:36مقابل المخرجات
00:11:38مقابل ما تم الإعلان عنه،
00:11:39يجب أن تعلم أن هناك الكثير
00:11:40من التخزين المؤقت (Caching) الجاري
00:11:42لجميع الثلاثة.
00:11:42إذن ماذا يعني هذا
00:11:43نوعاً ما؟
00:11:44حسناً،
00:11:44الشيء الكبير هو Kimi،
00:11:46أليس كذلك؟
00:11:47ثقيلة جداً
00:11:48في استهلاك الرموز
00:11:49وقد استغرقت وقتاً طويلاً جداً.
00:11:51استغرقت ساعة
00:11:52ونصف.
00:11:52بكل صراحة،
00:11:53عندما كنت أصنع هذا الفيديو،
00:11:55قلت لنفسي،
00:11:56أوه،
00:11:57ربما سأفعل،
00:11:59كما تعلم،
00:12:00ثلاثة،
00:12:00ربما حتى أربعة أمثلة.
00:12:01لا،
00:12:01لن أجلس هنا
00:12:02لـ 20 ساعة للقيام بذلك.
00:12:02و،
00:12:03كما تعلم،
00:12:03لذا هي متأخرة جداً
00:12:04في هذين الجانبين
00:12:05مقارنة بنماذج Frontier،
00:12:06ولكن بشكل عام،
00:12:07كانت مخرجاتها قوية.
00:12:09كما تعلم،
00:12:09أعتقد أنها قامت
00:12:10بعمل جيد حقاً،
00:12:11مع أخذ كل شيء في الاعتبار.
00:12:12وأكثرهم تكلفة
00:12:13بين المجموعة،
00:12:14كان من الواضح
00:12:15أنها Fable
00:12:15بينما كان Codex
00:12:16هو الأرخص.
00:12:17إذن ما الذي يمكننا استخلاصه
00:12:18من كل هذا؟
00:12:19حسناً،
00:12:20أعتقد ما يمكننا استخلاصه
00:12:20على الأقل هنا
00:12:21مع كون كودكس
00:12:22هو الأرخص.
00:12:24إذًا ماذا يمكننا حقًا أن نستنتج
00:12:26من كل هذا؟
00:12:27حسنًا،
00:12:27أعتقد أنه يمكننا الاستنتاج
00:12:29هنا على الأقل
00:12:29في جانب الواجهة الأمامية،
00:12:31وربما ينطبق الأمر
00:12:32نفسه على البرمجة
00:12:32إذا أردنا أن نأخذ
00:12:33المعايير القياسية
00:12:33كما هي،
00:12:34وهي أن “كيمي”
00:12:36يمكنها المنافسة.
00:12:37نموذج “كيمي كيه 3”
00:12:38هو نموذج مفتوح المصدر
00:12:39يمكنه المنافسة
00:12:40مع “فيبل” في إصدار 5.6.
00:12:42ومع ذلك،
00:12:43إنه ليس رخيصًا
00:12:45كما قد تتوقع.
00:12:46في بعض الحالات،
00:12:47يكون أكثر تكلفة.
00:12:49وهو بطيء جدًا.
00:12:51إنه بطيء للغاية.
00:12:54وهو أمر يعتبر
00:12:55عائقًا كبيرًا
00:12:55بالنسبة للكثيرين
00:12:56اعتمادًا على ما تفعله.
00:12:58ولكن،
00:12:58إذا كان ذلك مناسبًا لك،
00:13:01فأنت تعلم،
00:13:02ربما لا يكون
00:13:03عيبًا كبيرًا.
00:13:03لكنني أعتقد
00:13:04أن الأمر الأهم
00:13:05الذي يضيع نوعًا ما
00:13:06في المعايير
00:13:06والأرقام
00:13:07هو التكلفة في الواقع.
00:13:08أليس كذلك؟
00:13:09لأنه ليس
00:13:09رخيصًا
00:13:10كما قد تتوقع
00:13:11بسبب هذا
00:13:12عدم الكفاءة
00:13:12عندما يتعلق الأمر
00:13:14باستخدام الرموز البرمجية (التوكنز) فعليًا.
00:13:15هذا ما
00:13:16سأختم به معكم.
00:13:16أتمنى أن أكون قد تمكنت
00:13:17من تسليط المزيد من الضوء
00:13:18على “كيمي كيه 3”.
00:13:19أعتقد أنه رائع.
00:13:20لدينا نموذج مفتوح المصدر
00:13:21يمكنه المنافسة.
00:13:22لكن دعونا لا نستبق الأمور
00:13:23فيما يتعلق
00:13:23بقدرته الخام
00:13:24وتحديدًا
00:13:25بتكلفته.
00:13:26سواء من حيث المال
00:13:27أو من حيث الوقت.
00:13:28لذا،
00:13:29أخبروني في التعليقات
00:13:30برأيكم حول الموضوع.
00:13:31وتأكدوا من التحقق من
00:13:31“تشيس إيه آي بلس”
00:13:32إذا كنتم ترغبون في الحصول على
00:13:32دورتي التعليمية “ماستر كلاس الكود السحابي”
00:13:33التي تتضمن أيضًا
00:13:34دورة “كودكس ماستر كلاس”
00:13:35في هذه الأيام.
00:13:36بخلاف ذلك،
00:13:37أراكم لاحقًا.
00:13:39أراكم لاحقًا.

핵심 요약

رغم أن Kimi K3 منافس قوي مفتوح الوزن في تصميم الواجهات الأمامية وبسعر مدخلات منخفض، إلا أن ضعف كفاءة استهلاكه للرموز وبطء سرعته يجعلانه خياراً أقل فاعلية من Fable 5 وGPT 5.6 في المهام البرمجية الفعلية.

하이라이트

  • يضم نموذج Kimi K3 مفتوح الوزن 2.8 تريليون متغير ويتطلب عتاداً بملايين الدولارات للتشغيل.

  • يتفوق Kimi K3 في مقاييس تصميم واجهات المستخدم البرمجية على منصة arena.ai عند مقارنته بـ GPT 5.6 و Fable 5.

  • تصل تكلفة مدخلات Kimi K3 إلى 3 دولارات لكل مليون رمز، وهو ما يمثل 60% من تكلفة GPT 5.6 و30% من تكلفة Fable 5.

  • يستهلك Kimi K3 كميات أكبر بكثير من الرموز البرمجية، حيث استهلك 21.5 مليون رمز في اختبار بناء لوحة معلومات، مقابل 3.5 مليون رمز لـ Fable 5.

  • استغرق Kimi K3 ساعة و33 دقيقة لإنهاء مهمة برمجة معينة، في حين أنجز Fable 5 نفس المهمة في 17 دقيقة فقط.

  • يحتل Fable 5 المرتبة الأولى في مؤشر المعرفة الشاملة لتقليل الهلوسة بـ 40 نقطة، بينما يأتي Kimi K3 في المرتبة الأخيرة بـ 18 نقطة.

타임라인

تحليل الأرقام والمقاييس لنموذج Kimi K3

  • يحتوي Kimi K3 على 2.8 تريليون متغير ويُصنف كنموذج مفتوح الوزن.
  • يظهر Kimi K3 أداءً تنافسياً في مخططات تصميم الواجهات على منصة arena.ai.
  • تتراوح تكلفة المدخلات لـ Kimi K3 عند 3 دولارات لكل مليون رمز.
  • يعاني النموذج من انخفاض الكفاءة في استهلاك الرموز وبطء زمن التنفيذ مقارنة بالمنافسين.

يركز هذا القسم على تقييم Kimi K3 بناءً على البيانات المنشورة ومقارنتها بنماذج مثل Fable 5 وGPT 5.6. بالرغم من جاذبية السعر المعلن على الورق، إلا أن التحليل يوضح فروقاً جوهرية في كفاءة الرموز (tokens) والسرعة، حيث تستهلك النماذج الصينية مفتوحة المصدر كميات ضخمة من الرموز، مما يقلل من ميزة التكلفة الفعلية. كما تظهر نتائج مؤشر المعرفة الشاملة أن Fable 5 هو الأكثر دقة في تقليل الهلوسة.

اختبار مقارنة مباشر لبناء واجهة مستخدم

  • تم اختبار قدرات النماذج الثلاثة في بناء لوحة معلومات سفر ثلاثية الأبعاد.
  • قدم Fable 5 أفضل جودة بصرية وتجربة مستخدم بفضل ميزة التبديل بين النهار والليل.
  • أظهر Kimi K3 قدرة جيدة في عرض البيانات ثلاثية الأبعاد رغم بساطة التفاصيل.
  • جاء GPT 5.6 في المرتبة الثالثة من حيث جودة الواجهة وتجربة القراءة.

تم وضع النماذج في اختبار عملي عبر Claude Code لإنشاء لوحة معلومات سفر بصرية تعتمد على كرة أرضية ثلاثية الأبعاد. تفوق Fable 5 في صقل واجهة المستخدم والوظائف التفاعلية مثل التبديل بين النهار والليل. أظهر Kimi K3 أداءً جيداً كبديل مفتوح المصدر، بينما قدم GPT 5.6 تجربة أقل إبهاراً مع صعوبة في قراءة النصوص داخل النوافذ المنبثقة.

الخلاصة الواقعية للتكلفة والأداء

  • استهلك Kimi K3 نحو 21.5 مليون رمز واستغرق 93 دقيقة لإتمام المهمة.
  • تفوق Fable 5 في السرعة والكفاءة حيث استغرق 17 دقيقة فقط باستهلاك 3.5 مليون رمز.
  • تتجاوز التكلفة الفعلية لـ Kimi K3 ما تشير إليه التكلفة المعلنة لكل مليون رمز بسبب عدم كفاءة الاستهلاك.
  • يظل Kimi K3 خياراً تنافسياً مفتوح المصدر ولكن مع عوائق زمنية وتقنية كبيرة.

في هذا الجزء، تم حساب التكلفة الفعلية والوقت المستغرق في الاختبار العملي. تبين أن Kimi K3 هو الأبطأ بفارق كبير والأكثر استهلاكاً للرموز، مما يجعله أقل كفاءة في العمليات البرمجية الطويلة. يخلص التحليل إلى أن النموذج يمثل إنجازاً مهماً كبديل مفتوح المصدر للمنافسة في السوق، لكنه ليس 'الخيار الأرخص' أو الأسرع عند النظر إلى التكاليف التشغيلية الإجمالية للمشاريع المعقدة.

커뮤니티 글

모든 글 보기