هذه المهارة جعلت Kimi K3 مصممًا أفضل بـ 10 أضعاف

AAI LABS
컴퓨터/소프트웨어AI/미래기술

Transcript

00:00:00تم إطلاق Kimi K3 للتو، وهو نموذج قوي للغاية يضاهي Claude Fable 5 وGPT 5.6.
00:00:06وأهم ما يميزه هو أنه بارع حقًا في الواجهات الأمامية،
00:00:09لدرجة أن الناس يعتبرونه أفضل في التصميم من أي نموذج آخر.
00:00:14وهو رائع بالفعل، لكن هناك مشكلة وهي ليست مقتصرة على Kimi.
00:00:17كل نموذج ذكاء اصطناعي له نمط تصميم خاص به لا تلاحظه إلا بعد استخدامه بكثرة.
00:00:22كلما أُعلن عن نموذج جديد، يقول الجميع إنه الأفضل في الواجهات الأمامية، وتبدو أول بضعة مواقعه كذلك.
00:00:28لكن الحقيقة هي أن جميعها تستخدم أنماطها المكررة في كل تصميم.
00:00:32سواء كان Sonnet 4.5 أو GPT 5.6، تستمر تلك الأنماط في الظهور بتصاميمها.
00:00:38لذا مهما كان النموذج الذي تستخدمه، تحتاج لشيء يخرجه عن نمطه الافتراضي، وهو ما يفعله المصمم الجيد.
00:00:43وإحدى أفضل الطرق لفعل ذلك هي مهارة تُدعى Hallmark.
00:00:46إن كانت هذه زيارتك الأولى، فنحن شركة برمجيات وهذه قناتنا AI Labs،
00:00:50حيث نوضح لك كيفية تحسين عملك باستخدام الذكاء الاصطناعي، وإن لم تكن تملك مشروعك الخاصة،
00:00:54يمكنك استخدام هذه المهارات لجني المال عبر تحسين مشاريع الآخرين.
00:00:58وفي هذا الفيديو، سنتناول نموذج Kimi وقدراته في تصميم الواجهات الأمامية والمهارة التي تجرد التصاميم من هذه الأنماط المكررة.
00:01:05قد تكون تعرف Kimi K3 كأحد أفضل نماذج Moonshot، ولكن إليك ملخصًا سريعًا لمن لا يعرفه.
00:01:11أطلقته Moonshot AI كنموذجها الرئيسي وحقق شعبية سريعة.
00:01:15والأهم من ذلك أنه ينضم الآن إلى النماذج التي تمتلك نافذة سياق بمليون رمز.
00:01:20من حيث الأداء، فهو ينافس Fable 5 وGPT 5.6 في مجالات عديدة، وهما من أقوى النماذج حاليًا.
00:01:26وللمقارنة، نستخدم اختبارات Artificial Analysis التي تقيّم النماذج في مجالات مختلفة.
00:01:32في الذكاء، يتفوق بوضوح على Opus 4.8 وGemini 3.6 الجديد، لكنه يتخلف بقليل عن Fable 5 وGPT 5.6.
00:01:40والفارق في الأرقام ضئيل جدًا لدرجة أنه يعتبر في نفس المستوى معهما تقريبًا.
00:01:44وفيما يتعلق بتصميم الواجهات الأمامية، فإنه يتفوق حتى على هذين النموذجين وفقًا لتقييم LM Arena،
00:01:48الذي يقارن النماذج ضد بعضها بنفس الموجهات ويرتبها بناءً على تقييمات المستخدمين الفعليين.
00:01:54أحد أسباب تفوق Kimi هناك هو الرؤية المدمجة في الحلقة، النابعة من قدراته البصرية القوية.
00:02:00ببساطة، النموذج لا يكتفي بكتابة الكود، بل يفحص ما يبنيه.
00:02:04معظم النماذج تنظر فقط إلى الكود لتخمين شكل الموقع،
00:02:07لكن Kimi يلتقط لقطات شاشة لما بناه، وينظر للنتيجة ويعدل بناءً عليها.
00:02:11وهذا سبب رئيسي ي جعل الناس يقولون إنه أفضل في الواجهات الأمامية.
00:02:15المسافات والمخططات تخرج متوازنة ومفهومة بشكل أفضل بكثير مقارنة بالنماذج الأخرى.
00:02:19يبقى عامل التكلفة.
00:02:20وهنا يحقق Kimi ميزة حقيقية.
00:02:22سعره 3 دولار لكل مليون رمز مدخلات و15 دولار لكل مليون رمز مخرجات.
00:02:27أما GPT 5.6 فأغلى قليلاً بسعر 5 دولار للمدخلات و30 دولار للمخرجات.
00:02:32و Fable هو الأغلى حاليًا بسعر 10 دولار للمدخلات و50 دولار للمخرجات.
00:02:36لذا يمنحك Kimi نفس مستوى أداء النماذج الرائدة بأقل سعر بين الثلاثة.
00:02:41يأتي Kimi مع بيئة التشغيل الخاصة به Kimi Code، والتي أُطلقت بجانب نموذج K2.5.
00:02:47وهو وكيل برمجي يعمل عبر الطرفية (Terminal)، ويتيح لك تشغيل Kimi دون استخدام API مباشرة.
00:02:52لكن عندما استخدمنا Kimi Code، وجدناه بطيئًا للغاية.
00:02:55المهمة التي تستغرق 3 دقائق في Claude Code أو Codex تستغرق نحو 10 دقائق في Kimi Code.
00:03:00ويرجع ذلك إلى أمرين.
00:03:01الأول هو أن أوزان Kimi ليست مفتوحة المصدر بعد، مما يعني أن هذا النموذج مستضاف لدى Kimi فقط ولا توجد خوادم أخرى.
00:03:08لذا يجب أن ينتقل كل طلب إلى خوادم Kimi الخاصة وليس لأي مكان آخر.
00:03:12تتعرض تلك الخوادم للضغط، لذا يستغرق كل طلب تطلبه وقتًا أطول للرد.
00:03:16والسبب الثاني هو بيئة التشغيل نفسها.
00:03:17وجدنا صعوبة في العمل معها حتى على النماذج القديمة، وKimi أنفسهم يعترفون في وثائقهم بأنها ليست مصممة لإخراج كامل إمكانيات K3.
00:03:25وهناك مشكلتان إضافيتان بجانب السرعة.
00:03:27إحداهما هي السياق.
00:03:28مع Codex وClaude Code، نغير النماذج كثيرًا حسب المهمة، وكلاهما يحتفظ بالسياق جيدًا عند التغيير.
00:03:36لكن لا يمكنك فعل ذلك في Kimi Code لأن طريقة احتفاظ الأداة بسياق المحادثة تنهار عند تبديل النماذج.
00:03:43والمشكلة الأخرى هي الوكلاء الفرعيون (Sub-agents).
00:03:44عند التشغيل، بدا وكأنه ينشئ عددًا هائلاً منهم.
00:03:47لكن عندما سألناه لاحقًا، قال إنه أنشأ 5 وكلاء فقط لإنجاز المهمة.
00:03:51لذا لاختبار النموذج بشكل صحيح، شغلناه داخل Claude Code بدلاً من ذلك لأنه يعمل هناك بشكل ممتاز.
00:03:57ويمنحك Kimi طريقة لفعل ذلك بالضبط.
00:03:59إحدى طرق تشغيل Kimi داخل Claude Code هي عبر الـ API الخاص به مباشرة.
00:04:03لكن هذا مكلف في الفاتورة لأنك تُحاسب على كل كلمة يقرؤها ويكتبها النموذج، وتتراكم التكلفة سريعًا مع كثرة الاستخدام.
00:04:10لذا فالخيار الأفضل هو تشغيله عبر خطة Kimi المدفوعة التي تمتلكها بالفعل.
00:04:14وبهذه الطريقة لا تقلق بشأن الفاتورة، بل تدفع اشتراكك الشهري المعتاد فقط.
00:04:18ولفعل ذلك، هناك أداة تُدعى CLI Proxy API.
00:04:21تأخذ أدوات البرمجة المسجل بها حاليًا وتحولها إلى API خاص بها يعمل محليًا على جهازك.
00:04:28فأنت تقوم بتحويل الاشتراك الذي تدفعه بالفعل إلى خادم يمكنك التشغيل من خلاله.
00:04:33تقوم بتثبيتها عبر الأمر brew install.
00:04:35بمجرد الانتهاء، تسجل الدخول إلى Kimi بأمر Kimi login، والذي يفتح صفحة تسجيل الدخول لتتمكن من الدخول.
00:04:41وبمجرد الحصول على بياناتك، تكون قد سجلت الدخول.
00:04:43ثم تبدأ تشغيل الخادم ليبدو اتصال Kimi نشطًا.
00:04:47هناك شيء آخر بعد ذلك، وهو إنشاء مفتاح API لهذا الإعداد المحلي لأن هذا المفتاح هو ما تمنحه لـ Claude Code للوصول.
00:04:54وبدلاً من القيام بذلك بنفسك، يمكنك طلب ذلك من Claude Code أو أي وكيل آخر لإعداد مفتاح الـ API باستخدام تلك الأداة.
00:05:02بمجرد الانتهاء، تنسخ المفتاح وتستخدمه.
00:05:04ثم تقوم بتشغيل Claude Code.
00:05:06ولقيام بذلك، تقوم بتغيير رابط الـ URL الذي يرسل إليه Claude طلباته.
00:05:09افتراضيًا، يشير إلى رابط Claude الخاص، لذا توجهه إلى localhost الخاص بك لأن الخادم يعمل على جهازك الآن.
00:05:16تضع المفتاح الذي أنشأه Claude كرمز مصادقة Anthropic auth token، وتحدد النموذج على Kimi K3.
00:05:22بعد ذلك، شغل أمر Claude وسيفُتح Claude Code مشغلاً K3 عبر اشتراك Kimi الخاص بك.
00:05:28ومن الجدير بالذكر أن هذه الإعدادات تظل نشطة فقط في جلسة الطرفية هذه.
00:05:32لذا لا شيء من هذا دائم.
00:05:33عند إغلاق الجلسة وتشغيل Claude في طرفية جديدة، يمكنك استخدام Claude Code عبر اشتراكك كالمعتاد.
00:05:39ولكن قبل التعمق في تفاصيل المهارة، يسعدنا اشتراكك في القناة والضغط على زر الإعجاب.
00:05:44هذه اللفتة البسيطة تدعمنا بشكل كبير.
00:05:47صفحة الهبوط هي واجهة شركتك.
00:05:49وإذا كانت صفحة الهبوط تفتقر للجودة، فستفقد المصداقية ولن يأتي العملاء لشركتك إطلاقًا.
00:05:54لبنائها بشكل صحيح، عليك إخراج النموذج من الأنماط الآمنة والمكررة التي يعتمد عليها تلقائيًا.
00:06:00وهناك العديد من المهارات المصممة لهذا الغرض بالتحديد.
00:06:02ومن أكثرها شهرة Hallmark، وهي مهارة تصميم تمنع رداءة تصاميم الذكاء الاصطناعي موجهة للوكلاء.
00:06:07تستخدمها من خلال أربعة أفعال (أوامر).
00:06:08الأول هو الوضع الافتراضي، فقط تخبر الوكيل بما تريد بناءه ويبني واجهات جديدة باتباع سير العمل في تعليماته.
00:06:15والثاني هو التدقيق (audit)، والذي يفحص الكود مقابل الأنماط السيئة المعروفة للتأكد من خلو الموقع منها.
00:06:21والثالث هو إعادة التصميم (redesign)، والذي يتخلص من تصميمك الحالي ويجرب مراجعة جديدة باتجاه مختلف تمامًا.
00:06:27والأخير هو الدراسة (study)، حيث تعطيه موقعًا يعجبك ليستخرج أسلوبه ويعمل في ذلك الاتجاه.
00:06:33وإليك الجزء المهم.
00:06:34لو طلبت من أي وكيل دراسة موقع بدون Hallmark، سينسخ الأسلوب حرفيًا.
00:06:40لكن Hallmark يمنع ذلك تحديدًا ويتعامل مع الموقع كمرجع تصميمي وليس كنسخة للتقليد.
00:06:45وبالتالي تظل النتيجة أصيلة ومبتكرة.
00:06:47كما يأتي مع مكتبة غنية من أساليب التصميم التي يمكنك الاستعانة بها لمشاريعك.
00:06:51وإذا أردت رؤية هذه الأساليب عمليًا، فإن موقعهم يحتوي صفحات هبوط مبنية بكل نمط منهم.
00:06:56لتستطيع استعراضها بصريًا.
00:06:57وفي وثائقهم، يوضح ملف recipe.md أفضل الممارسات لكتابة الموجهات.
00:07:02لاستخدام Hallmark، عليك تثبيته أولاً.
00:07:04لذا تنسخ أمر التثبيت من مستودع GitHub، وتلصقه في الطرفية، فيبدأ التثبيت.
00:07:11ويسألك عن الوكيل الذي تريد التثبيت لأجله.
00:07:13إذا كنت تستخدم Kimi Code أو تشغل Codex، يمكنك المتابعة دون تغيير أي شيء.
00:07:17وسيتم التثبيت داخل مجلد ‎.agents، الذي يستخدمه العديد من الوكلاء ومنهم هذان لحفظ الإعدادات.
00:07:23ولكن بما أنك تستخدم Kimi داخل Claude Code، فعليك تحديد Claude Code من قائمة الوكلاء أيضًا.
00:07:28وسيؤدي ذلك لتثبيته في مجلد ‎.claude، حيث توجد كافة إعدادات Claude.
00:07:32بعد التثبيت، تتجه للمشروع وتجد كلاً من مجلدي ‎.agents و‎.claude وبداخلهما المهارة.
00:07:38يحتوي ملف skill.md على شرح طريقة الاستخدام وكيفية الاستدعاء وكل ما يلزم لعملها.
00:07:44وهذا ما يجعلها أفضل من البدائل الأخرى.
00:07:46لأنها تتضمن أكثر من مئة مرجع تغطي جوانب مختلفة، بما في ذلك الأنماط السيئة للذكاء الاصطناعي.
00:07:52وهي تجري اختبارًا من 58 مرحلة قبل تسليم النتيجة، وهي 58 فحصًا تضمن خلو الموقع من رداءة الذكاء الاصطناعي.
00:07:58وتحتوي المهارة أيضًا على مراجع للمكونات وللأوامر المذكورة سابقًا.
00:08:02ولكن قبل استعراض التصاميم من هذه المهارة، نستمع لرعايتنا.
00:08:05يكون مساعد الذكاء الاصطناعي للبرمجة مذهلاً أثناء العمل معه، ثم ينسى كل شيء بمجرد إغلاقه أو تغيير الأداة.
00:08:12فتبدأ من الجديد دون معرفة ما بنيته بالأمس أو ما اكتشفه وكيل آخر، فتضيع الوقت والمال في إعادة شرح ما يعرفه بالفعل.
00:08:19إليك Jolly Memory، إضافة مجانية ومفتوحة المصدر لبيئة التطوير تمنح مساعدك ذاكرة مستمرة.
00:08:24تلتقط تلقائيًا الأسباب المنطقية لمشروعك من التذاكر أو الروابط والمحادثات وتحفظها على جهازك، وتحولها إلى وثائق مهيكلة ملحقة بكل تغيير الكود (Commit) تلتقط تلقائيًا المنطق وراء كل قرار معماري وهندسي.
00:08:39وهي ليست محصورة بأداة أو نموذج واحد، فيمكنك التنقل من Claude إلى Gemini أو Qwen وتنتقل ذاكرتك معك دون ملف state.md أو ملاحظات للمزامنة.
00:08:48تعمل داخل VS Code وIntelliJ وCursor وClaude وWindsurf، تثبتها مرة واحدة وتتذكر كل شيء في كل مكان.
00:08:56وعند حدوث خطأ ما، يمكنك تتبع المنطق خلف كل تغيير، وتعرض لك كل شيء كخريطة بسيطة لمشروعك.
00:09:03احصل على Jolly Memory باستخدام الرابط الموجود في التعليق المثبت.
00:09:06الآن، ورغم أن Kimi بارع حقًا في الواجهات الأمامية، إلا أنه اكتسب أنماطًا خاصة به، وتلك الأنماط تشكل أسلوب تصميمه.
00:09:13إنه جديد تمامًا، لذا هذه الأنماط ليست ملحوظة جدًا بعد، لكنها ستصبح أكثر وضوحًا مع الوقت.
00:09:18وبما أن النماذج الصينية معروفة بتدريبها عبر تقطير (distillation) نماذج Claude، وهو ما يعني تدريب نموذج على مخرجات نموذج آخر، فإن أسلوب Opus 4.8 يظهر كثيرًا فيما ينشئه Kimi.
00:09:29طريقة Opus في وضع الصور خلف القسم الرئيسي (hero section)، وجعل النص الرئيسي جانبًا، واستخدام درجات البرتقالي والبني الدافئة، سواء كان الموقع داكنًا أو فاتحًا، كل ذلك يظهر في تصاميم Kimi أيضًا.
00:09:40لكن ما يعجبنا في Kimi هو أن النصوص ليست محشوة بكلمات الترويج التسويقية التي يعتمد عليها Opus.
00:09:46كل شيء يبدو أنه وُضع لسبب محدد، وتُقرأ المحتويات بشكل أكثر هدفية مما تقدمه النماذج الأخرى.
00:09:51لاختبار المهارة، شغلناها في Claude Code مع Kimi وأعطيناه موجهًا بسيطًا لصفحة هبوط.
00:09:56وعند التشغيل، يبدأ بخطوة تمهيدية تُسمى الفحص التمهيدي (pre-flight).
00:09:59يمر الفحص التمهيدي عبر ملفاتك الحالية التي تحتوي معلومات عن أسلوب التصميم، ويحدد ما يمكن الإبقاء عليه وما يجب تغييره.
00:10:06وبما أننا أنشأنا قالب Next.js جديدًا للتو، فقد اعتمد Next.js كإطار عمل وتخلص من الباقي.
00:10:11وقبل المتابعة، يسأل عن ثلاثة أشياء: من هم الجمهور المستهدف، وما الغرض من الموقع، وما النبرة المطلوبة.
00:10:18ذكر ذلك مباشرة في الموجه يعد من أفضل الممارسات، ولكن إذا أهملته، سيسألك بنفسه، لذا ليس أمرًا إلزاميًا.
00:10:25بمجرد الإجابة، يسحب المظهر وكل شيء آخر من المراجع ويبني الموقع.
00:10:30وعند الانتهاء، يتأكد من نجاح جميع فحوصات اكتشاف الأنماط السيئة الـ 58.
00:10:34وبما أن Hallmark يعتمد على تلك الأفعال، فإن طلب إعادة تصميم كاملة يغير كل شيء.
00:10:39فهو يتعرف على ذلك الأمر، ويحمل بروتوكول إعادة التصميم، ويسأل الأسئلة مجددًا، ويبدأ سير العمل نفسه، ويعيد بناء كل شيء باتجاه مختلف تمامًا عن الأول.
00:10:49ثم هناك وضع التدقيق (audit)، والذي يفحص التصميم مقابل أنماط الذكاء الاصطناعي السيئة.
00:10:53عند تشغيل تدقيق Hallmark، يحمل المهارة مجددًا، وينشئ تقريرًا بناءً على تلك الأنماط، ويحدد كل نقطة مقتنصة.
00:11:00ومن ذلك التقرير، تقرر التعديلات التي تريد تطبيقها.
00:11:02لكن عند العمل مع Kimi وClaude Code، عليك مراعاة إدارة السياق لأن الضغط التلقائي للسياق لن يعمل.
00:11:09لذا عند امتلاء نافذة السياق، لا يتوقف عن العمل.
00:11:12ولكن مع امتلاء النافذة، ستلاحظ أن الإجابات تبدأ بالانحراف عن التعليمات أو تصبح غريبة وعامة.
00:11:18بعد التدقيق، قام Kimi بتطبيق التغييرات المشار إليها، وكانت قليلة.
00:11:22فقد أزال الخط الذي جعل التصميم يبدو كأنه من مخرجات الذكاء الاصطناعي المكررة.
00:11:25واستبدل الصور المأخوذة من Unsplash بـموقع آخر يُدعى Pixum، نظرًا لأن Unsplash هو الخيار المعتاد لكل النماذج تقريبًا.
00:11:32وأصلح التوافق مع الهواتف المحمولة، مما رفع من جودة الموقع ككل.
00:11:36ومن هناك، يمكنك الاستمرار في طلب نسخ جديدة حتى ترضى عن النتيجة.
00:11:39نصيحة إذا كنت ستستخدم المهارات مع Kimi وClaude Code.
00:11:42الاستدعاء التلقائي لا يعمل بشكل موثوق لأن Kimi ليس النموذج الافتراضي لـ Claude Code،
00:11:47وهذا التفعيل التلقائي مصمم خصيصًا حول نماذج Claude نفسها.
00:11:51لذا الخيار الأفضل هو استدعاء المهارة يدويًا عبر الأمر المسبوق بشرطة مائلة (slash command)، مما يضمن تحميلها قبل بدء البناء.
00:11:57أجرينا أيضًا نفس الاختبار في Claude Code على نموذج Opus 4.8، بالاستعانة بالمهارة وبدونها.
00:12:03بدأنا بدون المهارة، وبنى التطبيق بالأسلوب المعتاد.
00:12:06استغرق الأمر نحو 6 دقائق، وكان الموقع الناتج محشوًا بأنماط الذكاء الاصطناعي المكررة بشكل واضح.
00:12:10كل شيء فيه ينطق بأسلوب Opus الكلاسيكي، بدءًا من الألوان المختارة، والتدرج في الخلفية، إلى الصناديق ذات الحواف الدائرية التي اعتمد عليها.
00:12:16الآن، إن كنت تتذكر، فإن نظام التصميم لدينا يحتوي على مهارة كشف تصاميم الذكاء الاصطناعي السيئة،
00:12:20والتي تم تدريبها لكشف تلك الأنماط المكررة بجميع أنواعها، بما فيها أنماط Opus.
00:12:24لذا شغلناها على المشروع، وحددت الكثير، مشيرةً إلى عدة أنماط مكررة بثقة عالية ومنخفضة،
00:12:30مع التركيز على النص المتدرج بشكل خاص.
00:12:32ثم شغلنا Hallmark.
00:12:33قام بتحميل المهارة، وإجراء الفحص التمهيدي، وتسجيل الأنماط، وطرح الأسئلة ذاتها، وتشغيل سير العمل بالكامل مجددًا.
00:12:39استغرق وقتًا أطول بكثير من التشغيل بدون المهارة، لكن النتيجة كانت تستحق،
00:12:43لأن التصميم النهائي خرج بأسلوب أكثر إبداعًا وهدفية.
00:12:46تمتعت الأزرار بتفاعلية أفضل بكثير، وكان كل ذلك بفضل فهم النموذج للمنتج بشكل أفضل.
00:12:51افتراضيًا، لا يضع صورًا مؤقتة أيضًا، لأن الاستعانة بصور Unsplash يعد أحد الأنماط السيئة في قواعده.
00:12:58إنه مصمم لبناة المنتجات، لذا يطلب منك إضافة صورك الخاصة بدلاً من الاعتماد على الصور الجاهزة أو التوليدية.
00:13:04وبشكل عام، قدم تصميمًا أفضل بكثير مما قدمه Kimi، لذا يمكننا القول إن المهارة تعمل بشكل أفضل مع Claude حاليًا.
00:13:10فهو لا يملك بعد فهمًا عميقًا لكيفية تصميم Kimi، ويقوم فقط بتحديد الملاحظات بناءً على أنماط النماذج الأخرى المعروفة.
00:13:15ولكن في جميع اختباراتنا، عملت المهارة بشكل ممتاز.
00:13:18نظام التصميم هذا الذي ذكرناه للتو، إلى جانب كل ما نبنيه ونعرضه في فيديوهاتنا،
00:13:23يمكن العثور عليه في AI Labs Pro، مجتمعنا الخاص.
00:13:26فإذا وجدت قيمة فيما نقدمه وترغب في دعم القناة، فهذه هي أفضل طريقة لفعل ذلك.
00:13:31الرابط في الوصف.
00:13:33الآن، إذا كنت قد استخدمت Codex أو تعرف كيف يعمل، ستعرف أن ألوانه الافتراضية هي المزيج بين الأخضر والأبيض،
00:13:38تمامًا كما يعتمد Opus افتراضيًا على البرتقالي، والقرمزي، والبني.
00:13:42تلك هي الألوان التي يلجأ إليها كنمط افتراضي.
00:13:45كما تعتمد تصاميمه على الكثير من عناصر SVG، ويميل لاختيار أحجام خطوط صغيرة نسبيًا مقارنة بالشاشة.
00:13:51تخرج التصاميم جيدة جدًا مقارنة بالغير، لكن تلك الأنماط الافتراضية ستظهر مهما كان.
00:13:56لذا اختبرنا Codex بعد تثبيت المهارة في مجلد ‎.agents، وأعطيناه موجهًا يوضح ببساطة ما نريد بناءه.
00:14:03استخدمنا تطبيق Codex لهذا، لأنه يأتي مع أدوات استخدام المتصفح وإمكانيات أخرى تجعله يعمل بشكل ممتاز.
00:14:09قام بالفحص التمهيدي، وسألنا عن الجمهور، وحالة الاستخدام، والنبرة.
00:14:14وبمجرد أن اخترنا ذلك، نفذ سير العمل بالكامل، معدلاً ملفات متعددة ومجريًا الاختبارات المعتادة واختبار متصفح تفاعلي.
00:14:21يمتلك إمكانيات تصفح مجهزة، وهو بارع حقًا في هذا النوع من المهام، لذا يضعها قيد الاستخدام.
00:14:26وعندما انتهى، كان شكل الموقع الذي قدمه أفضل بكثير.
00:14:29الشيء الوحيد هو أن مزيج الأزرق والأبيض قد يظل يبدو قليلاً كأنه توليد ذكاء اصطناعي، لكنه يظهر هنا كأمر مقصود وليس كرداءة، لأن هذه الألوان تتناسب مع المواقع التقنية.
00:14:39كانت كل العناصر مختلفة عن طريقة إخراج Codex للتصاميم افتراضيًا.
00:14:43ورغم وجود بعض المشاكل في الصورة الموضوعة في القسم الرئيسي، مثل عدم ضبط المظهر البصري للتبويب المحدد، إلا أن هذا شيء كان يمكننا تصليحه لاحقًا.
00:14:52لذا شغلنا تدقيق Hallmark، وأنشأ تقريرًا.
00:14:54ذكر التقرير أن الهيكل العام كان قويًا مع وجود مشكلات قليلة متبقية شملت التوافق، وهو ما تميل النسخة الأولى لتفويته.
00:15:02وهذا ينقلنا إلى نهاية هذا الفيديو.
00:15:03إذا كنت ترغب في دعم القناة ومساعدتنا في الاستمرار بإعداد مثل هذه الفيديوهات، يمكنك فعل ذلك عبر زر “شكراً جزيلاً” (Super Thanks) أدناه.
00:15:10وكما هو الحال دائمًا، شكرًا للمتابعة، وألقاكم في الفيديو القادم.

Key Takeaway

يتفوق Kimi K3 في بناء الواجهات الأمامية بأقل تكلفة بين النماذج الرائدة، ولكن تحسين مخرجاته يتطلب تشغيله عبر Claude Code باستخدام أداة CLI Proxy API ودمج مهارة Hallmark للتخلص من أنماط التصميم المكررة.

Highlights

  • ينضم نموذج Kimi K3 إلى النماذج التي تمتلك نافذة سياق بمليون رمز، وينافس أداء GPT 5.6 وClaude Fable 5 مع تفوقه في الواجهات الأمامية عبر الرؤية المدمجة في الحلقة.

  • تبلغ تكلفة Kimi K3 نحو 3 دولارات لكل مليون رمز مدخلات و15 دولارًا لكل مليون رمز مخرجات، مقارنة بـ GPT 5.6 (5$/30$) وFable 5 (10$/50$).

  • تتسبب بيئة Kimi Code البطء للعمليات بمدد تصل إلى 10 دقائق مقارنة بـ 3 دقائق في Claude Code نظراً لاكتظاظ الخوادم الحصرية وعدم فتح مصدر أوزان النموذج.

  • تُمكن أداة CLI Proxy API من تشغيل نموذج Kimi K3 داخل Claude Code عبر الاشتراك الشهري المدفوع بالاستعانة بخادم محلي دون تكاليف API إضافية.

  • تتضمن مهارة Hallmark بروتوكولاً من 58 فحصًا لمنع أنماط التصميم المكررة ومحو الآثار النمطية لنماذج الذكاء الاصطناعي عبر أربعة أفعال أساسية.

Timeline

تقييم قدرات Kimi K3 وتكاليف التشغيل

  • ينافس Kimi K3 أداء النماذج الكبرى مثل GPT 5.6 وClaude Fable 5 ويمتلك نافذة سياق تصل إلى مليون رمز.
  • يعتمد Kimi K3 على الرؤية المدمجة في الحلقة التقاط لقطات شاشة وفحص ما يبنيه وتعديل المسافات والمخططات تلقائيًا.
  • يقدم Kimi K3 تسعيرًا منخفضًا عند 3 دولارات للمدخلات و15 دولارًا للمخرجات لكل مليون رمز.

تظهر اختبارات Artificial Analysis تقاربًا كبيراً في الذكاء بين Kimi K3 والنماذج الرائدة الأخرى، مع تفوق واضح لـ Kimi K3 في تقييمات LM Arena الخاصة بالواجهات الأمامية. يعود هذا التفوق إلى قدرة النموذج البصرية على معاينة الكود بصريًا بدلاً من التخمين النصي. تنخفض تكلفة التشغيل بنسبة تصل إلى النصف مقارنة بـ GPT 5.6 وبفارق أكبر مقارنة بـ Fable 5.

قيود بيئة Kimi Code وحل تشغيله داخل Claude Code

  • تستغرق المهمة في Kimi Code نحو 10 دقائق مقارنة بـ 3 دقائق في Claude Code بسبب الضغط على خوادم Moonshot وتصميم بيئة التشغيل.
  • يفقد Kimi Code السياق عند تبديل النماذج وينشئ عددًا كبيرًا من الوكلاء الفرعيين.
  • تتيح أداة CLI Proxy API تحويل اشتراك Kimi إلى خادم محلي لاستخدام النموذج داخل Claude Code.

تعود بطء استجابة Kimi Code إلى كون أوزانه غير مفتوحة المصدر واقتصار الاستضافة على خوادم Kimi الخاصة المكتظة بالطلبات. كما تقر الوثائق الرسمية بعدم جاهزية Kimi Code لإخراج كامل إمكانيات K3. يتم تجاوز هذا العائق عن طريق تثبيت CLI Proxy API عبر brew، وتسجيل الدخول بحساب Kimi، ثم توجيه طلبات Claude Code إلى localhost للاستفادة من الاشتراك الثابت.

آلية عمل مهارة Hallmark وتثبيتها

  • تعتمد مهارة Hallmark على أربعة أفعال أساسية هي الوضع الافتراضي، التدقيق، إعادة التصميم، والدراسة.
  • تجري المهارة فحصًا يتكون من 58 مرحلة لضمان خلو المخرجات من التصاميم النمطية المكررة للذكاء الاصطناعي.
  • يتطلب تشغيل Kimi داخل Claude Code تثبيت المهارة في مسار .claude بالإضافة إلى مسار .agents.

تتعامل Hallmark مع المراجع البصرية كاتجاهات تصميمية بدلاً من نسخها حرفياً، مما يمنع التكرار السطحي. توفر المهارة ملف skill.md وأكثر من مئة مرجع تغطي جوانب التصميم والأنماط السيئة. يتيح تثبيتها عبر مستودع GitHub تحديد الوكيل المطلوب لضمان إيداع ملفات الإعداد في المجلد المناسب لبيئة العمل.

اختبار Kimi K3 وتأثير التقطير المعرفي

  • تظهر في مخرجات Kimi K3 أنماط تصميمية تشبه Opus 4.8 مثل استخدام الدرجات الدافئة ووضع الصور خلف القسم الرئيسي.
  • يتجاوز Kimi K3 نصوص Opus التسويقية بكتابة محتوى أكثر هدفية ومباشرة.
  • تتطلب إدارة السياق مع Kimi في Claude Code مراقبة يدوية لتجنب انحراف الإجابات عند امتلاء النافذة.

يعود ظهور أنماط Opus 4.8 في Kimi K3 إلى تدريب النماذج عبر التقطير (distillation) من مخرجات Claude. تبدأ المهارة بفحص تمهيدي (pre-flight) لإطار العمل وتحديد الجمهور والنبرة، ثم تنفذ فحوصات اكتشاف الأنماط الـ 58. أدى استخدام وضع التدقيق مع Kimi إلى استبدال صور Unsplash بمصادر من Pixum وإصلاح التوافق مع الهواتف المحمولة.

مقارنة الأداء بين Opus 4.8 وCodex عند استخدام المهارة

  • ينتج Opus 4.8 بدون المهارة تصاميم مكررة تعتمد على التدرجات الأرجوانية والحواف الدائرية خلال 6 دقائق.
  • تحقق مهارة Hallmark نتائج أفضل وأكثر تفاعلية مع نموذج Opus 4.8 مقارنة بـ Kimi K3 حاليًا.
  • يستخدم Codex أنماطًا افتراضية تعتمد على اللونين الأبيض والأخضر وعناصر SVG بحجم خطوط صغير.

كشف نظام الكشف عن الأنماط السيئة وجود نصوص متدرجة وعناصر مكررة كثيرة في مخرجات Opus 4.8 القياسية. وعند تفعيل Hallmark مع Opus، تحسنت تفاعلية الأزرار والهيكل العام مع الامتناع عن وضع صور مؤقتة. وفي اختبار Codex، نجحت المهارة في استغلال إمكانيات التصفح لديه وإجراء اختبارات متصفح تفاعلية لتقديم واجهة متناسقة للمواقع التقنية.

Community Posts

View all posts