هذه المهارة الجديدة تحل أخيرًا مشكلة التفكير لدى وكلاء الذكاء الاصطناعي

AAI LABS
Computing/SoftwareInternet Technology

Transcript

00:00:00تتشارك أدوات Claude Code وCodex وتقريبًا كل وكيل ذكاء اصطناعي آخر تستخدمه في مشكلة واحدة خطيرة، وتواجهها في اللحظة التي تحتاج فيها إلى اتخاذ قرار فعلي.
00:00:08يمكن لهذه النماذج التفكير في المشكلة بتمعن، لكنها لا تأتي أبدًا بأي شيء جديد.
00:00:12ولا يهم أي نموذج تستخدمه، فجميعها تفشل في اللحظة التي تحتاج فيها إلى شيء إبداعي.
00:00:17عندما تلجأ إليها للحصول على أفكار، تعود إليك بالإجابة الآمنة، وتجد نفسك تطلب مرارًا وتكرارًا الزوايا التي كان ينبغي لها اكتشافها بنفسها.
00:00:24وإلى أن تقدم لها تلك الزوايا بنفسك، لن تفكر بإبداع مطلقًا.
00:00:28لكن الحل لهذه المشكلة الغريبة هو في الواقع “اضطراب فرط الحركة ونقص الانتباه” (ADHD)، وهو عندما يتشتت انتباه الشخص في كل مكان بدلاً من التركيز على شيء واحد.
00:00:35ويتضح أن هذا الاضطراب يصبح قوة خارقة عندما تكون وكيل ذكاء اصطناعي، وهذا ما نمنحه لها الآن بأساسه.
00:00:41هناك أداة رائجة هذه الأيام تقوم بذلك بالضبط.
00:00:44وإذا كانت هذه زيارتك الأولى، فنحن شركة برمجيات وهذه قناتنا AI Labs حيث نوضح لك كيفية تحسين عملياتك باستخدام الذكاء الاصطناعي تمامًا كما حسّنا عملياتنا.
00:00:54لذا في هذا الفيديو، سنشرح كيف يساعد منح وكيلك سمة ADHD في الواقع.
00:00:59قبل أن نتطرق إلى الأداة، عليك أن تعرف سبب حاجتك إليها في المقام الأول.
00:01:03إذا عملت مع Claude Code أو Codex أو أي وكيل آخر، فأنت تعلم بالفعل أنها جيدة في تقسيم المهام الكبيرة التي تعطيها لها إلى أجزاء صغيرة.
00:01:10هي تسلم تلك الأجزاء لوكلاء فرعيين بحيث يعمل كل واحد في نافذة السياق الخاصة به دون ملء الجلسة الرئيسية.
00:01:16لا يتعين عليك حتى طلب ذلك.
00:01:18تنشئ مهامًا وتفوضها أينما أمكن حتى يعمل العمل بشكل متوازٍ.
00:01:22لكن كل هذا التقسيم يحدث فقط للعمل نفسه.
00:01:26لا يحدث أي شيء منه عندما تطلب منها توليد الأفكار، وإذا حاولت العصف الذهني لزوايا مختلفة لفكرة ما مع أحدهم، فستعرف هذه المعاناة.
00:01:34تطلب تنويعات، وما يعود إليك يبدو مختلفًا عند قراءته، لكن كل الأفكار هي مجرد نفس الفكرة بإعادة صياغة مختلفة.
00:01:40لذا فإن توليد الأفكار هو أصعب شيء يمكن تفويضه لأن إيجاد اتجاهات مختلفة تمامًا ليس شيئًا يجيده الوكلاء.
00:01:47أساسًا، يعود الأمر إلى كيفية تدريب هذه النماذج.
00:01:50يتجه الوكيل إلى النمط الذي ظهر بشكل متكرر في البيانات التي تعلم منها، لأن رؤية نفس الإجابة تتكرر هي ما علمه أن الإجابة جيدة.
00:01:59هذا لا يجعل إجاباته خاطئة، وما تحصل عليه عادة ما يكون جيدًا، ولكن هناك زوايا أخرى للمشكلة لا ينظر إليها أبدا، مما يلغي الهدف من العصف الذهني معه.
00:02:08والأنماط الآمنة ليست سوى نصف المشكلة، لأنه أيضًا لا يقيّم كل فكرة بمفردها أبدا.
00:02:13يتم تحليل كل احتمال في نفس نافذة السياق، فتتداخل الأفكار مع بعضها ويمتلئ السياق بالضجيج.
00:02:20يسوء التفكير بدلاً من أن يتحسن، ولهذا السبب لا يمكنه تقييم أي شيء بوضوح وينتهي به الأمر بتقديم نفس الفكرة بصياغة مختلفة.
00:02:28ظهرت مهارة ADHD مؤخرًا وحصلت على الكثير من التقييمات العالية في غضون أيام قليلة.
00:02:33والاسم مناسب لأنه مثل اضطراب فرط الحركة الفعلي حيث تشتت الأفكار، فإنها تشتت التفكير بدلاً من تشغيله في خط مستقيم واحد.
00:02:42فهي تأخذ توليد الأفكار أو أي مهمة بها العديد من الاتجاهات المحتملة وتقسمها عبر وكلاء منفصلين كـ “شجرة أفكار”.
00:02:49شجرة الأفكار هي بنية تعمل فيها فروع متعددة من الوكلاء الفرعيين بمعزل عن بعضها على أفكار مختلفة، تمامًا كما تتفرع أغصان الشجرة.
00:02:58ثم في النهاية، وبمجرد أن يستقر كل فرع على احتمال واحد، يجمع كل تلك الأفكار مجددًا ويدمجها في الإجابة النهائية.
00:03:06لذا فهي تشغل وكلاء متعددين يفكرون في نوافذ السياق الخاصة بهم ويحصل كل واحد على صياغة مختلفة لنفس المشكلة.
00:03:12هم معزولون، لذا يتشاركون صفر سياق ولا يعرف أي منهم ما يعمل عليه الآخرون.
00:03:17لكن العزل هنا ليس لتقسيم العمل، بل لإبقاء كل فكرة منفصلة حتى لا تؤثر على بعضها.
00:03:24والطريقة التي تبقيهم بها منفصلين هي باستخدام الإطارات (Frames) وهي عدسات مختلفة للنظر إلى المشكلة.
00:03:29تحتوي على مكتبة إطارات كاملة بداخلها تضم جميع الاتجاهات التي يمكن للوكلاء الذهاب إليها، ويختار كل وكيل الإطار الذي سيعمل من خلاله.
00:03:37فيتلقى موجه الإطارات هذا جنبًا إلى جنب مع موجه النظام والمشكلة نفسها.
00:03:41ثم يقوم وكيل ناقد بتقييم كل ما يعود لأن شيئًا ما يجب أن يقرر أي من هذه الأفكار يستحق الاحتفاظ به.
00:03:48يقيّم كل فكرة بناءً على ثلاثة أشياء.
00:03:50الابتكار (Novelty)، وهو مدى جدة الفكرة وإبداعها بالفعل.
00:03:54الجدوى (Viability)، وهي ما إذا كان بإمكانك بناؤها بجميع النواحي العملية.
00:03:57والملائمة (Fit)، وهي مدى تطابقها مع المشكلة التي تحاول حلها.
00:04:01يحدث هذا التقييم في وكيل خاص به، يعمل بموجه يخبره بأن يتصرف كمهندس خبير متشكك.
00:04:07لذا فإن مهمته بالكامل هي أن يكون صارمًا تجاه كل ما يقرأه.
00:04:10وبناءً على النتيجة، يقرر ما إذا كانت الفكرة ستستمر أم يتم التخلص منها.
00:04:15في النهاية، تختار المهارة أقوى الأفكار وتراجع قائمة الفخاخ التي هي بأساسها المشاكل التي قد تسببها كل فكرة إذا اعتمدتها بالفعل.
00:04:23ثم تعطي الأولوية لتلك الأفكار التي تم تعليمها كـ “غير بديهية”.
00:04:26قبل أن نريك طرقًا مثيرة للاهتمام تساعد بها هذه المهارة، سيكون من الرائع أن تشترك في القناة وتضغط على زر الإعجاب.
00:04:33هذه اللفتة الصغيرة من الدعم تعني الكثير بالنسبة لنا.
00:04:36هذا ما تفعله خلف الكواليس.
00:04:38الآن دعنا نقوم بتثبيتها.
00:04:40ستجد أمر التثبيت على مستودع GitHub الخاص بالمشروع.
00:04:43تنسخه، وتفتح الطرفية (Terminal) في أي مشروع تعمل عليه وتقوم بتشغيله.
00:04:47ثم يسألك عن وكيل البرمجة بالذكاء الاصطناعي الذي تريد تثبيتها له، وهو يدعم أكثر من 45 منها.
00:04:53لذا يمكنك فقط اختيار الوكيل الذي تستخدمه.
00:04:55بعد ذلك، يسأل عما إذا كان ينبغي أن تكون المهارة متاحة فقط داخل المشروع الحالي (Project Scope) أم من أي مكان بغض النظر عن المشروع.
00:05:03إذا كنت تحتاجها في مكان واحد فقط، فـ Project Scope هو الخيار المناسب.
00:05:06لكن بمجرد الانتهاء، تستقر المهارة في مجلد يسمى .agents.
00:05:10هذا ما يستخدمه العديد من الوكلاء الآخرين مثل Codex للأنماط والتكوين، ولكن Claude Code يتعرف فقط على مجلد .claude افتراضيًا.
00:05:18لذا إذا كان هذا ما تستخدمه، فإنك تعيد تسمية ذلك المجلد إلى .claude وسيتم التعرّف عليه.
00:05:22عندما تفتحه، ستجد المهارة موجودة هناك.
00:05:25وهي مجرد ملف skill.md واحد يتعامل مع كل شيء بنفسه، دون ملفات مرجعية أو تبعيات بجانبه.
00:05:31كما تدفع التعليمات الوكيل بقوة لتجاوز إجاباته الثلاث الأولى.
00:05:36ينص الملف صراحة على أن الإجابات الثلاث الأولى هي الاستجابات الأكثر شيوعًا في البيانات التي تعلمت منها هذه النماذج،
00:05:41وهي أيضًا الإجابات التي يمكن لأي وكيل خبير تقديمها فورًا.
00:05:44الأشياء الأكثر إثارة للاهتمام التي يستطيع الوكيل الخبير تقديمها تبدأ فقط بعد ذلك.
00:05:50لكن تشغيل هذا العدد الكبير من الوكلاء يستهلك الكثير من الرموز (Tokens)،
00:05:52لذا فهناك خطوة تحقق مسبق تقرر ما إذا كان ينبغي تشغيل هذه المهارة على الإطلاق.
00:05:56إذا استدعيتها بـ أمر الشرطة المائلة (slash command)، أو طلبتها مباشرة، فإنها تعمل فورًا.
00:06:01إذا لم تذكرها في موجهك لاستدعاء المهارة مباشرة،
00:06:04وقرر وكيلك استدعاء المهارة تلقائيًا،
00:06:07فإنه يمرر المشكلة عبر ثلاثة أسئلة تشكل خطوة التحقق المسبق.
00:06:11السؤال الأول هو ما إذا كانت المشكلة مفتوحة النهاية،
00:06:14مما يعني بأساسه، هل سيكون لشخص ذي خبرة إجابات مختلفة تعمل هنا،
00:06:19أم إجابة واحدة صحيحة فقط.
00:06:20إذا كانت هناك إجابة واحدة صحيحة فقط،
00:06:22فإن التفكير من زوايا متعددة لا فائدة منه ويضيع الرموز فقط،
00:06:26لذا يتوقف هناك.
00:06:27السؤال الثاني هو ما إذا كانت المخاطر عالية بالفعل،
00:06:29مما يعني، هل سيكلفك الأمر شيئًا حقًا إذا تبين أن الإجابة الواضحة كانت خاطئة.
00:06:34والثالث هو كيف طلبت ذلك.
00:06:36إذا استخدمت كلمات مثل “سريع” أو “قياسي”،
00:06:38فأنت تبحث بوضوح عن إجابة مباشرة،
00:06:40لذا يتوقف هناك بدلاً من استخدام المهارة.
00:06:43بصرف النظر عن خطوة التحقق المسبق،
00:06:44لديك جميع مراحل الحلقة مع جدول الإطارات التي تبدو كاتجاهات مختلفة يتم تسليمها لكل وكيل.
00:06:50كما يسرد الأنماط التي يُطلب من الوكلاء صراحة تجنبها.
00:06:54ولكن قبل أن نتعمق في الطرق الشيقة التي يمكنك استخدامها بها، فلنستمع إلى راعينا.
00:06:59Top View.
00:06:59إذا كنت تصنع فيديوهات بالذكاء الاصطناعي، فأنت تعرف المعاناة بالفعل.
00:07:02كل نموذج يعيش على منصة مختلفة وتنشئ مقطعًا واحدًا في كل مرة.
00:07:05Top View يحل ذلك.
00:07:06إنها أول مهارة فيديو ذكاء اصطناعي متكاملة في العالم، وتعمل داخل وكيل البرمجة الخاص بك مباشرة.
00:07:11Claude code وCursor وCodex.
00:07:13فهي تجمع كل النماذج الرائدة في مكان واحد.
00:07:16VO وKling وSea Dance وNano Banana وغيرها الكثير.
00:07:19لا حاجة للتبديل بين المنصات، أو إدارة اشتراكات متعددة.
00:07:22لذا قمنا بتجربتها.
00:07:23أعطينا وكيلنا أمرًا واحدًا.
00:07:25أنشئ 10 تنويعات لإعلان TikTok مدته 15 ثانية من صورة المنتج هذه.
00:07:29وبعد ثوانٍ، كان لدينا 10 إعلانات جاهزة للنشر.
00:07:32هذا هو التحول الحقيقي.
00:07:34تحول Top View وكيلك إلى خط إنتاج فيديو.
00:07:36تصف ما تريد مرة واحدة وتنشئ دفعة من عشرات الفيديوهات عبر نماذج وأنماط ونسب أبعاد مختلفة في جلسة واحدة.
00:07:44حتى أنها تختار النموذج المناسب للمهمة تلقائيًا.
00:07:47تنتقل من سطر نصي واحد إلى فيديوهات نهائية دون مغادرة وكيلك أبدا.
00:07:51جرب مهارة Top View عبر الرابط الموجود في الوصف.
00:07:54هذا هو إعدادها.
00:07:54الآن دعنا ندخل في الأماكن التي تؤتي فيها ثمارها حقًا.
00:07:57أحد المجالات التي تجدي فيها نفعًا حقًا هو التطوير الموجه بالاختبار (TDD)، حيث تجعل الوكيل يكتب الاختبارات أولاً.
00:08:03ثم يبني التطبيق قطعة قطعة حتى تتجاوز كل تلك الاختبارات بنجاح.
00:08:07وكتابة الاختبارات قبل كتابة الكود أمر مهم، كما تحدثنا في فيديوهاتنا السابقة،
00:08:12لأنه عندما يتم كتابة جميع متطلباتك بصرامة ككود، فإن أي تغيير يعطل التطبيق يتم اكتشافه بواسطة الاختبارات.
00:08:18يُجبر الوكيل على الالتزام بها.
00:08:20وكتابة الاختبارات مشكلة جيدة جدًا لتقديمها للمهارة، لأن هذا هو بالضبط المكان الذي يتكاسل فيه الوكلاء.
00:08:26فهم لا يغطون جميع الحالات التي ينبغي عليهم تغطيتها، لأنهم كما قلنا للتو، يعتمدون على نفس الإجابات الشائعة ويكتبون الاختبارات حولها فقط.
00:08:33ولا ينظرون أبدا إلى المسارات الأخرى التي يمكن لشخص ما اتخاذها عبر التطبيق، والتي يجب تغطيتها أيضًا.
00:08:37يمكنك إعطاء أحدهم موجهًا مفصلاً حول كيفية كتابة الاختبارات، ويمكنك بناء وكيل متخصص لكتابة الاختبارات مهمته الوحيدة هي كتابتها.
00:08:45لكنهم ما زالوا يعودون إلى نفس الأنماط.
00:08:47قبل تشغيله، يحتاج الوكيل إلى معرفة ما تبنيه قبل أن يكتب أي شيء.
00:08:51لهذا السبب، تحتاج إلى كتابة ما يجب بناؤه، مثل وثيقة متطلبات المنتج (PRD)، وهي المستند الذي يوضح ما يهدف التطبيق لفعله والمشكلة التي يحلها، إلى جانب الأهداف والجمهور المستهدف.
00:09:03وإلى جانب ذلك، يجب أيضًا إعطاؤه مستند المواصفات الفنية، والذي يحدد التفاصيل الفنية حتى لا تكرر إخباره بالأدوات التي يجب استخدامها.
00:09:11تقوم بربط كلاهما داخل ملف Claude.md الخاص بك، بحيث يلتقط هذا السياق منذ البداية.
00:09:16ثم تستدعي المهارة باستخدام أمر الشرطة المائلة، وتطلق موجهًا يصف التطبيق الذي تبنيه، وتطلب منه كتابة حالات الاختبار باستخدام نهج TDD.
00:09:25ولأنك استدعيتها صراحة، فإنها تتخطى التحقق المسبق وتشغل خمسة وكلاء فورًا.
00:09:30ينطلق كل واحد في اتجاهه الخاص في التفكير، باستخدام الإطار الذي يناسب المشكلة بشكل أفضل، ويعودون بأساليب مختلفة لكتابة الاختبارات.
00:09:38ثم يقيّم كل منها وفق المعايير التي استعرضناها سابقًا، ويختار أفضل ثلاثة، ويستكشفها بتعمق أكبر.
00:09:44وبمجرد انتهاء كل هؤلاء الوكلاء، تحصل على تقرير مفصل باتجاهات الاختبار جنباً إلى جنب مع درجاتها.
00:09:50تُكتب الدرجات باختصار، حيث تعني N9 أن الفكرة حصلت على 9 في الابتكار، وتعني V8 أنها حصلت على 8 في الجدوى، وتعني F10 أنها حصلت على درجة كاملة في الملائمة.
00:10:00تأتي كل فكرة أيضًا مع رسم تخطيطي لكيفية بنائها، والمخاطرن والخطوات الأولى للبدء فيها.
00:10:07لكن الأفكار التي تعود لا تشبه أبدًا مجموعة عادية من الاختبارات.
00:10:11عادةً ما تتحقق الاختبارات التي يكتبها الوكيل من أن التطبيق يعمل بشكل صحيح فقط.
00:10:15لكن الأفكار التي قدمتها المهارة استهدفت حالات حافة (Edge cases) أكثر بكثير، ويكتشفون مشاكل الأداء أيضًا.
00:10:21فتنتهي بمجموعة اختبارات ألمع بكثير، مقسمة على ثلاثة فروع مستكشفة بعمق، وكل فرع يختبر مسارًا مختلفًا عبر التطبيق.
00:10:30لكن يجب التوضيح هنا: المهارة تخطط للاختبارات، ولا تكتبها في الواقع.
00:10:34ما تحصل عليه هو الاستراتيجية، ومن هناك تخبر الوكيل بالاتجاه الذي تريده، ليقوم بتنفيذه.
00:10:40يمكنك اختيار اتجاه واحد إذا كان هذا كل ما تحتاجه، أو تجعله ينفذ الثلاثة جميعًا.
00:10:44إذا كان الأداء حاسمًا لما تبنيه، فستحتاج إلى الثلاثة جميعًا، لكن ذلك يستغرق وقتًا، لأن الوكيل عليه العمل على المسارات واحدًا تلو الآخر.
00:10:52بمجرد الانتهاء، يمكنك أن ترى بوضوح أن الاختبارات أكثر تفصيلاً بكثير مما كانت ستكون عليه بخلاف ذلك،
00:10:57لأن استراتيجية الاختبار بأكملها تم التخطيط لها بعمق قبل كتابة اختبار واحد.
00:11:02لذا فإن هذا يعمل بشكل جيد للغاية قبل أن تبدأ في البناء، حيث يغطي معظم الجوانب مسبقًا ويقلل من فرص تعطل التطبيق لاحقًا.
00:11:09لكن كل هذا يخص مرحلة ما قبل البناء.
00:11:11الطريقة الأخرى لاستخدام هذا هي كخطوة مباشرة قبل الإطلاق.
00:11:14تشغل المهارة على التطبيق الذي توشك على إطلاقه، وتطلب منها تقييم تجربة المستخدم.
00:11:18عندها تحدد أي شيء قد يعيق المستخدمين أثناء تصفح الموقع أو استخدام المنتج،
00:11:23وأي شيء قد يدفعهم إلى التسرب (Churn)، وهو بأساسه يتلخص في توقف الأشخاص عن استخدام منتجك بعد أن بدأوا في استخدامه بالفعل.
00:11:29ويحدث التسرب كثيرًا بمجرد إتاحة موقعك للجمهور واستخدام أشخاص حقيقيين له، خاصة إذا كان مدفوعًا.
00:11:34يعجبهم المنتج في البداية ثم يغادرون لأن ميزة واحدة لم تعمل كما توقعوا،
00:11:38فيطالبون باسترداد أموالهم.
00:11:40وفي كثير من الأحيان، يكون الأمر تفصيلة صغيرة تم إغفالها أثناء بناء التطبيق،
00:11:44وشق طريقه إلى النسخة الحية، وتسبب في مشاكل لاحقًا.
00:11:48قمنا بتشغيل هذا على موقع مجتمعنا الخاص، وكنا في المنتصف من إطلاق ميزة جديدة.
00:11:53لدينا بالفعل العديد من الأعضاء هناك، لذا يجب فحص أي شيء جديد بعناية شديدة،
00:11:57لأننا لا نريد إطلاق شيء يفسد التجربة على الأشخاص الموجودين بالفعل.
00:12:01لذا استدعيناها بأمر الشرطة المائلة، وأعطيناها الميزة، وطلبنا منها تحديد
00:12:05المواضع التي قد يتسرب منها الأشخاص وما الذي قد يمنحهم تجربة سيئة.
00:12:09بدأت بقطع التطبيق بعمق لجمع السياق،
00:12:12ثم شغلت وكلاءها بنفس الطريقة وأظهرت حوالي 30 فكرة مختلفة.
00:12:17ومن بين تلك الأفكار، اختارت أفضل ثلاثة واستكشفتها بشكل أكبر.
00:12:20وبمجرد الانتهاء من ذلك، أعطتنا كل نتيجة مقيمة حسب الابتكار والجدوى والملائمة.
00:12:25ورصدت ثغرات لم يتم اكتشافها تمامًا،
00:12:28مثل الميزات التي وُعد بها في مستند PRD ولكن لم يتم بناؤها أبدًا،
00:12:32لذا كنا سنطلق شيئًا لا يتطابق مع ما قلنا إنه سيفعله،
00:12:35إلى جانب مجموعة من النتائج الأخرى.
00:12:37ولكل منها، اقترحت إصلاحًا وسردت الفخاخ والمخاطر المصاحبة لها.
00:12:42وهي تعمل بنفس طريقة الاختبارات هنا.
00:12:44فهي لا تصلح أي شيء بنفسها، لذا أنت تعيد النتائج التي تريدها إلى الوكيل،
00:12:48وهو يقوم بتنفيذها.
00:12:50لذا يمكنك التعامل مع كل ذلك قبل الإطلاق بدلاً من بعده،
00:12:53مما يضع تطبيقك في حالة أفضل بكثير بحلول الوقت الذي يتاح فيه للجمهور فعليًا.
00:12:57الآن جميع المهارات وسير العمل والموارد التي نوضحها لك في فيديوهاتنا
00:13:01متاحة في AI Labs Pro، وهو مجتمعنا.
00:13:04لذا إذا وجدت قيمة فيما نقدمه وأردت دعم القناة،
00:13:07فهذه هي أفضل طريقة للقيام بذلك.
00:13:09الرابط في الوصف.
00:13:10هذا ينقلنا إلى نهاية هذا الفيديو.
00:13:12إذا كنت ترغب في دعم القناة ومساعدتنا في الاستمرار في إنشاء فيديوهات مثل هذه،
00:13:16يمكنك القيام بذلك باستخدام زر الشكر الفائق (Super Thanks) أدناه.
00:13:18وكالعادة، شكرًا لك على المشاهدة، وأراك في الفيديو القادم.

Key Takeaway

تتغلب مهارة ADHD على النمطية في وكلاء الذكاء الاصطناعي عبر توزيع الأفكار على وكلاء معزولين بإطارات تفكير مختلفة وتمريرها على وكيل ناقد لتقييم الابتكار والجدوى والملائمة.

Highlights

  • تفشل نماذج الذكاء الاصطناعي مثل Claude Code وCodex في التفكير الإبداعي لأنها تعود تلقائيًا لأكثر ثلاثة أنماط تكرارًا في بيانات تدريبها.

  • تُقسّم مهارة ADHD مهام العصف الذهني عبر شجرة أفكار تعمل فيها وكلاء فرعيون بنوافذ سياق معزولة وإطارات تفكير مختلفة لمنع التداخل والضجيج.

  • يقيّم وكيل ناقد يمثل مهندسًا خبيرًا متشككًا كل فكرة ناتجة بناءً على الابتكار والجدوى والملائمة قبل دمج الأفكار النهائية.

  • تتضمن المهارة خطوة تحقق مسبق عبر ثلاثة أسئلة لتجنب استهلاك الرموز (Tokens) في المشاكل المغلقة أو ذات المخاطر المنخفضة.

  • يؤدي تطبيق هذه المهارة على منهجية التطوير الموجه بالاختبار (TDD) إلى تغطية حالات الحافة ومشاكل الأداء التي تتجاهلها الاختبارات التقليدية.

Timeline

قصور التفكير الإبداعي لدى وكلاء الذكاء الاصطناعي

  • تعود وكلاء الذكاء الاصطناعي إلى الاستجابات الآمنة والمعادة عند طلب أفكار إبداعية.
  • ينتج التحيز في الإجابات عن اعتماد النماذج على الأنماط الأكثر تكرارًا في بيانات التدريب.
  • يؤدي تحليل كل الاحتمالات داخل نافذة سياق واحدة إلى تداخل الأفكار وامتلائها بالضجيج.

تُمتاز أدوات مثل Claude Code وCodex بالقدرة على تقسيم المهام إلى مهام فرعية وتنفيذها بالتوازي، لكنها تفشل في العصف الذهني توليد زوايا متعددة. يرجع هذا إلى طريقة تدريب النماذج التي تُفضل الأنماط المتكررة كإجابات صحيحة. كما يتسبب تقييم جميع المقترحات داخل نفس نافذة السياق في تدهور جودة التفكير وتقديم نفس المقترحات بصياغات مختلفة.

آلية عمل مهارة ADHD وتقييم الأفكار

  • توزع المهارة المهام على وكلاء معزولين ضمن شجرة أفكار تستخدم إطارات تفكير مختلفة.
  • يحلل وكيل ناقد كل مقترح بناءً على معايير الابتكار والجدوى والملائمة.
  • تُستبعد الاستجابات الثلاث الأولى الصادرة عن النماذج لكونها الأكثر شيوعًا وتوقعيًا.

تستخدم مهارة ADHD بنية تفرع تُسمى شجرة الأفكار حيث يعمل كل وكيل فرعي في نافذة سياق معزولة تمامًا لمنع التأثير المتبادل. يحصل كل وكيل على إطار محدد من مكتبة الإطارات يوجه زاوية التفكير. يتولى وكيل ناقد يعمل كممثل لمهندس خبير متشكك تقييم الأفكار وترشيح الأكثر ابتكارًا وجدوى وملائمة للمشكلة، مع استبعاد أول ثلاث إجابات تقليدية وتجنب الوقوع في الفخاخ التقنية.

خطوات التثبيت وفحص التحقق المسبق

  • تتطلب عملية التثبيت تشغيل أمر طرفي وتحديد نطاق المشروع أو المفهوم العام للوكيل.
  • يحتوي ملف skill.md المنفرد على كافة تعليمات وقواعد المهارة بدون تبعيات خارجية.
  • تفحص المهارة طبيعة المشكلة عبر ثلاثة أسئلة لتجنب الهدر في استهلاك الرموز.

تُثبت المهارة عبر الطرفية لدعم أكثر من 45 وكيل برمجة، وتستقر في مجلد المهارات المخصص (.agents أو .claude). لمنع الاستهلاك المفرط للرموز (Tokens) عند تشغيل وكلاء متعددين، تطبق المهارة آلية فحص مسبق تتكون من ثلاثة أسئلة: هل المشكلة مفتوحة النهاية، هل المخاطر عالية عند الخطأ، وهل صياغة الموجه تطلب إجابة سريعة. إذا كانت المشكلة تتطلب إجابة واحدة محددة، يتوقف تشغيل المهارة تلقائيًا.

تطبيق المهارة في التطوير الموجه بالاختبار (TDD)

  • تساعد المهارة في بناء استراتيجيات اختبار شاملة قبل البدء في كتابة الكود البرمجي.
  • يُطلب ربط مستندات PRD والمواصفات الفنية لتزويد الوكلاء بالسياق المطلوب.
  • تولد المهارة تقارير مفصلة بدرجات التقييم ومخططات البناء دون كتابة الكود الفعلي.

يتكاسل وكلاء البرمجة عادةً عند كتابة الاختبارات ويفحصون حالات العمل الطبيعية فقط. عند تزويد Mهارة ADHD بمستند متطلبات المنتج (PRD) والمواصفات الفنية، يتم إطلاق وكلاء متعددين لبناء استراتيجيات تستهدف حالات الحافة ومشاكل الأداء. تعود المهارة بتقارير مبرهنة بدرجات قياسية (مثل N9 للابتكار، V8 للجدوى، F10 للملائمة) ومخططات هيكلية، ليقوم الوكيل الأساسي بعد ذلك بتنفيذ الكود بناءً على الاستراتيجية المختارة.

كشف ثغرات تجربة المستخدم ومخاطر التسرب قبل الإطلاق

  • تُستخدم المهارة لفحص تجربة المستخدم واكتشاف العوامل المسببة لتوقف المشتركين.
  • تحدد المهارة الفجوات بين الميزات الموعودة في المستندات وما تم بناؤه فعليًا.
  • يقدم الوكيل الناقد حلولاً للمشاكل المكتشفة مع توضيح مخاطر كل خيار.

تُطبق المهارة كخطوة مراجعة نهائية قبل إطلاق المنتجات لمنع تسرب المستخدمين (Churn). عند تحليل الميزات، يستخرج الوكلاء السياق الكامل للكود ويولدون عشرات الأفكار التي ترصد النواقص مثل الميزات المذكورة في وثيقة PRD والتي لم تُنفذ في النسخة الحية. توفر المهارة حلولاً واضحة للثغرات قبل وصول المنتج للجمهور، مما يتفادى طلبات استرداد الأموال أو تجارب الاستخدام السيئة.

Community Posts

View all posts