Les compétences de l'agent Hermes qui le rendent 10x plus puissant

AAI LABS
Computing/SoftwareInternet Technology

Transcript

00:00:00Depuis la sortie de Hermes Agent, les utilisateurs mettent en place toutes sortes de flux de travail avec.
00:00:04Et pour rendre un agent déjà puissant encore meilleur, beaucoup ont également développé de nombreuses compétences pour lui.
00:00:10Certains d'entre eux sont même devenus des projets parmi les plus populaires sur GitHub.
00:00:14Vous vous demandez peut-être pourquoi il serait nécessaire d'installer des compétences supplémentaires,
00:00:17puisque Hermes en propose déjà beaucoup et qu'il peut même en créer de nouvelles à partir de vos flux de travail.
00:00:22Mais les compétences créées par Hermes proviennent uniquement des processus qu'il apprend de vous.
00:00:25Ces autres compétences sont conçues par des personnes ayant déjà résolu des problèmes qu'Hermes ne peut régler seul,
00:00:31et elles ont regroupé ces solutions dans des compétences que vous pouvez utiliser.
00:00:34Si vous découvrez la chaîne, bienvenue, nous sommes une entreprise logicielle et ceci est AI Labs.
00:00:38Dans cette vidéo, nous allons passer en revue les compétences qui améliorent réellement l'utilisation des agents Hermes.
00:00:43Mais avant d'aborder la première, vous devez savoir ceci :
00:00:46même si nous utilisons ces compétences avec Hermes, la plupart d'entre elles fonctionnent avec n'importe quel agent de code IA.
00:00:51Si vous travaillez avec des agents de code, qu'il s'agisse de Hermes ou de n'importe quel autre,
00:00:56ils rencontrent tous le même problème.
00:00:57Au cours d'une longue conversation, votre agent peut oublier les détails mentionnés plus tôt,
00:01:02ce qui vous oblige à lui répéter la même instruction.
00:01:04Cela se produit plus souvent lorsque vous utilisez des modèles Opus avec Hermes,
00:01:08car ils ont tendance à oublier les choses plus rapidement.
00:01:10La cause de ce phénomène réside dans le trop grand nombre de messages dans votre fenêtre de contexte,
00:01:14obligeant le modèle à prêter attention à l'ensemble d'entre eux.
00:01:16Dans ce cas, il peut perdre de vue les détails mineurs et fournir de moins bonnes réponses.
00:01:20Pour résoudre ce problème, il existe une compétence appelée Planning with Files.
00:01:24Elle conserve le plan là où l'agent ne peut pas l'ignorer.
00:01:27Plutôt que de garder le plan dans le chat et d'occuper de l'espace dans la fenêtre de contexte,
00:01:31cette compétence convertit le plan en trois fichiers dans le dossier de votre projet.
00:01:34Le premier est TaskPlan.MD, qui divise votre tâche principale en sous-tâches
00:01:40afin que l'agent puisse les exécuter une par une.
00:01:42Vient ensuite Findings.MD, qui consigne chaque problème rencontré par l'agent et sa résolution.
00:01:47Si le même problème se reproduit, l'agent peut s'appuyer sur ces apprentissages pour l'éviter.
00:01:51Enfin, Progress.MD enregistre l'avancement de l'agent dans son travail.
00:01:56Vous pensez peut-être que conserver son plan dans des fichiers n'a rien de nouveau,
00:01:59et la plupart d'entre vous le font peut-être déjà.
00:02:01Ce qui distingue cette méthode, c'est que l'agent ne peut pas ignorer le plan.
00:02:04Cela est dû à l'utilisation d'un hook,
00:02:06qui insère de force les trois fichiers dans la fenêtre de contexte,
00:02:09empêchant ainsi le modèle de décider de les ignorer.
00:02:12La plupart des agents ne prennent pas en charge les hooks, mais Hermes fait partie des rares exceptions.
00:02:16Selon leurs propres tests, l'agent a obtenu de bien meilleurs résultats avec le hook actif,
00:02:20car il ne s'est pas écarté de la tâche qui lui avait été assignée.
00:02:23Les commandes d'installation pour tous les agents sont répertoriées dans le dépôt,
00:02:26dont le lien se trouve dans la description ci-dessous.
00:02:28Une fois installé, il s'ajoutera aux côtés de toutes les autres compétences.
00:02:32De plus, les hooks seront installés automatiquement dans votre agent.
00:02:35Le fichier de compétences explique la nature des trois fichiers,
00:02:38leur emplacement et le rôle de chacun.
00:02:40Il inclut également l'ensemble des règles que l'agent doit respecter,
00:02:43afin qu'il sache de quoi il dispose.
00:02:44Une fois l'installation terminée,
00:02:46vous pouvez lancer la compétence et fournir une consigne pour ce que vous souhaitez que l'agent réalise.
00:02:50Vous pouvez observer ici que l'agent a commencé par créer le plan des tâches,
00:02:53les constats, puis les fichiers de progression.
00:02:56Ensuite, il nous a posé des questions auxquelles nous avons répondu au fur et à mesure.
00:02:59À la fin de cette longue session, il a finalisé le plan et nous a fourni les trois fichiers.
00:03:03Mais avant de passer à la compétence suivante,
00:03:04ce serait formidable si vous vous abonniez à la chaîne et cliquiez sur le bouton j'aime.
00:03:08Ce geste de soutien minime représente beaucoup pour nous.
00:03:11Vous savez peut-être déjà qu'il est possible d'utiliser plusieurs outils de code avec Hermes.
00:03:15Par exemple, vous pouvez connecter votre abonnement codex à l'agent Hermes et exploiter ses modèles.
00:03:19Vous savez peut-être aussi que Hermes intègre déjà une compétence Claude Code qui transmet les tâches directement,
00:03:24et dispose d'un mécanisme similaire pour codex.
00:03:27Toutefois, le problème de ces compétences est qu'Hermes ne les utilise pas sans instruction explicite de votre part.
00:03:31Il vous faut également préciser dans votre consigne quelle tâche attribuer à quel agent.
00:03:35Il existe pourtant une autre compétence qui route les tâches vers n'importe quel agent déjà installé sur votre système.
00:03:40Cette compétence fait office d'orchestrateur entre l'ensemble d'entre eux.
00:03:43Elle détermine aussi quel outil de code installé convient le mieux à chaque tâche et lui confie le travail.
00:03:49Il s'agit en réalité d'un ensemble de compétences.
00:03:51La principale se nomme delegate setup et coordonne les autres agents.
00:03:54Elle intègre également des compétences de délégation dédiées pour différents agents de code, dont Claude Code, codex et cursor.
00:04:00Ces agents s'exécutent dans un mode où ils ne demandent pas d'autorisation avant d'exécuter une commande,
00:04:05évitant ainsi que l'agent de code ne s'arrête et n'attende votre validation pour chaque modification.
00:04:08Pour installer cette compétence, exécutez la commande d'installation.
00:04:11Elle vous demande de choisir parmi 18 compétences, ce qui vous permet de sélectionner les outils présents sur votre machine.
00:04:16Une fois l'installation effectuée, vous constaterez que Hermes dispose de la compétence delegate setup prête à l'emploi.
00:04:20Pour l'utiliser, il suffit de lancer la compétence avec la commande slash, de saisir la consigne et de la transmettre à l'agent Hermes.
00:04:26Dans un premier temps, il identifie les outils de code installés.
00:04:28Ensuite, il vous fournit une cartographie complète du domaine pris en charge par chaque agent, avec le nom exact du modèle et le niveau d'effort.
00:04:35Dès que vous validez le plan, il commence à exécuter les compétences.
00:04:37Il transmet ensuite chaque tâche à l'agent désigné pour celle-ci.
00:04:40Une fois que chaque agent a transmis ses conclusions, Hermes vous délivre un rapport collectif et marque la tâche comme terminée.
00:04:46Vous savez peut-être déjà que votre agent Hermes exécute des commandes dans le terminal.
00:04:50Chaque exécution de commande de terminal renvoie une sortie que l'agent doit lire.
00:04:5490 % du temps, vous n'avez même pas besoin de l'intégralité de la sortie générée par cette commande.
00:04:59Seule une partie spécifique vous est utile.
00:05:00Le reste ne fait qu'alourdir le contexte sans raison.
00:05:03Et comme nous l'avons mentionné précédemment, un excédent d'informations dans la fenêtre de contexte nuit à la concentration de l'agent.
00:05:09C'est là qu'intervient RTK.
00:05:10Il élague la sortie des commandes de terminal exécutées par l'agent pour n'en conserver que les éléments nécessaires,
00:05:16filtrant ainsi la sortie avant même qu'elle n'atteigne la fenêtre de contexte.
00:05:20La base de données des commandes de terminal les plus utilisées par les agents lui permet de savoir comment filtrer leur sortie.
00:05:25Par exemple, lors de l'exécution de tests, l'agent n'a besoin de consulter que les résultats des tests en échec, et non ceux réussis.
00:05:31RTK s'en charge par défaut en ne conservant que les échecs.
00:05:35Cependant, il ne s'agit pas réellement d'une compétence.
00:05:37C'est un outil distinct à installer sur votre appareil et à lancer depuis le terminal.
00:05:41Il figure dans cette liste car il garantit que votre agent reçoit uniquement le contexte pertinent.
00:05:45Si vous le souhaitez, vous pouvez aussi l'installer directement et demander à l'agent de l'utiliser.
00:05:49Mais comme les agents ont tendance à oublier nos consignes, nous avons créé une compétence qui indique à l'agent de router les commandes via cet outil plutôt que d'utiliser la méthode habituelle.
00:05:57Cette compétence intègre également les détails requis pour l'agent, ainsi qu'une référence pour chaque commande afin de lui indiquer lesquelles utiliser et comment s'en servir.
00:06:05Vous pouvez ajouter cette compétence à votre configuration Hermes.
00:06:07Une fois fait, vous pourrez confier n'importe quelle tâche à Hermes et il exécutera chaque commande via RTK au lieu de la méthode classique.
00:06:14Seule la sortie utile à l'agent parvient à la fenêtre de contexte, permettant à Hermes de fournir des réponses plus précises.
00:06:20Mais avant de passer à la suite, écoutons un mot de notre sponsor.
00:06:23Plural.
00:06:24L'exploitation d'une infrastructure de production se résume souvent à une seule chose : l'alerte de 3 heures du matin et l'analyse des logs Kubernetes pour trouver l'origine de la panne.
00:06:31Plural résout ce problème grâce aux workbenches.
00:06:34Ce sont des agents IA qui gèrent réellement votre infrastructure pour vous au sein de vos contrôles d'accès existants, garantissant qu'aucune action non autorisée au préalable ne se produise.
00:06:42Voici ce qui nous a convaincus.
00:06:43Nous l'avons intégré à notre observabilité et lorsqu'une alerte s'est déclenchée, l'agent ne s'est pas contenté de nous envoyer un ping.
00:06:48Il a mené sa propre enquête, fouillé dans les logs et les métriques pour revenir avec un diagnostic concret et des prochaines étapes claires.
00:06:54De plus, Workbench se connecte aux outils que vous utilisez déjà, tels que Datadog et Slack, lui permettant de démarrer de manière autonome dès qu'une alerte retentit ou selon un calendrier défini.
00:07:02Au lieu de rédiger des consignes à partir de zéro, vous lui fournissez des compétences prêtes à l'emploi issues de la bibliothèque de Plural.
00:07:07C'est en somme un ingénieur d'astreinte qui ne dort jamais.
00:07:10Essayez Plural via le lien dans la description.
00:07:12La compétence suivante est proposée par Google et s'intitule Mantis.
00:07:15Mantis est un ensemble de compétences d'examen de sécurité que vos agents peuvent exécuter.
00:07:19Il regroupe différentes compétences, chacune se concentrant sur un volet particulier de l'audit de sécurité.
00:07:23Cette configuration fonctionne peu importe l'application que vous développez, qu'il s'agisse d'une application mobile ou web, vous pouvez l'installer et l'utiliser pour vos projets en cours.
00:07:30La commande d'installation est indiquée dans le dépôt GitHub.
00:07:33Lorsque vous l'exécutez, on vous demandera de choisir parmi les nombreuses compétences spécialisées.
00:07:38Il vaut mieux toutes les installer car elles constituent des éléments distincts du processus global.
00:07:42Une fois l'installation terminée, vous verrez la liste de toutes les compétences installées.
00:07:46Par exemple, il existe une compétence nommée Mantis plan qui prépare votre révision de sécurité avant de commencer.
00:07:52Elle contient aussi Mantis reflect, qui analyse les résultats pour s'assurer que les échecs sont bien documentés.
00:07:59On pourrait se demander pourquoi ajouter Mantis si Hermes tourne en continu et qu'on ne code pas directement avec.
00:08:06Mais une fois votre application hébergée, elle a besoin de vérifications régulières, ce qu'on oublie souvent de faire soi-même.
00:08:14C'est ce qui fait d'Hermes l'endroit idéal pour les exécuter.
00:08:16Il gère les tâches cron, c'est-à-dire des scripts qui s'exécutent de façon autonome selon un planning.
00:08:21Vous pouvez en configurer une pour lancer ces vérifications sur votre application hébergée.
00:08:25Et comme Hermes fonctionne en permanence, il peut vous alerter sur Slack ou une autre plateforme en cas de problème.
00:08:31Nous utilisons une configuration similaire pour notre propre projet.
00:08:33Ici, vous voyez qu'on a fourni notre projet à Hermes dans le prompt pour qu'il analyse tout le code.
00:08:39Il détecte et corrige les problèmes en continu, ce qui maintient l'application saine et sans le moindre bug.
00:08:45Si vous avez déjà essayé de faire des recherches avec des agents, vous avez dû faire face à un gros problème.
00:08:49L'accès à certains contenus est refusé à votre agent.
00:08:52Cela se produit parce que de nombreux sites, comme Reddit, refusent que des modèles utilisent leurs données.
00:08:56Ces sites sont pourtant précieux car de vrais utilisateurs y partagent leurs avis et expériences, enrichissant les recherches.
00:09:05Pour donner aux agents accès à ce contenu, il existe une compétence appelée Agent Reach.
00:09:09Elle permet à Hermes d'accéder aux sites habituellement restreints, dont Reddit, GitHub et bien d'autres.
00:09:15Elle utilise des méthodes gratuites, donc cela ne vous coûte rien.
00:09:18C'était aussi le projet le plus populaire sur GitHub récemment.
00:09:21Vous pouvez l'installer dans Hermes pour obtenir un accès à plus de 15 plateformes.
00:09:26Il peut effectuer des recherches sur Instagram, Facebook, Twitter et Reddit.
00:09:29Une fois installé, vous pouvez l'utiliser directement via Hermes pour chercher n'importe quel sujet partout.
00:09:35Il exécute ses propres scripts, trouve les informations pertinentes et vous fournit les réponses nécessaires.
00:09:41Comme vous le savez, Hermes intègre déjà plus de 90 compétences par défaut.
00:09:45De plus, lorsqu'Hermes repère dans votre discussion un flux de travail potentiellement utile à l'avenir,
00:09:50il en fait une compétence qu'il pourra réutiliser lors de ses prochaines sessions.
00:09:54C'est top car il s'adapte automatiquement à vous, mais cela pose un problème.
00:09:58La seule partie d'une compétence qui intègre réellement la fenêtre de contexte est son nom et sa description.
00:10:04Ils sont envoyés avec chacun de vos messages pour que l'agent sache que ces compétences existent.
00:10:08On pourrait se dire que le nom et la description sont courts et n'impactent pas la fenêtre de contexte,
00:10:14mais si vous avez plus de 100 compétences et utilisez Hermes depuis longtemps,
00:10:18tous ces noms et descriptions finissent par consommer une part énorme de la fenêtre de contexte.
00:10:23Pour résoudre ce problème, un ensemble de compétences a été créé pour rendre l'agent plus productif.
00:10:28Mais celle qui nous intéresse le plus est la compétence de récupération de compétences.
00:10:31Elle remplace la liste complète des prompts de compétences par les descriptions les plus pertinentes,
00:10:36ce qui a pour effet de réduire la taille du contexte.
00:10:38En gros, elle exécute une étape supplémentaire avant qu'Hermes n'appelle le modèle.
00:10:42Elle découpe votre message en petits morceaux compréhensibles par un modèle,
00:10:45fait de même pour chaque compétence, puis associe votre message à la liste des compétences.
00:10:50Ce sont celles qui obtiennent les meilleurs scores qui sont envoyées.
00:10:52Leurs documents fournissent des chiffres.
00:10:54Ils indiquent qu'avec la liste complète, cela utilisait environ 11 000 jetons.
00:10:58Après cela, il n'en utilise que 2 300, ce qui permettrait d'économiser plus de 9 000 jetons par échange.
00:11:04Cela vous aide de deux manières.
00:11:05Premièrement, il y a beaucoup moins d'éléments dans la fenêtre de contexte à chaque message,
00:11:09ce qui réduit vos coûts d'utilisation.
00:11:11Et deuxièmement, l'agent n'est pas distrait par des compétences sans rapport avec votre demande,
00:11:16ce qui améliore les réponses obtenues.
00:11:17C'est fourni sous forme de plugin, et Skill Retriever est l'une des compétences incluses.
00:11:21Une fois le plugin installé, vous pouvez activer Skill Retriever depuis la section des plugins.
00:11:25La liste des compétences transmise au contexte sera alors bien plus courte qu'auparavant.
00:11:29La compétence RTK créée dans cette vidéo est disponible sur AI Labs Pro, qui est notre communauté.
00:11:35Si vous appréciez notre travail et souhaitez soutenir la chaîne, c'est le meilleur moyen de le faire.
00:11:39Le lien est dans la description.
00:11:41Ceci nous amène à la fin de cette vidéo.
00:11:43Si vous souhaitez soutenir la chaîne et nous aider à continuer à créer ce genre de contenu,
00:11:46vous pouvez le faire en utilisant le bouton Super Thanks ci-dessous.
00:11:49Comme toujours, merci d'avoir regardé, et à bientôt pour la prochaine.

Key Takeaway

L'installation de compétences et d'outils spécialisés comme Planning with Files, RTK et Skill Retriever résout les limitations de contexte des agents d'intelligence artificielle et réduit l'utilisation à 2 300 jetons par échange.

Highlights

  • La compétence Planning with Files convertit les plans en trois fichiers Markdown distincts et les force dans la fenêtre de contexte via un hook pour empêcher l'agent de s'écarter de la tâche.

  • L'utilisation de la compétence delegate setup permet de coordonner 18 outils de code différents et d'exécuter des agents en mode sans demande d'autorisation pour éviter les interruptions.

  • L'outil RTK élague 90 pour cent des sorties de commandes de terminal inutiles pour ne transmettre que les données pertinentes à la fenêtre de contexte.

  • La compétence Mantis exécute des audits de sécurité automatisés et s'associe à des tâches cron pour analyser et corriger le code en continu sur les applications hébergées.

  • La compétence Agent Reach contourne les restrictions d'accès de plateformes comme Reddit et GitHub pour récupérer gratuitement des données utilisateur issues de plus de 15 sites.

  • La compétence de récupération de compétences réduit la consommation de jetons de 11 000 à 2 300 par échange en ne chargeant que les descriptions de compétences les plus pertinentes.

Timeline

Introduction aux compétences d'agents d'intelligence artificielle

  • Les utilisateurs développent de nouvelles compétences pour améliorer les agents d'intelligence artificielle comme Hermes au-delà de leurs fonctions natives.
  • Les agents de code perdent souvent les détails mentionnés au début des longues conversations en raison de l'excès de messages dans la fenêtre de contexte.

Les compétences créées par la communauté résolvent des problèmes spécifiques qu'un agent ne peut régler seul. L'accumulation de messages dans la fenêtre de contexte surcharge les modèles, notamment le modèle Opus, ce qui détériore la qualité des réponses fournies.

Gestion des plans de travail avec des fichiers et des hooks

  • La compétence Planning with Files crée les fichiers TaskPlan.MD, Findings.MD et Progress.MD dans le dossier du projet.
  • Un hook insère de force ces trois fichiers dans la fenêtre de contexte pour empêcher le modèle d'ignorer le plan initial.

Plutôt que de conserver le plan dans l'historique du chat, cette méthode structure la tâche en sous-tâches, consigne les problèmes rencontrés et trace la progression. Hermes utilise ses capacités de hook pour imposer ces données au modèle et maintenir sa concentration.

Orchestration multi-agent avec delegate setup

  • La compétence delegate setup coordonne plusieurs outils de code installés sur le système, tels que Claude Code, codex et cursor.
  • Les agents s'exécutent en mode sans demande d'autorisation pour enchaîner les commandes sans intervention humaine constante.

L'orchestrateur analyse les outils disponibles et attribue chaque tâche au modèle le plus adapté avec le niveau d'effort requis. Il centralise les conclusions des différents agents pour délivrer un rapport collectif unique.

Filtrage des sorties de terminal avec RTK

  • L'outil RTK filtre 90 pour cent des sorties de commandes de terminal inutiles pour préserver la fenêtre de contexte.
  • Une compétence dédiée configure l'agent pour router systématiquement ses commandes à travers cet outil de filtrage.

Les sorties de terminal brutes alourdissent inutilement le contexte des agents. RTK utilise une base de données des commandes fréquentes pour ne conserver que les données essentielles, comme les résultats de tests en échec.

Audits de sécurité automatisés avec Mantis

  • La compétence Mantis regroupe plusieurs modules d'examen de sécurité pour les applications web et mobiles.
  • L'exécution combinée avec des tâches cron permet à Hermes de surveiller et corriger le code en continu sur les applications en production.

Les vérifications de sécurité régulières sont souvent négligées après le déploiement. L'intégration de Mantis avec les capacités d'exécution autonome d'Hermes permet d'envoyer des alertes sur Slack en cas de détection d'anomalies.

Accès aux sites restreints et optimisation des jetons

  • La compétence Agent Reach permet de contourner les blocages de plateformes comme Reddit et GitHub pour récupérer des données utilisateur.
  • La compétence de récupération de compétences réduit le coût en contexte de 11 000 à 2 300 jetons par échange.

De nombreux sites refusent l'accès aux robots, privant les agents d'informations précieuses issues de communautés réelles. Agent Reach résout ce problème via des méthodes gratuites. De plus, la récupération ciblée de compétences évite d'envoyer l'intégralité des descriptions de compétences à chaque message.

Community Posts

View all posts