Habilidades de Hermes Agent que lo hacen 10 veces más potente

AAI LABS
Computing/SoftwareInternet Technology

Transcript

00:00:00Desde que se lanzó Hermes Agent, la gente ha estado configurando todo tipo de flujos de trabajo en él.
00:00:04Y para mejorar aún más un agente que ya es potente, la gente también ha creado una gran cantidad de habilidades para él.
00:00:10Algunas de ellas incluso se han convertido en los proyectos más populares en GitHub.
00:00:14Ahora podrías preguntarte por qué necesitarías instalar más habilidades para empezar,
00:00:17porque Hermes ya viene con muchas de ellas e incluso puede crear nuevas a partir de tus flujos de trabajo.
00:00:22Pero las habilidades que crea Hermes solo provienen de los procesos que aprende de ti.
00:00:25Estas otras habilidades son creadas por personas que ya han resuelto problemas que Hermes no puede manejar por sí solo,
00:00:31y han empaquetado esas soluciones en habilidades que puedes usar.
00:00:34Ahora, si eres nuevo en el canal, bienvenido; somos una empresa de software y esto es AI Labs.
00:00:38Y en este video vamos a repasar las habilidades que realmente hacen que usar los agentes de Hermes sea mucho mejor.
00:00:43Pero antes de empezar con la primera, necesitas saber esto:
00:00:46aunque estemos usando estas habilidades con Hermes, la mayoría se puede usar con cualquier agente de programación de IA.
00:00:51Ahora bien, si has estado trabajando con agentes de programación, ya sea Hermes o literalmente cualquier otro agente,
00:00:56todos tienen el mismo problema.
00:00:57Si mantienes una conversación larga, tu agente puede olvidar los detalles que mencionaste antes,
00:01:02por lo que tienes que darle la misma instrucción por segunda vez.
00:01:04Y esto pasa más a menudo cuando usas modelos Opus con Hermes,
00:01:08porque tienden a olvidar las cosas más rápidamente.
00:01:10Esto ocurre porque hay demasiados mensajes en tu ventana de contexto,
00:01:14y el modelo tiene que prestar atención a todos ellos.
00:01:16Cuando eso pasa, puede perder de vista los detalles más pequeños y obtienes peores respuestas.
00:01:20Para resolver ese problema, existe una habilidad llamada Planificación con Archivos.
00:01:24Mantiene el plan donde el agente no lo puede ignorar.
00:01:27En lugar de mantener el plan en el chat y ocupar espacio en la ventana de contexto,
00:01:31esta habilidad convierte el plan en tres archivos dentro de la carpeta de tu proyecto.
00:01:34El primero es TaskPlan.MD, que básicamente divide tu tarea principal en tareas más pequeñas
00:01:40para que el agente pueda hacerlas una por una.
00:01:42Luego está Findings.MD, que contiene cada problema que enfrentó el agente y cómo lo resolvió.
00:01:47Si vuelve a ocurrir el mismo problema, el agente puede usar esos aprendizajes para evitarlo.
00:01:51Y el último es Progress.MD, que registra qué tanto ha avanzado el agente.
00:01:56Ahora, podrías pensar que mantener tu plan en archivos no es nuevo,
00:01:59y la mayoría de ustedes tal vez ya lo esté haciendo.
00:02:01Lo que distingue a esta habilidad es que el agente no puede ignorar el plan.
00:02:04Eso es porque utiliza un gancho (hook),
00:02:06el cual inserta a la fuerza los tres archivos en la ventana de contexto,
00:02:09por lo cual el modelo no puede optar por ignorarlo.
00:02:12Ahora bien, la mayoría de los agentes no admiten ganchos, pero Hermes es uno de los pocos que sí.
00:02:16Y según sus propias pruebas, el agente rindió mucho mejor con el gancho en ejecución
00:02:20porque no se desvió de la tarea que se le asignó.
00:02:23Los comandos de instalación para todos los agentes figuran en el repositorio,
00:02:26el cual estará enlazado en la descripción de abajo.
00:02:28Una vez que lo tengas instalado, se agregará junto con todas las demás habilidades.
00:02:32Y los ganchos se instalarán automáticamente en tu agente.
00:02:35El archivo de habilidades explica qué son los tres archivos,
00:02:38dónde deben estar y qué hace cada uno.
00:02:40También incluye todas las reglas que el agente debe seguir,
00:02:43para que sepa con qué está trabajando.
00:02:44Así que una vez que tengas esto instalado,
00:02:46puedes ejecutar la habilidad y darle un mensaje con lo que quieres que haga el agente.
00:02:50Aquí puedes ver que el agente comenzó creando el plan de tareas,
00:02:53los hallazgos y luego los archivos de progreso también.
00:02:56Luego nos hizo preguntas y las respondimos sobre la marcha.
00:02:59Después de esa larga sesión, finalizó el plan y nos dio los tres archivos.
00:03:03Pero antes de pasar a la siguiente habilidad,
00:03:04sería genial si te suscribes al canal y le das al botón de me gusta.
00:03:08Este pequeño gesto de apoyo significa mucho para nosotros.
00:03:11Quizás ya sepas que puedes usar múltiples herramientas de programación con Hermes.
00:03:15Por ejemplo, puedes conectar tu suscripción de Codex al agente Hermes y usar sus modelos.
00:03:19También tal vez sepas que Hermes ya cuenta con una habilidad de Claude Code que envía tareas directamente a este,
00:03:24y tiene el mismo tipo de habilidad para Codex también.
00:03:27Pero el problema con estas habilidades es que Hermes no las usará a menos que se lo pidas.
00:03:31También tienes que indicar en tu mensaje qué tareas deben ir a cada agente.
00:03:35Pero hay otra habilidad que envía una tarea a cualquier agente que ya esté instalado en tu sistema.
00:03:40Y esta habilidad actúa como un orquestador entre todos ellos.
00:03:43También determina cuál de tus herramientas de programación instaladas es la mejor para cada tarea y le asigna el trabajo.
00:03:49Esto es en realidad un conjunto de habilidades.
00:03:51La principal se llama delegate setup, que coordina a los otros agentes.
00:03:54También viene con habilidades de delegación dedicadas para diferentes agentes de programación, incluyendo Claude Code, Codex y Cursor.
00:04:00Estos agentes se ejecutan en un modo en el que no piden permiso antes de ejecutar ningún comando,
00:04:05por lo que el agente de programación no se detiene a esperar que apruebes cada cambio.
00:04:08Para instalar esta habilidad, ejecuta el comando de instalación.
00:04:11Te pide que elijas entre 18 habilidades, para que puedas seleccionar las herramientas instaladas en tu sistema.
00:04:16Una vez instalada, verás que Hermes tiene la habilidad delegate setup lista para usar.
00:04:20Para usarla, solo tienes que ejecutar la habilidad con el comando de barra diagonal, escribir el mensaje y dárselo al agente Hermes.
00:04:26Primero, identifica qué herramientas de programación están instaladas.
00:04:28Luego te da un mapa completo de qué área manejará cada agente, junto con el nombre exacto del modelo y el nivel de esfuerzo.
00:04:35Una vez que apruebas el plan, comienza a ejecutar las habilidades.
00:04:37Luego envía cada tarea al agente elegido para ella.
00:04:40Después de que cada agente informa sus hallazgos, Hermes te da un informe colectivo y marca la tarea como completa.
00:04:46Ahora quizás ya sepas que tu agente Hermes ejecuta comandos de terminal.
00:04:50Cada comando de terminal que se ejecuta devuelve una salida que el agente tiene que leer.
00:04:54El 90% de las veces, ni siquiera necesitas toda la salida que produce ese comando.
00:04:59Solo necesitas una parte específica de ella.
00:05:00El resto solo satura el contexto sin ninguna razón.
00:05:03Y tal como mencionamos antes, tener demasiada información en la ventana de contexto dificulta que el agente se concentre.
00:05:09Aquí es donde entra RTK.
00:05:10Recorta la salida de los comandos de terminal que ejecuta el agente y conserva solo las partes que el agente necesita,
00:05:16por lo que la salida se filtra antes de llegar a la ventana de contexto.
00:05:20La base de datos de los comandos de terminal que los agentes usan más a menudo, para saber cómo filtrar su salida.
00:05:25Por ejemplo, si ejecutas pruebas, el agente solo necesita ver los resultados de las pruebas fallidas y no las que pasaron.
00:05:31RTK hace eso por defecto y conserva solo los fallos.
00:05:35Pero la cuestión es que en realidad no es una habilidad.
00:05:37Es una herramienta independiente que instalas en tu dispositivo y ejecutas desde la terminal.
00:05:41Y está en esta lista porque asegura que tu agente reciba solo el contexto correcto.
00:05:45Si lo deseas, también puedes instalarla directamente y decirle al agente que la use.
00:05:49Pero como los agentes tienden a olvidar lo que pedimos, de hecho creamos una habilidad que le indica al agente que enrute los comandos a través de esta herramienta en lugar de ejecutarlos de la manera habitual.
00:05:57Esta habilidad también contiene los detalles que el agente necesita, junto con una referencia para cada comando para que sepa qué comandos puede usar y cómo usarlos.
00:06:05Puedes agregar esta habilidad a tu configuración de Hermes.
00:06:07Una vez que hayas hecho eso, puedes darle a Hermes cualquier tarea y ejecutará cada comando a través de RTK en lugar de usar el método habitual.
00:06:14Solo la salida que el agente necesita llega a la ventana de contexto, por lo que Hermes puede darte respuestas más precisas.
00:06:20Pero antes de pasar a lo siguiente, escuchemos una palabra de nuestro patrocinador.
00:06:23Plural.
00:06:24Ejecutar infraestructura de producción generalmente se reduce a una cosa: la alerta de las 3 a. m. y rebuscar en los registros de Kubernetes para encontrar qué se rompió.
00:06:31Plural soluciona eso con los entonos de trabajo (workbenches).
00:06:34Son agentes de IA que operan tu infraestructura por ti y se ejecutan dentro de tus controles de acceso existentes, por lo que no ocurre nada que no hayas autorizado previamente.
00:06:42Esto es lo que nos convenció.
00:06:43Lo conectamos a nuestra observabilidad y, cuando se disparó una alerta, el agente no se limitó a avisarnos.
00:06:48Investigó por su cuenta, rebuscó en los registros y métricas, y regresó con un diagnóstico real y próximos pasos claros.
00:06:54Y Workbench se conecta a las herramientas que ya usas, como Datadog y Slack, por lo que puede iniciarse solo en el momento en que se dispara una alerta o en un horario que programes.
00:07:02Y en lugar de escribir mensajes desde cero, les entregas habilidades prehechas de la biblioteca de Plural.
00:07:07Básicamente es un ingeniero de guardia que nunca duerme.
00:07:10Prueba Plural en el enlace de la descripción.
00:07:12Ahora la siguiente habilidad es de Google y se llama Mantis.
00:07:15Mantis es un conjunto de habilidades de revisión de seguridad que tus agentes pueden ejecutar.
00:07:19Contiene una variedad de habilidades, cada una centrada en un área diferente de revisión de seguridad.
00:07:23Esta configuración funciona sin importar qué aplicación estés construyendo, ya sea móvil o web, puedes instalarla y usarla para lo que estés trabajando.
00:07:30El comando de instalación aparece en el repositorio de GitHub.
00:07:33Cuando ejecutes el comando de instalación, se te pedirá que elijas entre las muchas habilidades especializadas que tiene.
00:07:38Es mejor instalarlas todas porque son piezas separadas de todo el proceso de revisión.
00:07:42Una vez que lo hayas instalado en tu configuración, verás todas las listas instaladas.
00:07:46Por ejemplo, hay una habilidad llamada plan Mantis y planifica tu proceso de revisión de seguridad antes de empezar.
00:07:52También contiene una habilidad llamada reflejo Mantis que repasa todos los hallazgos y asegura que los fallos se documenten bien.
00:07:59Ahora podrías pensar que si Hermes es un agente activo siempre y no solemos programar con él, ¿para qué necesitamos añadir Mantis?
00:08:06Pero la razón es que una vez que tu aplicación está alojada, necesita revisiones de seguridad una y otra vez y eso no querrás recordarlo tú.
00:08:14Y eso es lo que hace que Hermes sea el mejor lugar para ejecutarlas.
00:08:16Tiene trabajos cron, que son básicamente tareas que se ejecutan por sí solas según un horario.
00:08:21Puedes configurar uno que ejecute este conjunto de revisión contra la aplicación que has alojado.
00:08:25Y debido a que Hermes funciona todo el tiempo, puede avisarte en Slack o cualquier otra plataforma conectada si encuentra un problema.
00:08:31También tenemos una configuración similar para nuestro propio proyecto.
00:08:33Aquí puedes ver que le dimos a Hermes nuestro proyecto en el aviso y le dijimos que ejecutara el conjunto completo sobre el código.
00:08:39Sigue encontrando problemas y aplicando arreglos, lo que mantiene la aplicación sana para nosotros y asegura que no tenga errores.
00:08:45Si alguna vez has intentado investigar con agentes, es posible que te hayas topado con un gran problema.
00:08:49A tu agente se le deniega el acceso a cierto contenido.
00:08:52Esto pasa porque muchos sitios como Reddit no quieren que los modelos usen su contenido.
00:08:56Pero esos sitios son muy valiosos ya que tienen usuarios reales hablando de problemas y sus opiniones y experiencias, lo que hace útil la información para investigar.
00:09:05Para dar a los agentes acceso a ese contenido, hay una habilidad llamada Agent Reach.
00:09:09Le da a Hermes acceso a los sitios que suelen estar restringidos, incluidos Reddit, GitHub y muchos otros.
00:09:15Usa métodos gratuitos, por lo que no te cuesta nada.
00:09:18También fue el proyecto número uno en tendencia en GitHub hace poco.
00:09:21Ahora puedes instalar esto en tu configuración de Hermes y te dará acceso a más de 15 plataformas.
00:09:26Puede buscar en Instagram, Facebook, Twitter y Reddit.
00:09:29Una vez que lo tengas instalado, puedes usarlo directamente desde Hermes y pedirle que busque cualquier tema en cualquier plataforma.
00:09:35Ejecuta sus propios scripts, encuentra la información relevante y luego te da las respuestas que necesitas.
00:09:41Ahora, como ya sabes, Hermes viene con más de 90 habilidades integradas.
00:09:45Y aparte de eso, cuando Hermes ve un flujo de trabajo en tu chat que podría ser útil en el futuro,
00:09:50en realidad crea una habilidad a partir de él y luego puede usar esa habilidad en futuras ejecuciones.
00:09:54Suena bien porque se adapta a ti automáticamente, pero hay un problema con esto.
00:09:58La única parte de una habilidad que realmente entra en la ventana de contexto es su nombre y descripción.
00:10:04Se envían con cada uno de tus mensajes para que el agente sepa que estas habilidades existen.
00:10:08Ahora, podrías decir que el nombre y la descripción forman un pequeño fragmento y no afectarían la ventana de contexto en absoluto,
00:10:14pero si tienes más de 100 habilidades y has estado usando Hermes durante mucho tiempo,
00:10:18todos esos nombres y descripciones empiezan a consumir una gran porción de la ventana de contexto.
00:10:23Así que, para resolver este problema, hay todo un conjunto de habilidades creado para hacer que el agente sea más productivo.
00:10:28Pero en la que más nos interesa es la habilidad de recuperación de habilidades.
00:10:31Reemplaza la lista completa de avisos de habilidades con solo las descripciones de habilidades más relevantes,
00:10:36lo que hace que el tamaño del contexto disminuya.
00:10:38Así que, básicamente, ejecuta otro paso antes de que Hermes llame al modelo.
00:10:42Divide tu mensaje en pequeños fragmentos que un modelo pueda entender,
00:10:45hace lo mismo con cada habilidad que tienes, y luego hace coincidir tu mensaje con la lista de habilidades.
00:10:50Las habilidades que obtienen la puntuación más alta son las que envía.
00:10:52Sus documentos ponen números en ello.
00:10:54Dicen que con toda la lista entrando, usaba alrededor de 11,000 tokens.
00:10:58Después de esto, usa solo 2.3 mil, por lo que afirman que ahorra más de 9,000 tokens en cada turno.
00:11:04Ahora, esto te ayuda de dos maneras.
00:11:05Primero, hay mucho menos entrando en la ventana de contexto con cada mensaje que envías,
00:11:09por lo que te cuesta menos ejecutarlo.
00:11:11Y segundo, el agente no se distrae con habilidades que no tienen nada que ver con lo que pediste,
00:11:16por lo que obtienes mejores respuestas.
00:11:17Esto viene como un complemento, y Skill Retriever es una de las habilidades dentro de él.
00:11:21Una vez que hayas instalado el complemento, puedes habilitar Skill Retriever desde el área de complementos.
00:11:25Entonces la lista de habilidades que entra en el contexto será mucho más corta que antes.
00:11:29Ahora, la habilidad RTK que creamos en este video se puede encontrar en AI Labs Pro, que es nuestra comunidad.
00:11:35Así que si encontraste valor en lo que hacemos y quieres apoyar el canal, esta es la mejor forma de hacerlo.
00:11:39El enlace está en la descripción.
00:11:41Eso nos lleva al final de este video.
00:11:43Si te gustaría apoyar el canal y ayudarnos a seguir haciendo videos como este,
00:11:46puedes hacerlo usando el botón de Súper Gracias abajo.
00:11:49Como siempre, gracias por ver y nos vemos en el próximo.

Key Takeaway

La instalación de habilidades especializadas como Planificación con Archivos, RTK y Skill Retriever optimiza la ventana de contexto de Hermes Agent y mejora su rendimiento en tareas de programación complejas.

Highlights

  • La habilidad Planificación con Archivos divide la tarea en TaskPlan.MD, Findings.MD y Progress.MD, forzando al modelo a mantener el plan en el contexto mediante ganchos.

  • El conjunto de habilidades delegate setup coordina herramientas de programación instaladas como Claude Code, Codex y Cursor en modo de ejecución sin permisos previos.

  • La herramienta RTK filtra la salida de los comandos de terminal y conserva únicamente los fallos de las pruebas para evitar saturar la ventana de contexto.

  • Mantis ejecuta revisiones de seguridad automatizadas mediante trabajos cron recurrentes en Hermes para detectar vulnerabilidades en aplicaciones alojadas.

  • Agent Reach otorga al agente acceso gratuito a plataformas restringidas como Reddit, GitHub e Instagram para realizar investigaciones con datos de usuarios reales.

  • La habilidad Skill Retriever reduce el consumo de tokens de 11,000 a 2,300 por turno al seleccionar únicamente las descripciones de habilidades más relevantes.

Timeline

Planificación con archivos para evitar el olvido en contextos largos

  • Las conversaciones largas provocan que los modelos olviden detalles previos debido a la saturación de la ventana de contexto.
  • La habilidad Planificación con Archivos almacena la información en tres archivos dentro del proyecto.
  • Un gancho (hook) inserta a la fuerza los archivos en el contexto para impedir que el agente ignore el plan.

Los modelos como Opus olvidan información rápidamente en sesiones extensas debido al exceso de mensajes. Para solucionar este problema, esta habilidad genera los archivos TaskPlan.MD para dividir tareas, Findings.MD para registrar problemas y soluciones, y Progress.MD para medir avances. Hermes utiliza ganchos para forzar la lectura constante de estos archivos.

Orquestación de múltiples agentes de programación

  • El conjunto de habilidades delegate setup coordina diferentes herramientas instaladas en el sistema.
  • Los agentes delegados operan en un modo que ejecuta comandos de manera automática sin solicitar aprobación constante.

Hermes puede actuar como un orquestador que distribuye subtareas entre herramientas como Claude Code, Codex y Cursor según su idoneidad. El sistema selecciona el modelo adecuado y asigna el nivel de esfuerzo necesario antes de recopilar los hallazgos de cada agente.

Filtrado de salidas de terminal con RTK

  • El noventa por ciento de la salida producida por los comandos de terminal satura innecesariamente el contexto del agente.
  • La herramienta RTK procesa la salida de la terminal y conserva únicamente los datos esenciales para el modelo.

La ejecución de comandos de terminal genera exceso de texto que distrae al agente. RTK actúa como una herramienta independiente conectada mediante una habilidad específica para filtrar resultados, enviando únicamente los errores de las pruebas y descartando la información redundante.

Revisiones de seguridad automatizadas con Mantis

  • Mantis ofrece un conjunto de habilidades especializadas en revisiones de seguridad para aplicaciones móviles y web.
  • Los trabajos cron de Hermes ejecutan estas revisiones de manera automática de forma periódica.

Las aplicaciones alojadas requieren auditorías de seguridad recurrentes. Mantis planifica y ejecuta revisiones exhaustivas utilizando las capacidades de ejecución continua de Hermes para notificar problemas en plataformas como Slack en cuanto se detectan.

Acceso a contenido restringido mediante Agent Reach

  • Plataformas como Reddit bloquean el acceso automatizado de modelos de inteligencia artificial.
  • Agent Reach permite buscar e indexar información en más de 15 plataformas utilizando métodos gratuitos.

La investigación técnica se ve limitada cuando los sitios web niegan el acceso al contenido. Agent Reach utiliza scripts propios para consultar experiencias de usuarios reales en Reddit, GitHub y redes sociales sin costos adicionales para el desarrollador.

Optimización del consumo de tokens con Skill Retriever

  • El almacenamiento masivo de nombres y descripciones de habilidades consume gran parte de la ventana de contexto.
  • Skill Retriever reduce el consumo de 11,000 a 2,300 tokens por turno.

A medida que el agente acumula habilidades, el listado de descripciones satura el contexto y distrae al modelo. Skill Retriever analiza el mensaje del usuario y selecciona exclusivamente las habilidades pertinentes para cada interacción específica.

Community Posts

View all posts