Habilidades de Hermes Agent que lo hacen 10 veces más potente
AAI LABS
Computing/SoftwareInternet Technology
Transcript
00:00:00Desde que se lanzó Hermes Agent, la gente ha estado configurando todo tipo de flujos de trabajo en él.
00:00:04Y para mejorar aún más un agente que ya es potente, la gente también ha creado una gran cantidad de habilidades para él.
00:00:10Algunas de ellas incluso se han convertido en los proyectos más populares en GitHub.
00:00:14Ahora podrías preguntarte por qué necesitarías instalar más habilidades para empezar,
00:00:17porque Hermes ya viene con muchas de ellas e incluso puede crear nuevas a partir de tus flujos de trabajo.
00:00:22Pero las habilidades que crea Hermes solo provienen de los procesos que aprende de ti.
00:00:25Estas otras habilidades son creadas por personas que ya han resuelto problemas que Hermes no puede manejar por sí solo,
00:00:31y han empaquetado esas soluciones en habilidades que puedes usar.
00:00:34Ahora, si eres nuevo en el canal, bienvenido; somos una empresa de software y esto es AI Labs.
00:00:38Y en este video vamos a repasar las habilidades que realmente hacen que usar los agentes de Hermes sea mucho mejor.
00:00:43Pero antes de empezar con la primera, necesitas saber esto:
00:00:46aunque estemos usando estas habilidades con Hermes, la mayoría se puede usar con cualquier agente de programación de IA.
00:00:51Ahora bien, si has estado trabajando con agentes de programación, ya sea Hermes o literalmente cualquier otro agente,
00:00:56todos tienen el mismo problema.
00:00:57Si mantienes una conversación larga, tu agente puede olvidar los detalles que mencionaste antes,
00:01:02por lo que tienes que darle la misma instrucción por segunda vez.
00:01:04Y esto pasa más a menudo cuando usas modelos Opus con Hermes,
00:01:08porque tienden a olvidar las cosas más rápidamente.
00:01:10Esto ocurre porque hay demasiados mensajes en tu ventana de contexto,
00:01:14y el modelo tiene que prestar atención a todos ellos.
00:01:16Cuando eso pasa, puede perder de vista los detalles más pequeños y obtienes peores respuestas.
00:01:20Para resolver ese problema, existe una habilidad llamada Planificación con Archivos.
00:01:24Mantiene el plan donde el agente no lo puede ignorar.
00:01:27En lugar de mantener el plan en el chat y ocupar espacio en la ventana de contexto,
00:01:31esta habilidad convierte el plan en tres archivos dentro de la carpeta de tu proyecto.
00:01:34El primero es TaskPlan.MD, que básicamente divide tu tarea principal en tareas más pequeñas
00:01:40para que el agente pueda hacerlas una por una.
00:01:42Luego está Findings.MD, que contiene cada problema que enfrentó el agente y cómo lo resolvió.
00:01:47Si vuelve a ocurrir el mismo problema, el agente puede usar esos aprendizajes para evitarlo.
00:01:51Y el último es Progress.MD, que registra qué tanto ha avanzado el agente.
00:01:56Ahora, podrías pensar que mantener tu plan en archivos no es nuevo,
00:01:59y la mayoría de ustedes tal vez ya lo esté haciendo.
00:02:01Lo que distingue a esta habilidad es que el agente no puede ignorar el plan.
00:02:04Eso es porque utiliza un gancho (hook),
00:02:06el cual inserta a la fuerza los tres archivos en la ventana de contexto,
00:02:09por lo cual el modelo no puede optar por ignorarlo.
00:02:12Ahora bien, la mayoría de los agentes no admiten ganchos, pero Hermes es uno de los pocos que sí.
00:02:16Y según sus propias pruebas, el agente rindió mucho mejor con el gancho en ejecución
00:02:20porque no se desvió de la tarea que se le asignó.
00:02:23Los comandos de instalación para todos los agentes figuran en el repositorio,
00:02:26el cual estará enlazado en la descripción de abajo.
00:02:28Una vez que lo tengas instalado, se agregará junto con todas las demás habilidades.
00:02:32Y los ganchos se instalarán automáticamente en tu agente.
00:02:35El archivo de habilidades explica qué son los tres archivos,
00:02:38dónde deben estar y qué hace cada uno.
00:02:40También incluye todas las reglas que el agente debe seguir,
00:02:43para que sepa con qué está trabajando.
00:02:44Así que una vez que tengas esto instalado,
00:02:46puedes ejecutar la habilidad y darle un mensaje con lo que quieres que haga el agente.
00:02:50Aquí puedes ver que el agente comenzó creando el plan de tareas,
00:02:53los hallazgos y luego los archivos de progreso también.
00:02:56Luego nos hizo preguntas y las respondimos sobre la marcha.
00:02:59Después de esa larga sesión, finalizó el plan y nos dio los tres archivos.
00:03:03Pero antes de pasar a la siguiente habilidad,
00:03:04sería genial si te suscribes al canal y le das al botón de me gusta.
00:03:08Este pequeño gesto de apoyo significa mucho para nosotros.
00:03:11Quizás ya sepas que puedes usar múltiples herramientas de programación con Hermes.
00:03:15Por ejemplo, puedes conectar tu suscripción de Codex al agente Hermes y usar sus modelos.
00:03:19También tal vez sepas que Hermes ya cuenta con una habilidad de Claude Code que envía tareas directamente a este,
00:03:24y tiene el mismo tipo de habilidad para Codex también.
00:03:27Pero el problema con estas habilidades es que Hermes no las usará a menos que se lo pidas.
00:03:31También tienes que indicar en tu mensaje qué tareas deben ir a cada agente.
00:03:35Pero hay otra habilidad que envía una tarea a cualquier agente que ya esté instalado en tu sistema.
00:03:40Y esta habilidad actúa como un orquestador entre todos ellos.
00:03:43También determina cuál de tus herramientas de programación instaladas es la mejor para cada tarea y le asigna el trabajo.
00:03:49Esto es en realidad un conjunto de habilidades.
00:03:51La principal se llama delegate setup, que coordina a los otros agentes.
00:03:54También viene con habilidades de delegación dedicadas para diferentes agentes de programación, incluyendo Claude Code, Codex y Cursor.
00:04:00Estos agentes se ejecutan en un modo en el que no piden permiso antes de ejecutar ningún comando,
00:04:05por lo que el agente de programación no se detiene a esperar que apruebes cada cambio.
00:04:08Para instalar esta habilidad, ejecuta el comando de instalación.
00:04:11Te pide que elijas entre 18 habilidades, para que puedas seleccionar las herramientas instaladas en tu sistema.
00:04:16Una vez instalada, verás que Hermes tiene la habilidad delegate setup lista para usar.
00:04:20Para usarla, solo tienes que ejecutar la habilidad con el comando de barra diagonal, escribir el mensaje y dárselo al agente Hermes.
00:04:26Primero, identifica qué herramientas de programación están instaladas.
00:04:28Luego te da un mapa completo de qué área manejará cada agente, junto con el nombre exacto del modelo y el nivel de esfuerzo.
00:04:35Una vez que apruebas el plan, comienza a ejecutar las habilidades.
00:04:37Luego envía cada tarea al agente elegido para ella.
00:04:40Después de que cada agente informa sus hallazgos, Hermes te da un informe colectivo y marca la tarea como completa.
00:04:46Ahora quizás ya sepas que tu agente Hermes ejecuta comandos de terminal.
00:04:50Cada comando de terminal que se ejecuta devuelve una salida que el agente tiene que leer.
00:04:54El 90% de las veces, ni siquiera necesitas toda la salida que produce ese comando.
00:04:59Solo necesitas una parte específica de ella.
00:05:00El resto solo satura el contexto sin ninguna razón.
00:05:03Y tal como mencionamos antes, tener demasiada información en la ventana de contexto dificulta que el agente se concentre.
00:05:09Aquí es donde entra RTK.
00:05:10Recorta la salida de los comandos de terminal que ejecuta el agente y conserva solo las partes que el agente necesita,
00:05:16por lo que la salida se filtra antes de llegar a la ventana de contexto.
00:05:20La base de datos de los comandos de terminal que los agentes usan más a menudo, para saber cómo filtrar su salida.
00:05:25Por ejemplo, si ejecutas pruebas, el agente solo necesita ver los resultados de las pruebas fallidas y no las que pasaron.
00:05:31RTK hace eso por defecto y conserva solo los fallos.
00:05:35Pero la cuestión es que en realidad no es una habilidad.
00:05:37Es una herramienta independiente que instalas en tu dispositivo y ejecutas desde la terminal.
00:05:41Y está en esta lista porque asegura que tu agente reciba solo el contexto correcto.
00:05:45Si lo deseas, también puedes instalarla directamente y decirle al agente que la use.
00:05:49Pero como los agentes tienden a olvidar lo que pedimos, de hecho creamos una habilidad que le indica al agente que enrute los comandos a través de esta herramienta en lugar de ejecutarlos de la manera habitual.
00:05:57Esta habilidad también contiene los detalles que el agente necesita, junto con una referencia para cada comando para que sepa qué comandos puede usar y cómo usarlos.
00:06:05Puedes agregar esta habilidad a tu configuración de Hermes.
00:06:07Una vez que hayas hecho eso, puedes darle a Hermes cualquier tarea y ejecutará cada comando a través de RTK en lugar de usar el método habitual.
00:06:14Solo la salida que el agente necesita llega a la ventana de contexto, por lo que Hermes puede darte respuestas más precisas.
00:06:20Pero antes de pasar a lo siguiente, escuchemos una palabra de nuestro patrocinador.
00:06:23Plural.
00:06:24Ejecutar infraestructura de producción generalmente se reduce a una cosa: la alerta de las 3 a. m. y rebuscar en los registros de Kubernetes para encontrar qué se rompió.
00:06:31Plural soluciona eso con los entonos de trabajo (workbenches).
00:06:34Son agentes de IA que operan tu infraestructura por ti y se ejecutan dentro de tus controles de acceso existentes, por lo que no ocurre nada que no hayas autorizado previamente.
00:06:42Esto es lo que nos convenció.
00:06:43Lo conectamos a nuestra observabilidad y, cuando se disparó una alerta, el agente no se limitó a avisarnos.
00:06:48Investigó por su cuenta, rebuscó en los registros y métricas, y regresó con un diagnóstico real y próximos pasos claros.
00:06:54Y Workbench se conecta a las herramientas que ya usas, como Datadog y Slack, por lo que puede iniciarse solo en el momento en que se dispara una alerta o en un horario que programes.
00:07:02Y en lugar de escribir mensajes desde cero, les entregas habilidades prehechas de la biblioteca de Plural.
00:07:07Básicamente es un ingeniero de guardia que nunca duerme.
00:07:10Prueba Plural en el enlace de la descripción.
00:07:12Ahora la siguiente habilidad es de Google y se llama Mantis.
00:07:15Mantis es un conjunto de habilidades de revisión de seguridad que tus agentes pueden ejecutar.
00:07:19Contiene una variedad de habilidades, cada una centrada en un área diferente de revisión de seguridad.
00:07:23Esta configuración funciona sin importar qué aplicación estés construyendo, ya sea móvil o web, puedes instalarla y usarla para lo que estés trabajando.
00:07:30El comando de instalación aparece en el repositorio de GitHub.
00:07:33Cuando ejecutes el comando de instalación, se te pedirá que elijas entre las muchas habilidades especializadas que tiene.
00:07:38Es mejor instalarlas todas porque son piezas separadas de todo el proceso de revisión.
00:07:42Una vez que lo hayas instalado en tu configuración, verás todas las listas instaladas.
00:07:46Por ejemplo, hay una habilidad llamada plan Mantis y planifica tu proceso de revisión de seguridad antes de empezar.
00:07:52También contiene una habilidad llamada reflejo Mantis que repasa todos los hallazgos y asegura que los fallos se documenten bien.
00:07:59Ahora podrías pensar que si Hermes es un agente activo siempre y no solemos programar con él, ¿para qué necesitamos añadir Mantis?
00:08:06Pero la razón es que una vez que tu aplicación está alojada, necesita revisiones de seguridad una y otra vez y eso no querrás recordarlo tú.
00:08:14Y eso es lo que hace que Hermes sea el mejor lugar para ejecutarlas.
00:08:16Tiene trabajos cron, que son básicamente tareas que se ejecutan por sí solas según un horario.
00:08:21Puedes configurar uno que ejecute este conjunto de revisión contra la aplicación que has alojado.
00:08:25Y debido a que Hermes funciona todo el tiempo, puede avisarte en Slack o cualquier otra plataforma conectada si encuentra un problema.
00:08:31También tenemos una configuración similar para nuestro propio proyecto.
00:08:33Aquí puedes ver que le dimos a Hermes nuestro proyecto en el aviso y le dijimos que ejecutara el conjunto completo sobre el código.
00:08:39Sigue encontrando problemas y aplicando arreglos, lo que mantiene la aplicación sana para nosotros y asegura que no tenga errores.
00:08:45Si alguna vez has intentado investigar con agentes, es posible que te hayas topado con un gran problema.
00:08:49A tu agente se le deniega el acceso a cierto contenido.
00:08:52Esto pasa porque muchos sitios como Reddit no quieren que los modelos usen su contenido.
00:08:56Pero esos sitios son muy valiosos ya que tienen usuarios reales hablando de problemas y sus opiniones y experiencias, lo que hace útil la información para investigar.
00:09:05Para dar a los agentes acceso a ese contenido, hay una habilidad llamada Agent Reach.
00:09:09Le da a Hermes acceso a los sitios que suelen estar restringidos, incluidos Reddit, GitHub y muchos otros.
00:09:15Usa métodos gratuitos, por lo que no te cuesta nada.
00:09:18También fue el proyecto número uno en tendencia en GitHub hace poco.
00:09:21Ahora puedes instalar esto en tu configuración de Hermes y te dará acceso a más de 15 plataformas.
00:09:26Puede buscar en Instagram, Facebook, Twitter y Reddit.
00:09:29Una vez que lo tengas instalado, puedes usarlo directamente desde Hermes y pedirle que busque cualquier tema en cualquier plataforma.
00:09:35Ejecuta sus propios scripts, encuentra la información relevante y luego te da las respuestas que necesitas.
00:09:41Ahora, como ya sabes, Hermes viene con más de 90 habilidades integradas.
00:09:45Y aparte de eso, cuando Hermes ve un flujo de trabajo en tu chat que podría ser útil en el futuro,
00:09:50en realidad crea una habilidad a partir de él y luego puede usar esa habilidad en futuras ejecuciones.
00:09:54Suena bien porque se adapta a ti automáticamente, pero hay un problema con esto.
00:09:58La única parte de una habilidad que realmente entra en la ventana de contexto es su nombre y descripción.
00:10:04Se envían con cada uno de tus mensajes para que el agente sepa que estas habilidades existen.
00:10:08Ahora, podrías decir que el nombre y la descripción forman un pequeño fragmento y no afectarían la ventana de contexto en absoluto,
00:10:14pero si tienes más de 100 habilidades y has estado usando Hermes durante mucho tiempo,
00:10:18todos esos nombres y descripciones empiezan a consumir una gran porción de la ventana de contexto.
00:10:23Así que, para resolver este problema, hay todo un conjunto de habilidades creado para hacer que el agente sea más productivo.
00:10:28Pero en la que más nos interesa es la habilidad de recuperación de habilidades.
00:10:31Reemplaza la lista completa de avisos de habilidades con solo las descripciones de habilidades más relevantes,
00:10:36lo que hace que el tamaño del contexto disminuya.
00:10:38Así que, básicamente, ejecuta otro paso antes de que Hermes llame al modelo.
00:10:42Divide tu mensaje en pequeños fragmentos que un modelo pueda entender,
00:10:45hace lo mismo con cada habilidad que tienes, y luego hace coincidir tu mensaje con la lista de habilidades.
00:10:50Las habilidades que obtienen la puntuación más alta son las que envía.
00:10:52Sus documentos ponen números en ello.
00:10:54Dicen que con toda la lista entrando, usaba alrededor de 11,000 tokens.
00:10:58Después de esto, usa solo 2.3 mil, por lo que afirman que ahorra más de 9,000 tokens en cada turno.
00:11:04Ahora, esto te ayuda de dos maneras.
00:11:05Primero, hay mucho menos entrando en la ventana de contexto con cada mensaje que envías,
00:11:09por lo que te cuesta menos ejecutarlo.
00:11:11Y segundo, el agente no se distrae con habilidades que no tienen nada que ver con lo que pediste,
00:11:16por lo que obtienes mejores respuestas.
00:11:17Esto viene como un complemento, y Skill Retriever es una de las habilidades dentro de él.
00:11:21Una vez que hayas instalado el complemento, puedes habilitar Skill Retriever desde el área de complementos.
00:11:25Entonces la lista de habilidades que entra en el contexto será mucho más corta que antes.
00:11:29Ahora, la habilidad RTK que creamos en este video se puede encontrar en AI Labs Pro, que es nuestra comunidad.
00:11:35Así que si encontraste valor en lo que hacemos y quieres apoyar el canal, esta es la mejor forma de hacerlo.
00:11:39El enlace está en la descripción.
00:11:41Eso nos lleva al final de este video.
00:11:43Si te gustaría apoyar el canal y ayudarnos a seguir haciendo videos como este,
00:11:46puedes hacerlo usando el botón de Súper Gracias abajo.
00:11:49Como siempre, gracias por ver y nos vemos en el próximo.