Habilidades do Hermes Agent que o tornam 10x mais poderoso
AAI LABS
Computing/SoftwareInternet Technology
Transcript
00:00:00Desde que o Hermes Agent foi lançado, as pessoas têm configurado todo tipo de fluxo de trabalho nele.
00:00:04E para tornar um agente que já é poderoso ainda melhor, as pessoas também criaram muitas habilidades para ele.
00:00:10Alguns deles até se tornaram os projetos mais populares no GitHub.
00:00:14Agora você deve se perguntar por que precisaria instalar mais habilidades para começar,
00:00:17já que o Hermes já vem com várias e ele mesmo pode criar novas a partir dos seus fluxos de trabalho.
00:00:22Mas as habilidades que o Hermes cria vêm apenas dos processos que ele aprende com você.
00:00:25Essas outras habilidades são construídas por pessoas que já resolveram problemas que o Hermes não consegue lidar sozinho,
00:00:31e elas empacotaram essas soluções em habilidades que você pode usar.
00:00:34Agora, se você é novo no canal, seja bem-vindo, somos uma empresa de software e este é o AI Labs.
00:00:38E neste vídeo vamos ver as habilidades que realmente tornam o uso dos agentes Hermes muito melhor.
00:00:43Mas antes de começarmos com a primeira, você precisa saber disto:
00:00:46embora estejamos usando essas habilidades com o Hermes, a maioria delas pode ser usada com qualquer agente de programação de IA.
00:00:51Agora, se você tem trabalhado com agentes de programação, seja o Hermes ou literalmente qualquer outro agente,
00:00:56todos eles têm o mesmo problema.
00:00:57Se você estiver tendo uma longa conversa, seu agente pode esquecer os detalhes que você mencionou antes,
00:01:02então você precisa dar a mesma instrução uma segunda vez.
00:01:04E isso acontece com mais frequência quando você usa modelos Opus com o Hermes,
00:01:08porque eles tendem a esquecer as coisas mais rapidamente.
00:01:10Isso acontece porque há muitas mensagens na sua janela de contexto,
00:01:14e o modelo tem que prestar atenção em todas elas.
00:01:16Quando isso acontece, ele pode perder o controle dos detalhes menores e você obtém respostas piores.
00:01:20Para resolver esse problema, existe uma habilidade chamada Planejamento com Arquivos.
00:01:24Ela mantém o plano onde o agente não pode ignorá-lo.
00:01:27Em vez de manter o plano no chat e ocupar espaço na janela de contexto,
00:01:31essa habilidade converte o plano em três arquivos na pasta do seu projeto.
00:01:34O primeiro é o TaskPlan.MD, que basicamente divide sua tarefa principal em tarefas menores
00:01:40para que o agente possa fazê-las uma de cada vez.
00:01:42Depois há o Findings.MD, que guarda todos os problemas que o agente enfrentou e como ele os resolveu.
00:01:47Se o mesmo problema acontecer novamente, o agente pode usar esses aprendizados para evitá-lo.
00:01:51E o último é o Progress.MD, que registra até onde o agente chegou.
00:01:56Agora, você pode pensar que manter seu plano em arquivos não é novidade,
00:01:59e a maioria de vocês já deve estar fazendo isso.
00:02:01O que diferencia essa habilidade é que o agente não pode ignorar o plano.
00:02:04Isso porque ele usa um gancho (hook),
00:02:06que insere à força os três arquivos na janela de contexto,
00:02:09e é por isso que o modelo não pode optar por ignorá-lo.
00:02:12Agora, a maioria dos agentes não oferece suporte a ganchos, mas o Hermes é um dos poucos que suporta.
00:02:16E de acordo com os testes deles próprios, o agente teve um desempenho muito melhor com o gancho rodando
00:02:20porque ele não se desviava da tarefa que lhe foi atribuída.
00:02:23Os comandos de instalação para todos os agentes estão listados no repositório,
00:02:26que estará listado na descrição abaixo.
00:02:28Assim que você o instalar, ele será adicionado junto com todas as outras habilidades.
00:02:32E os ganchos serão instalados automaticamente no seu agente.
00:02:35O arquivo de habilidade explica quais são os três arquivos,
00:02:38onde eles devem estar e o que cada um faz.
00:02:40Ele também inclui todas as regras que o agente precisa seguir,
00:02:43para que saiba com o que está trabalhando.
00:02:44Então, assim que você tiver isso instalado,
00:02:46você pode executar a habilidade e dar a ela um comando sobre o que deseja que o agente faça.
00:02:50Aqui você pode ver que o agente começou criando o plano de tarefas,
00:02:53as descobertas e também os arquivos de progresso.
00:02:56Depois, ele nos fez perguntas, e nós as respondemos conforme avançávamos.
00:02:59Após essa longa sessão, ele finalizou o plano e nos entregou os três arquivos.
00:03:03Mas antes de passarmos para a próxima habilidade,
00:03:04seria ótimo se você se inscrevesse no canal e apertasse o botão de curtir.
00:03:08Esse pequeno gesto de apoio nos ajuda muito.
00:03:11Você talvez já saiba que pode usar várias ferramentas de programação com o Hermes.
00:03:15Por exemplo, você pode conectar sua assinatura do codex ao agente Hermes e usar os modelos dele.
00:03:19Você também pode saber que o Hermes já tem uma habilidade de claude code que envia tarefas diretamente para ele,
00:03:24e ele tem o mesmo tipo de habilidade para o codex também.
00:03:27Mas o problema com essas habilidades é que o Hermes não as usará a menos que você peça.
00:03:31Você também precisa dizer qual tarefa deve ir para cada agente no seu comando.
00:03:35Mas há outra habilidade que envia uma tarefa para qualquer agente que já esteja instalado no seu sistema.
00:03:40E essa habilidade atua como um orquestrador entre todos eles.
00:03:43Ela também descobre qual das suas ferramentas de programação instaladas é melhor para cada tarefa e entrega o trabalho a essa ferramenta.
00:03:49Na verdade, este é um conjunto de habilidades.
00:03:51A principal chama-se delegate setup, que coordena os outros agentes.
00:03:54Ela também vem com habilidades de delegação dedicadas para diferentes agentes de programação, incluindo claude code, codex e cursor.
00:04:00Esses agentes rodam em um modo em que não pedem permissão antes de executar qualquer comando,
00:04:05para que o agente de programação não pare e espere você aprovar cada alteração.
00:04:08Para instalar esta habilidade, execute o comando de instalação.
00:04:11Ela pede que você escolha entre 18 habilidades, para que possa selecionar as ferramentas instaladas no seu sistema.
00:04:16Uma vez instalada, você verá que o Hermes tem a habilidade delegate setup pronta para uso.
00:04:20Para usá-la, basta executar a habilidade com o comando de barra, digitar o prompt e entregá-lo ao agente Hermes.
00:04:26Primeiro, ele identifica quais ferramentas de programação estão instaladas.
00:04:28Depois, ele lhe dá um mapa completo de qual área cada agente vai gerenciar, junto com o nome exato do modelo e o nível de esforço.
00:04:35Assim que você aprova o plano, ele começa a executar as habilidades.
00:04:37Em seguida, ele envia cada tarefa para o agente escolhido para ela.
00:04:40Após cada agente relatar suas descobertas, o Hermes lhe dá um relatório coletivo e marca a tarefa como concluída.
00:04:46Agora, você talvez já saiba que seu agente Hermes executa comandos de terminal.
00:04:50Cada comando de terminal é executado e retorna uma saída que o agente precisa ler.
00:04:5490% das vezes, você nem precisa de toda a saída que esse comando produz.
00:04:59Você só precisa de uma certa parte dela.
00:05:00O resto apenas sobrecarrega o contexto sem nenhum motivo.
00:05:03E assim como mencionamos antes, ter muita informação na janela de contexto dificulta o foco do agente.
00:05:09É aí que entra o RTK.
00:05:10Ele corta a saída dos comandos de terminal que o agente executa e mantém apenas as partes que o agente precisa,
00:05:16de modo que a saída é filtrada antes mesmo de chegar à janela de contexto.
00:05:20O banco de dados dos comandos de terminal que os agentes usam com mais frequência, para que ele saiba como filtrar a saída deles.
00:05:25Por exemplo, se você executa testes, o agente só precisa ver os resultados dos testes que falharam e não os que passaram.
00:05:31O RTK faz isso por padrão e mantém apenas as falhas.
00:05:35Mas a questão é que ele não é exatamente uma habilidade.
00:05:37É uma ferramenta separada que você instala no seu dispositivo e executa a partir do terminal.
00:05:41E ele está nesta lista porque garante que seu agente receba apenas o contexto correto.
00:05:45Se quiser, você também pode instalá-lo diretamente e dizer ao agente para usá-lo.
00:05:49Mas como os agentes tendem a esquecer o que pedimos, nós criamos uma habilidade que diz ao agente para direcionar os comandos através desta ferramenta, em vez de executá-los da maneira usual.
00:05:57Esta habilidade também contém os detalhes de que o agente precisa, junto com uma referência para cada comando, para que ele saiba quais comandos pode usar e como usá-los.
00:06:05Você pode adicionar esta habilidade à sua configuração do Hermes.
00:06:07Assim que fizer isso, você poderá dar qualquer tarefa ao Hermes e ele executará cada comando através do RTK em vez de usar o método comum.
00:06:14Apenas a saída de que o agente precisa chega à janela de contexto, para que o Hermes possa lhe dar respostas mais precisas.
00:06:20Mas antes de passarmos para o próximo, vamos ouvir uma palavra do nosso patrocinador.
00:06:23Plural.
00:06:24Gerenciar a infraestrutura de produção geralmente se resume a uma coisa: o alerta das 3 da manhã e vasculhar os logs do Kubernetes para descobrir o que quebrou.
00:06:31O Plural resolve isso com bancadas de trabalho (workbenches).
00:06:34Eles são agentes de IA que realmente operam sua infraestrutura para você e rodam dentro dos seus controles de acesso existentes, para que nada aconteça sem a sua autorização prévia.
00:06:42Eis o que nos convenceu.
00:06:43Nós o conectamos à nossa observabilidade e, quando um alerta disparou, o agente não apenas nos chamou.
00:06:48Ele investigou por conta própria, vasculhou os logs e métricas e voltou com um diagnóstico real e próximos passos claros.
00:06:54E o Workbench se conecta às ferramentas que você já usa, como Datadog e Slack, para que possa começar a agir sozinho no momento em que um alerta dispara ou em um horário programado por você.
00:07:02E em vez de escrever prompts do zero, você fornece a eles habilidades prontas da biblioteca do Plural.
00:07:07É basicamente um engenheiro de plantão que nunca dorme.
00:07:10Experimente o Plural no link na descrição.
00:07:12Agora, a próxima habilidade é do Google e se chama Mantis.
00:07:15Mantis é um conjunto de habilidades de revisão de segurança que seus agentes podem executar.
00:07:19Ele contém uma variedade de habilidades, cada uma focando em uma área diferente de revisão de segurança.
00:07:23Esta configuração funciona não importa qual aplicativo você esteja construindo, seja um aplicativo móvel ou web, você pode instalá-lo e usá-lo para o que estiver trabalhando.
00:07:30O comando de instalação está listado no repositório do GitHub.
00:07:33Quando você executar o comando de instalação, será solicitado que escolha entre as várias habilidades especializadas que ele possui.
00:07:38É melhor instalar todas elas, pois são partes separadas de todo o processo de revisão.
00:07:42Assim que você o instalar em sua configuração, verá todas as instaladas listadas.
00:07:46Por exemplo, há uma habilidade chamada Mantis plan que planeja o seu processo de revisão de segurança antes de você realmente começar.
00:07:52Ela também contém uma habilidade chamada Mantis reflect que revisa todas as descobertas e garante que as falhas sejam documentadas adequadamente.
00:07:59Agora, você pode pensar que, se o Hermes é um agente em execução contínua e normalmente não codificamos com ele, por que precisaríamos adicionar o Mantis lá?
00:08:06Mas o motivo é que, uma vez que o seu aplicativo está hospedado, ele precisa de revisões de segurança repetidamente, e isso não é algo que você queira se lembrar de fazer sozinho.
00:08:14E é isso que torna o Hermes o melhor lugar para executá-las.
00:08:16Ele possui cron jobs, que basicamente são tarefas executadas de forma autônoma em um cronograma.
00:08:21Você pode configurar um que execute este conjunto de revisões contra o aplicativo que você hospedou.
00:08:25E como o Hermes está rodando o tempo todo, ele pode alertá-lo no Slack ou em qualquer outra plataforma conectada se encontrar um problema.
00:08:31Também temos uma configuração semelhante para o nosso próprio projeto.
00:08:33Aqui você pode ver que demos o nosso projeto ao Hermes no prompt e dissemos para ele executar o conjunto completo sobre o código.
00:08:39Ele continua encontrando problemas e aplicando correções, o que mantém o aplicativo saudável para nós e garante que não haja bugs.
00:08:45Se você já tentou fazer pesquisas com agentes, deve ter esbarrado em um grande problema.
00:08:49O seu agente tem o acesso negado a determinados conteúdos.
00:08:52Isso acontece porque muitos sites, como o Reddit, não querem que modelos usem seu conteúdo.
00:08:56Mas esses sites são realmente valiosos, pois neles há usuários reais discutindo problemas, opiniões e experiências, o que torna a informação útil para pesquisas.
00:09:05Para dar aos agentes acesso a esse conteúdo, existe uma habilidade chamada Agent Reach.
00:09:09Ela concede ao Hermes acesso aos sites que geralmente são restritos, incluindo Reddit, GitHub e muitos outros.
00:09:15Ela usa métodos gratuitos, portanto não custa nada para você.
00:09:18Recentemente, ele também foi o projeto número um em alta no GitHub.
00:09:21Agora você pode instalar isso na sua configuração do Hermes e terá acesso a mais de 15 plataformas.
00:09:26Ele pode pesquisar no Instagram, Facebook, Twitter e Reddit.
00:09:29Assim que o tiver instalado, você poderá usá-lo diretamente a partir do Hermes e pedir para ele buscar qualquer tópico em qualquer plataforma.
00:09:35Ele executa seus próprios scripts, encontra as informações relevantes e fornece as respostas de que você precisa.
00:09:41Como você já sabe, o Hermes vem com mais de 90 habilidades integradas.
00:09:45E além disso, quando o Hermes percebe um fluxo de trabalho em seu chat que pode ser útil no futuro,
00:09:50ele cria uma habilidade a partir dele e passa a usá-la em execuções futuras.
00:09:54Parece bom porque ele se adapta a você automaticamente, mas há um problema nisso.
00:09:58A única parte de uma habilidade que realmente vai para a janela de contexto é o seu nome e descrição.
00:10:04Eles são enviados com cada uma de suas mensagens para que o agente saiba que essas habilidades existem.
00:10:08Agora, você pode dizer que o nome e a descrição formam um pequeno trecho e não afetariam a janela de contexto,
00:10:14mas se você tem mais de 100 habilidades e usa o Hermes há muito tempo,
00:10:18todos esses nomes e descrições começam a consumir uma enorme parcela da janela de contexto.
00:10:23Portanto, para resolver esse problema, há todo um conjunto de habilidades criado para tornar o agente mais produtivo.
00:10:28Mas a que mais nos interessa é a habilidade de recuperação de habilidades (skill retriever).
00:10:31Ela substitui a lista completa de prompts de habilidades apenas pelas descrições mais relevantes,
00:10:36o que faz com que o tamanho do contexto diminua.
00:10:38Basicamente, ela executa outra etapa antes que o Hermes chame o modelo.
00:10:42Ela divide sua mensagem em pequenos pedaços que um modelo consegue compreender,
00:10:45faz o mesmo com cada habilidade que você possui e, em seguida, cruza sua mensagem com a lista de habilidades.
00:10:50As habilidades que pontuam mais alto são as que são enviadas.
00:10:52A documentação deles traz números sobre isso.
00:10:54Eles dizem que, com a lista inteira sendo incluída, eram usados cerca de 11.000 tokens.
00:10:58Depois disso, passa a usar apenas 2,3 mil, então eles afirmam que economiza mais de 9.000 tokens a cada turno.
00:11:04Isso ajuda você de duas maneiras.
00:11:05Primeiro, há muito menos dados indo para a janela de contexto a cada mensagem enviada,
00:11:09portanto custa menos para executar.
00:11:11E segundo, o agente não se distrai com habilidades que não têm nada a ver com o que você pediu,
00:11:16então você obtém respostas melhores.
00:11:17Isso vem como um plugin, e o Skill Retriever é uma das habilidades dentro dele.
00:11:21Assim que você instalar o plugin, poderá ativar o Skill Retriever na área de plugins.
00:11:25Então a lista de habilidades enviada para o contexto será muito mais curta do que costumava ser.
00:11:29A habilidade RTK que criamos neste vídeo pode ser encontrada no AI Labs Pro, que é a nossa comunidade.
00:11:35Portanto, se você achou valor no que fazemos e quer apoiar o canal, esta é a melhor maneira de fazer isso.
00:11:39O link está na descrição.
00:11:41Isso nos traz ao final deste vídeo.
00:11:43Se você quiser apoiar o canal e nos ajudar a continuar fazendo vídeos como este,
00:11:46você pode fazer isso usando o botão de valeu demais abaixo.
00:11:49Como sempre, obrigado por assistir e vejo você no próximo.