Навыки агента Hermes, которые делают его в 10 раз мощнее

AAI LABS
Computing/SoftwareInternet Technology

Transcript

00:00:00С тех пор как вышел агент Hermes, люди настраивают с его помощью самые разные рабочие процессы.
00:00:04И чтобы сделать и без того мощного агента еще лучше, пользователи создали для него множество навыков.
00:00:10Некоторые из них даже вошли в число самых популярных проектов на GitHub.
00:00:14Теперь вы можете задаться вопросом, зачем вообще устанавливать дополнительные навыки,
00:00:17ведь Hermes уже поставляется со множеством из них и может даже создавать новые на основе ваших процессов.
00:00:22Но навыки, которые создает Hermes, основаны только на тех сценариях, которым он учится у вас.
00:00:25Эти другие навыки созданы людьми, которые уже решили проблемы, с которыми Hermes не справляется сам,
00:00:31и они упаковали эти решения в навыки, которыми вы можете воспользоваться.
00:00:34Если вы впервые на нашем канале — добро пожаловать, мы софтверная компания, а это AI Labs.
00:00:38И в этом видео мы разберем навыки, которые действительно делают работу с агентами Hermes намного лучше.
00:00:43Но прежде чем мы перейдем к первому, вам нужно знать следующее:
00:00:46хотя мы используем эти навыки с Hermes, большинство из них применимы к любому AI-агенту для кодирования.
00:00:51Если вы работали с агентами кодирования, будь то Hermes или буквально любой другой агент,
00:00:56у всех у них есть одна и та же проблема.
00:00:57Если у вас долгий разговор, агент может забыть детали, упомянутые ранее,
00:01:02и вам приходится повторять одну и ту же инструкцию во второй раз.
00:01:04И это происходит тем чаще, когда вы используете модели Opus с Hermes,
00:01:08поскольку они имеют свойство забывать всё быстрее.
00:01:10Это происходит потому, что в вашем контекстном окне слишком много сообщений,
00:01:14и модели приходится уделять внимание каждому из них.
00:01:16Когда это происходит, он может упустить мелкие детали, и вы получаете худшие ответы.
00:01:20Для решения этой проблемы существует навык под названием “Планирование с помощью файлов”.
00:01:24Он хранит план там, где агент не сможет его проигнорировать.
00:01:27Вместо того чтобы держать план в чате и занимать место в контекстном окне,
00:01:31этот навык преобразует план в три файла в папке вашего проекта.
00:01:34Первый — это TaskPlan.MD, который разбивает вашу главную задачу на более мелкие подзадачи,
00:01:40чтобы агент мог выполнять их по одной.
00:01:42Затем идет Findings.MD, где фиксируются все проблемы, с которыми столкнулся агент, и способы их решения.
00:01:47Если та же проблема возникнет снова, агент сможет использовать этот опыт, чтобы избежать её.
00:01:51И последний — Progress.MD, в котором записывается текущий прогресс агента.
00:01:56Возможно, вы думаете, что хранение плана в файлах — это не новость,
00:01:59и большинство из вас уже делает это.
00:02:01Что отличает этот навык, так это то, что агент не может проигнорировать план.
00:02:04Это происходит за счет использования хука,
00:02:06который принудительно внедряет эти три файла в контекстное окно,
00:02:09поэтому модель не может просто взять и проигнорировать их.
00:02:12Большинство агентов не поддерживают хуки, но Hermes — один из немногих, кто поддерживает.
00:02:16И судя по их собственному тестированию, агент работал намного лучше с работающим хуком,
00:02:20поскольку он не отвлекался от поставленной перед ним задачи.
00:02:23Команды установки для всех агентов указаны в репозитории,
00:02:26ссылка на который будет приведена в описании ниже.
00:02:28После установки он будет добавлен вместе со всеми остальными навыками.
00:02:32А хуки будут автоматически установлены в вашем агенте.
00:02:35В файле навыка объясняется, что это за три файла,
00:02:38где они должны находиться и что делает каждый из них.
00:02:40Он также включает в себя все правила, которым должен следовать агент,
00:02:43чтобы он понимал, с чем работает.
00:02:44Так что, установив это,
00:02:46вы можете запустить навык и дать ему промпт с тем, что должен сделать агент.
00:02:50Здесь вы видите, что агент начал с создания плана задач,
00:02:53файла результатов, а затем и файлов прогресса.
00:02:56Затем он задавал нам вопросы, и мы отвечали на них по ходу дела.
00:02:59После этой долгой сессии он финализировал план и выдал нам эти три файла.
00:03:03Но прежде чем перейти к следующему навыку,
00:03:04было бы здорово, если вы подпишитесь на канал и нажмете кнопку лайка.
00:03:08Этот небольшой жест поддержки очень важен для нас.
00:03:11Вы, возможно, уже знаете, что с Hermes можно использовать несколько инструментов кодирования.
00:03:15Например, вы можете подключить свою подписку codex к агенту Hermes и использовать его модели.
00:03:19Вы также можете знать, что у Hermes уже есть навык Claude Code, который отправляет задачи прямо в него,
00:03:24и такой же навык есть и для codex.
00:03:27Но проблема с этими навыками заключается в том, что Hermes не будет использовать их, пока вы сами не попросите.
00:03:31Вам также придется указывать в промпте, какие задачи какому агенту отправлять.
00:03:35Но есть и другой навык, который отправляет задачу любому агенту, уже установленному в вашей системе.
00:03:40И этот навык действует как оркестратор между ними всеми.
00:03:43Он также определяет, какой из установленных инструментов кодирования лучше всего подходит для конкретной задачи, и передает работу ему.
00:03:49Фактически это набор навыков.
00:03:51Основной называется delegate setup, он координирует остальных агентов.
00:03:54Он также поставляется со специализированными навыками делегирования для различных агентов кодирования, включая Claude Code, codex и cursor.
00:04:00Эти агенты работают в режиме, когда они не запрашивают разрешение перед выполнением любой команды,
00:04:05поэтому агент кодирования не останавливается и не ждет, пока вы одобрите каждое изменение.
00:04:08Чтобы установить этот навык, выполните команду установки.
00:04:11Он предложит выбрать из 18 навыков, чтобы вы могли отметить инструменты, установленные в вашей системе.
00:04:16После установки вы увидите, что у Hermes готов к использованию навык delegate setup.
00:04:20Чтобы использовать его, вам просто нужно запустить навык с помощью команды слэш, ввести промпт и передать его агенту Hermes.
00:04:26Сначала он определяет, какие инструменты кодирования установлены.
00:04:28Затем он дает вам полную карту того, какую область будет обрабатывать каждый агент, вместе с точным именем модели и уровнем усилий.
00:04:35Как только вы одобряете план, он начинает запуск навыков.
00:04:37После этого он отправляет каждую задачу выбранному для нее агенту.
00:04:40После того как каждый агент сообщает о своих результатах, Hermes выдает вам единый общий отчет и отмечает задачу как выполненную.
00:04:46Теперь вы, возможно, уже знаете, что ваш агент Hermes выполняет команды терминала.
00:04:50Каждая команда терминала выполняется, и она возвращает вывод, который агент должен прочитать.
00:04:54В 90% случаев вам даже не нужен весь тот вывод, который производит эта команда.
00:04:59Вам нужна лишь определенная ее часть.
00:05:00Остальное просто засоряет контекст без всякой причины.
00:05:03И как мы уже упоминали ранее, избыток информации в контекстном окне затрудняет концентрацию агента.
00:05:09Здесь на сцену выходит RTK.
00:05:10Он сокращает вывод команд терминала, выполняемых агентом, и оставляет только те части, которые нужны агенту,
00:05:16так что вывод фильтруется еще до того, как попадает в контекстное окно.
00:05:20База данных команд терминала, которые агенты используют чаще всего, чтобы он знал, как фильтровать их вывод.
00:05:25Например, если вы запускаете тесты, агенту нужно видеть только результаты упавших тестов, а не успешных.
00:05:31RTK делает это по умолчанию и сохраняет только ошибки.
00:05:35Но дело в том, что это на самом деле не навык.
00:05:37Это отдельный инструмент, который вы устанавливаете на свое устройство и запускаете из терминала.
00:05:41И он находится в этом списке, потому что гарантирует, что ваш агент получает только правильный контекст.
00:05:45Если хотите, вы также можете установить его напрямую и сказать агенту использовать его.
00:05:49Но поскольку агенты имеют свойство забывать наши просьбы, мы фактически создали навык, который указывает агенту направлять команды через этот инструмент вместо их обычного выполнения.
00:05:57Этот навык также содержит детали, необходимые агенту, наряду со справочником для каждой команды, чтобы он знал, какие команды может использовать и как.
00:06:05Вы можете добавить этот навык в свою конфигурацию Hermes.
00:06:07Сделав это, вы сможете дать Hermes любую задачу, и он будет прогонять каждую команду через RTK вместо использования привычного метода.
00:06:14В контекстное окно попадает только необходимый агенту вывод, поэтому Hermes может давать более точные ответы.
00:06:20Но прежде чем мы перейдем к следующему, послушайте слово от нашего спонсора.
00:06:23Plural.
00:06:24Управление продакшн-инфраструктурой обычно сводится к одному: ночным алертам в 3 часа ночи и копанию в логах Kubernetes в поисках того, что сломалось.
00:06:31Plural исправляет это с помощью верстаков (workbenches).
00:06:34Это AI-агенты, которые фактически управляют вашей инфраструктурой за вас и работают в рамках ваших текущих прав доступа, поэтому ничего не произойдет без вашего предварительного разрешения.
00:06:42Вот что нас покорило.
00:06:43Мы подключили его к нашей системе мониторинга, и когда сработал алерт, агент не просто пингнул нас.
00:06:48Он провел самостоятельное расследование, изучил логи и метрики и вернулся с реальным диагнозом и четкими дальнейшими шагами.
00:06:54При этом Workbench интегрируется с инструментами, которые вы уже используете, такими как Datadog и Slack, поэтому он может запускаться самостоятельно в момент срабатывания алерта или по заданному расписанию.
00:07:02И вместо того чтобы писать промпты с нуля, вы передаете им готовые навыки из библиотеки Plural.
00:07:07По сути, это дежурный инженер, который никогда не спит.
00:07:10Попробуйте Plural по ссылке в описании.
00:07:12Ну а следующий навык разработан Google и называется Mantis.
00:07:15Mantis представляет собой набор навыков проверки безопасности, которые могут запускать ваши агенты.
00:07:19Он содержит различные навыки, каждый из которых сфокусирован на определенной области проверки безопасности.
00:07:23Эта настройка работает независимо от того, какое приложение вы создаете — мобильное или веб-приложение, вы можете установить его и использовать для всего, над чем работаете.
00:07:30Команда установки указана в репозитории на GitHub.
00:07:33При запуске команды установки вам будет предложено выбрать из множества специализированных навыков.
00:07:38Лучше установить их все, так как они представляют собой отдельные части общего процесса проверки.
00:07:42После установки вы увидите весь список установленных компонентов.
00:07:46Например, есть навык Mantis plan, который планирует процесс проверки безопасности до ее фактического начала.
00:07:52Он также содержит навык Mantis reflect, который анализирует все результаты и гарантирует правильное документирование сбоев.
00:07:59Теперь вы можете подумать: если Hermes — это постоянно работающий агент, и мы обычно не пишем с ним код, зачем нам вообще добавлять туда Mantis?
00:08:06Причина в том, что после развертывания приложения проверки безопасности нужны снова и снова, и вряд ли вы захотите делать это вручную.
00:08:14И именно поэтому Hermes — лучшее место для их запуска.
00:08:16В нем есть задания cron — по сути, задачи, которые выполняются автоматически по расписанию.
00:08:21Вы можете настроить запуск этого набора проверок для развернутого приложения.
00:08:25И поскольку Hermes работает постоянно, он может предупредить вас в Slack или другой подключенной платформе при обнаружении проблемы.
00:08:31У нас для нашего проекта настроено примерно так же.
00:08:33Здесь видно, что мы передали Hermes наш проект в промпте и велели запустить полный набор проверок кода.
00:08:39Он продолжает находить проблемы и применять исправления, поддерживая работоспособность приложения и защищая его от багов.
00:08:45Если вы когда-нибудь пытались проводить исследование с помощью агентов, вы могли столкнуться с огромной проблемой.
00:08:49Вашему агенту запрещен доступ к определенному контенту.
00:08:52Это происходит потому, что многие сайты вроде Reddit не хотят, чтобы модели использовали их контент.
00:08:56Но эти сайты очень ценны, так как там реальные пользователи обсуждают проблемы, делятся мнениями и опытом, что делает информацию полезной для исследований.
00:09:05Чтобы предоставить агентам доступ к этому контенту, существует навык Agent Reach.
00:09:09Он дает Hermes доступ к обычно заблокированным сайтам, включая Reddit, GitHub и многие другие.
00:09:15Он использует бесплатные методы, поэтому вы ничего не платите.
00:09:18Не так давно этот проект также занимал первое место в трендах на GitHub.
00:09:21Теперь вы можете установить его в Hermes, и он откроет доступ более чем к 15 платформам.
00:09:26Он может искать в Instagram, Facebook, Twitter и на Reddit.
00:09:29Установив его, вы можете использовать его прямо из Hermes, запрашивая поиск любой темы на любой платформе.
00:09:35Он запускает собственные скрипты, находит нужную информацию и выдает необходимые ответы.
00:09:41Как вы уже знаете, Hermes поставляется с более чем 90 встроенными навыками.
00:09:45Кроме того, когда Hermes видит в чате рабочий процесс, который может пригодиться в будущем,
00:09:50он фактически создает из него навык и затем может использовать его в дальнейшей работе.
00:09:54Звучит отлично, ведь он подстраивается под вас автоматически, но в этом есть проблема.
00:09:58Единственная часть навыка, которая попадает в окно контекста, — это его название и описание.
00:10:04Они отправляются с каждым вашим сообщением, чтобы агент знал о существовании этих навыков.
00:10:08И вы можете сказать, что название и описание занимают совсем немного места и никак не повлияют на контекстное окно,
00:10:14но если у вас более 100 навыков и вы давно пользуетесь Hermes,
00:10:18все эти названия и описания начинают забирать огромную часть контекстного окна.
00:10:23Поэтому для решения этой проблемы создан целый набор навыков, повышающих продуктивность агента.
00:10:28Но больше всего нас интересует навык поиска навыков (skill retriever).
00:10:31Он заменяет полный список подсказок навыков только самыми релевантными описаниями,
00:10:36что приводит к уменьшению размера контекста.
00:10:38По сути, он выполняет еще один шаг перед тем, как Hermes обратится к модели.
00:10:42Он разбивает ваше сообщение на небольшие фрагменты, понятные модели,
00:10:45делает то же самое с каждым вашим навыком, а затем сопоставляет ваше сообщение со списком навыков.
00:10:50Навыки, набравшие наибольшее количество баллов, и отправляются.
00:10:52В их документации приводятся цифры.
00:10:54Они говорят, что при передаче всего списка используется около 11 000 токенов.
00:10:58После этого расходуется всего 2,3 тысячи, то есть они заявляют об экономии более 9 000 токенов за запрос.
00:11:04Это помогает вам двумя способами.
00:11:05Во-первых, с каждым отправляемым сообщением в окно контекста попадает гораздо меньше информации,
00:11:09поэтому работа обходится дешевле.
00:11:11И во-вторых, агент не отвлекается на навыки, не имеющие отношения к вашему вопросу,
00:11:16поэтому вы получаете лучшие ответы.
00:11:17Это поставляется в виде плагина, и Skill Retriever — один из навыков внутри него.
00:11:21Установив плагин, вы можете включить Skill Retriever в разделе плагинов.
00:11:25Тогда список навыков, попадающих в контекст, станет намного короче, чем раньше.
00:11:29Навык RTK, который мы создали в этом видео, можно найти в нашем сообществе AI Labs Pro.
00:11:35Так что, если вам было полезно то, что мы делаем, и вы хотите поддержать канал, это лучший способ.
00:11:39Ссылка в описании.
00:11:41На этом видео подходит к концу.
00:11:43Если вы хотите поддержать канал и помочь нам продолжать выпускать такие видео,
00:11:46вы можете сделать это с помощью кнопки суперспасибо ниже.
00:11:49Как всегда, спасибо за просмотр, и до встречи в следующем видео.

Key Takeaway

Дополнительные внешние навыки и хуки для агента Hermes расширяют его возможности, оптимизируют контекстное окно и автоматизируют управление задачами кодирования.

Highlights

  • Навык «Планирование с помощью файлов» разделяет задачи на TaskPlan.MD, Findings.MD и Progress.MD, предотвращая игнорирование плана моделью.

  • Набор навыков delegate setup координирует работу установленных инструментов кодирования без запроса дополнительных подтверждений.

  • Инструмент RTK сокращает вывод терминала, уменьшая расход контекстного окна в среднем на 90 процентов.

  • Набор навыков Mantis от Google автоматизирует проверку безопасности развернутых приложений по расписанию cron.

  • Навык Agent Reach предоставляет агенту доступ к заблокированным для моделей платформам вроде Reddit и GitHub.

  • Навык поиска навыков (skill retriever) снижает расход токенов на передачу описаний навыков примерно на 9000 токенов за запрос.

Timeline

Планирование с помощью файлов и контекстные хуки

  • Длинные разговоры приводят к тому, что языковые модели забывают ранние детали из-за переполнения контекстного окна.
  • Навык планирования сохраняет задачи, проблемы и прогресс в трех файлах папки проекта.
  • Хуки принудительно внедряют эти файлы в контекстное окно, не позволяя модели игнорировать план.

Модели Opus забывают информацию быстрее остальных при накоплении сообщений в чате. Навык «Планирование с помощью файлов» решает эту проблему через файлы TaskPlan.MD, Findings.MD и Progress.MD. Специальный хук принудительно удерживает эти файлы в поле зрения модели.

Делегирование задач между агентами кодирования

  • Hermes может управлять другими агентами кодирования вроде Claude Code, codex и cursor.
  • Основной навык delegate setup распределяет работу между установленными в системе инструментами.
  • Специализированные агенты выполняют задачи в фоновом режиме без ожидания подтверждения каждого изменения.

Ручной выбор агента для каждой задачи снижает эффективность работы. Набор навыков delegate setup автоматически определяет подходящий инструмент для каждого подзапроса, выдает общую карту распределения работы и объединяет результаты в единый отчет.

Фильтрация вывода терминала через RTK

  • Большая часть вывода терминальных команд избыточна и лишь засоряет контекстное окно агента.
  • Инструмент RTK фильтрует лог выполнения команд до того, как он попадает в контекст модели.
  • Навык RTK перенаправляет запросы агента через этот инструмент по умолчанию.

Девяносто процентов данных из терминала не нужны для принятия решений. Инструмент RTK отсекает лишнюю информацию, оставляя только критические ошибки или результаты упавших тестов, что экономит токены и повышает точность ответов.

Автоматическая проверка безопасности с Mantis

  • Mantis представляет собой набор навыков безопасности от Google для проверки кода.
  • Задачи cron в Hermes запускают проверки по расписанию для уже развернутых приложений.
  • Агент самостоятельно находит уязвимости и применяет исправления без участия разработчика.

Проверки безопасности требуются регулярно после каждого обновления приложений. Интеграция Mantis с задачами cron позволяет Hermes проводить аудит кода в фоновом режиме и отправлять уведомления при обнаружении критических сбоев.

Доступ к внешним источникам данных через Agent Reach

  • Многие платформы вроде Reddit блокируют прямой доступ для искусственного интеллекта.
  • Навык Agent Reach открывает доступ к заблокированным сайтам без использования платных API.
  • Инструмент поддерживает поиск по более чем 15 платформам, включая социальные сети и GitHub.

Сбор информации с форумов и социальных сетей критически важен для исследований. Agent Reach обходит ограничения популярных платформ бесплатными методами, позволяя Hermes находить мнения реальных пользователей по любым темам.

Оптимизация контекста с помощью skill retriever

  • Названия и описания большого числа навыков занимают значительную часть контекстного окна.
  • Skill retriever сопоставляет сообщение пользователя с базой навыков и передает модели только релевантные.
  • Этот подход экономит около 9000 токенов на один запрос и повышает точность работы.

Автоматическое создание новых навыков Hermes приводит к росту их общего количества и исчерпанию контекста. Навык поиска навыков фильтрует список описаний перед обращением к модели, сокращая объем передаваемых данных с 11000 до 2300 токенов.

Community Posts

View all posts