Навыки агента Hermes, которые делают его в 10 раз мощнее
AAI LABS
Computing/SoftwareInternet Technology
Transcript
00:00:00С тех пор как вышел агент Hermes, люди настраивают с его помощью самые разные рабочие процессы.
00:00:04И чтобы сделать и без того мощного агента еще лучше, пользователи создали для него множество навыков.
00:00:10Некоторые из них даже вошли в число самых популярных проектов на GitHub.
00:00:14Теперь вы можете задаться вопросом, зачем вообще устанавливать дополнительные навыки,
00:00:17ведь Hermes уже поставляется со множеством из них и может даже создавать новые на основе ваших процессов.
00:00:22Но навыки, которые создает Hermes, основаны только на тех сценариях, которым он учится у вас.
00:00:25Эти другие навыки созданы людьми, которые уже решили проблемы, с которыми Hermes не справляется сам,
00:00:31и они упаковали эти решения в навыки, которыми вы можете воспользоваться.
00:00:34Если вы впервые на нашем канале — добро пожаловать, мы софтверная компания, а это AI Labs.
00:00:38И в этом видео мы разберем навыки, которые действительно делают работу с агентами Hermes намного лучше.
00:00:43Но прежде чем мы перейдем к первому, вам нужно знать следующее:
00:00:46хотя мы используем эти навыки с Hermes, большинство из них применимы к любому AI-агенту для кодирования.
00:00:51Если вы работали с агентами кодирования, будь то Hermes или буквально любой другой агент,
00:00:56у всех у них есть одна и та же проблема.
00:00:57Если у вас долгий разговор, агент может забыть детали, упомянутые ранее,
00:01:02и вам приходится повторять одну и ту же инструкцию во второй раз.
00:01:04И это происходит тем чаще, когда вы используете модели Opus с Hermes,
00:01:08поскольку они имеют свойство забывать всё быстрее.
00:01:10Это происходит потому, что в вашем контекстном окне слишком много сообщений,
00:01:14и модели приходится уделять внимание каждому из них.
00:01:16Когда это происходит, он может упустить мелкие детали, и вы получаете худшие ответы.
00:01:20Для решения этой проблемы существует навык под названием “Планирование с помощью файлов”.
00:01:24Он хранит план там, где агент не сможет его проигнорировать.
00:01:27Вместо того чтобы держать план в чате и занимать место в контекстном окне,
00:01:31этот навык преобразует план в три файла в папке вашего проекта.
00:01:34Первый — это TaskPlan.MD, который разбивает вашу главную задачу на более мелкие подзадачи,
00:01:40чтобы агент мог выполнять их по одной.
00:01:42Затем идет Findings.MD, где фиксируются все проблемы, с которыми столкнулся агент, и способы их решения.
00:01:47Если та же проблема возникнет снова, агент сможет использовать этот опыт, чтобы избежать её.
00:01:51И последний — Progress.MD, в котором записывается текущий прогресс агента.
00:01:56Возможно, вы думаете, что хранение плана в файлах — это не новость,
00:01:59и большинство из вас уже делает это.
00:02:01Что отличает этот навык, так это то, что агент не может проигнорировать план.
00:02:04Это происходит за счет использования хука,
00:02:06который принудительно внедряет эти три файла в контекстное окно,
00:02:09поэтому модель не может просто взять и проигнорировать их.
00:02:12Большинство агентов не поддерживают хуки, но Hermes — один из немногих, кто поддерживает.
00:02:16И судя по их собственному тестированию, агент работал намного лучше с работающим хуком,
00:02:20поскольку он не отвлекался от поставленной перед ним задачи.
00:02:23Команды установки для всех агентов указаны в репозитории,
00:02:26ссылка на который будет приведена в описании ниже.
00:02:28После установки он будет добавлен вместе со всеми остальными навыками.
00:02:32А хуки будут автоматически установлены в вашем агенте.
00:02:35В файле навыка объясняется, что это за три файла,
00:02:38где они должны находиться и что делает каждый из них.
00:02:40Он также включает в себя все правила, которым должен следовать агент,
00:02:43чтобы он понимал, с чем работает.
00:02:44Так что, установив это,
00:02:46вы можете запустить навык и дать ему промпт с тем, что должен сделать агент.
00:02:50Здесь вы видите, что агент начал с создания плана задач,
00:02:53файла результатов, а затем и файлов прогресса.
00:02:56Затем он задавал нам вопросы, и мы отвечали на них по ходу дела.
00:02:59После этой долгой сессии он финализировал план и выдал нам эти три файла.
00:03:03Но прежде чем перейти к следующему навыку,
00:03:04было бы здорово, если вы подпишитесь на канал и нажмете кнопку лайка.
00:03:08Этот небольшой жест поддержки очень важен для нас.
00:03:11Вы, возможно, уже знаете, что с Hermes можно использовать несколько инструментов кодирования.
00:03:15Например, вы можете подключить свою подписку codex к агенту Hermes и использовать его модели.
00:03:19Вы также можете знать, что у Hermes уже есть навык Claude Code, который отправляет задачи прямо в него,
00:03:24и такой же навык есть и для codex.
00:03:27Но проблема с этими навыками заключается в том, что Hermes не будет использовать их, пока вы сами не попросите.
00:03:31Вам также придется указывать в промпте, какие задачи какому агенту отправлять.
00:03:35Но есть и другой навык, который отправляет задачу любому агенту, уже установленному в вашей системе.
00:03:40И этот навык действует как оркестратор между ними всеми.
00:03:43Он также определяет, какой из установленных инструментов кодирования лучше всего подходит для конкретной задачи, и передает работу ему.
00:03:49Фактически это набор навыков.
00:03:51Основной называется delegate setup, он координирует остальных агентов.
00:03:54Он также поставляется со специализированными навыками делегирования для различных агентов кодирования, включая Claude Code, codex и cursor.
00:04:00Эти агенты работают в режиме, когда они не запрашивают разрешение перед выполнением любой команды,
00:04:05поэтому агент кодирования не останавливается и не ждет, пока вы одобрите каждое изменение.
00:04:08Чтобы установить этот навык, выполните команду установки.
00:04:11Он предложит выбрать из 18 навыков, чтобы вы могли отметить инструменты, установленные в вашей системе.
00:04:16После установки вы увидите, что у Hermes готов к использованию навык delegate setup.
00:04:20Чтобы использовать его, вам просто нужно запустить навык с помощью команды слэш, ввести промпт и передать его агенту Hermes.
00:04:26Сначала он определяет, какие инструменты кодирования установлены.
00:04:28Затем он дает вам полную карту того, какую область будет обрабатывать каждый агент, вместе с точным именем модели и уровнем усилий.
00:04:35Как только вы одобряете план, он начинает запуск навыков.
00:04:37После этого он отправляет каждую задачу выбранному для нее агенту.
00:04:40После того как каждый агент сообщает о своих результатах, Hermes выдает вам единый общий отчет и отмечает задачу как выполненную.
00:04:46Теперь вы, возможно, уже знаете, что ваш агент Hermes выполняет команды терминала.
00:04:50Каждая команда терминала выполняется, и она возвращает вывод, который агент должен прочитать.
00:04:54В 90% случаев вам даже не нужен весь тот вывод, который производит эта команда.
00:04:59Вам нужна лишь определенная ее часть.
00:05:00Остальное просто засоряет контекст без всякой причины.
00:05:03И как мы уже упоминали ранее, избыток информации в контекстном окне затрудняет концентрацию агента.
00:05:09Здесь на сцену выходит RTK.
00:05:10Он сокращает вывод команд терминала, выполняемых агентом, и оставляет только те части, которые нужны агенту,
00:05:16так что вывод фильтруется еще до того, как попадает в контекстное окно.
00:05:20База данных команд терминала, которые агенты используют чаще всего, чтобы он знал, как фильтровать их вывод.
00:05:25Например, если вы запускаете тесты, агенту нужно видеть только результаты упавших тестов, а не успешных.
00:05:31RTK делает это по умолчанию и сохраняет только ошибки.
00:05:35Но дело в том, что это на самом деле не навык.
00:05:37Это отдельный инструмент, который вы устанавливаете на свое устройство и запускаете из терминала.
00:05:41И он находится в этом списке, потому что гарантирует, что ваш агент получает только правильный контекст.
00:05:45Если хотите, вы также можете установить его напрямую и сказать агенту использовать его.
00:05:49Но поскольку агенты имеют свойство забывать наши просьбы, мы фактически создали навык, который указывает агенту направлять команды через этот инструмент вместо их обычного выполнения.
00:05:57Этот навык также содержит детали, необходимые агенту, наряду со справочником для каждой команды, чтобы он знал, какие команды может использовать и как.
00:06:05Вы можете добавить этот навык в свою конфигурацию Hermes.
00:06:07Сделав это, вы сможете дать Hermes любую задачу, и он будет прогонять каждую команду через RTK вместо использования привычного метода.
00:06:14В контекстное окно попадает только необходимый агенту вывод, поэтому Hermes может давать более точные ответы.
00:06:20Но прежде чем мы перейдем к следующему, послушайте слово от нашего спонсора.
00:06:23Plural.
00:06:24Управление продакшн-инфраструктурой обычно сводится к одному: ночным алертам в 3 часа ночи и копанию в логах Kubernetes в поисках того, что сломалось.
00:06:31Plural исправляет это с помощью верстаков (workbenches).
00:06:34Это AI-агенты, которые фактически управляют вашей инфраструктурой за вас и работают в рамках ваших текущих прав доступа, поэтому ничего не произойдет без вашего предварительного разрешения.
00:06:42Вот что нас покорило.
00:06:43Мы подключили его к нашей системе мониторинга, и когда сработал алерт, агент не просто пингнул нас.
00:06:48Он провел самостоятельное расследование, изучил логи и метрики и вернулся с реальным диагнозом и четкими дальнейшими шагами.
00:06:54При этом Workbench интегрируется с инструментами, которые вы уже используете, такими как Datadog и Slack, поэтому он может запускаться самостоятельно в момент срабатывания алерта или по заданному расписанию.
00:07:02И вместо того чтобы писать промпты с нуля, вы передаете им готовые навыки из библиотеки Plural.
00:07:07По сути, это дежурный инженер, который никогда не спит.
00:07:10Попробуйте Plural по ссылке в описании.
00:07:12Ну а следующий навык разработан Google и называется Mantis.
00:07:15Mantis представляет собой набор навыков проверки безопасности, которые могут запускать ваши агенты.
00:07:19Он содержит различные навыки, каждый из которых сфокусирован на определенной области проверки безопасности.
00:07:23Эта настройка работает независимо от того, какое приложение вы создаете — мобильное или веб-приложение, вы можете установить его и использовать для всего, над чем работаете.
00:07:30Команда установки указана в репозитории на GitHub.
00:07:33При запуске команды установки вам будет предложено выбрать из множества специализированных навыков.
00:07:38Лучше установить их все, так как они представляют собой отдельные части общего процесса проверки.
00:07:42После установки вы увидите весь список установленных компонентов.
00:07:46Например, есть навык Mantis plan, который планирует процесс проверки безопасности до ее фактического начала.
00:07:52Он также содержит навык Mantis reflect, который анализирует все результаты и гарантирует правильное документирование сбоев.
00:07:59Теперь вы можете подумать: если Hermes — это постоянно работающий агент, и мы обычно не пишем с ним код, зачем нам вообще добавлять туда Mantis?
00:08:06Причина в том, что после развертывания приложения проверки безопасности нужны снова и снова, и вряд ли вы захотите делать это вручную.
00:08:14И именно поэтому Hermes — лучшее место для их запуска.
00:08:16В нем есть задания cron — по сути, задачи, которые выполняются автоматически по расписанию.
00:08:21Вы можете настроить запуск этого набора проверок для развернутого приложения.
00:08:25И поскольку Hermes работает постоянно, он может предупредить вас в Slack или другой подключенной платформе при обнаружении проблемы.
00:08:31У нас для нашего проекта настроено примерно так же.
00:08:33Здесь видно, что мы передали Hermes наш проект в промпте и велели запустить полный набор проверок кода.
00:08:39Он продолжает находить проблемы и применять исправления, поддерживая работоспособность приложения и защищая его от багов.
00:08:45Если вы когда-нибудь пытались проводить исследование с помощью агентов, вы могли столкнуться с огромной проблемой.
00:08:49Вашему агенту запрещен доступ к определенному контенту.
00:08:52Это происходит потому, что многие сайты вроде Reddit не хотят, чтобы модели использовали их контент.
00:08:56Но эти сайты очень ценны, так как там реальные пользователи обсуждают проблемы, делятся мнениями и опытом, что делает информацию полезной для исследований.
00:09:05Чтобы предоставить агентам доступ к этому контенту, существует навык Agent Reach.
00:09:09Он дает Hermes доступ к обычно заблокированным сайтам, включая Reddit, GitHub и многие другие.
00:09:15Он использует бесплатные методы, поэтому вы ничего не платите.
00:09:18Не так давно этот проект также занимал первое место в трендах на GitHub.
00:09:21Теперь вы можете установить его в Hermes, и он откроет доступ более чем к 15 платформам.
00:09:26Он может искать в Instagram, Facebook, Twitter и на Reddit.
00:09:29Установив его, вы можете использовать его прямо из Hermes, запрашивая поиск любой темы на любой платформе.
00:09:35Он запускает собственные скрипты, находит нужную информацию и выдает необходимые ответы.
00:09:41Как вы уже знаете, Hermes поставляется с более чем 90 встроенными навыками.
00:09:45Кроме того, когда Hermes видит в чате рабочий процесс, который может пригодиться в будущем,
00:09:50он фактически создает из него навык и затем может использовать его в дальнейшей работе.
00:09:54Звучит отлично, ведь он подстраивается под вас автоматически, но в этом есть проблема.
00:09:58Единственная часть навыка, которая попадает в окно контекста, — это его название и описание.
00:10:04Они отправляются с каждым вашим сообщением, чтобы агент знал о существовании этих навыков.
00:10:08И вы можете сказать, что название и описание занимают совсем немного места и никак не повлияют на контекстное окно,
00:10:14но если у вас более 100 навыков и вы давно пользуетесь Hermes,
00:10:18все эти названия и описания начинают забирать огромную часть контекстного окна.
00:10:23Поэтому для решения этой проблемы создан целый набор навыков, повышающих продуктивность агента.
00:10:28Но больше всего нас интересует навык поиска навыков (skill retriever).
00:10:31Он заменяет полный список подсказок навыков только самыми релевантными описаниями,
00:10:36что приводит к уменьшению размера контекста.
00:10:38По сути, он выполняет еще один шаг перед тем, как Hermes обратится к модели.
00:10:42Он разбивает ваше сообщение на небольшие фрагменты, понятные модели,
00:10:45делает то же самое с каждым вашим навыком, а затем сопоставляет ваше сообщение со списком навыков.
00:10:50Навыки, набравшие наибольшее количество баллов, и отправляются.
00:10:52В их документации приводятся цифры.
00:10:54Они говорят, что при передаче всего списка используется около 11 000 токенов.
00:10:58После этого расходуется всего 2,3 тысячи, то есть они заявляют об экономии более 9 000 токенов за запрос.
00:11:04Это помогает вам двумя способами.
00:11:05Во-первых, с каждым отправляемым сообщением в окно контекста попадает гораздо меньше информации,
00:11:09поэтому работа обходится дешевле.
00:11:11И во-вторых, агент не отвлекается на навыки, не имеющие отношения к вашему вопросу,
00:11:16поэтому вы получаете лучшие ответы.
00:11:17Это поставляется в виде плагина, и Skill Retriever — один из навыков внутри него.
00:11:21Установив плагин, вы можете включить Skill Retriever в разделе плагинов.
00:11:25Тогда список навыков, попадающих в контекст, станет намного короче, чем раньше.
00:11:29Навык RTK, который мы создали в этом видео, можно найти в нашем сообществе AI Labs Pro.
00:11:35Так что, если вам было полезно то, что мы делаем, и вы хотите поддержать канал, это лучший способ.
00:11:39Ссылка в описании.
00:11:41На этом видео подходит к концу.
00:11:43Если вы хотите поддержать канал и помочь нам продолжать выпускать такие видео,
00:11:46вы можете сделать это с помощью кнопки суперспасибо ниже.
00:11:49Как всегда, спасибо за просмотр, и до встречи в следующем видео.