Hermes 에이전트를 10배 더 강력하게 만드는 핵심 기술

AAI LABS
컴퓨터/소프트웨어AI/미래기술

스크립트

00:00:00Hermes Agent가 출시된 이후로, 사람들은 이 에이전트로 온갖 종류의 워크플로우를 구축해 왔습니다.
00:00:04그리고 이미 강력한 에이전트를 더욱 유용하게 만들기 위해, 사람들은 다양한 스킬들도 함께 만들어왔죠.
00:00:10그중 일부는 GitHub에서 가장 인기 있는 프로젝트가 되기도 했습니다.
00:00:14애초에 왜 스킬을 더 설치해야 하는지 의문이 드실 수도 있을 겁니다.
00:00:17Hermes에는 이미 많은 기능이 내장되어 있고 작업 흐름으로부터 새로운 스킬을 생성할 수도 있으니까요.
00:00:22하지만 Hermes가 만드는 스킬은 오직 여러분으로부터 학습한 프로세스에서만 비롯됩니다.
00:00:25반면에 다른 사람들이 만든 스킬은 Hermes가 혼자 해결할 수 없는 문제를 이미 해결한 이들이
00:00:31그 해결책을 여러분이 쓸 수 있도록 패키지로 묶어둔 것입니다.
00:00:34이 채널이 처음이시라면 환영합니다. 저희는 소프트웨어 회사이며 이곳은 AI Labs입니다.
00:00:38이번 영상에서는 Hermes 에이전트의 사용성을 극대화해 주는 유용한 스킬들을 살펴보겠습니다.
00:00:43첫 번째 스킬을 살펴보기 전에 꼭 알아두셔야 할 점이 있습니다.
00:00:46우리가 이 스킬들을 Hermes와 함께 사용하긴 하지만, 대부분은 어떤 AI 코딩 에이전트와도 호환된다는 점입니다.
00:00:51자, 코딩 에이전트를 다뤄보셨다면 Hermes든 그 어떤 에이전트든 간에 공통된 문제를 겪어보셨을 겁니다.
00:00:56바로 모두 같은 문제를 가지고 있다는 거죠.
00:00:57대화가 길어지면 에이전트가 이전에 언급했던 세부 사항을 잊어버리게 되며,
00:01:02결국 똑같은 지시를 두 번 내여야 하는 상황이 발생합니다.
00:01:04이 현상은 특히 Hermes에서 Opus 모델을 사용할 때 더욱 두드러지는데,
00:01:08이 모델들이 내용을 더 빨리 잊어버리는 경향이 있기 때문입니다.
00:01:10이런 일이 생기는 이유는 컨텍스트 윈도우에 너무 많은 메시지가 쌓여 있고,
00:01:14모델이 그 모든 것에 신경을 써야 하기 때문입니다.
00:01:16그렇게 되면 사소한 디테일을 놓치게 되고 결과물의 질이 떨어지게 됩니다.
00:01:20이 문제를 해결하기 위해 '파일 기반 계획(Planning with Files)'이라는 스킬이 존재합니다.
00:01:24이 스킬은 에이전트가 무시할 수 없는 위치에 계획을 보관합니다.
00:01:27채팅창에 계획을 남겨두어 컨텍스트 윈도우 낭비를 유발하는 대신,
00:01:31이 스킬은 프로젝트 폴더 내에 세 개의 파일로 계획을 변환해 줍니다.
00:01:34첫 번째는 TaskPlan.MD로, 메인 작업을 더 작은 단위로 쪼개어
00:01:40에이전트가 하나씩 처리할 수 있게 합니다.
00:01:42다음은 Findings.MD인데, 에이전트가 직면했던 모든 문제와 해결 방법을 담고 있습니다.
00:01:47동일한 문제가 다시 발생하면 에이전트는 이 학습 내용을 활용해 이를 피할 수 있죠.
00:01:51마지막은 Progress.MD로, 에이전트가 어디까지 진행했는지를 기록합니다.
00:01:56계획을 파일로 관리하는 게 새롭지 않다고 생각하실 수도 있고,
00:01:59이미 많은 분이 실천하고 계실지도 모릅니다.
00:02:01이 스킬이 차별화되는 점은 에이전트가 계획을 임의로 무시할 수 없다는 것입니다.
00:02:04그 이유는 훅(hook)을 사용하기 때문인데,
00:02:06이 훅이 세 개의 파일을 컨텍스트 윈도우에 강제로 밀어 넣습니다.
00:02:09그래서 모델이 마음대로 이를 무시할 수 없는 것이죠.
00:02:12대부분의 에이전트는 훅을 지원하지 않지만, Hermes는 지원하는 몇 안 되는 에이전트 중 하나입니다.
00:02:16자체 테스트 결과에 따르면, 이 훅이 작동할 때 에이전트의 성능이 훨씬 더 뛰어났다고 합니다.
00:02:20할당받은 작업에서 엉뚱한 길로 새지 않았기 때문입니다.
00:02:23모든 에이전트의 설치 명령어는 저장소에 나와 있으며,
00:02:26관련 링크는 아래 더보기란에 기재해 두겠습니다.
00:02:28설치하고 나면 다른 스킬들과 함께 추가될 것입니다.
00:02:32그리고 훅도 여러분의 에이전트에 자동으로 설치됩니다.
00:02:35스킬 파일에는 세 파일이 무엇인지, 어디에 위치해야 하는지,
00:02:38각각 어떤 역할을 하는지가 설명되어 있습니다.
00:02:40또한 에이전트가 준수해야 할 모든 규칙도 포함되어 있어서
00:02:43자신이 무엇을 다루고 있는지 파악할 수 있죠.
00:02:44따라서 이 설치를 마치고 나면,
00:02:46스킬을 실행하고 에이전트에게 수행할 작업에 대한 프롬프트를 전달할 수 있습니다.
00:02:50여기서 보시는 것처럼 에이전트는 작업 계획 생성으로 시작하여
00:02:53발견 사항과 진행 상황 파일까지 순서대로 만들어 나갑니다.
00:02:56그런 다음 우리에게 질문을 던지고, 우리는 진행하면서 거기에 답변을 합니다.
00:02:59긴 세션이 끝난 후, 에이전트는 계획을 최종 확정하고 세 개의 파일을 제공합니다.
00:03:03다음 스킬로 넘어가기 전에,
00:03:04채널 구독과 좋아요 버튼을 눌러주시면 저희에게 정말 큰 힘이 됩니다.
00:03:08이러한 작은 성원의 손길이 저희에게는 큰 의미로 다가옵니다.
00:03:11Hermes에서는 여러 코딩 도구를 함께 사용할 수 있다는 점을 이미 알고 계실 겁니다.
00:03:15예를 들어, Codex 구독을 Hermes 에이전트에 연동하여 해당 모델들을 사용할 수 있죠.
00:03:19또한 Hermes에는 작업을 직접 보내는 Claude Code 스킬이 이미 내장되어 있으며,
00:03:24Codex에 대해서도 유사한 스킬을 지원한다는 것을 아실 겁니다.
00:03:27하지만 이러한 스킬들의 문제점은 사용자가 직접 요청하지 않으면 Hermes가 먼저 사용하지 않는다는 것입니다.
00:03:31게다가 프롬프트에서 어떤 작업을 각 에이전트에 할당해야 할지 일일이 지정해 주어야 하죠.
00:03:35하지만 시스템에 이미 설치되어 있는 어떤 에이전트에게든 작업을 알아서 보내주는 다른 스킬이 존재합니다.
00:03:40이 스킬은 모든 에이전트 사이에서 오케스트레이터 역할을 수행합니다.
00:03:43또한 설치된 코딩 도구 중 어떤 것이 특정 작업에 가장 적합한지 판단하여 해당 도구에 업무를 배분합니다.
00:03:49이것은 사실 하나의 스킬 세트입니다.
00:03:51핵심 스킬은 다른 에이전트들을 조율하는 'delegate setup'이라고 불립니다.
00:03:54여기에는 Claude Code, Codex, Cursor를 포함한 다양한 코딩 에이전트용 전용 위임 스킬들도 함께 포함되어 있습니다.
00:04:00이 에이전트들은 명령어를 실행하기 전에 허락을 구하지 않는 모드로 작동하므로,
00:04:05코딩 에이전트가 멈춰 서서 매번 변경 사항을 승인해 주기를 기다리지 않습니다.
00:04:08이 스킬을 설치하려면 설치 명령어를 실행하면 됩니다.
00:04:1118개의 스킬 중 선택하라는 창이 뜨므로 시스템에 설치된 도구를 골라 선택할 수 있습니다.
00:04:16설치가 끝나면 Hermes에 delegate setup 스킬이 준비된 것을 확인할 수 있습니다.
00:04:20사용법은 간단합니다. 슬래시 명령어로 스킬을 실행하고 프롬프트를 입력해 Hermes 에이전트에 전달하면 됩니다.
00:04:26먼저, 시스템에 어떤 코딩 도구들이 설치되어 있는지 파악합니다.
00:04:28그 후 각 에이전트가 담당할 영역과 정확한 모델 이름, 노력 수준이 담긴 전체적인 매핑 구조를 제시해 줍니다.
00:04:35계획을 승인하면 스킬들이 실행되기 시작합니다.
00:04:37그런 다음 각 작업을 선정된 에이전트에게 전달합니다.
00:04:40모든 에이전트가 결과를 보고하고 나면 Hermes가 종합 보고서 하나를 전달하고 작업을 완료 처리합니다.
00:04:46Hermes 에이전트가 터미널 명령어를 실행한다는 것은 이미 알고 계실 겁니다.
00:04:50터미널 명령어가 실행될 때마다 에이전트가 읽어야 하는 출력 결과가 반환됩니다.
00:04:5490%의 경우에 명령어 생성되는 전체 출력 결과는 사실 필요하지도 않습니다.
00:04:59오직 특정 부분만 필요할 뿐이죠.
00:05:00나머지는 불필요하게 컨텍스트 용량만 차지할 뿐입니다.
00:05:03앞서 언급했듯이 컨텍스트 윈도우에 정보가 너무 많으면 에이전트가 집중하기 어려워집니다.
00:05:09여기서 RTK가 등장합니다.
00:05:10RTK는 에이전트가 실행하는 터미널 명령어의 출력에서 에이전트에게 꼭 필요한 부분만 남기고 잘라내어
00:05:16컨텍스트 윈도우에 도달하기 전에 미리 출력을 필터링해 줍니다.
00:05:20에이전트가 가장 자주 사용하는 터미널 명령어 데이터베이스를 활용해 출력을 필터링하는 방법을 파악하고 있죠.
00:05:25예를 들어, 테스트를 실행할 때 에이전트는 성공한 테스트 결과는 볼 필요 없고 실패한 결과만 필요로 합니다.
00:05:31RTK는 기본적으로 실패한 항목만 남기고 이를 처리합니다.
00:05:35하지만 사실 이 도구는 엄밀히 말해 스킬이 아닙니다.
00:05:37기기에 따로 설치하여 터미널에서 실행하는 별도의 도구죠.
00:05:41에이전트가 올바른 컨텍스트만 확실히 받도록 만들어 주기 때문에 이 목록에 포함된 것입니다.
00:05:45원하신다면 직접 설치한 뒤 에이전트에게 이 도구를 사용하라고 지시할 수도 있습니다.
00:05:49하지만 에이전트들은 흔히 우리가 요청한 것을 잊어버리곤 하므로, 평소 방식대로 실행하는 대신 이 도구를 통해 명령어를 우회하도록 지시하는 스킬을 만들었습니다.
00:05:57이 스킬에는 에이전트가 필요한 세부 정보와 각 명령어의 레퍼런스가 포함되어 있어 어떤 명령어를 어떻게 써야 하는지 알 수 있습니다.
00:06:05이 스킬을 Hermes 설정에 추가할 수 있습니다.
00:06:07그렇게 하면 Hermes에게 어떤 작업을 주든 평소 방식 대신 모든 명령어를 RTK를 통해 실행하게 됩니다.
00:06:14에이전트에게 꼭 필요한 출력만 컨텍스트 윈도우에 도달하므로 Hermes가 훨씬 정확한 답변을 제공할 수 있습니다.
00:06:20다음 내용으로 넘어가기 전에, 스폰서인 Plural의 메시지를 들어보겠습니다.
00:06:23Plural입니다.
00:06:24운영 인프라를 관리하는 일은 대개 새벽 3시의 경고 알림을 받고 무엇이 고장 났는지 찾으려 Kubernetes 로그를 뒤지는 것으로 귀결됩니다.
00:06:31Plural은 '워크벤치(workbenches)'를 통해 이를 해결합니다.
00:06:34이것은 인프라를 직접 운영해 주는 AI 에이전트로, 기존의 액세스 제어 내부에서 실행되기 때문에 여러분이 허용한 범위 내에서만 작동합니다.
00:06:42저희가 반했던 이유는 이렇습니다.
00:06:43모니터링 시스템에 연결해 두었더니 알림이 울렸을 때 에이전트가 단순히 저희를 호출하는 데 그치지 않았습니다.
00:06:48스스로 조사를 시작해 로그와 지표를 뒤져본 뒤, 실제 진단 결과와 명확한 다음 조치 방안을 들고 나타났죠.
00:06:54또한 Datadog이나 Slack처럼 이미 사용 중인 도구와 연동되므로 알림이 울리는 즉시 또는 설정한 일정에 따라 스스로 작업을 시작할 수 있습니다.
00:07:02프롬프트를 처음부터 작성할 필요 없이 Plural 라이브러리의 기성 스킬들을 가져다 쓸 수 있습니다.
00:07:07말하자면 절대 잠들지 않는 온콜 엔지니어인 셈입니다.
00:07:10더보기란의 링크를 통해 Plural을 만나보세요.
00:07:12자, 다음 스킬은 구글에서 만든 'Mantis'입니다.
00:07:15Mantis는 에이전트가 실행할 수 있는 보안 검토 스킬 모음입니다.
00:07:19각각 보안 검토의 서로 다른 영역에 초점을 맞춘 다양한 스킬들로 구성되어 있습니다.
00:07:23이 설정은 모바일 앱이든 웹 앱이든 만들고 계신 앱의 종류에 상관없이 작동하므로, 작업 중인 환경에 설치해 사용할 수 있습니다.
00:07:30설치 명령어는 GitHub 저장소에 나와 있습니다.
00:07:33설치 명령어를 실행하면 다양한 특화 기술 중 원하는 것을 선택하라는 메시지가 뜹니다.
00:07:38전체 검토 과정의 각각 독립된 조각들이므로 전부 설치하는 것이 좋습니다.
00:07:42설정이 완료되면 설치된 목록이 전부 표시됩니다.
00:07:46예를 들어, 보안 검토 과정을 본격적으로 시작하기 전에 계획을 세워주는 Mantis plan이라는 기술이 있습니다.
00:07:52또한 발견된 모든 사항을 다시 검토하고 실패 항목이 제대로 기록되었는지 확인하는 Mantis reflect 기술도 포함되어 있습니다.
00:07:59Hermes가 상시 실행되는 에이전트이고 평소에 코딩할 때 잘 쓰지 않는다면 굳이 왜 Mantis를 추가해야 할지 의문이 들 수 있습니다.
00:08:06하지만 앱이 배포된 후에는 지속적인 보안 검토가 필요한데, 이를 직접 일일이 기억해서 실행하기는 번거롭기 때문입니다.
00:08:14바로 이 점이 Hermes를 실행하기 가장 좋은 환경으로 만들어 줍니다.
00:08:16여기에는 일정에 맞춰 스스로 실행되는 작업인 크론 잡(cron job) 기능이 있습니다.
00:08:21배포한 앱을 상대로 이 검토 세트를 실행하도록 크론 잡을 설정할 수 있습니다.
00:08:25Hermes는 항상 실행 상태를 유지하므로 문제가 발견되면 Slack이나 기타 연결된 플랫폼을 통해 알림을 보낼 수 있습니다.
00:08:31저희 프로젝트에도 이와 유사한 설정이 구축되어 있습니다.
00:08:33여기서 보시는 것처럼 프롬프트에 Hermes에게 프로젝트를 전달하고 코드 전체에 검토 세트를 실행하라고 지시했습니다.
00:08:39에이전트가 계속해서 문제를 찾아내고 수정 사항을 적용하므로 앱의 상태가 건강하게 유지되고 버그를 방지할 수 있습니다.
00:08:45에이전트를 활용해 리서치를 해보셨다면 큰 문제에 부딪힌 적이 있으실 겁니다.
00:08:49에이전트가 특정 콘텐츠에 대한 접근을 거부당하는 현상입니다.
00:08:52Reddit과 같은 많은 사이트가 AI 모델이 자신의 콘텐츠를 사용하는 것을 원하지 않기 때문에 발생합니다.
00:08:56하지만 해당 사이트들에는 실제 유저들의 문제 제기, 의견, 경험이 담겨 있어 리서치에 매우 유용한 가치를 지닙니다.
00:09:05에이전트가 이러한 콘텐츠에 접근할 수 있도록 돕는 Agent Reach라는 기술이 있습니다.
00:09:09Reddit, GitHub를 비롯해 평소에는 제한되던 여러 사이트에 Hermes가 접근할 수 있게 해줍니다.
00:09:15무료 방식을 사용하므로 비용이 전혀 들지 않습니다.
00:09:18또한 최근 GitHub에서 트렌딩 1위를 차지한 프로젝트이기도 합니다.
00:09:21이를 Hermes 설정에 설치하면 15개가 넘는 플랫폼에 접근할 수 있게 됩니다.
00:09:26Instagram, Facebook, Twitter, Reddit을 검색할 수 있습니다.
00:09:29설치를 마치면 Hermes에서 바로 사용하여 원하는 플랫폼에서 어떤 주제든 검색할 수 있습니다.
00:09:35자체 스크립트를 실행해 관련 정보를 찾은 뒤 필요한 답변을 제공해 줍니다.
00:09:41이미 아시다시피 Hermes에는 90개가 넘는 내장 기술이 기본 포함되어 있습니다.
00:09:45그뿐만 아니라, 채팅 중에 나중에 유용하게 쓰일 수 있는 워크플로우를 감지하면
00:09:50실제로 그로부터 새로운 기술을 생성하여 이후 실행에 활용할 수 있습니다.
00:09:54사용자에 맞춰 자동으로 적응하므로 좋아 보이지만 여기에 한 가지 문제가 있습니다.
00:09:58실제로 컨텍스트 윈도우에 들어가는 기술의 일부분은 이름과 설명뿐이라는 점입니다.
00:10:04에이전트가 이러한 기술의 존재를 인식할 수 있도록 매 메시지마다 함께 전송됩니다.
00:10:08이름과 설명 정도는 작은 분량이라 컨텍스트 윈도우에 영향을 주지 않는다고 생각할 수 있지만,
00:10:14기술이 100개가 넘고 Hermes를 오랜 기간 사용해 왔다면
00:10:18그 모든 이름과 설명이 컨텍스트 윈도우의 엄청난 부분을 차지하게 됩니다.
00:10:23따라서 이 문제를 해결하기 위해 에이전트의 생산성을 높이도록 설계된 일련의 기술 세트가 존재합니다.
00:10:28하지만 그중에서 우리가 가장 주목하는 것은 바로 기술 검색기(Skill Retriever) 기술입니다.
00:10:31전체 기술 프롬프트 목록을 가장 관련성이 높은 기술 설명으로만 대체하여
00:10:36컨텍스트 크기를 줄여줍니다.
00:10:38즉, 기본적으로 Hermes가 모델을 호출하기 전에 또 다른 단계를 거치는 방식입니다.
00:10:42메시지를 모델이 이해할 수 있는 작은 조각으로 나누고
00:10:45모든 보유 기술에도 동일한 작업을 거친 뒤 메시지와 기술 목록을 매칭합니다.
00:10:50가장 높은 점수를 받은 기술들이 전송됩니다.
00:10:52문서에 구체적인 수치가 나와 있습니다.
00:10:54전체 목록이 들어갈 때는 약 11,000개의 토큰이 사용되었다고 합니다.
00:10:58이후에는 2,300개만 사용하므로 매번 9,000개 이상의 토큰을 절약할 수 있다고 주장합니다.
00:11:04이는 두 가지 면에서 도움이 됩니다.
00:11:05첫째, 메시지를 보낼 때마다 컨텍스트 윈도우에 들어가는 양이 훨씬 적어지므로
00:11:09운영 비용이 절감됩니다.
00:11:11둘째, 요청 사항과 관련 없는 기술들로 인해 에이전트가 산만해지지 않으므로
00:11:16더 나은 답변을 얻을 수 있습니다.
00:11:17이 기능은 플러그인 형태로 제공되며 기술 검색기(Skill Retriever)는 그 안에 포함된 기술 중 하나입니다.
00:11:21플러그인을 설치한 후 플러그인 메뉴에서 기술 검색기를 활성화할 수 있습니다.
00:11:25그러면 컨텍스트에 들어가는 기술 목록이 이전보다 훨씬 짧아지게 됩니다.
00:11:29이번 영상에서 만든 RTK 기술은 저희 커뮤니티인 AI Labs Pro에서 확인하실 수 있습니다.
00:11:35저희의 활동이 유익했고 채널을 지원하고 싶으시다면 이것이 가장 좋은 방법입니다.
00:11:39링크는 설명란에 있습니다.
00:11:41이것으로 이번 영상도 마무리하겠습니다.
00:11:43채널을 지원하고 이와 같은 영상을 계속 만들 수 있도록 돕고 싶으시다면
00:11:46아래의 슈퍼 땡스(Super Thanks) 버튼을 통해 동참해 주실 수 있습니다.
00:11:49언제나 시청해 주셔서 감사드리며 다음 영상에서 뵙겠습니다.

핵심 요약

다양한 외부 스킬과 도구를 연동하면 Hermes 에이전트의 컨텍스트 윈도우 효율과 작업 정확도를 극대화할 수 있습니다.

하이라이트

  • 파일 기반 계획 스킬은 TaskPlan, Findings, Progress 등 세 개의 파일을 컨텍스트 윈도우에 강제로 유지하여 에이전트의 기억 상실 문제를 방지합니다.

  • 위임 설정 스킬은 Claude Code, Codex, Cursor 등 시스템에 설치된 코딩 도구 중 특정 작업에 가장 적합한 도구를 판단하여 자동으로 업무를 배분합니다.

  • RTK는 터미널 명령어의 출력 결과 중 성공한 테스트 결과를 제외하고 실패한 항목 등 에이전트에게 필요한 핵심 부분만 필터링하여 컨텍스트 윈도우 낭비를 줄입니다.

  • Mantis는 모바일 앱이나 웹 앱 배포 후 크론 잡을 통해 상시 실행되며 지속적인 보안 검토를 수행하고 문제를 발견할 경우 알림을 보냅니다.

  • Agent Reach는 Reddit, GitHub 등 AI 모델의 접근이 거부된 15개가 넘는 플랫폼에 비용 없이 접근하여 실제 유저들의 경험과 데이터를 수집할 수 있게 합니다.

  • 기술 검색기 플러그인은 전체 기술 프롬프트 목록 대신 가장 관련성이 높은 기술 설명만 매칭하여 매 운영마다 9,000개 이상의 토큰을 절약합니다.

타임라인

파일 기반 계획을 통한 에이전트 기억 유지

  • 대화가 길어지면 에이전트가 이전 세부 사항을 잊어버리는 문제가 발생합니다.
  • 파일 기반 계획 스킬은 프로젝트 폴더 내에 TaskPlan, Findings, Progress 세 개의 파일을 생성합니다.
  • 훅이 세 개의 파일을 컨텍스트 윈도우에 강제로 밀어 넣어 에이전트가 임의로 계획을 무시하지 못하게 합니다.

Hermes에서 Opus 모델을 사용할 때 컨텍스트 윈도우에 메시지가 너무 많이 쌓이면 사소한 디테일을 놓치는 현상이 두드러집니다. 이를 해결하기 위해 채팅창 대신 프로젝트 폴더 내에 메인 작업을 쪼개는 TaskPlan.MD, 문제와 해결 방법을 담은 Findings.MD, 진행 상황을 기록하는 Progress.MD 파일을 활용합니다. 훅을 통해 이 파일들을 강제로 컨텍스트에 유지함으로써 에이전트가 엉뚱한 길로 새지 않고 훨씬 뛰어난 성능을 발휘합니다.

코딩 에이전트 오케스트레이션을 위한 위임 스킬

  • Hermes는 Claude Code, Codex, Cursor 등 여러 코딩 도구를 함께 사용할 수 있습니다.
  • 위임 설정 스킬은 설치된 코딩 도구 중 특정 작업에 가장 적합한 도구를 판단하여 업무를 배분합니다.
  • 에이전트들은 명령어를 실행하기 전에 허락을 구하지 않는 모드로 작동하여 승인을 기다리는 지연을 없앱니다.

사용자가 직접 프롬프트에서 각 에이전트에 작업을 할당해야 하는 번거로움을 없애기 위해 오케스트레이터 역할을 수행하는 위임 스킬 세트가 존재합니다. 명령어를 실행하면 시스템에 설치된 도구 목록을 파악하고 각 에이전트가 담당할 영역과 모델 이름이 담긴 매핑 구조를 제시합니다. 모든 에이전트가 작업을 완료하고 결과를 보고하면 Hermes가 최종 종합 보고서를 전달합니다.

RTK를 통한 터미널 출력 필터링

  • 터미널 명령어의 전체 출력 결과 중 90%는 에이전트에게 실제로 필요하지 않습니다.
  • RTK는 에이전트에게 꼭 필요한 부분만 남기고 출력을 미리 필터링합니다.
  • 테스트 실행 시 성공한 결과는 제외하고 실패한 항목만 남겨 컨텍스트 용량을 절약합니다.

에이전트가 터미널 명령어를 실행할 때 발생하는 방대한 출력 결과는 불필요하게 컨텍스트 용량을 차지하여 집중력을 떨어뜨립니다. 독립적인 기기 설치 도구인 RTK는 자주 사용하는 터미널 명령어 데이터베이스를 활용해 필수적인 세부 정보와 레퍼런스만 남깁니다. Hermes 설정에 이 스킬을 추가하면 모든 명령어가 RTK를 거쳐 실행되므로 에이전트가 훨씬 정확한 답변을 제공합니다.

Mantis를 활용한 지속적인 자동 보안 검토

  • Mantis는 에이전트가 실행할 수 있는 다양한 보안 검토 스킬 모음입니다.
  • 배포된 앱을 상대로 크론 잡을 설정하여 상시 실행 및 모니터링이 가능합니다.
  • 문제가 발견되면 Slack 등을 통해 알림을 보내고 스스로 수정 사항을 적용합니다.

앱이 배포된 후에는 지속적인 보안 검토가 필요하지만 사람이 직접 실행하기는 번거롭습니다. Mantis는 모바일과 웹 앱 환경에 상관없이 작동하는 보안 검토 스킬 세트를 제공합니다. Hermes의 상시 실행 및 크론 잡 기능을 활용해 배포된 앱을 주기적으로 검토하고 버그를 예방할 수 있습니다.

Agent Reach를 통한 제한된 플랫폼 접근

  • 많은 사이트가 AI 모델의 콘텐츠 접근을 거부하여 리서치에 어려움이 발생합니다.
  • Agent Reach는 Reddit, GitHub 등 제한되던 사이트에 Hermes가 접근할 수 있게 합니다.
  • 15개가 넘는 플랫폼을 무료로 검색하여 실제 유저들의 문제 제기와 경험을 수집합니다.

Reddit 같은 플랫폼은 AI의 데이터 수집을 차단하지만 실제 유저들의 의견과 문제 해결 경험이 담겨 있어 리서치에 큰 가치를 지닙니다. Agent Reach 기술을 설정에 설치하면 Instagram, Facebook, Twitter, Reddit 등 15개 이상의 플랫폼에서 자체 스크립트를 실행해 필요한 정보를 직접 검색하고 답변을 도출할 수 있습니다.

기술 검색기를 통한 토큰 절약과 최적화

  • Hermes는 사용 중 생성된 기술의 이름과 설명을 매 메시지마다 컨텍스트에 전송합니다.
  • 기술이 100개가 넘으면 컨텍스트 윈도우의 엄청난 부분을 차지하게 됩니다.
  • 기술 검색기는 가장 관련성이 높은 기술 설명만 매칭하여 매번 9,000개 이상의 토큰을 절약합니다.

Hermes는 워크플로우에서 새로운 기술을 자동으로 생성하지만 기술이 많아질수록 이름과 설명이 컨텍스트 윈도우를 과도하게 점유합니다. 기술 검색기 플러그인은 메시지와 보유 기술을 매칭하여 가장 높은 점수를 받은 관련 기술 설명만 모델에 전송합니다. 이를 통해 운영 비용을 절감하고 관련 없는 기술로 인한 에이전트의 산만함을 방지합니다.

커뮤니티 글

모든 글 보기