Transcript
00:00:00Hermes Agent가 출시된 이후로, 사람들은 이 에이전트로 온갖 종류의 워크플로우를 구축해 왔습니다.
00:00:04그리고 이미 강력한 에이전트를 더욱 유용하게 만들기 위해, 사람들은 다양한 스킬들도 함께 만들어왔죠.
00:00:10그중 일부는 GitHub에서 가장 인기 있는 프로젝트가 되기도 했습니다.
00:00:14애초에 왜 스킬을 더 설치해야 하는지 의문이 드실 수도 있을 겁니다.
00:00:17Hermes에는 이미 많은 기능이 내장되어 있고 작업 흐름으로부터 새로운 스킬을 생성할 수도 있으니까요.
00:00:22하지만 Hermes가 만드는 스킬은 오직 여러분으로부터 학습한 프로세스에서만 비롯됩니다.
00:00:25반면에 다른 사람들이 만든 스킬은 Hermes가 혼자 해결할 수 없는 문제를 이미 해결한 이들이
00:00:31그 해결책을 여러분이 쓸 수 있도록 패키지로 묶어둔 것입니다.
00:00:34이 채널이 처음이시라면 환영합니다. 저희는 소프트웨어 회사이며 이곳은 AI Labs입니다.
00:00:38이번 영상에서는 Hermes 에이전트의 사용성을 극대화해 주는 유용한 스킬들을 살펴보겠습니다.
00:00:43첫 번째 스킬을 살펴보기 전에 꼭 알아두셔야 할 점이 있습니다.
00:00:46우리가 이 스킬들을 Hermes와 함께 사용하긴 하지만, 대부분은 어떤 AI 코딩 에이전트와도 호환된다는 점입니다.
00:00:51자, 코딩 에이전트를 다뤄보셨다면 Hermes든 그 어떤 에이전트든 간에 공통된 문제를 겪어보셨을 겁니다.
00:00:56바로 모두 같은 문제를 가지고 있다는 거죠.
00:00:57대화가 길어지면 에이전트가 이전에 언급했던 세부 사항을 잊어버리게 되며,
00:01:02결국 똑같은 지시를 두 번 내여야 하는 상황이 발생합니다.
00:01:04이 현상은 특히 Hermes에서 Opus 모델을 사용할 때 더욱 두드러지는데,
00:01:08이 모델들이 내용을 더 빨리 잊어버리는 경향이 있기 때문입니다.
00:01:10이런 일이 생기는 이유는 컨텍스트 윈도우에 너무 많은 메시지가 쌓여 있고,
00:01:14모델이 그 모든 것에 신경을 써야 하기 때문입니다.
00:01:16그렇게 되면 사소한 디테일을 놓치게 되고 결과물의 질이 떨어지게 됩니다.
00:01:20이 문제를 해결하기 위해 '파일 기반 계획(Planning with Files)'이라는 스킬이 존재합니다.
00:01:24이 스킬은 에이전트가 무시할 수 없는 위치에 계획을 보관합니다.
00:01:27채팅창에 계획을 남겨두어 컨텍스트 윈도우 낭비를 유발하는 대신,
00:01:31이 스킬은 프로젝트 폴더 내에 세 개의 파일로 계획을 변환해 줍니다.
00:01:34첫 번째는 TaskPlan.MD로, 메인 작업을 더 작은 단위로 쪼개어
00:01:40에이전트가 하나씩 처리할 수 있게 합니다.
00:01:42다음은 Findings.MD인데, 에이전트가 직면했던 모든 문제와 해결 방법을 담고 있습니다.
00:01:47동일한 문제가 다시 발생하면 에이전트는 이 학습 내용을 활용해 이를 피할 수 있죠.
00:01:51마지막은 Progress.MD로, 에이전트가 어디까지 진행했는지를 기록합니다.
00:01:56계획을 파일로 관리하는 게 새롭지 않다고 생각하실 수도 있고,
00:01:59이미 많은 분이 실천하고 계실지도 모릅니다.
00:02:01이 스킬이 차별화되는 점은 에이전트가 계획을 임의로 무시할 수 없다는 것입니다.
00:02:04그 이유는 훅(hook)을 사용하기 때문인데,
00:02:06이 훅이 세 개의 파일을 컨텍스트 윈도우에 강제로 밀어 넣습니다.
00:02:09그래서 모델이 마음대로 이를 무시할 수 없는 것이죠.
00:02:12대부분의 에이전트는 훅을 지원하지 않지만, Hermes는 지원하는 몇 안 되는 에이전트 중 하나입니다.
00:02:16자체 테스트 결과에 따르면, 이 훅이 작동할 때 에이전트의 성능이 훨씬 더 뛰어났다고 합니다.
00:02:20할당받은 작업에서 엉뚱한 길로 새지 않았기 때문입니다.
00:02:23모든 에이전트의 설치 명령어는 저장소에 나와 있으며,
00:02:26관련 링크는 아래 더보기란에 기재해 두겠습니다.
00:02:28설치하고 나면 다른 스킬들과 함께 추가될 것입니다.
00:02:32그리고 훅도 여러분의 에이전트에 자동으로 설치됩니다.
00:02:35스킬 파일에는 세 파일이 무엇인지, 어디에 위치해야 하는지,
00:02:38각각 어떤 역할을 하는지가 설명되어 있습니다.
00:02:40또한 에이전트가 준수해야 할 모든 규칙도 포함되어 있어서
00:02:43자신이 무엇을 다루고 있는지 파악할 수 있죠.
00:02:44따라서 이 설치를 마치고 나면,
00:02:46스킬을 실행하고 에이전트에게 수행할 작업에 대한 프롬프트를 전달할 수 있습니다.
00:02:50여기서 보시는 것처럼 에이전트는 작업 계획 생성으로 시작하여
00:02:53발견 사항과 진행 상황 파일까지 순서대로 만들어 나갑니다.
00:02:56그런 다음 우리에게 질문을 던지고, 우리는 진행하면서 거기에 답변을 합니다.
00:02:59긴 세션이 끝난 후, 에이전트는 계획을 최종 확정하고 세 개의 파일을 제공합니다.
00:03:03다음 스킬로 넘어가기 전에,
00:03:04채널 구독과 좋아요 버튼을 눌러주시면 저희에게 정말 큰 힘이 됩니다.
00:03:08이러한 작은 성원의 손길이 저희에게는 큰 의미로 다가옵니다.
00:03:11Hermes에서는 여러 코딩 도구를 함께 사용할 수 있다는 점을 이미 알고 계실 겁니다.
00:03:15예를 들어, Codex 구독을 Hermes 에이전트에 연동하여 해당 모델들을 사용할 수 있죠.
00:03:19또한 Hermes에는 작업을 직접 보내는 Claude Code 스킬이 이미 내장되어 있으며,
00:03:24Codex에 대해서도 유사한 스킬을 지원한다는 것을 아실 겁니다.
00:03:27하지만 이러한 스킬들의 문제점은 사용자가 직접 요청하지 않으면 Hermes가 먼저 사용하지 않는다는 것입니다.
00:03:31게다가 프롬프트에서 어떤 작업을 각 에이전트에 할당해야 할지 일일이 지정해 주어야 하죠.
00:03:35하지만 시스템에 이미 설치되어 있는 어떤 에이전트에게든 작업을 알아서 보내주는 다른 스킬이 존재합니다.
00:03:40이 스킬은 모든 에이전트 사이에서 오케스트레이터 역할을 수행합니다.
00:03:43또한 설치된 코딩 도구 중 어떤 것이 특정 작업에 가장 적합한지 판단하여 해당 도구에 업무를 배분합니다.
00:03:49이것은 사실 하나의 스킬 세트입니다.
00:03:51핵심 스킬은 다른 에이전트들을 조율하는 'delegate setup'이라고 불립니다.
00:03:54여기에는 Claude Code, Codex, Cursor를 포함한 다양한 코딩 에이전트용 전용 위임 스킬들도 함께 포함되어 있습니다.
00:04:00이 에이전트들은 명령어를 실행하기 전에 허락을 구하지 않는 모드로 작동하므로,
00:04:05코딩 에이전트가 멈춰 서서 매번 변경 사항을 승인해 주기를 기다리지 않습니다.
00:04:08이 스킬을 설치하려면 설치 명령어를 실행하면 됩니다.
00:04:1118개의 스킬 중 선택하라는 창이 뜨므로 시스템에 설치된 도구를 골라 선택할 수 있습니다.
00:04:16설치가 끝나면 Hermes에 delegate setup 스킬이 준비된 것을 확인할 수 있습니다.
00:04:20사용법은 간단합니다. 슬래시 명령어로 스킬을 실행하고 프롬프트를 입력해 Hermes 에이전트에 전달하면 됩니다.
00:04:26먼저, 시스템에 어떤 코딩 도구들이 설치되어 있는지 파악합니다.
00:04:28그 후 각 에이전트가 담당할 영역과 정확한 모델 이름, 노력 수준이 담긴 전체적인 매핑 구조를 제시해 줍니다.
00:04:35계획을 승인하면 스킬들이 실행되기 시작합니다.
00:04:37그런 다음 각 작업을 선정된 에이전트에게 전달합니다.
00:04:40모든 에이전트가 결과를 보고하고 나면 Hermes가 종합 보고서 하나를 전달하고 작업을 완료 처리합니다.
00:04:46Hermes 에이전트가 터미널 명령어를 실행한다는 것은 이미 알고 계실 겁니다.
00:04:50터미널 명령어가 실행될 때마다 에이전트가 읽어야 하는 출력 결과가 반환됩니다.
00:04:5490%의 경우에 명령어 생성되는 전체 출력 결과는 사실 필요하지도 않습니다.
00:04:59오직 특정 부분만 필요할 뿐이죠.
00:05:00나머지는 불필요하게 컨텍스트 용량만 차지할 뿐입니다.
00:05:03앞서 언급했듯이 컨텍스트 윈도우에 정보가 너무 많으면 에이전트가 집중하기 어려워집니다.
00:05:09여기서 RTK가 등장합니다.
00:05:10RTK는 에이전트가 실행하는 터미널 명령어의 출력에서 에이전트에게 꼭 필요한 부분만 남기고 잘라내어
00:05:16컨텍스트 윈도우에 도달하기 전에 미리 출력을 필터링해 줍니다.
00:05:20에이전트가 가장 자주 사용하는 터미널 명령어 데이터베이스를 활용해 출력을 필터링하는 방법을 파악하고 있죠.
00:05:25예를 들어, 테스트를 실행할 때 에이전트는 성공한 테스트 결과는 볼 필요 없고 실패한 결과만 필요로 합니다.
00:05:31RTK는 기본적으로 실패한 항목만 남기고 이를 처리합니다.
00:05:35하지만 사실 이 도구는 엄밀히 말해 스킬이 아닙니다.
00:05:37기기에 따로 설치하여 터미널에서 실행하는 별도의 도구죠.
00:05:41에이전트가 올바른 컨텍스트만 확실히 받도록 만들어 주기 때문에 이 목록에 포함된 것입니다.
00:05:45원하신다면 직접 설치한 뒤 에이전트에게 이 도구를 사용하라고 지시할 수도 있습니다.
00:05:49하지만 에이전트들은 흔히 우리가 요청한 것을 잊어버리곤 하므로, 평소 방식대로 실행하는 대신 이 도구를 통해 명령어를 우회하도록 지시하는 스킬을 만들었습니다.
00:05:57이 스킬에는 에이전트가 필요한 세부 정보와 각 명령어의 레퍼런스가 포함되어 있어 어떤 명령어를 어떻게 써야 하는지 알 수 있습니다.
00:06:05이 스킬을 Hermes 설정에 추가할 수 있습니다.
00:06:07그렇게 하면 Hermes에게 어떤 작업을 주든 평소 방식 대신 모든 명령어를 RTK를 통해 실행하게 됩니다.
00:06:14에이전트에게 꼭 필요한 출력만 컨텍스트 윈도우에 도달하므로 Hermes가 훨씬 정확한 답변을 제공할 수 있습니다.
00:06:20다음 내용으로 넘어가기 전에, 스폰서인 Plural의 메시지를 들어보겠습니다.
00:06:23Plural입니다.
00:06:24운영 인프라를 관리하는 일은 대개 새벽 3시의 경고 알림을 받고 무엇이 고장 났는지 찾으려 Kubernetes 로그를 뒤지는 것으로 귀결됩니다.
00:06:31Plural은 '워크벤치(workbenches)'를 통해 이를 해결합니다.
00:06:34이것은 인프라를 직접 운영해 주는 AI 에이전트로, 기존의 액세스 제어 내부에서 실행되기 때문에 여러분이 허용한 범위 내에서만 작동합니다.
00:06:42저희가 반했던 이유는 이렇습니다.
00:06:43모니터링 시스템에 연결해 두었더니 알림이 울렸을 때 에이전트가 단순히 저희를 호출하는 데 그치지 않았습니다.
00:06:48스스로 조사를 시작해 로그와 지표를 뒤져본 뒤, 실제 진단 결과와 명확한 다음 조치 방안을 들고 나타났죠.
00:06:54또한 Datadog이나 Slack처럼 이미 사용 중인 도구와 연동되므로 알림이 울리는 즉시 또는 설정한 일정에 따라 스스로 작업을 시작할 수 있습니다.
00:07:02프롬프트를 처음부터 작성할 필요 없이 Plural 라이브러리의 기성 스킬들을 가져다 쓸 수 있습니다.
00:07:07말하자면 절대 잠들지 않는 온콜 엔지니어인 셈입니다.
00:07:10더보기란의 링크를 통해 Plural을 만나보세요.
00:07:12자, 다음 스킬은 구글에서 만든 'Mantis'입니다.
00:07:15Mantis는 에이전트가 실행할 수 있는 보안 검토 스킬 모음입니다.
00:07:19각각 보안 검토의 서로 다른 영역에 초점을 맞춘 다양한 스킬들로 구성되어 있습니다.
00:07:23이 설정은 모바일 앱이든 웹 앱이든 만들고 계신 앱의 종류에 상관없이 작동하므로, 작업 중인 환경에 설치해 사용할 수 있습니다.
00:07:30설치 명령어는 GitHub 저장소에 나와 있습니다.
00:07:33설치 명령어를 실행하면 다양한 특화 기술 중 원하는 것을 선택하라는 메시지가 뜹니다.
00:07:38전체 검토 과정의 각각 독립된 조각들이므로 전부 설치하는 것이 좋습니다.
00:07:42설정이 완료되면 설치된 목록이 전부 표시됩니다.
00:07:46예를 들어, 보안 검토 과정을 본격적으로 시작하기 전에 계획을 세워주는 Mantis plan이라는 기술이 있습니다.
00:07:52또한 발견된 모든 사항을 다시 검토하고 실패 항목이 제대로 기록되었는지 확인하는 Mantis reflect 기술도 포함되어 있습니다.
00:07:59Hermes가 상시 실행되는 에이전트이고 평소에 코딩할 때 잘 쓰지 않는다면 굳이 왜 Mantis를 추가해야 할지 의문이 들 수 있습니다.
00:08:06하지만 앱이 배포된 후에는 지속적인 보안 검토가 필요한데, 이를 직접 일일이 기억해서 실행하기는 번거롭기 때문입니다.
00:08:14바로 이 점이 Hermes를 실행하기 가장 좋은 환경으로 만들어 줍니다.
00:08:16여기에는 일정에 맞춰 스스로 실행되는 작업인 크론 잡(cron job) 기능이 있습니다.
00:08:21배포한 앱을 상대로 이 검토 세트를 실행하도록 크론 잡을 설정할 수 있습니다.
00:08:25Hermes는 항상 실행 상태를 유지하므로 문제가 발견되면 Slack이나 기타 연결된 플랫폼을 통해 알림을 보낼 수 있습니다.
00:08:31저희 프로젝트에도 이와 유사한 설정이 구축되어 있습니다.
00:08:33여기서 보시는 것처럼 프롬프트에 Hermes에게 프로젝트를 전달하고 코드 전체에 검토 세트를 실행하라고 지시했습니다.
00:08:39에이전트가 계속해서 문제를 찾아내고 수정 사항을 적용하므로 앱의 상태가 건강하게 유지되고 버그를 방지할 수 있습니다.
00:08:45에이전트를 활용해 리서치를 해보셨다면 큰 문제에 부딪힌 적이 있으실 겁니다.
00:08:49에이전트가 특정 콘텐츠에 대한 접근을 거부당하는 현상입니다.
00:08:52Reddit과 같은 많은 사이트가 AI 모델이 자신의 콘텐츠를 사용하는 것을 원하지 않기 때문에 발생합니다.
00:08:56하지만 해당 사이트들에는 실제 유저들의 문제 제기, 의견, 경험이 담겨 있어 리서치에 매우 유용한 가치를 지닙니다.
00:09:05에이전트가 이러한 콘텐츠에 접근할 수 있도록 돕는 Agent Reach라는 기술이 있습니다.
00:09:09Reddit, GitHub를 비롯해 평소에는 제한되던 여러 사이트에 Hermes가 접근할 수 있게 해줍니다.
00:09:15무료 방식을 사용하므로 비용이 전혀 들지 않습니다.
00:09:18또한 최근 GitHub에서 트렌딩 1위를 차지한 프로젝트이기도 합니다.
00:09:21이를 Hermes 설정에 설치하면 15개가 넘는 플랫폼에 접근할 수 있게 됩니다.
00:09:26Instagram, Facebook, Twitter, Reddit을 검색할 수 있습니다.
00:09:29설치를 마치면 Hermes에서 바로 사용하여 원하는 플랫폼에서 어떤 주제든 검색할 수 있습니다.
00:09:35자체 스크립트를 실행해 관련 정보를 찾은 뒤 필요한 답변을 제공해 줍니다.
00:09:41이미 아시다시피 Hermes에는 90개가 넘는 내장 기술이 기본 포함되어 있습니다.
00:09:45그뿐만 아니라, 채팅 중에 나중에 유용하게 쓰일 수 있는 워크플로우를 감지하면
00:09:50실제로 그로부터 새로운 기술을 생성하여 이후 실행에 활용할 수 있습니다.
00:09:54사용자에 맞춰 자동으로 적응하므로 좋아 보이지만 여기에 한 가지 문제가 있습니다.
00:09:58실제로 컨텍스트 윈도우에 들어가는 기술의 일부분은 이름과 설명뿐이라는 점입니다.
00:10:04에이전트가 이러한 기술의 존재를 인식할 수 있도록 매 메시지마다 함께 전송됩니다.
00:10:08이름과 설명 정도는 작은 분량이라 컨텍스트 윈도우에 영향을 주지 않는다고 생각할 수 있지만,
00:10:14기술이 100개가 넘고 Hermes를 오랜 기간 사용해 왔다면
00:10:18그 모든 이름과 설명이 컨텍스트 윈도우의 엄청난 부분을 차지하게 됩니다.
00:10:23따라서 이 문제를 해결하기 위해 에이전트의 생산성을 높이도록 설계된 일련의 기술 세트가 존재합니다.
00:10:28하지만 그중에서 우리가 가장 주목하는 것은 바로 기술 검색기(Skill Retriever) 기술입니다.
00:10:31전체 기술 프롬프트 목록을 가장 관련성이 높은 기술 설명으로만 대체하여
00:10:36컨텍스트 크기를 줄여줍니다.
00:10:38즉, 기본적으로 Hermes가 모델을 호출하기 전에 또 다른 단계를 거치는 방식입니다.
00:10:42메시지를 모델이 이해할 수 있는 작은 조각으로 나누고
00:10:45모든 보유 기술에도 동일한 작업을 거친 뒤 메시지와 기술 목록을 매칭합니다.
00:10:50가장 높은 점수를 받은 기술들이 전송됩니다.
00:10:52문서에 구체적인 수치가 나와 있습니다.
00:10:54전체 목록이 들어갈 때는 약 11,000개의 토큰이 사용되었다고 합니다.
00:10:58이후에는 2,300개만 사용하므로 매번 9,000개 이상의 토큰을 절약할 수 있다고 주장합니다.
00:11:04이는 두 가지 면에서 도움이 됩니다.
00:11:05첫째, 메시지를 보낼 때마다 컨텍스트 윈도우에 들어가는 양이 훨씬 적어지므로
00:11:09운영 비용이 절감됩니다.
00:11:11둘째, 요청 사항과 관련 없는 기술들로 인해 에이전트가 산만해지지 않으므로
00:11:16더 나은 답변을 얻을 수 있습니다.
00:11:17이 기능은 플러그인 형태로 제공되며 기술 검색기(Skill Retriever)는 그 안에 포함된 기술 중 하나입니다.
00:11:21플러그인을 설치한 후 플러그인 메뉴에서 기술 검색기를 활성화할 수 있습니다.
00:11:25그러면 컨텍스트에 들어가는 기술 목록이 이전보다 훨씬 짧아지게 됩니다.
00:11:29이번 영상에서 만든 RTK 기술은 저희 커뮤니티인 AI Labs Pro에서 확인하실 수 있습니다.
00:11:35저희의 활동이 유익했고 채널을 지원하고 싶으시다면 이것이 가장 좋은 방법입니다.
00:11:39링크는 설명란에 있습니다.
00:11:41이것으로 이번 영상도 마무리하겠습니다.
00:11:43채널을 지원하고 이와 같은 영상을 계속 만들 수 있도록 돕고 싶으시다면
00:11:46아래의 슈퍼 땡스(Super Thanks) 버튼을 통해 동참해 주실 수 있습니다.
00:11:49언제나 시청해 주셔서 감사드리며 다음 영상에서 뵙겠습니다.