Transcript
00:00:00Hermes Agentがリリースされて以来、さまざまなワークフローを構築する人が続出しています.
00:00:04すでに強力なエージェントをさらに進化させるため、多くのスキルも開発されてきました.
00:00:10GitHubで大きな話題を集めているプロジェクトも少なくありません.
00:00:14そもそもなぜ新たなスキルをインストールする必要があるのか、疑問に思うかもしれません.
00:00:17Hermesには標準で多くの機能が備わっており、ワークフローから新しいスキルを作成することもできるからです.
00:00:22しかし、Hermesが自ら作成するスキルは、ユーザーから学習したプロセスに基づいたものに限られます.
00:00:25一方、その他のスキルは、Hermes単体では対処できない問題をすでに解決した人々によって開発されており,
00:00:31その解決策を利用可能なスキルとしてパッケージ化しています.
00:00:34当チャンネルを初めてご覧の方へ、ようこそ。私たちはソフトウェア企業であり、ここはAI Labsです.
00:00:38今回は、Hermesエージェントの利便性を劇的に高めるスキルについて詳しく見ていきます.
00:00:43ですが、最初のスキルに入る前に、これだけは知っておく必要があります。
00:00:46これらのスキルはHermesで使用しますが、その大部分は他のあらゆるAIコーディングエージェントでも活用可能です.
00:00:51Hermesに限らず、あるいは他のいかなるエージェントであれ、コーディングエージェントを使用しているなら
00:00:56誰もが同じ問題を抱えています.
00:00:57長時間の会話を続けると、エージェントが以前伝えた詳細を忘れてしまうことがあり,
00:01:02同じ指示をもう一度繰り返さなければならなくなります.
00:01:04これはHermesでOpusモデルを使用している場合に特に起こりやすく
00:01:08情報をより早く忘却してしまう傾向があるためです.
00:01:10原因は、コンテキストウィンドウ内のメッセージが多すぎることにあります.
00:01:14モデルはそのすべてに注意を払わなければなりません.
00:01:16その結果、細かい詳細を見落とし、精度の低い回答につながってしまいます.
00:01:20この問題を解決するのが「Planning with Files」と呼ばれるスキルです.
00:01:24エージェントが無視できない場所に計画を保持してくれます.
00:01:27チャット内に計画を留めてコンテキストウィンドウのスペースを圧迫する代わりに,
00:01:31このスキルは計画をプロジェクトフォルダ内の3つのファイルに変換します.
00:01:341つ目はTaskPlan.MDで、メインのタスクをより小さなタスクに分割し
00:01:40エージェントが1つずつ実行できるようにします.
00:01:422つ目はFindings.MDで、エージェントが直面したすべての問題と、その解決方法が記録されます.
00:01:47同じ問題が再び発生した場合、エージェントはその学習内容を活用して回避できます.
00:01:51そして3つ目はProgress.MDで、エージェントの進捗状況を記録します.
00:01:56ファイルで計画を管理することは新しいことではないと思われるかもしれませんし,
00:01:59すでに実践している方も多いでしょう.
00:02:01このスキルが優れているのは、エージェントが計画を無視できない点にあります.
00:02:04フックを使用しているためです.
00:02:06これによって3つのファイルがコンテキストウィンドウに強制的に挿入されるため,
00:02:09モデルが勝手に無視することはできません.
00:02:12ほとんどのエージェントはフックをサポートしていませんが、Hermesは数少ない例外の1つです.
00:02:16開発元によるテストによると、フックを有効にして実行した方がパフォーマンスが大幅に向上しました.
00:02:20割り当てられたタスクから脱線しなくなったためです.
00:02:23各エージェントのインストールコマンドはリポジトリに記載されており,
00:02:26リンクは以下の概要欄に掲載されています.
00:02:28インストールが完了すると、他のすべてのスキルと並行して追加されます.
00:02:32また、フックもエージェントに自動的にインストールされます.
00:02:35スキルファイルには、3つのファイルの内容、配置場所
00:02:38そしてそれぞれの役割が説明されています.
00:02:40エージェントが従うべきすべてのルールも含まれているため,
00:02:43自分が何を扱っているのかを把握できます.
00:02:44このようにインストールを済ませれば,
00:02:46スキルを実行し、エージェントにさせたいことのプロンプトを与えることができます.
00:02:50ご覧の通り、エージェントはまずタスクプラン、発見事項
00:02:53そして進捗ファイルをそれぞれ作成することから始めます.
00:02:56その後、質問を投げかけてくるので、進行に合わせて回答します.
00:02:59長いセッションの終了後、計画をファイナライズして3つのファイルを提供してくれます.
00:03:03次のスキルに進む前に,
00:03:04チャンネル登録と高評価ボタンのクリックをよろしくお願いいたします.
00:03:08こうした小さなご支援が、私たちにとって大きな励みになります.
00:03:11ご存知の方もいるかもしれませんが、Hermesでは複数のコーディングツールを使用できます.
00:03:15例えば、CodexのサブスクリプションをHermesエージェントに連携してそのモデルを利用可能です.
00:03:19また、Hermesにはタスクを直接送信するClaude Code用のスキルがすでに備わっており,
00:03:24Codex向けにも同様のスキルが用意されています.
00:03:27しかし、これらのスキルの問題点は、あなたが指示しない限りHermesがそれらを使わないことです。
00:03:31さらに、どのタスクをどのエージェントに割り当てるべきかをプロンプトで明示する必要があります.
00:03:35そこで、システムにインストールされているあらゆるエージェントにタスクを割り振る別のスキルが存在します.
00:03:40このスキルは、すべてのエージェントの間でオーケストレーターとして機能します.
00:03:43インストール済みのコーディングツールのうちどれがどのタスクに最適かを判断し、作業を振り分けます.
00:03:49実は、これは一連のスキルのセットです.
00:03:51メインとなるのはdelegate setupと呼ばれ、他のエージェントを調整します.
00:03:54また、Claude Code、Codex、Cursorなどの各種コーディングエージェント向けの専用委任スキルも付属しています.
00:04:00これらのエージェントは、コマンド実行前に許可を求めないモードで動作するため,
00:04:05すべての変更をユーザーが承認するのを待って処理が中断されることがありません.
00:04:08このスキルをインストールするには、インストールコマンドを実行します.
00:04:1118個のスキルから選択するよう求められるため、システムにインストールされているツールを選べます.
00:04:16インストール完了後、Hermesでdelegate setupスキルが使用可能な状態になっていることが確認できます.
00:04:20利用するには、スラッシュコマンドでスキルを実行し、プロンプトを入力してHermesエージェントに渡すだけです.
00:04:26まず、どのコーディングツールがインストールされているかを特定します.
00:04:28次に、各エージェントが担当する領域の全体像を、正確なモデル名や努力度(エフォートレベル)とともに提示してくれます.
00:04:35計画を承認すると、スキルの実行が始まります.
00:04:37そして、各タスクを選定されたエージェントへと送信します.
00:04:40各エージェントから結果報告を受けた後、Hermesが総合レポートをまとめ、タスクを完了としてマークします.
00:04:46Hermesエージェントがターミナルコマンドを実行することは、すでにご存知かもしれません.
00:04:50ターミナルコマンドが実行されるたびに、エージェントが読み取るべき出力が返されます.
00:04:54しかし、そのコマンドが生成する出力のうち90%は、実際には必要ありません.
00:04:59特定の部分だけで十分なのです.
00:05:00残りの部分は単にコンテキストを無駄に肥大化させるだけです.
00:05:03先ほども触れたように、コンテキストウィンドウ内の情報が多すぎると、エージェントの集中力が低下します.
00:05:09そこで登場するのがRTKです.
00:05:10エージェントが実行するターミナルコマンドの出力を切り詰め、必要な部分のみを保持することで,
00:05:16コンテキストウィンドウに到達する前に出力がフィルタリングされます.
00:05:20エージェントが頻繁に使用するターミナルコマンドのデータベースを備えており、出力のフィルタリング方法を把握しています.
00:05:25例えばテストを実行した場合、エージェントに必要なのは成功した結果ではなく失敗したテスト結果のみです.
00:05:31RTKはデフォルトでそれを実行し、失敗部分だけを残します.
00:05:35もっとも、これは厳密にはスキルではありません.
00:05:37お使いのデバイスにインストールし、ターミナルから実行する別のツールです.
00:05:41エージェントに正しいコンテキストのみを確実に渡せるため、このリストに含めています.
00:05:45必要であれば、直接インストールしてエージェントに使用するよう指示することも可能です.
00:05:49ただし、エージェントは指示を忘れる傾向があるため、通常のやり方で実行する代わりにこのツール経由でコマンドをルーティングするようエージェントに指示するスキルを独自に作成しました.
00:05:57このスキルには、エージェントに必要な詳細だけでなく、使用可能なコマンドとその使用方法を把握するための各コマンドのリファレンスも含まれています.
00:06:05このスキルはHermesのセットアップに追加できます.
00:06:07導入すれば、Hermesにどんなタスクを与えても、従来の方法ではなくRTKを経由してすべてのコマンドを実行するようになります.
00:06:14エージェントに必要な出力のみがコンテキストウィンドウに届くため、Hermesはより正確な回答を返すことができます.
00:06:20次の項目に進む前に、スポンサーのご紹介です.
00:06:23Pluralです.
00:06:24本番インフラの運用は突き詰めると、午前3時のアラートに対応し、障害箇所を突き止めるためにKubernetesのログを漁ることに尽きます.
00:06:31Pluralはワークベンチによってその課題を解決します.
00:06:34これらはインフラを実際に操作してくれるAIエージェントであり、既存のアクセス制御内で動作するため、許可していない勝手な操作は一切行われません.
00:06:42私たちが導入を決めた理由は次の通りです.
00:06:43観測可能性(オブザーバビリティ)ツールに組み込んだところ、アラートが発報された際にエージェントは単に通知を送るだけでなく,
00:06:48自ら調査を行い、ログやメトリクスを調べ上げて、正確な診断結果と明確な次のステップを提示してくれました.
00:06:54また、DatadogやSlackなどの既存ツールと連携するため、アラート発生時や設定したスケジュールに応じて自動的に処理を開始できます.
00:07:02ゼロからプロンプトを書く代わりに、Pluralのライブラリにある既製のスキルをそのまま活用できます.
00:07:07まさに、決して眠らないオンコールエンジニアのような存在です.
00:07:10概要欄のリンクからPluralをお試しください.
00:07:12続いてのスキルはGoogleによるもので、「Mantis」という名称です.
00:07:15Mantisは、エージェントが実行できる一連のセキュリティレビュー用スキルです.
00:07:19それぞれ異なるセキュリティレビュー領域に特化した、多様なスキルが含まれています.
00:07:23モバイルアプリやウェブアプリなど、開発しているアプリケーションの種類を問わず、インストールして作業中のプロジェクトに活用できます.
00:07:30インストールコマンドはGitHubリポジトリに記載されています。
00:07:33インストールコマンドを実行すると、数多くの専用スキルの中からどれを使うか選択を求められます。
00:07:38レビュープロセス全体を構成する個別のパーツとなるため、すべてインストールするのがおすすめです。
00:07:42セットアップが完了すると、インストールされた項目の一覧が表示されます。
00:07:46たとえば、「Mantis plan」というスキルがあり、実際の作業を始める前にセキュリティレビューのプロセスを計画してくれます。
00:07:52また、「Mantis reflect」というスキルもあり、検出結果をすべて見直し、問題点が適切にドキュメント化されているか確認してくれます。
00:07:59ここで、Hermesが常時稼働するエージェントであり、普段はこれでコードを書かないのであれば、なぜMantisを追加する必要があるのか疑問に思うかもしれません。
00:08:06しかしその理由は、アプリをホストした後は定期的なセキュリティレビューが必要であり、それを毎回自分で覚えておくわけにはいかないからです。
00:08:14それこそが、Hermesで実行するのが最適な理由です。
00:08:16cronジョブ機能があり、スケジュールに従ってタスクを自動で実行してくれます。
00:08:21ホストしたアプリに対して、このレビューセットを実行するよう設定することができます。
00:08:25Hermesは常に稼働しているため、問題を発見した場合はSlackやその他の連携プラットフォームで通知してくれます。
00:08:31私たちのプロジェクトでも同様のセットアップを行っています。
00:08:33こちらをご覧いただくとわかるように、Hermesのプロンプトにプロジェクトを渡し、コード全体に対してレビューセットを実行するよう指示しています。
00:08:39問題の検出と修正を継続的に行ってくれるため、アプリの健全性が保たれ、バグのない状態を維持できます。
00:08:45エージェントを使ってリサーチを行ったことがある方なら、大きな問題に直面したことがあるかもしれません。
00:08:49エージェントが特定のコンテンツへのアクセスを拒否されるという問題です。
00:08:52これは、Redditのような多くのサイトが、AIモデルにコンテンツを使用されることを望んでいないために起こります。
00:08:56しかし、そうしたサイトには実際のユーザーが問題や意見、経験について語っている非常に価値のある情報があり、リサーチにおいて非常に有用です。
00:09:05エージェントにそのコンテンツへのアクセスを許可するために、「Agent Reach」というスキルが存在します。
00:09:09これにより、RedditやGitHubをはじめとする、通常は制限されているサイトにHermesからアクセスできるようになります。
00:09:15無料の方法を使用しているため、費用は一切かかりません。
00:09:18また、最近GitHubでトレンド1位を獲得したプロジェクトでもあります。
00:09:21これをHermesの環境にインストールすれば、15以上のプラットフォームにアクセスできるようになります。
00:09:26Instagram、Facebook、Twitter、Redditを検索できるようになります。
00:09:29インストールが完了したら、Hermesから直接使用して、あらゆるプラットフォームであらゆるトピックを検索させることができます。
00:09:35独自のスクリプトを実行して関連情報を見つけ出し、必要な回答を提供してくれます。
00:09:41ご存知の通り、Hermesには90以上のスキルが最初から組み込まれています。
00:09:45それに加えて、Hermesはチャット内のワークフローから将来役立ちそうなものを検知すると、
00:09:50実際にそこからスキルを自動生成し、今後の実行時にそのスキルを使用できるようになります。
00:09:54ユーザーに合わせて自動的に適応してくれるため素晴らしく聞こえますが、これには1つ問題があります。
00:09:58コンテキストウィンドウに実際に読み込まれるスキルの部分は、その名前と説明文のみです。
00:10:04エージェントがこれらのスキルの存在を認識できるよう、メッセージごとに送信されます。
00:10:08名前と説明文は小さな塊であり、コンテキストウィンドウには全く影響しないと思われるかもしれませんが、
00:10:14もし100個以上のスキルがあり、Hermesを長期間使い続けていると、
00:10:18それらの名前や説明文がコンテキストウィンドウの大部分を圧迫し始めます。
00:10:23そのため、この問題を解決するために、エージェントの生産性を高めるための一連のスキルが用意されています。
00:10:28しかし、私たちが最も注目すべきは「スキルリトリーバー」スキルです。
00:10:31スキルプロンプトの完全なリストを、最も関連性の高いスキルの説明のみに置き換えます。
00:10:36これにより、コンテキストのサイズを削減できます。
00:10:38つまり、Hermesがモデルを呼び出す前に、別のステップが実行される仕組みです。
00:10:42メッセージをモデルが理解できる小さなチャンクに分割し、
00:10:45所有しているすべてのスキルに対しても同様の処理を行い、メッセージとスキルリストを照合します。
00:10:50スコアが最も高かったスキルが送信される仕組みです。
00:10:52ドキュメントには具体的な数値が記載されています。
00:10:54リスト全体を送信していたときは、約11,000トークンを使用していたとのことです。
00:10:58これを使用するとわずか2,300トークンになり、毎ターン9,000トークン以上を節約できると謳われています。
00:11:04これにより、2つのメリットが得られます。
00:11:05まず、メッセージを送信するたびにコンテキストウィンドウに入る情報量が大幅に減るため、
00:11:09実行コストを抑えられます。
00:11:11次に、質問に関係のないスキルによってエージェントの気が散ることがなくなるため、
00:11:16より良い回答を得ることができます。
00:11:17これはプラグインとして提供されており、スキルリはその中の1つのスキルです。
00:11:21プラグインをインストールしたら、プラグイン画面からスキルリトリーバーを有効にすることができます。
00:11:25これにより、コンテキストに渡されるスキルリストが従来よりもはるかに短くなります。
00:11:29なお、この動画で作成したRTKスキルは、私たちのコミュニティであるAI Labs Proで見つけることができます。
00:11:35私たちの活動に価値を感じ、チャンネルをサポートしたいと思っていただけたなら、これが最高のサポート方法です。
00:11:39リンクは概要欄にあります。
00:11:41これで今回の動画は終了となります。
00:11:43チャンネルをサポートし、このような動画の制作を続けられるよう協力していただける場合は、
00:11:46下のスーパーサンクスボタンからご支援いただけます。
00:11:49いつもご視聴いただきありがとうございます。また次回の動画でお会いしましょう。