Transcript
00:00:00Seit der Veröffentlichung von Hermes Agent richten die Leute darauf alle möglichen Workflows ein.
00:00:04Und um einen ohnehin schon leistungsstarken Agenten noch besser zu machen, wurden auch viele Skills dafür entwickelt.
00:00:10Einige davon sind sogar zu den beliebtesten Projekten auf GitHub geworden.
00:00:14Nun fragst du dich vielleicht, warum man überhaupt weitere Skills installieren muss,
00:00:17da Hermes ohnehin schon viele mitbringt und sogar neue aus deinen Workflows erstellen kann.
00:00:22Aber die von Hermes erstellten Skills stammen nur aus den Prozessen, die es von dir lernt.
00:00:25Diese anderen Skills wurden von Leuten entwickelt, die Probleme gelöst haben, mit denen Hermes allein nicht fertig wird,
00:00:31und sie haben diese Lösungen in nutzbare Skills verpackt.
00:00:34Falls du neu auf dem Kanal bist, willkommen – wir sind ein Softwareunternehmen und das hier ist AI Labs.
00:00:38Und in diesem Video schauen wir uns die Skills an, die die Arbeit mit Hermes-Agenten wirklich so viel besser machen.
00:00:43Aber bevor wir zum ersten kommen, musst du Folgendes wissen:
00:00:46Obwohl wir diese Skills mit Hermes verwenden, lassen sich die meisten davon mit jedem KI-Coding-Agenten nutzen.
00:00:51Wenn du bereits mit Coding-Agenten gearbeitet hast, egal ob Hermes oder buchstäblich jedem anderen,
00:00:56haben sie alle dasselbe Problem.
00:00:57Führst du ein längeres Gespräch, vergisst dein Agent möglicherweise Details, die du zuvor erwähnt hast,
00:01:02sodass du ihm dieselbe Anweisung ein zweites Mal geben musst.
00:01:04Das passiert besonders häufig, wenn du Opus-Modelle mit Hermes nutzt,
00:01:08weil diese dazu neigen, Dinge schneller zu vergessen.
00:01:10Dies geschieht, weil sich zu viele Nachrichten in deinem Kontextfenster befinden
00:01:14und das Modell all diesen Aufmerksamkeit schenken muss.
00:01:16In diesem Fall kann es kleinere Details aus den Augen verlieren und du erhältst schlechtere Antworten.
00:01:20Um dieses Problem zu lösen, gibt es einen Skill namens Planning with Files.
00:01:24Er bewahrt den Plan dort auf, wo der Agent ihn nicht ignorieren kann.
00:01:27Anstatt den Plan im Chat zu belassen und Platz im Kontextfenster zu verschwenden,
00:01:31wandelt dieser Skill den Plan in drei Dateien in deinem Projektordner um.
00:01:34Die erste ist TaskPlan.MD, die deine Hauptaufgabe im Grunde in kleinere Teilaufgaben unterteilt,
00:01:40damit der Agent sie nacheinander abarbeiten kann.
00:01:42Dann gibt es Findings.MD, wo jedes Problem festgehalten wird, auf das der Agent stieß und wie er es gelöst hat.
00:01:47Tritt dasselbe Problem erneut auf, kann der Agent diese Erkenntnisse nutzen, um es zu vermeiden.
00:01:51Und die letzte ist Progress.MD, die aufzeichnet, wie weit der Agent fortgeschritten ist.
00:01:56Nun magst du denken, dass das Speichern des Plans in Dateien nichts Neues ist
00:01:59und die meisten von euch das vielleicht bereits tun.
00:02:01Was diesen Skill auszeichnet, ist, dass der Agent den Plan nicht ignorieren kann.
00:02:04Das liegt daran, dass er einen Hook nutzt,
00:02:06der die drei Dateien mit Nachdruck in das Kontextfenster einfügt,
00:02:09weshalb das Modell sich nicht aussuchen kann, sie zu ignorieren.
00:02:12Die meisten Agenten unterstützen zwar keine Hooks, aber Hermes gehört zu den wenigen, die das tun.
00:02:16Und laut eigenen Tests schnitt der Agent mit aktivem Hook wesentlich besser ab,
00:02:20weil er nicht von der ihm zugewiesenen Aufgabe abdriftete.
00:02:23Die Installationsbefehle für alle Agenten sind im Repo aufgeführt,
00:02:26das in der Beschreibung unten verlinkt ist.
00:02:28Sobald du es installiert hast, wird es zusammen mit allen anderen Skills hinzugefügt.
00:02:32Und die Hooks werden automatisch in deinem Agenten installiert.
00:02:35Die Skill-Datei erklärt, was die drei Dateien sind,
00:02:38wo sie hingehören und was jede einzelne bewirkt.
00:02:40Sie enthält auch alle Regeln, die der Agent befolgen muss,
00:02:43damit er weiß, womit er es zu tun hat.
00:02:44Sobald du dies installiert hast,
00:02:46kannst du den Skill ausführen und ihm einen Prompt geben, was der Agent tun soll.
00:02:50Hier siehst du, dass der Agent anfangs den Aufgabenplan, die Erkenntnisse
00:02:53sowie die Fortschrittsdateien erstellt hat.
00:02:56Danach stellte er uns Fragen, die wir im Laufe des Prozesses beantworteten.
00:02:59Nach dieser langen Sitzung hat er den Plan finalisiert und uns die drei Dateien übergeben.
00:03:03Doch bevor wir zum nächsten Skill übergehen,
00:03:04wäre es großartig, wenn du den Kanal abonnierst und den Daumen nach oben drückst.
00:03:08Diese kleine Geste der Unterstützung hilft uns enorm weiter.
00:03:11Vielleicht weißt du bereits, dass du mehrere Coding-Tools mit Hermes verwenden kannst.
00:03:15Zum Beispiel kannst du dein Codex-Abo mit dem Hermes-Agenten verbinden und dessen Modelle nutzen.
00:03:19Du weißt vielleicht auch, dass Hermes bereits über eine Claude-Code-Fähigkeit verfügt, die Aufgaben direkt dorthin sendet,
00:03:24und es gibt eine ähnliche Funktion auch für Codex.
00:03:27Das Problem bei diesen Fähigkeiten ist jedoch, dass Hermes sie nicht nutzt, es sei denn, du bittest darum.
00:03:31Außerdem musst du in deinem Befehl angeben, welche Aufgaben an welchen Agenten gehen sollen.
00:03:35Es gibt jedoch eine weitere Fähigkeit, die eine Aufgabe an jeden bereits auf deinem System installierten Agenten sendet.
00:03:40Und diese Fähigkeit fungiert als Orchestrator zwischen all diesen Werkzeugen.
00:03:43Sie findet auch heraus, welches deiner installierten Programmierwerkzeuge sich am besten für welche Aufgabe eignet, und übergibt die Arbeit an dieses Tool.
00:03:49Eigentlich handelt es sich hierbei um eine Reihe von Fähigkeiten.
00:03:51Die Hauptfunktion heißt Delegate Setup und koordiniert die anderen Agenten.
00:03:54Sie bietet zudem dedizierte Delegationsfunktionen für verschiedene Programmieragenten, darunter Claude Code, Codex und Cursor.
00:04:00Diese Agenten laufen in einem Modus, in dem sie vor dem Ausführen von Befehlen nicht um Erlaubnis bitten,
00:04:05sodass der Programmieragent nicht anhält und darauf wartet, dass du jede Änderung genehmigst.
00:04:08Um diese Fähigkeit zu installieren, führst du den Install-Befehl aus.
00:04:11Er fordert dich auf, aus 18 Fähigkeiten zu wählen, sodass du die auf deinem System installierten Tools auswählen kannst.
00:04:16Nach der Installation wirst du sehen, dass Hermes die Delegate-Setup-Fähigkeit einsatzbereit zur Verfügung hat.
00:04:20Um sie zu nutzen, musst du lediglich die Funktion mit dem Slash-Befehl aufrufen, den Prompt eingeben und ihn dem Hermes-Agenten übergeben.
00:04:26Zunächst ermittelt er, welche Programmierwerkzeuge installiert sind.
00:04:28Dann liefert er dir eine vollständige Übersicht darüber, welchen Bereich jeder Agent übernimmt, mitsamt genauem Modellnamen und Aufwandsgrad.
00:04:35Sobald du den Plan genehmigst, beginnt er mit der Ausführung der Fähigkeiten.
00:04:37Daraufhin leitet er jede Aufgabe an den dafür ausgewählten Agenten weiter.
00:04:40Nachdem jeder Agent seine Ergebnisse gemeldet hat, gibt Hermes dir einen gemeinsamen Sammelbericht und markiert die Aufgabe als abgeschlossen.
00:04:46Nun weißt du vielleicht bereits, dass dein Hermes-Agent Terminalbefehle ausführt.
00:04:50Wird ein Terminalbefehl ausgeführt, liefert er eine Ausgabe, die der Agent lesen muss.
00:04:54In 90 % der Fälle benötigst du nicht einmal die gesamte Ausgabe, die dieser Befehl erzeugt.
00:04:59Du brauchst nur einen bestimmten Teil davon.
00:05:00Der Rest bläht den Kontext nur unnötig auf.
00:05:03Und wie bereits erwähnt, erschwert zu viel Information im Kontextfenster dem Agenten die Konzentration.
00:05:09Hier kommt RTK ins Spiel.
00:05:10Es kürzt die Ausgabe der vom Agenten ausgeführten Terminalbefehle und behält nur die Teile, die der Agent benötigt,
00:05:16sodass die Ausgabe gefiltert wird, noch bevor sie das Kontextfenster erreicht.
00:05:20Die Datenbank der von Agenten am häufigsten genutzten Terminalbefehle hilft dabei zu wissen, wie deren Ausgabe zu filtern ist.
00:05:25Wenn du beispielsweise Tests durchführst, muss der Agent nur die Ergebnisse der fehlgeschlagenen Tests sehen und nicht die erfolgreichen.
00:05:31RTK tut genau das standardmäßig und behält ausschließlich die Fehlschläge bei.
00:05:35Das Ding ist allerdings, dass es sich hierbei eigentlich um keine Fähigkeit handelt.
00:05:37Es ist ein separates Tool, das du auf deinem Gerät installierst und vom Terminal aus ausführst.
00:05:41Und es steht auf dieser Liste, weil es sicherstellt, dass dein Agent nur den richtigen Kontext erhält.
00:05:45Wenn du möchtest, kannst du es auch direkt installieren und dem Agenten sagen, dass er es nutzen soll.
00:05:49Da Agenten jedoch dazu neigen, unsere Bitten zu vergessen, haben wir eine Fähigkeit erstellt, die dem Agenten aufträgt, Befehle über dieses Tool statt auf üblichem Wege zu leiten.
00:05:57Diese Fähigkeit enthält außerdem die vom Agenten benötigten Details sowie eine Referenz für jeden Befehl, damit er weiß, welche Befehle er nutzen kann und wie.
00:06:05Du kannst diese Fähigkeit zu deinem Hermes-Setup hinzufügen.
00:06:07Sobald du das getan hast, kannst du Hermes jede beliebige Aufgabe erteilen und jeder Befehl läuft über RTK anstelle der gewohnten Methode.
00:06:14Nur die Ausgabe, die der Agent wirklich braucht, erreicht das Kontextfenster, weshalb Hermes dir präzisere Antworten geben kann.
00:06:20Doch bevor wir zum nächsten Punkt übergehen, hören wir ein Wort von unserem Sponsor.
00:06:23Plural.
00:06:24Der Betrieb von Produktionsinfrastruktur läuft meist auf eines hinaus: den 3-Uhr-nachts-Alarm und das Durchwühlen von Kubernetes-Logs nach der Ursache.
00:06:31Plural löst dieses Problem mit Workbenches.
00:06:34Das sind KI-Agenten, die tatsächlich deine Infrastruktur für dich betreiben und innerhalb deiner bestehenden Zugriffskontrollen laufen, sodass nichts ohne deine vorherige Erlaubnis geschieht.
00:06:42Das hat uns überzeugt.
00:06:43Wir haben es in unsere Überwachung integriert, und als ein Alarm ausgelöst wurde, hat uns der Agent nicht nur benachrichtigt.
00:06:48Er hat eigenständig ermittelt, Protokolle und Metriken durchsucht und eine echte Diagnose sowie klare nächste Schritte geliefert.
00:06:54Workbench verbindet sich zudem nahtlos mit Tools, die du bereits nutzt wie Datadog und Slack, sodass es beim Auslösen eines Alarms oder nach einem festgelegten Zeitplan von selbst startet.
00:07:02Anstatt Prompts von Grund auf neu zu schreiben, greifst du auf fertige Fähigkeiten aus der Bibliothek von Plural zurück.
00:07:07Im Grunde ist es ein Bereitschaftsingenieur, der niemals schläft.
00:07:10Teste Plural über den Link in der Beschreibung.
00:07:12Die nächste Fähigkeit stammt von Google und heißt Mantis.
00:07:15Mantis ist eine Sammlung von Sicherheitsüberprüfungsfunktionen, die deine Agenten ausführen können.
00:07:19Sie umfasst eine Vielzahl von Fähigkeiten, die sich jeweils auf einen anderen Bereich der Sicherheitsprüfung konzentrieren.
00:07:23Dieses Setup funktioniert unabhängig davon, welche App du entwickelst – ob Mobil- oder Web-App –, du kannst es installieren und für dein aktuelles Projekt verwenden.
00:07:30Der Installationsbefehl ist im GitHub-Repository aufgeführt.
00:07:33Wenn Sie den Befehl ausführen, werden Sie aufgefordert, eine der vielen spezialisierten Fähigkeiten auszuwählen.
00:07:38Es ist besser, alle zu installieren, da sie separate Teile des gesamten Überprüfungsprozesses sind.
00:07:42Sobald Sie es in Ihrem Setup installiert haben, sehen Sie die gesamte Liste der installierten Elemente.
00:07:46Beispielsweise gibt es eine Funktion namens Mantis plan, die Ihren Sicherheitsprüfungsprozess plant, bevor Sie tatsächlich beginnen.
00:07:52Sie enthält auch eine Funktion namens Mantis reflect, die alle Ergebnisse durchgeht und sicherstellt, dass Fehler ordnungsgemäß dokumentiert werden.
00:07:59Nun könnten Sie denken: Wenn Hermes ein ständig laufender Agent ist und wir normalerweise nicht damit coden, warum sollten wir dann überhaupt Mantis hinzufügen?
00:08:06Der Grund ist jedoch, dass Ihre App nach dem Hosting immer wieder Sicherheitsüberprüfungen benötigt und das nichts ist, woran man immer selbst denken möchte.
00:08:14Und genau das macht Hermes zum besten Ort, um sie auszuführen.
00:08:16Es verfügt über Cron-Jobs, also Aufgaben, die nach einem Zeitplan automatisch im Hintergrund ablaufen.
00:08:21Sie können einen einrichten, der diesen Überprüfungssatz für die von Ihnen gehostete App ausführt.
00:08:25Und da Hermes ständig läuft, kann es Sie auf Slack oder einer anderen verbundenen Plattform benachrichtigen, wenn ein Problem auftritt.
00:08:31Wir haben ein ähnliches Setup auch für unser eigenes Projekt.
00:08:33Hier sehen Sie, dass wir Hermes unser Projekt im Prompt übergeben und ihm gesagt haben, dass es den kompletten Satz über den Code laufen lassen soll.
00:08:39Es findet kontinuierlich Probleme und wendet Korrekturen an, wodurch die App für uns fehlerfrei und stabil bleibt.
00:08:45Wenn Sie jemals versucht haben, mit Agenten zu recherchieren, sind Sie möglicherweise auf ein großes Problem gestoßen.
00:08:49Ihrem Agenten wird der Zugriff auf bestimmte Inhalte verweigert.
00:08:52Dies passiert, weil viele Websites wie Reddit nicht möchten, dass Modelle ihre Inhalte verwenden.
00:08:56Aber diese Websites sind wirklich wertvoll, da dort echte Nutzer über Probleme, ihre Meinungen und Erfahrungen sprechen, was die Informationen für die Forschung nützlich macht.
00:09:05Um Agenten Zugriff auf diese Inhalte zu geben, gibt es eine Funktion namens Agent Reach.
00:09:09Sie gibt Hermes Zugriff auf Websites, die normalerweise eingeschränkt sind, einschließlich Reddit, GitHub und vielen anderen.
00:09:15Es verwendet kostenlose Methoden, sodass es Sie überhaupt nichts kostet.
00:09:18Es war kürzlich auch das auf GitHub am häufigsten trendende Projekt.
00:09:21Jetzt können Sie dies in Ihrer Hermes-Einrichtung installieren und es verschafft Ihnen Zugriff auf über 15 Plattformen.
00:09:26Es kann Instagram, Facebook, Twitter und Reddit durchsuchen.
00:09:29Sobald es installiert ist, können Sie es direkt über Hermes verwenden und es bitten, nach jedem Thema auf jeder Plattform zu suchen.
00:09:35Es führt eigene Skripte aus, findet die relevanten Informationen und liefert Ihnen dann die gewünschten Antworten.
00:09:41Wie Sie bereits wissen, ist Hermes standardmäßig mit über 90 integrierten Funktionen ausgestattet.
00:09:45Abgesehen davon erstellt Hermes, wenn es in Ihrem Chat einen Workflow bemerkt, der in Zukunft nützlich sein könnte,
00:09:50tatsächlich eine Funktion daraus, die es dann bei zukünftigen Durchläufen verwenden kann.
00:09:54Das klingt gut, weil es sich automatisch an Sie anpasst, aber das bringt ein Problem mit sich.
00:09:58Der einzige Teil einer Funktion, der tatsächlich in das Kontextfenster gelangt, ist ihr Name und ihre Beschreibung.
00:10:04Sie werden mit jeder Ihrer Nachrichten gesendet, damit der Agent weiß, dass diese Funktionen existieren.
00:10:08Nun könnten Sie sagen, dass Name und Beschreibung nur einen kleinen Teil ausmachen und das Kontextfenster überhaupt nicht beeinträchtigen,
00:10:14aber wenn Sie über 100 Funktionen haben und Hermes schon lange nutzen,
00:10:18fangen all diese Namen und Beschreibungen an, einen riesigen Teil des Kontextfensters zu beanspruchen.
00:10:23Um dieses Problem zu lösen, gibt es eine Reihe von Funktionen, die entwickelt wurden, um den Agenten produktiver zu machen.
00:10:28Aber diejenige, die uns am meisten interessiert, ist die Skill-Retriever-Funktion.
00:10:31Sie ersetzt die vollständige Liste der Funktions-Prompts durch nur die relevantesten Funktionsbeschreibungen,
00:10:36was dazu führt, dass die Kontextgröße sinkt.
00:10:38Im Grunde wird also ein weiterer Schritt ausgeführt, bevor Hermes das Modell aufruft.
00:10:42Es unterteilt Ihre Nachricht in kleine Abschnitte, die ein Modell verstehen kann,
00:10:45macht dasselbe mit jeder Funktion, die Sie haben, und gleicht Ihre Nachricht dann mit der Funktionsliste ab.
00:10:50Die Funktionen mit den höchsten Werten werden gesendet.
00:10:52In ihrer Dokumentation nennen sie Zahlen.
00:10:54Sie geben an, dass mit der gesamten Liste etwa 11.000 Token verwendet wurden.
00:10:58Danach werden nur noch 2.300 verwendet, weshalb sie beanspruchen, bei jedem Durchlauf mehr als 9.000 Token einzusparen.
00:11:04Das hilft Ihnen auf zwei Arten.
00:11:05Erstens gelangt mit jeder gesendeten Nachricht viel weniger in das Kontextfenster,
00:11:09sodass die Ausführung weniger kostet.
00:11:11Und zweitens wird der Agent nicht durch Funktionen abgelenkt, die nichts mit Ihrer Frage zu tun haben,
00:11:16weshalb Sie bessere Antworten erhalten.
00:11:17Dies ist als Plugin erhältlich, und Skill Retriever ist eine der darin enthaltenen Funktionen.
00:11:21Sobald Sie das Plugin installiert haben, können Sie Skill Retriever im Plugin-Bereich aktivieren.
00:11:25Dann ist die Funktionsliste, die in den Kontext einfließt, viel kürzer als zuvor.
00:11:29Die RTK-Funktion, die wir in diesem Video erstellt haben, finden Sie in AI Labs Pro, unserer Community.
00:11:35Wenn Sie also unseren Wert schätzen und den Kanal unterstützen möchten, ist dies der beste Weg dafür.
00:11:39Der Link ist in der Beschreibung.
00:11:41Damit sind wir am Ende dieses Videos angelangt.
00:11:43Wenn Sie den Kanal unterstützen und uns helfen möchten, weiterhin solche Videos zu machen,
00:11:46können Sie dies über den Super-Thanks-Button unten tun.
00:11:49Wie immer vielen Dank fürs Zusehen, und bis zum nächsten Mal.