NCA Social Media
Aktualisiert:
Autor:
Roland Golla
Grüner isometrischer Server mit Hermes Neontext und Messaging Icons NCA 2026

Was ist Hermes Agent

Hermes Agent ist ein selbstlernender, Open Source KI Agent von Nous Research, der im Februar 2026 unter MIT Lizenz veröffentlicht wurde. Anders als klassische Chatbot Wrapper oder IDE gebundene Copiloten lebt Hermes Agent dauerhaft auf dem eigenen Server, merkt sich Kontext über Sessions hinweg und wird mit jeder Interaktion leistungsfähiger. Die Software unterstützt Telegram, Discord, Slack, WhatsApp, Signal und CLI über ein einziges Gateway.

Das Projekt hat innerhalb weniger Wochen über 65.000 GitHub Stars erreicht und ist damit eines der am schnellsten wachsenden Open Source KI Projekte 2026. Hermes Agent kombiniert persistentes Memory, ein autonomes Skills System und MCP Integration in einem einzigen, selbst gehosteten Paket. Für Unternehmen, die KI Agenten lokal und DSGVO konform betreiben wollen, ist Hermes Agent eine ernstzunehmende Alternative zu Cloud basierten Lösungen.

Neu dazugekommen ist Bot Mode. Damit werden aus den Hermes Profilen benannte Bots mit eigener Rolle, eigenem Modell, eigenem Memory und eigenem Bild. Bots erledigen wiederkehrende Routinen, sitzen zusammen in Gruppenchats und schicken sich gegenseitig Nachrichten. Ausgeliefert wird das Feature fest eingebaut in Hermes Desktop, standardmäßig aktiv ab Version 0.20.3.

Hermes Agent basiert auf der Hermes Modellfamilie (aktuell Hermes 4.3 auf ByteDance Seed 36B), kann aber mit jedem OpenAI kompatiblen Endpoint betrieben werden: Nous Portal, OpenRouter, OpenAI, DeepSeek, Qwen oder lokale Modelle via Ollama. Der Wechsel zwischen Providern erfolgt ohne Code Änderungen über einen einzigen CLI Befehl.

CYPRESS.IO Ambassador und IT Consultant für QA Engenieering und Qualität in PHP Projekten.

NCA Vibe Coding Consulting

Roland Golla ist Entwickler aus Leidenschaft – seit über 20 Jahren. Er hat hunderte Projekte begleitet, von Legacy-Refactoring bis KI-Integration. Bei Vibe Coding verbindet er das Beste aus beiden Welten: Die Geschwindigkeit von KI-generiertem Code mit der Qualität professioneller Softwareentwicklung. Kein Bullshit, keine Agentur-Floskeln – direkte Hilfe von jemandem, der selbst täglich im Code steckt.

Wie funktioniert Hermes Agent

Hermes Agent unterscheidet sich von klassischen KI Assistenten durch drei Kernmechanismen, die zusammen einen geschlossenen Lernkreislauf bilden: persistentes Memory, autonome Skill Erstellung und Selbstoptimierung via GEPA.

Persistentes Memory: Hermes Agent nutzt FTS5 Volltextsuche mit LLM Zusammenfassungen für sitzungsübergreifende Erinnerung. Das System speichert Projekte, Präferenzen und Arbeitskontext dauerhaft. Zusätzlich unterstützt Hermes modulare Memory Backends wie Honcho, Mem0, Hindsight oder RetainDB. Je länger der Agent läuft, desto besser kennt er den Nutzer und dessen Arbeitsweise.

Autonome Skill Erstellung: Nach Abschluss komplexer Aufgaben (typischerweise ab fünf Tool Calls) synthetisiert Hermes Agent die Erfahrung automatisch in ein wiederverwendbares Skill Dokument. Diese Skills folgen dem offenen agentskills.io Standard, sind durchsuchbar, teilbar und verbessern sich bei jeder Nutzung selbst. Der Agent erstellt, aktualisiert und löscht Skills während laufender Sessions.

GEPA Self Evolution: Das begleitende GEPA System (ICLR 2026 Oral Acceptance) analysiert Ausführungsprotokolle, erkennt Ineffizienzen und optimiert Prompts sowie Prozeduren über DSPy. Wenn eine Aufgabe 47 Tool Calls benötigt, aber in 12 lösbar wäre, identifiziert GEPA diese Lücke und passt den Skill entsprechend an.

Bot Mode: Hermes Profile werden zu benannten Bots

Bot Mode macht aus den Profilen von Hermes Agent ein Roster benannter Bots. Jeder Bot hat eine eigene Rolle, ein eigenes Modell, eigenes Memory, eigene Skills und ein eigenes Bild. Nous Research hat das Feature zuerst als eintägige Public Beta über ein separates Desktop Plugin getestet. Inzwischen ist Bot Mode fest in Hermes Desktop eingebaut und ab Version 0.20.3 standardmäßig aktiv. Das eigenständige Repository ist archiviert, die Entwicklung läuft im Hauptprojekt weiter.

Ein Bot ist ein Profil. Es gibt kein neues Konzept zu lernen. Bot Mode ist eine Oberfläche über den bestehenden Hermes Profilen unter ~/.hermes/profiles/. Config, Memory, Skills, Zugangsdaten und Chatverlauf bleiben pro Bot sauber getrennt. Alles bleibt aus dem Terminal erreichbar: hermes -p bot chat öffnet denselben Agenten, den man im Desktop anklickt. Keine Core Patches, keine zusätzlichen Daemons, kein extra Storage.

Angelegt ist ein Bot in Sekunden. Name, Titel, Beschreibung reichen, danach stellt sich der Bot in seinem eigenen Chat selbst vor. Wer mehr braucht, öffnet den Advanced Bereich: klonen aus einem bestehenden Profil, Model Pin auf einen beliebigen Provider, eigene SOUL.md als Persona, gezielte Freigabe einzelner Skills, Toolsets und MCP Server. Verschiedene Bots laufen parallel auf verschiedenen Modellen. Ein Rechercheur auf einem großen Modell, ein Routinebot auf einem kleinen lokalen Modell über Ollama.

Routines hängen wiederkehrende Aufgaben an den Bot, der sie erledigt. Die Zusammenfassung der Mails am Morgen liegt beim Mailbot, der Report am Freitag beim Reportbot. Technisch sind das normale Hermes Cron Jobs mit dem Namensschema [bot:name]. Sie tauchen weiter in hermes cron list auf, und die Ergebnisse landen im Chat des jeweiligen Bots. Wer Skills sauber nach SKILL.md Standard pflegt, baut sich damit Spezialisten, die man einmal einrichtet und dauerhaft nutzt.

Gruppenchats und Nachrichten zwischen Bots

Bots lassen sich in Gruppen sortieren. Jede Gruppe bekommt eine eigene Zeile im Roster und einen gemeinsamen Raum für zwei bis sechs Bots. Eine Nachricht löst maximal drei serielle Runden aus. Wer per @Name angesprochen wird, antwortet. Ist niemand genannt, kommt jeder einmal dran und darf auch passen. Harte Grenzen von zehn Nachrichten pro Senden und drei Runden verhindern, dass sich ein Raum aufschaukelt.

Braucht der Raum eine menschliche Entscheidung, holt ein Bot mit @user den Nutzer dazu und die Gruppenzeile markiert das. Jedes Mitglied behält dabei seine eigene Session zum Raum. Der Kontext überlebt also wie in jedem anderen Chat. Das Muster kennen Teams aus dem Agentic Coding und aus Frameworks wie CrewAI oder LangGraph, hier sitzt es aber direkt in der Desktop Oberfläche.

Direkte Übergaben laufen über @Mentions in jedem beliebigen Chat. Der aktive Bot reicht die Nachricht weiter, wartet auf die Antwort und meldet zurück. Das Protokoll dafür schreibt Hermes automatisch in den kanonischen Bot Chat, steuerbar über agent.bot_mode_protocol in der config.yaml. Über Rechnergrenzen hinweg funktioniert das mit registrierten Peers:

Code:
          

hermes peer add spark --url http://spark.lan:8377 --key API_SERVER_KEY
hermes peer list
hermes peer dm spark "Status vom Nightly Build bitte"

Wichtig für die Erwartungshaltung: Die Zustellung passiert pro Aufruf. Ein Bot nimmt die Nachricht auf, wenn er das nächste Mal läuft. Ein laufendes Gespräch lässt sich nicht unterbrechen. Wer harte Echtzeit braucht, bleibt bei einer klassischen Queue.

Sessions und Bot Mode im Vergleich

Merkmal Sessions Bot Mode
Einstieg Liste von Chats pro Profil Roster mit einer Zeile pro Bot
Modellwahl Modell des gestarteten Profils Model Pin pro Bot, mehrere Modelle parallel
Wiederkehrende Aufgaben Cron Jobs zentral gepflegt Routines am zuständigen Bot, [bot:name] im Cron
Zusammenarbeit Kopieren zwischen Chats Gruppenchats und @Mentions zwischen Bots
Reichweite Ein Gateway pro Fenster Bots mehrerer Rechner in einem Roster

Bot Mode in der Praxis: Nutzen und Grenzen

Der Gewinn liegt im Zuschnitt. Ein Bot mit enger Persona, drei freigegebenen Skills und einem passenden Modell arbeitet sauberer als ein Generalist, der alles kann und deshalb nichts richtig. Genau das ist auch die Antwort auf ein bekanntes Problem: Je schmaler der Auftrag, desto weniger Ballast schleppt der Agent im Context Window mit sich herum.

Die Kehrseite sind die Kosten. Mehr Bots heißen mehr parallele Kontexte, und ein Gruppenchat mit drei Runden vervielfacht die Aufrufe pro Nachricht. Wer produktiv damit arbeitet, sollte den Verbrauch messen und Limits setzen, etwa über LiteLLM als Proxy mit Budget Limits. Die Regeln aus dem Beitrag weniger Tokens brauchen gelten für ein Bot Team stärker als für einen einzelnen Agenten.

Beim Datenschutz gilt die NCA Regel: Coding aus der Cloud, Datenverarbeitung im eigenen Netz. Bots teilen sich standardmäßig einen Token Pool mit dem Hauptprofil, deshalb bekommt jeder Bot nur die Skills, Toolsets und MCP Server, die er wirklich braucht. Modelle, die nicht auf eigener Infrastruktur laufen, arbeiten gegen lokale Entwicklungsumgebungen mit Fake Daten, nie gegen echte Bestände. Für dauerhaft laufende Routinen eignen sich kleine Modelle über Ollama, alles Weitere gehört in eine bewusst gewählte Architektur für self hosted KI im Unternehmen und in die Compliance Bewertung lokaler KI.

Ehrlich bleibt: Bot Mode ist eine Oberfläche, kein neuer Motor. Profile, Cron Jobs und Skills gab es vorher. Wer ausschließlich über CLI und Gateway arbeitet, gewinnt wenig. Wer dagegen mehrere Spezialisten betreut, gewinnt Übersicht, klare Übergaben und ein Roster, das über mehrere Rechner hinweg zusammenhält. Das Feature ist jung, entsprechend gehört es in eine Testumgebung, bevor es an produktive Zugänge darf.

Installation und Setup von Hermes Agent

Die Installation von Hermes Agent erfolgt über einen einzigen Terminal Befehl auf Linux, macOS oder WSL2. Der Installer erkennt das Betriebssystem automatisch und richtet alle Abhängigkeiten ein. Natives Windows wird nicht unterstützt, WSL2 ist der empfohlene Weg. Android Nutzer können Hermes über Termux installieren.

Code:
          

curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

Nach der Installation konfiguriert hermes setup den Model Provider und verbindet Messaging Plattformen. Hermes Agent unterstützt über 200 Modelle via OpenRouter, dazu Nous Portal, OpenAI, DeepSeek, Qwen, Kimi/Moonshot, MiniMax und beliebige OpenAI kompatible Endpoints. Für den vollständig lokalen Betrieb eignet sich die Kombination mit Ollama und einem lokalen Modell wie Hermes 4.3 oder Qwen.

Code:
          

hermes setup # Vollständiger Setup Wizard
hermes model # Model Provider wählen
hermes gateway # Messaging Gateway starten
hermes doctor # Diagnose bei Problemen

Das Gateway verbindet Telegram, Discord, Slack, WhatsApp, Signal und Mail über einen einzigen Prozess. Voice Memo Transkription und plattformübergreifende Konversationskontinuität sind integriert. Der eingebaute Cron Scheduler ermöglicht autonome Aufgabenausführung nach Zeitplan mit Zustellung auf jeder Plattform.

Hermes Agent vs. OpenClaw: Vergleich und Migration

Die Debatte zwischen Hermes Agent und OpenClaw bestimmt die KI Agent Community im Frühjahr 2026. Beide Projekte verfolgen unterschiedliche Philosophien: OpenClaw setzt auf ein breites Ökosystem mit über 44.000 Community Skills und einem Gateway GUI für Einsteiger. Hermes Agent konzentriert sich auf kognitive Tiefe: selbstlernende Skills, persistentes Memory und autonome Selbstverbesserung.

Architektur: OpenClaw basiert auf TypeScript/Node.js mit einem zentralen Controller, der alle Aufgaben orchestriert. Hermes Agent ist in Python geschrieben und organisiert sich um einen wiederholbaren Zyklus aus Ausführen, Lernen und Verbessern. In Praxistests reagiert Hermes Agent schneller auf Tool Calls und zeigt niedrigere Latenz, was an der leichtgewichtigen Terminal Architektur liegt.

Migration: Hermes Agent bietet mit hermes claw migrate ein dediziertes Migrationstool, das SOUL.md Persona Dateien, Memory Einträge, Skills, Messaging Konfigurationen und API Schlüssel in einem interaktiven Prozess mit Dry Run Vorschau importiert. Das Tool erkennt automatisch bestehende OpenClaw, ClawdBot und MoltBot Installationen. Beide Agents können parallel betrieben und über das Agent Communication Protocol (ACP) miteinander kommunizieren.

Wann OpenClaw, wann Hermes: Teams, die ein großes Ökosystem vorgefertigter Skills und einfachen Einstieg bevorzugen, sind mit OpenClaw gut bedient. Wer einen KI Agenten sucht, der sich langfristig an individuelle Arbeitsweisen anpasst, Skills autonom erstellt und sich dabei stetig verbessert, findet in Hermes Agent die zukunftsfähigere Architektur.

DSGVO und lokaler Betrieb von Hermes Agent

Für europäische Unternehmen ist die DSGVO Konformität von KI Agenten eine zentrale Anforderung. Hermes Agent bietet hier klare Vorteile: Die Software läuft vollständig selbst gehostet, enthält keine Telemetrie, kein Tracking und keinen Cloud Lock in. Alle Daten bleiben auf der eigenen Infrastruktur.

In Kombination mit lokalen Modellen über Ollama entsteht ein vollständig offline fähiger KI Agent ohne externe API Calls. Hermes 4.3 (35B A3B Mixture of Experts) läuft auf Apple Silicon mit 32 GB RAM komfortabel und erreicht auf M3 Max etwa 35 Tokens pro Sekunde. Damit ist ein produktiver, DSGVO konformer Betrieb ohne Cloud Abhängigkeit möglich.

Die sechs unterstützten Terminal Backends (Lokal, Docker, SSH, Daytona, Singularity, Modal) ermöglichen flexible Deployment Szenarien: vom 5 Dollar VPS bis zur Serverless Cloud Infrastruktur. Für Unternehmen, die sensible Daten verarbeiten oder regulatorische Anforderungen wie CMMC, HIPAA oder branchenspezifische Compliance Frameworks erfüllen müssen, ist das Self Hosting Modell von Hermes Agent die sicherste Wahl.

Lass uns sprechen

Finde das passende Angebot für dein Projekt

Anfrage-Konfiguration

Starten Sie Ihre Anfrage

Projektart
Infos
Nachricht

Eliminierung technischer Schulden mit PHPStan, Rector PHP und PHPUnit. Über 20 Jahre Praxiserfahrung in skalierbaren Backends.

CORE EXPERTISE

Gesetzliche Konformität & Inklusion. Optimierung von Performance und Conversion durch radikal nutzerzentriertes, universelles Design.

BFSG COMPLIANT

Skalierbare KI-Systeme mit echtem Code Ownership. CI/CD, Backup-Strategien und Infrastruktur, die mit deinem Team wächst.

ENTERPRISE READY

We have rehauled our memory system to be much more maintainable. Hermes Agent now supports Honcho, Mem0, OpenViking, Vectorize Hindsight, RetainDB and Byterover memory systems.

Teknium, Nous Research – via X (Twitter)

NCA Erfahrung mit KI Agent Frameworks

Never Code Alone begleitet Unternehmen bei der Auswahl, Einrichtung und Integration von KI Agent Frameworks. Unsere praktische Erfahrung umfasst den produktiven Einsatz verschiedener Tools aus dem KI Agent Ökosystem: von OpenClaw als autonomem Assistenten über Paperclip für die Orchestrierung von KI Agenten Teams bis zur Implementierung von Vibe Coding Workflows mit Microsofts VS Code und Claude Code.

Bei der Bewertung neuer Frameworks wie Hermes Agent achten wir auf drei Kriterien: DSGVO Konformität durch Self Hosting und lokale Modelle, Integration in bestehende Infrastruktur über MCP Server und Standard APIs sowie langfristige Wartbarkeit durch aktive Community und klare Lizenzierung. Hermes Agent erfüllt alle drei Kriterien und bietet mit dem MIT lizenzierten, selbstlernenden Ansatz einen echten Mehrwert gegenüber statischen Agent Frameworks.

Sie planen den Einsatz von KI Agenten in Ihrem Unternehmen oder möchten bestehende Setups optimieren? NCA unterstützt Sie bei der Auswahl des passenden Frameworks, der DSGVO konformen Konfiguration und der Integration in Ihre Entwicklungs und Geschäftsprozesse. Kontaktieren Sie uns für eine kostenlose Erstberatung: roland@nevercodealone.de oder telefonisch unter +49 176 24747727.

Häufige Fragen zu Hermes Agent

Die wichtigsten Fragen und Antworten rund um Hermes Agent von Nous Research: Installation, Kosten, Sicherheit, Vergleich mit OpenClaw und DSGVO konformer Betrieb.

Was ist Bot Mode in Hermes Agent 2026?

Bot Mode macht aus den Hermes Profilen ein Roster benannter Bots. Jeder Bot hat eine eigene Rolle, ein eigenes Modell, eigenes Memory, eigene Skills und ein eigenes Bild. Technisch ist ein Bot ein ganz normales Hermes Profil, es kommt also kein neues Konzept dazu. Das Feature ist fest in Hermes Desktop eingebaut und ab Version 0.20.3 standardmäßig aktiv.

Können Hermes Bots 2026 miteinander kommunizieren?

Ja. Über @Mentions reicht ein Bot Aufgaben an einen anderen weiter, wartet auf die Antwort und meldet zurück. Gruppenchats fassen zwei bis sechs Bots in einem Raum zusammen, mit maximal drei seriellen Runden pro Nachricht. Die Zustellung passiert pro Aufruf, ein laufendes Gespräch lässt sich nicht unterbrechen.

Was kostet Hermes Agent 2026?

Hermes Agent ist Open Source unter MIT Lizenz und kostenlos nutzbar. Die einzigen Kosten entstehen durch LLM API Nutzung (je nach Provider 2 bis 65 Dollar monatlich) und optionales VPS Hosting ab etwa 5 Dollar pro Monat. Mit lokalen Modellen über Ollama fallen keine API Kosten an.

Ist Hermes Agent 2026 DSGVO konform einsetzbar?

Ja. Hermes Agent läuft vollständig selbst gehostet ohne Telemetrie oder Cloud Abhängigkeit. In Kombination mit lokalen Modellen über Ollama verlassen keine Daten die eigene Infrastruktur. Für den DSGVO konformen Betrieb empfiehlt NCA die Konfiguration mit Hermes 4.3 auf eigenem Server.

Welche Messaging Plattformen unterstützt Hermes Agent 2026?

Hermes Agent unterstützt Telegram, Discord, Slack, WhatsApp, Signal und CLI über ein einziges Gateway. Voice Memo Transkription und plattformübergreifende Konversationskontinuität sind integriert. Alle Plattformen werden über einen einzigen systemd Service verwaltet.

Wie unterscheidet sich Hermes Agent von OpenClaw?

Der Hauptunterschied liegt im Lernansatz. OpenClaw nutzt statische, manuell erstellte Skills. Hermes Agent erstellt Skills autonom aus abgeschlossenen Aufgaben, verbessert sie bei jeder Nutzung und baut ein tiefes Nutzermodell auf. OpenClaw bietet dafür ein größeres Ökosystem mit über 44.000 Community Skills.

Kann ich von OpenClaw zu Hermes Agent migrieren?

Ja. Der Befehl hermes claw migrate importiert SOUL.md Persona Dateien, Memory Einträge, Skills, Messaging Konfigurationen und API Schlüssel automatisch. Der Prozess ist interaktiv mit Dry Run Vorschau. Beide Agents können auch parallel über das Agent Communication Protocol betrieben werden.

Wie lege ich einen neuen Bot an?

Über New Agent im Roster genügen Name, Titel und Beschreibung, dann stellt sich der Bot in seinem eigenen Chat vor. Der Advanced Bereich öffnet die volle Konfiguration: klonen aus einem bestehenden Profil, Model Pin, eigene SOUL.md und die gezielte Freigabe einzelner Skills, Toolsets und MCP Server.

Wie schalte ich Bot Mode wieder ab?

Bot Mode ist ein mitgeliefertes Desktop Plugin und lässt sich unter Settings, Plugins, Bots deaktivieren. Roster, Routines Bereich und Composer verschwinden sofort, ein Neustart ist nicht nötig. Profile, Sessions und Cron Jobs bleiben dabei unangetastet, denn Bot Mode zeigt diese Daten nur an.

Welche Modelle funktionieren mit Hermes Agent?

Hermes Agent unterstützt jeden OpenAI kompatiblen Endpoint: Nous Portal, OpenRouter mit über 200 Modellen, OpenAI, DeepSeek, Qwen, Kimi, MiniMax und lokale Modelle via Ollama. Der Modellwechsel erfolgt ohne Code Änderungen über den Befehl hermes model. Im Bot Mode kann jeder Bot ein eigenes Modell festhalten.

Was ist das Skills System von Hermes Agent?

Nach komplexen Aufgaben erstellt Hermes Agent automatisch wiederverwendbare Skill Dokumente im agentskills.io Standard. Diese enthalten Prozeduren, bekannte Fallstricke und Verifikationsschritte. Skills verbessern sich bei jeder Nutzung selbst und sind zwischen Agenten teilbar.

Wie funktioniert das Memory System?

Hermes nutzt FTS5 Volltextsuche mit LLM Zusammenfassungen für sitzungsübergreifende Erinnerung. Das System unterstützt modulare Backends wie Honcho, Mem0, Hindsight und RetainDB. Der Agent merkt sich Projekte, Präferenzen und Kontext dauerhaft und baut ein immer tieferes Nutzerverständnis auf.

Auf welcher Hardware läuft Hermes Agent lokal?

Apple Silicon mit 32 GB RAM reicht für komfortablen lokalen Betrieb mit Hermes 4.3 via Ollama. Ein M3 Max erreicht etwa 35 Tokens pro Sekunde, M3 Ultra etwa 50. Alternativ genügt ein Linux Server mit NVIDIA GPU oder ein VPS für den API basierten Betrieb.

Was ist GEPA bei Hermes Agent?

GEPA ist das begleitende Self Evolution System, das eine ICLR 2026 Oral Acceptance erhalten hat. Es analysiert Ausführungsprotokolle, erkennt Ineffizienzen und optimiert Prompts über DSPy. GEPA unterscheidet sich von einfachen Retry Schleifen durch peer reviewed Architektur und systematische Verbesserung.

Kann NCA bei der Einrichtung von Hermes Agent helfen?

Ja. Never Code Alone unterstützt bei der Auswahl des passenden KI Agent Frameworks, beim Zuschnitt einzelner Bots, bei der DSGVO konformen Konfiguration mit lokalen Modellen und bei der Integration in bestehende Prozesse. Den Aufwand schätzen wir vorab und rechnen minutengenau ab.