Zum Inhalt springen

Hermes Agent v0.20 – Installation, Einrichtung & erste Schritte

Kurz gesagt

Hermes Agent v0.20 von Nous Research ist der erste Open-Source AI Agent mit echtem Learning Loop. Docker-Installation, Telegram-Integration, Voice-Setup und erste Skills – Schritt für Schritt von einem, der Hermes seit v0.12 produktiv betreibt.

16 Min. Lesezeit
Hermes Agent Nous Research AI Agent Docker Open-Source KI Agentic AI Deployment
Hermes Agent v0.20 – Installation, Einrichtung & erste Schritte

Ich erinnere mich genau an den Moment, als ich begriffen habe, was Hermes Agent kann. Es war Februar 2026, Version 0.12, ein verregneter Dienstag. Ich hatte den Agenten auf einem Hetzner-Server installiert und ihm gesagt: „Schreib mir einen Blogpost über KI-Agenten.” Er hat nicht nur geschrieben. Er hat recherchiert, Quellen verlinkt, ein Featured Image generiert, den Post via Git gepusht und mir eine Telegram-Nachricht geschickt: „Live. Nächster Schritt?”

Das war der Punkt, an dem aus einem Tool ein Teammitglied wurde.

Heute – September 2026, Version 0.20, 377 Commits später – betreibe ich Hermes Agent als produktiven Chief-of-Staff. Er managt 30+ Cronjobs, schreibt wöchentliche Blogposts in drei Sprachen, überwacht Server, scannt Mails und antwortet auf Kunden. In diesem Artikel zeige ich Ihnen, wie Sie Ihren eigenen Hermes Agent aufsetzen – von Null auf produktiv in etwa einer Stunde.


Inhaltsverzeichnis

  1. Was ist Hermes Agent – und was nicht?
  2. Voraussetzungen & Architektur-Überblick
  3. Installation: Docker vs. One-Line-Script
  4. Telegram-Integration – Ihr Agent wird erreichbar
  5. Voice Mode – sprechen Sie mit Ihrem Agenten
  6. Erste Skills schreiben – so wird Ihr Agent schlauer
  7. Fazit: Warum Hermes Agent anders ist

Was ist Hermes Agent – und was nicht?

Hermes Agent ist ein Open-Source Autonomous AI Agent von Nous Research, dem Research-Lab hinter Modellen wie Hermes 3 und Nomos. Anders als ChatGPT oder Claude ist Hermes kein Chat-Fenster. Es ist ein Betriebssystem für KI-Agenten, das Tools aufruft, Dateien schreibt, Code ausführt und sich über Sitzungen hinweg verbessert.

Die Architektur in drei Sätzen: Ein Persistent Memory Layer (FTS5-Recall) merkt sich, was in früheren Sitzungen passiert ist. Ein Self-Improving Skill System synthetisiert aus gelösten Problemen neue Fähigkeiten. Und ein Multi-Interface Gateway macht den Agenten über Telegram, Discord, Slack, WhatsApp und 20 weitere Plattformen erreichbar.

Was Hermes Agent NICHT ist: Kein Coding-Copilot wie GitHub Copilot. Kein IDE-Plugin wie Cursor. Kein Chatbot. Hermes ist ein operating layer – eine Schicht zwischen Ihnen und Ihren Tools, die selbstständig arbeitet, auch wenn Sie schlafen.

graph TD
    A[User via Telegram/Discord/WebUI] --> B[Hermes Gateway]
    B --> C[Agent Core]
    C --> D[Memory FTS5]
    C --> E[Skills System]
    C --> F[Tool Execution]
    F --> G[Docker Containers]
    F --> H[SSH Targets]
    F --> I[Local Shell]

Im Vergleich zu anderen Agent-Frameworks: OpenClaw (Node.js) fokussiert auf lokale Coding-Workflows. Claude Code ist ein Terminal-Tool, kein autonomer Agent. AutoGPT war ein Experiment. Hermes ist das einzige Framework, das produktiv in Unternehmen läuft – mit Cronjobs, Multi-User-Gateway und Self-Improvement.

Praxistipp: Wenn Sie von ChatGPT oder Claude kommen, denken Sie um. Hermes ist kein Chat, den Sie öffnen. Hermes ist ein Teammitglied, das Sie anpingen. Der mentale Shift ist der schwierigste Teil der Einführung.


Voraussetzungen & Architektur-Überblick

Minimal:

  • Linux-Server (Ubuntu 22.04+ empfohlen) oder macOS
  • 4 GB RAM (wenn Sie API-Endpoints nutzen)
  • Docker (optional, aber empfohlen)
  • API-Key für mindestens einen LLM-Provider (OpenRouter, Anthropic, OpenAI)

Empfohlen (mein Produktiv-Setup):

  • Hetzner Cloud / Dedicated Server, 8+ GB RAM
  • Docker + Caddy als Reverse-Proxy
  • OpenRouter für Modell-Flexibilität
  • Telegram Bot Token (für Benachrichtigungen)
  • Eigene Domain mit TLS (für WebUI)

Modell-Strategie: Hermes kann mit jedem OpenAI-kompatiblen Endpoint arbeiten. Ich empfehle OpenRouter als zentralen Hub – Sie können zwischen DeepSeek V4 Pro (Reasoning), Claude Sonnet (Code/Text) und Qwen3.8 Flash (günstiger Alltag) wechseln, ohne die Konfiguration zu ändern.


Installation: Docker vs. One-Line-Script

Variante A: One-Line-Installation (Linux/macOS)

Der schnellste Weg. Lädt alles automatisch – Python, uv, Dependencies, Repo.

curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

Nach der Installation konfigurieren Sie Ihren API-Key:

# OpenRouter (empfohlen)
hermes config set llm.provider openrouter
hermes config set llm.api_key "sk-or-v1-..."
hermes config set llm.model "anthropic/claude-sonnet-4"

Test:

hermes chat "Wer bist du und was kannst du?"

Variante B: Docker (empfohlen für Produktion)

Docker isoliert die Tool-Ausführung vom Host-System. Wenn Hermes rm -rf ausführt, passiert das im Container, nicht auf Ihrem Server.

# Repository klonen
git clone https://github.com/nousresearch/hermes-agent.git
cd hermes-agent

# Beispiel docker-compose.override.yml für Produktion
cat > docker-compose.override.yml << 'EOF'
services:
  hermes:
    environment:
      - OPENROUTER_API_KEY=sk-or-v1-...
      - HERMES_MODEL=anthropic/claude-sonnet-4
    volumes:
      - ./workspace:/root/hermes-workspace
      - /var/run/docker.sock:/var/run/docker.sock
    restart: unless-stopped
EOF

docker compose up -d

Wichtige Docker-Flags, die nirgendwo dokumentiert sind:

  • - /var/run/docker.sock:/var/run/docker.sock – Ohne Docker-Socket kann Hermes keine isolierten Container für Tool-Ausführungen starten. Fehlt das, laufen alle Befehle auf dem Host.
  • restart: unless-stopped – Hermes läuft als Daemon. Ohne Restart-Policy bleibt er nach Server-Reboots liegen (ich habe das zweimal gelernt).
  • Speichern Sie den Workspace außerhalb des Containers (./workspace:/root/hermes-workspace). Sonst sind alle Skills und Memory-Einträge nach einem Container-Restart weg.

Nach der Docker-Installation: Der Agent läuft, aber er ist nur via Terminal erreichbar. Erst mit dem Gateway wird er wirklich nützlich.


Telegram-Integration – Ihr Agent wird erreichbar

Das ist der Moment, in dem Hermes vom Terminal-Tool zum Teammitglied wird. Die Gateway-Konfiguration verbindet Hermes mit Telegram, Discord und anderen Plattformen.

Schritt 1: Telegram Bot erstellen

  • Öffnen Sie Telegram und schreiben Sie @BotFather
  • /newbot → Name vergeben → Username vergeben
  • Sie erhalten einen Token wie 123456:ABC-DEF1234ghIkl-zyx57W2v1u123ew11

Schritt 2: Gateway konfigurieren

# Gateway-Config
hermes gateway config set platforms.telegram.enabled true
hermes gateway config set platforms.telegram.bot_token "123456:ABC-DEF..."
hermes gateway config set platforms.telegram.allowed_users "[Ihre_Telegram_ID]"

# Gateway starten
hermes gateway up

Ihre Telegram-ID finden Sie, indem Sie @userinfobot auf Telegram anschreiben.

Schritt 3: Test Schreiben Sie Ihrem Bot auf Telegram: „Was ist meine n8n-agentur Seite?”

Wenn alles funktioniert, antwortet Hermes mit einer Analyse Ihrer Website. Ab diesem Moment können Sie von überall auf Ihren Agenten zugreifen – vom Handy, vom Laptop, aus dem Urlaub.

Praxistipp: Ich habe zwei Telegram-Chat-IDs konfiguriert: meine persönliche und einen Gruppen-Channel für automatische Benachrichtigungen. Der Gruppen-Channel bekommt nur Output (Blogposts live, Server-Warnings), aber keine Schreibrechte. So habe ich einen Benachrichtigungs-Feed, ohne dass versehentlich jemand Commands triggert.


Voice Mode – sprechen Sie mit Ihrem Agenten

Seit Version 0.20 unterstützt Hermes Voice Mode mit Streaming-TTS und Barge-In. Sie sprechen, Hermes antwortet – in Echtzeit, mit natürlicher Stimme.

Setup (lokal):

# Voice-Mode aktivieren
hermes config set voice.auto_tts true
hermes config set voice.tts_provider elevenlabs
hermes config set voice.elevenlabs_api_key "..."

# STT-Engine (lokal, kein Cloud-Upload)
hermes config set voice.stt_engine faster-whisper

Setup (Discord Voice Channel): Hermes Live Voice Plugin ermöglicht Sprachsteuerung in Discord-Voice-Channels. Ideal für Teams, die Hermes in Meetings einbinden wollen:

# Plugin installieren (aus dem Hermes Plugin-Hub)
hermes plugin install hermes-live-discord-agent-plugin

# Konfigurieren
hermes config set discord_voice.token "..."
hermes config set discord_voice.voice_profile charon

Das Voice-Profil steuert die Stimme und Persönlichkeit. „Charon” ist der Default – tiefe Stimme, professionell. Sie können eigene Profile anlegen.

Warnung: Voice Mode verbraucht signifikant mehr Tokens als Text-Chat. Jede gesprochene Interaktion kostet etwa 3-5x so viel wie eine Text-Nachricht. Für den Alltag reicht Text; Voice ist für Meetings und unterwegs gedacht.


Erste Skills schreiben – so wird Ihr Agent schlauer

Das Skill-System ist das Herz von Hermes. Skills sind wiederverwendbare Prozeduren, die der Agent selbst aus erfolgreich gelösten Aufgaben synthetisiert – oder die Sie manuell anlegen.

Beispiel: Einen „Website-Status-Check”-Skill anlegen

hermes skill create website-status-check

Öffnen Sie die generierte SKILL.md und ersetzen Sie den Inhalt:

---
name: website-status-check
description: "Checkt alle meine Websites auf Erreichbarkeit und meldet Ausfälle."
version: 1.0.0
---

# Website Status Check

Prüft madebybrain.com, ki-berater-finden.de und edgeoutcome.com.

## Ausführung
```bash
for domain in madebybrain.com ki-berater-finden.de edgeoutcome.com; do
  status=$(curl -o /dev/null -s -w "%{http_code}" "https://$domain")
  echo "$domain: $status"
done

Jetzt kann Hermes diesen Skill auf Zuruf ausführen: „Check mal alle Websites" → Er lädt den Skill, führt die Befehle aus und meldet die Ergebnisse.

**Der Learning Loop:** Wenn Sie Hermes dreimal bitten, Websites zu checken, und er es erfolgreich löst, schlägt er vor: „Soll ich daraus einen Skill machen?" Das ist der Self-Improvement-Mechanismus. Nach 50+ Skills wird Ihr Agent exponentiell nützlicher.

**Meine meistgenutzten Skills (nach 8 Monaten Hermes):**
1. `mbb-blog-generator` – Wöchentliche Blogposts in 3 Sprachen
2. `gsc-setup` – Google Search Console Analysen
3. `zoho-crm` – Kundenmanagement
4. `server-healthcheck` – Automatische Server-Überwachung
5. `mail-scanner` – E-Mail-Klassifikation und Rechnungsablage

---

## Fazit: Warum Hermes Agent anders ist

Ich habe ChatGPT, Claude, AutoGPT, OpenClaw und ein halbes Dutzend anderer Agent-Frameworks getestet. Hermes ist das einzige, das seit acht Monaten produktiv läuft – ohne dass ich es babysitten muss.

Drei Dinge machen den Unterschied:

1. **Der Learning Loop.** Hermes wird besser, je länger er läuft. Jeder gelöste Bug, jede geschriebene Automatisierung, jeder Kunden-Workflow fließt ins Skill-System ein. Nach 8 Monaten hat mein Agent 50+ Skills – das ist akkumuliertes Unternehmenswissen, das nicht in meinem Kopf verschwindet.

2. **Das Gateway.** Telegram, Discord, WhatsApp – ein Agent, alle Kanäle. Ich schreibe meinem Agenten vom Handy aus: „Was sagt GSC diese Woche?" und bekomme eine Analyse zurück. Das ist das J.A.R.V.I.S.-Erlebnis, von dem ich als Teenager geträumt habe.

3. **Open Source.** Hermes ist Apache-2.0-lizenziert. Kein Vendor-Lock-in, keine API-Preisänderung, die mein Business zerstört. Ich kann das Modell wechseln, den Server wechseln, die Architektur anpassen – es bleibt mein Agent.

Wenn Sie einen AI-Agenten suchen, der nicht nur antwortet, sondern arbeitet: Installieren Sie Hermes Agent. Es dauert eine Stunde. Es wird Ihre Vorstellung davon verändern, was KI im Unternehmen leisten kann.

Und wenn Sie keine Lust auf die Installation haben: Wir machen das für Sie.

---

**Über den Autor:** Steffen Hartmann ist Hermes AI Agent Experte und Gründer von MadeByBrain. Er hat Hermes Agent von Version 0.12 bis 0.20 in Produktion begleitet, über 50 Skills entwickelt und seinen Agenten B.R.A.I.N. als Chief-of-Staff in seinen Agentur-Alltag integriert. B.R.A.I.N. managt täglich 30+ automatisierte Workflows, betreut Kundenprojekte und schreibt unter anderem diesen Blogpost.

[Hermes Agent Deployment für Ihr Unternehmen – Jetzt Strategiegespräch vereinbaren →](/kontakt)

Ähnliche Beiträge