Hermes Agent de Nous Research: el agente IA que aprende solo — instalación, uso y conexión con Telegram y WhatsApp (tutorial completo)

¿Qué es Hermes Agent?
Hermes Agent (☤) es el agente IA self-improving de Nous Research. Es el único agente con un learning loop integrado: crea skills desde la experiencia, las mejora durante el uso, se auto-nudgea a persistir conocimiento, busca sus propias conversaciones pasadas, y construye un modelo profundo de quién eres across sessions.
Puedes correrlo en un VPS de $5, un GPU cluster, o infra serverless que casi no cuesta nada cuando está idle. No está tied a tu laptop — háblale desde Telegram mientras trabaja en un cloud VM.
La última versión es v0.20.0 "The Herald Release" (3 agosto 2026), con ~3.650 commits, ~1.400 PRs merged, 650+ contributors.
Features clave
- Learning loop: agent-curated memory con periodic nudges, autonomous skill creation tras tasks complejos, skills que se auto-mejoran
- 30+ plataformas de messaging: Telegram, WhatsApp, Discord, Slack, Signal, SMS, Email, Home Assistant, Mattermost, Matrix, Microsoft Teams, LINE y más — todas desde un solo gateway process
- 60+ tools integradas: web search, image generation, TTS, cloud browser, file ops, terminal, code execution, vision, delegation, cron, skills, plugins, MCP
- Voice mode real-time: streaming TTS, barge-in, wake words on-device, hands-free across CLI, desktop y gateway platforms
- A2A v1.0: Agent-to-Agent protocol para discover, talk to y ser driven por otros agentes compatibles
- Grounded citations: research con claims respaldados por sources verificables, quotes matched contra page text real, fact-checking mode
- Outbound webhooks: eventos signed con HMAC hacia cualquier HTTP endpoint — CI, home automation, dashboards
- Desktop app como plataforma: artifacts con live preview, plugin SDK, quick-entry global hotkey, multiple windows
- Agent Plugins 1.0.0: soporte para el estándar portable de plugins (MCPs + Skills), compatible con ChatGPT, Codex, Cursor, etc.
- 7 terminal backends: local, Docker, SSH, Singularity, Modal, Daytona, Vercel Sandbox
- Cron scheduler: automations en natural language, delivery a cualquier plataforma
- Subagent delegation: spawn isolated subagents para parallel workstreams
- FTS5 session search: cross-session recall con LLM summarization
- Honcho dialectic user modeling: modelo profundo de quién eres
- Compatible con agentskills.io: open standard para skills
Instalación
Opción 1: Desktop installer (recomendado para macOS/Windows)
Descarga el Hermes Desktop installer desde la web oficial y ejecútalo. Instala CLI + desktop app.
Opción 2: CLI only — Linux / macOS / WSL2 / Termux
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
Opción 3: CLI only — Windows native (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
Opción 4: Package managers
# macOS (Homebrew)
brew install --cask stablyai/orca/orca # (Orca incluye Hermes)
# Arch Linux (AUR)
yay -S stably-orca-bin
¿Qué instala el installer?
El installer maneja todo automáticamente:
- uv (fast Python package manager)
- Python 3.11 (via uv, no sudo needed)
- Node.js v22 (para browser automation y WhatsApp bridge)
- ripgrep (fast file search)
- ffmpeg (audio format conversion para TTS)
- Repo clone, virtual environment, global
hermescommand
Único prerrequisito: Git (git --version). En Linux también curl y xz-utils.
Layout de instalación
| Modo | Code | Binary | Data |
|---|---|---|---|
| Per-user | ~/.hermes/hermes-agent/ | ~/.local/bin/hermes | ~/.hermes/ |
| Root | /usr/local/lib/hermes-agent/ | /usr/local/bin/hermes | /root/.hermes/ |
Post-instalación
source ~/.bashrc # or: source ~/.zshrc
hermes # Start chatting!
Configuración individual:
hermes model # Choose LLM provider and model
hermes tools # Configure which tools enabled
hermes gateway setup # Set up messaging platforms
hermes config set # Set individual config values
hermes setup # Full setup wizard
hermes doctor # Diagnose issues
hermes update # Update to latest
Fastest path: Nous Portal
hermes setup --portal
Un OAuth login cubre 300+ modelos + Tool Gateway (web search, image gen, TTS, browser). Recomendado.
Providers soportados
| Provider | Cómo configurar |
|---|---|
| Nous Portal | OAuth login via hermes model (300+ modelos, recommended) |
| OpenAI Codex | ChatGPT OAuth, Codex models |
| Anthropic | OAuth (Max plan) o API key |
| OpenRouter | API key |
| Fireworks AI | FIREWORKS_API_KEY |
| Z.AI / Zhipu | GLM_API_KEY |
| Kimi / Moonshot | KIMI_API_KEY |
| GitHub Copilot | OAuth via hermes model |
| Vercel AI Gateway | 200+ modelos, no markup on tokens |
| Custom endpoint | OpenAI-compatible, tu propio endpoint |
Conexión con Telegram — paso a paso
Paso 1: Crear bot via BotFather
- Abre Telegram y busca @BotFather
- Envía
/newbot - Elige nombre (ej. "Hermes Agent")
- Elige username terminado en
bot(ej.my_hermes_bot) - BotFather responde con tu API token:
123456789:ABCdefGHIjklMNOpqrSTUvwxYZ
Guarda el token secreto. Si se filtra, revócalo con /revoke en BotFather.
Paso 2: Personalizar bot (opcional)
En BotFather:
/setdescription - Descripción del bot
/setabouttext - About text
/setuserpic - Avatar
/setcommands - Comandos del menu:
help - Show help
new - Start new conversation
sethome - Set this chat as home channel
Paso 3: Encontrar tu User ID
Hermes usa numeric Telegram user IDs para access control. Mensajea a @userinfobot y te responde con tu ID (ej. 123456789).
Paso 4: Configurar Hermes
Opción A: Interactive (recomendado)
hermes gateway setup
Select Telegram, pega tu bot token y user IDs. El wizard escribe la config.
Opción B: Manual
Edita ~/.hermes/.env:
TELEGRAM_BOT_TOKEN=123456789:ABCdefGHIjklMNOpqrSTUvwxYZ
TELEGRAM_ALLOWED_USERS=123456789 # Comma-separated for multiple
Paso 5: Iniciar gateway
hermes gateway # Foreground
hermes gateway install # Install as user service
sudo hermes gateway install --system # Linux: boot-time system service
El bot debería estar online en segundos. Envíale un mensaje en Telegram para verificar.
Features de Telegram
- Voice memos: auto-transcribed con STT provider (faster-whisper, Groq, OpenAI)
- Voice replies: TTS responses como MP3 attachments
- Streaming: respuestas progresivas (edita message in real-time)
- Images y files: send screenshots, charts, generated images, documents
- Threads: soporte para forum topics
- Multi-session DM:
/topicactiva múltiples conversaciones paralelas en tu DM - Private Chat Topics (Bot API 9.4): forum-style topics en 1-on-1 DMs
- Group chat: bot responde en grupos con privacy mode config
- Large files: local telegram-bot-api server sube el límite de 20MB a 2GB
- Proxy support: SOCKS5/HTTP proxy
- Webhook mode: alternativa a long-polling, ideal para cloud deploy
Conexión con WhatsApp — paso a paso
Dos modos
- Bot mode: número dedicado para el bot (menor riesgo de ban, cleaner UX)
- Self-chat mode: usa tu propio número, te messageas a ti mismo (más fácil, más riesgo)
Prerrequisitos
- Node.js v18+ y npm (el WhatsApp bridge corre como Node.js process)
- Un teléfono con WhatsApp instalado (para escanear QR code)
Paso 1: Run setup wizard
hermes whatsapp
El wizard:
- Pregunta qué modo quieres (bot o self-chat)
- Instala bridge dependencies (Baileys library)
- Muestra QR code en tu terminal
- Espera a que lo escanees
Para escanear: WhatsApp → Settings → Linked Devices → Link a Device → apunta cámara al QR.
Paso 2: Número dedicado (bot mode)
Opciones para conseguir un segundo número:
- Google Voice (voice.google.com)
- Dual-SIM con WhatsApp Business
- Numero virtual barato
Registra el número en WhatsApp, luego corre hermes whatsapp y escanea QR desde esa cuenta.
Paso 3: Configurar Hermes
Edita ~/.hermes/.env:
WHATSAPP_ENABLED=true
WHATSAPP_MODE=bot # "bot" o "self-chat"
WHATSAPP_ALLOWED_USERS=15551234567 # Phone numbers con country code, sin +
Config opcional en ~/.hermes/config.yaml:
whatsapp:
reply_prefix: "" # Empty desactiva header
send_read_receipts: false # Blue ticks off por defecto
unauthorized_dm_behavior: ignore # Silencio para strangers
Paso 4: Iniciar gateway
hermes gateway # Foreground
hermes gateway install # User service
Features de WhatsApp
- Voice messages: incoming .ogg opus auto-transcribed, outgoing TTS como MP3
- Streaming: respuestas progresivas editando message en real-time
- Images y files: nativo como attachments
- Session persistence: sesión guardada en
~/.hermes/platforms/whatsapp/session, sobrevive restarts - Auto-reconnect: reconexión automática para network blips
- Re-pairing: si sesión se rompe,
hermes whatsappgenera fresh QR - Native polls: clarify-as-poll y locations
- Message batching: debounce para múltiples messages rápidos
Seguridad WhatsApp
chmod 700 ~/.hermes/platforms/whatsapp/session— protege credenciales- Usa número dedicado para aislar riesgo de tu cuenta personal
- Si sospechas compromiso: WhatsApp → Settings → Linked Devices → unlink
- Riesgo: Baileys es bridge no oficial. Para uso personal, ban risk bajo. Para bulk messaging, riesgo significante. WhatsApp Business API Cloud es el path compliant.
30+ plataformas de messaging
| Plataforma | Voice | Images | Files | Threads | Streaming |
|---|---|---|---|---|---|
| Telegram | ✅ | ✅ | ✅ | ✅ | ✅ |
| Discord | ✅ | ✅ | ✅ | ✅ | ✅ |
| Slack | ✅ | ✅ | ✅ | ✅ | ✅ |
| — | ✅ | ✅ | — | ✅ | |
| WhatsApp Cloud API | ✅ | ✅ | ✅ | — | — |
| Signal | — | ✅ | ✅ | — | — |
| SMS (Twilio) | — | — | — | — | — |
| Email (IMAP/SMTP) | — | ✅ | ✅ | ✅ | — |
| Home Assistant | — | — | — | — | — |
| Microsoft Teams | — | ✅ | — | ✅ | — |
| Matrix | ✅ | ✅ | ✅ | ✅ | ✅ |
| Mattermost | ✅ | ✅ | ✅ | ✅ | ✅ |
| Feishu/Lark | ✅ | ✅ | ✅ | ✅ | ✅ |
| + 15 más | DingTalk, WeCom, Weixin, BlueBubbles, QQ, Yuanbao, LINE, ntfy, IRC, SimpleX, Buzz, Photon, Raft, Webhooks, API Server |
Un solo hermes gateway process maneja todas las plataformas configuradas. Misma memory, skills y session history across todas.
Voice mode
- CLI: real-time conversational voice con streaming TTS y barge-in
- Discord: voice channels con real-time transcription y TTS
- Telegram: voice memos auto-transcribed, voice replies opcionales
- WhatsApp: voice messages auto-transcribed, TTS como MP3
- Wake words on-device: hands-free activation
- STT providers: faster-whisper (local), Groq Whisper, OpenAI Whisper, gpt-transcribe
- TTS: configurable, unified spoken-text preprocessor limpia markdown/code/URLs
Novedades v0.20.0 "The Herald Release" (3 agosto 2026)
- Real-time voice: streaming TTS, barge-in, wake words, hands-free across CLI/desktop/gateway
- A2A v1.0: Agent-to-Agent protocol para multi-agent systems heterogéneos
- Grounded citations: research con claims verificables, fact-checking mode
- Outbound webhooks: eventos signed con HMAC hacia cualquier HTTP endpoint
- Desktop como plataforma: artifacts con live preview, plugin SDK, Kanban plugin, quick-entry global hotkey, multiple windows
- CLI power-user wave:
!commandshell mode,/init,/diff,/context,/focus, Ctrl+S stash - Compression overhaul: proactive tool-result pruning, per-turn micro-compaction, guaranteed N-user-message tail
- Tools self-recovery: herramientas se auto-recuperan de failures
- Agent Plugins 1.0.0: soporte para portable plugins standard (MCPs + Skills)
- Vercel AI Gateway + Sandbox: 200+ modelos via AI Gateway, commands en Vercel Sandbox microVM
- hermes import-agent: migra Claude Code o Codex CLI setup a Hermes en un comando
CLI commands principales
hermes # Interactive CLI — start conversation
hermes model # Choose LLM provider and model
hermes tools # Configure tools
hermes gateway # Start messaging gateway
hermes gateway setup # Setup wizard for platforms
hermes whatsapp # WhatsApp setup wizard
hermes setup # Full setup wizard
hermes setup --portal # Nous Portal quick setup
hermes desktop # Launch desktop app
hermes doctor # Diagnose issues
hermes update # Update to latest
hermes import-agent # Migrate from Claude Code/Codex
Slash commands (dentro de conversación)
/new # Nueva conversación
/model [p:m] # Cambiar modelo
/personality [n] # Set personality
/retry # Retry last turn
/undo # Undo last turn
/compress # Comprimir contexto
/usage # Check usage
/insights --days N # Insights
/skills # Browse skills
/stop # Interrupt
/topic # Multi-session DM (Telegram)
/diff # Show changes
/context # Context window breakdown
/focus # Reduced-output view
/init # Generate AGENTS.md
Terminal backends
| Backend | Best for |
|---|---|
| Local | Day-to-day, fast iteration |
| Docker | Aislamiento reproducible |
| SSH | Remote dev boxes, GPU hosts |
| Singularity | HPC environments |
| Modal | Serverless persistence, hibernate when idle |
| Daytona | Serverless persistence, wake on demand |
| Vercel Sandbox | Cloud microVM, node24/node22/python3.13 |
Arquitectura del learning loop
- Memory: agent-curated con periodic nudges para persistir conocimiento
- Skills creation: tras tasks complejos, Hermes crea skills autónomamente
- Skills improvement: skills se auto-mejoran durante uso
- Session search: FTS5 con LLM summarization para cross-session recall
- User modeling: Honcho dialectic modeling construye modelo profundo de ti
- agentskills.io: compatible con open standard para skills portables
Seguridad
- Command approval: autorización para comandos sensibles
- Container isolation: Docker/Sandbox para execution aislada
- ALLOWED_USERS: allowlist por plataforma o global (
GATEWAY_ALLOWED_USERS) - DM pairing: pairing code approval para nuevos users
- Nunca set
GATEWAY_ALLOW_ALL_USERS=trueen gateway con shell access
FAQ
¿Hermes es gratis?
Hermes Agent es open source. El código es gratis. Pagas por el LLM provider que elijas (Nous Portal subscription, OpenAI, Anthropic, OpenRouter, etc.). Nous Portal cubre 300+ modelos + Tool Gateway en una subscription.
¿Puedo usar mi suscripción de Claude?
Sí. Anthropic OAuth (requiere Max plan + extra credits) o API key pay-per-token.
¿Funciona en Windows?
Sí, native Windows sin WSL. CLI, gateway, TUI y tools funcionan nativamente. PowerShell one-liner instala todo.
¿WhatsApp es seguro?
Usa Baileys (bridge no oficial). Para uso personal, ban risk bajo. Para business, usa WhatsApp Cloud API (oficial, compliant). Protege session directory con chmod 700.
¿Puedo tener Telegram y WhatsApp al mismo tiempo?
Sí. Un solo hermes gateway process maneja todas las plataformas. Misma memory y skills across todas.
¿Qué lo diferencia de otros agentes?
El learning loop: Hermes crea skills desde la experiencia, las mejora durante uso, y construye modelo de usuario across sessions. Otros agentes empiezan de cero cada sesión.
Conclusión
Hermes Agent es el agente IA más completo del ecosistema open source en 2026. Con v0.20.0 "The Herald Release", Nous Research entregó real-time voice, A2A protocol, grounded citations, outbound webhooks, desktop como plataforma con plugin SDK, y soporte para Agent Plugins 1.0.0. La integración con 30+ plataformas de messaging — especialmente Telegram y WhatsApp — lo convierte en un asistente 24/7 alcanzable desde cualquier dispositivo. El learning loop integrado significa que cuánto más lo usas, mejor te conoce y más skills acumula. Si buscas un agente IA que no solo responda sino que aprenda, Hermes es la opción más madura y feature-complete del mercado open source.