Blog / ia

Hermes 0.20: cuando los agentes empiezan a hablar entre ellos

Hermes 0.20: cuando los agentes empiezan a hablar entre ellos

Durante mucho tiempo, la idea de un agente de inteligencia artificial fue bastante sencilla:

tú le das una instrucción, el agente utiliza algunas herramientas y trata de completar la tarea.

Pero algo está cambiando.

Los agentes empiezan a dejar de ser herramientas aisladas para convertirse en piezas de sistemas mucho más grandes: agentes que pueden hablar, delegar tareas, consultar fuentes, comunicarse con otros agentes y conectarse con aplicaciones externas.

Y Hermes Agent acaba de dar un paso importante en esa dirección.

El 3 de agosto de 2026, Nous Research publicó Hermes Agent 0.20.0, The Herald Release, una actualización que agrupa aproximadamente 3,650 commits, 1,400 pull requests fusionados, 5,200 archivos modificados, 1,200 issues cerrados y la participación de más de 650 contribuidores desde la versión 0.19.0.

Pero los números no son lo más interesante.

Lo verdaderamente interesante es lo que Hermes puede hacer ahora.


¿Qué es Hermes Agent?

Hermes Agent es un agente de IA open source desarrollado por Nous Research.

No es simplemente otro chatbot.

Hermes puede ejecutarse desde un ordenador o servidor, utilizar diferentes modelos, acceder a herramientas, mantener memoria, crear habilidades, ejecutar tareas y comunicarse a través de diferentes plataformas.

La propia página del proyecto lo presenta como un agente que puede vivir en diferentes superficies —CLI, Telegram, Discord, Slack, WhatsApp y otras— manteniendo una memoria común. También incorpora subagentes, búsqueda web, automatización, generación de imágenes y diferentes mecanismos de sandboxing.

Si quieres ver cómo llegó a mi máquina y cómo lo conecté a Telegram y WhatsApp, ya te conté la historia completa en Hermes Agent: la evolución natural de mi agente de IA.

Y precisamente por eso la versión 0.20 resulta especialmente interesante.

Porque varias de sus nuevas funciones apuntan hacia una misma dirección:

Hermes ya no solamente quiere trabajar para ti. También quiere trabajar con otros sistemas y otros agentes.


1. Hermes ahora puede hablar contigo

Empecemos por la característica más llamativa.

La voz.

Pero aquí hay una diferencia importante respecto a simplemente añadir texto a voz.

En versiones anteriores, hablar con un agente de voz podía sentirse como:

Hablas → esperas → el agente genera toda la respuesta → escuchas.

Hermes 0.20 introduce streaming de voz conversacional.

La respuesta puede comenzar a reproducirse mientras todavía se está generando.

Y además incorpora barge-in: puedes interrumpir al agente mientras está hablando.

Es decir:

Hermes está hablando → tú lo interrumpes → Hermes se detiene → escucha → continúa con la nueva información.

La release oficial describe precisamente este comportamiento como una conversación más natural, con respuesta por fragmentos, interrupción durante la reproducción y detección de silencio para evitar que el sistema hable encima del usuario.

Esto parece un detalle de interfaz.

No lo es.

Cuando un agente puede ser interrumpido, deja de comportarse como un reproductor de audio y comienza a comportarse más como un interlocutor.


2. Y entonces aparece “Oye, Hermes”

Aquí la cosa se pone todavía más interesante.

Hermes 0.20 incorpora wake words.

Puedes definir una frase para activar al agente, por ejemplo:

“Hey Hermes”

o utilizar otra frase personalizada.

La detección de la palabra de activación se realiza localmente en el dispositivo mientras Hermes espera, de modo que el audio no tiene que salir de la máquina simplemente para comprobar si alguien pronunció la palabra de activación.

También existe control manos libres.

Incluso puedes decir “stop” para detener la conversación de voz.

En otras palabras:

Hermes empieza a comportarse como un asistente de voz que vive dentro de tu entorno de trabajo.

Y esto abre una posibilidad interesante.

No necesitas tener una ventana abierta frente a ti.

Puedes estar trabajando, programando o haciendo otra cosa y llamar al agente.


3. Voz en WhatsApp, Telegram y otros canales

La voz tampoco se queda en el escritorio.

Hermes 0.20 amplía el procesamiento de voz hacia sus diferentes gateways.

Puedes enviar una nota de voz desde plataformas compatibles, Hermes puede transcribirla, procesarla y responder utilizando voz cuando el canal lo permite.

La release menciona WhatsApp, Feishu, DingTalk, LINE, QQ, Photon y Weixin, además de diferentes configuraciones para STT y TTS.

Esto es importante porque empieza a desaparecer una frontera:

el agente ya no tiene que vivir en una aplicación específica.

Puede vivir detrás de diferentes canales.

Y eso nos lleva a la siguiente novedad.


4. A2A: ahora los agentes pueden hablar entre ellos

Esta es, probablemente, la novedad arquitectónicamente más importante de Hermes 0.20.

A2A significa Agent-to-Agent.

La idea es sencilla:

Hasta ahora podíamos tener algo así:

Diagrama de flujo: usuario a Hermes a herramientas, con web, terminal, base de datos y APIs, fondo negro con texto dorado

Pero ahora podemos empezar a imaginar:

Diagrama: usuario a Hermes conectado a agentes especializados de frontend, backend, seguridad e investigación, fondo negro con texto dorado

Cada agente puede tener una especialidad diferente.

Uno puede encargarse del frontend.

Otro del backend.

Otro de seguridad.

Otro de investigación.

Y un agente principal puede coordinar el trabajo.

Hermes 0.20 incorpora un plugin compatible con A2A v1.0, permitiendo descubrir, comunicarse y ser controlado por otros agentes compatibles con el protocolo. La propia release lo presenta como una forma de incorporar Hermes a sistemas multiagente con diferentes tecnologías.

Y aquí hay una distinción fundamental:

A2A no reemplaza a MCP.

MCP sirve para conectar un agente con herramientas y recursos.

A2A sirve para conectar agentes con agentes.

Una arquitectura puede utilizar ambos.

Diagrama: agente A conectado por A2A a agente B, que usa MCP para conectar con API y base de datos, fondo negro con texto dorado

Y ahí comienza a aparecer algo mucho más parecido a un equipo digital de agentes especializados.


5. Investigación con evidencia: Hermes intenta ponerle freno a las alucinaciones

Otra de las grandes novedades de Hermes 0.20 es su nuevo sistema de grounded research.

La idea es atacar uno de los problemas clásicos de los agentes:

pueden sonar extremadamente convincentes incluso cuando están equivocados.

El nuevo skill grounded-citations busca que las afirmaciones de una investigación estén respaldadas por fuentes verificables.

La release especifica tres elementos especialmente interesantes:

  • las citas se contrastan con el contenido real de la página;
  • los enlaces apuntan hacia la evidencia concreta;
  • existe un modo de fact-checking para comprobar afirmaciones o documentos.

Esto merece una aclaración.

No significa que Hermes haya conseguido algo mágico llamado:

“cero alucinaciones”.

Eso sería una exageración.

Lo que cambia es el mecanismo de investigación.

En lugar de confiar únicamente en que el modelo “recuerde” o genere una respuesta plausible, el sistema intenta establecer una relación explícita entre:

afirmación → fuente → evidencia.

Y esa diferencia es enorme cuando estamos hablando de investigación profesional.


6. 500 pasos: el cambio que puede pasar desapercibido

Hay otra mejora menos espectacular visualmente, pero muy importante para los agentes autónomos.

La capacidad de ejecutar tareas más largas.

En la presentación de la release se destaca el salto de 90 a 500 pasos por tarea.

¿Por qué importa?

Porque un agente no resuelve una tarea compleja en una sola llamada al modelo.

Puede necesitar:

Diagrama de flujo vertical: pensar, buscar, leer, ejecutar, comprobar, corregir, volver a buscar, ejecutar otra herramienta, verificar, fondo negro con texto dorado

Cada una de esas interacciones consume tiempo y recursos.

Un límite de pasos pequeño puede impedir que un agente complete tareas relativamente complejas.

Un límite mucho mayor permite construir flujos más largos.

Pero nuevamente hay que tener cuidado:

500 pasos no significa que Hermes vaya a trabajar 500 veces mejor.

Significa que tiene más espacio operativo para tareas largas.

La calidad seguirá dependiendo del modelo, las herramientas, el contexto y la capacidad del agente para saber cuándo debe detenerse.


7. ¿Y si Hermes se está equivocando mientras trabaja?

Esta es otra mejora que me parece especialmente buena.

Antes, si el agente tomaba un camino equivocado, normalmente tenías que detenerlo.

Ahora puedes redirigirlo durante el turno.

La release llama a esta característica mid-turn redirects.

Si Hermes está trabajando y detectas que tomó una dirección incorrecta, puedes escribir una corrección mientras el turno está activo.

El trabajo en curso se conserva y el agente incorpora la nueva instrucción para cambiar de rumbo.

La diferencia conceptual es importante.

Antes:

Diagrama: agente se equivoca, stop, explicar todo nuevamente, reintentar, fondo negro con texto dorado

Ahora:

Diagrama: agente trabajando, corrección del usuario, agente corrige el rumbo y continúa, fondo negro con texto dorado

Es un pequeño cambio de interfaz que puede tener un impacto enorme en la experiencia de trabajar con agentes.


8. Hermes empieza a convertirse en un workbench

La versión 0.20 también transforma bastante la aplicación de escritorio.

Aparecen Artifacts, con tarjetas versionadas y previsualización en vivo dentro de un entorno aislado.

Esto permite que Hermes no solamente produzca una respuesta textual.

Puede producir algo que después podamos visualizar y continuar trabajando.

Por ejemplo:

Diagrama: Hermes genera aplicación, artifact, preview, nueva versión, corrección, nueva versión, fondo negro con texto dorado

La release también incorpora un SDK de plugins, múltiples ventanas y un sistema de quick entry.

La propia documentación de la release utiliza una frase que resume muy bien este cambio:

el escritorio deja de ser solamente un cliente de chat y comienza a convertirse en un entorno de trabajo.


9. Quick Entry: Hermes desde cualquier lugar

Otra función aparentemente pequeña:

Quick Entry.

Mediante un atajo global puedes invocar una pequeña ventana de Hermes desde cualquier aplicación.

No necesitas abrir nuevamente todo el cliente.

Esto parece trivial hasta que empiezas a pensar en el flujo cotidiano.

Estás programando:

“Hermes, revisa esta función.”

Estás navegando:

“Hermes, resume esta página.”

Estás redactando:

“Hermes, dame tres alternativas.”

El agente comienza a comportarse menos como una aplicación que abres y más como una capa de asistencia permanente sobre tu entorno de trabajo.


10. También puedes importar tus agentes de Claude Code y Codex

Y aquí hay una jugada bastante inteligente.

Hermes incorpora:

hermes import-agent

La herramienta permite migrar configuraciones de agentes de Claude Code o Codex CLI hacia Hermes.

¿Por qué importa?

Porque uno de los problemas de cambiar de herramienta es precisamente este:

“Ya tengo configurado mi agente. Ya tiene instrucciones, archivos, contexto y una forma de trabajar. ¿Tengo que empezar desde cero?”

Con esta función, Hermes intenta reducir ese costo de migración.

No significa que todo el ecosistema sea automáticamente compatible.

Pero sí demuestra una intención clara:

Hermes quiere convertirse en una plataforma desde la que puedas operar diferentes flujos de agentes.


11. Y aparece otra pieza: Webhooks

Hay una novedad que quizá no sea tan sexy para una demo de YouTube, pero para una empresa puede ser mucho más importante:

outbound webhooks.

Hermes ahora puede enviar eventos a sistemas externos mediante HTTP.

Y además utiliza firmas HMAC, de manera que el sistema receptor puede verificar que el evento realmente proviene de Hermes y no fue manipulado.

Esto permite imaginar integraciones como:

Diagrama: Hermes emite eventos de sesión, tarea, herramienta y turno; pasan por webhook y llegan a API, CRM y dashboard, fondo negro con texto dorado

Y aquí Hermes empieza a dejar de ser solamente una herramienta personal.

Empieza a convertirse en un componente integrable dentro de otros sistemas.


12. Entonces… ¿qué cambió realmente en Hermes 0.20?

Si hacemos una lista rápida:

Antes

Diagrama: usuario a agente a herramientas, fondo negro con texto dorado

Ahora

Diagrama: usuario a Hermes conectado a herramientas, web, otros agentes, APIs, canales de voz y artifacts, fondo negro con texto dorado

Y eso es precisamente lo que hace interesante esta versión.

No es una sola función revolucionaria.

Es la combinación de muchas piezas.

Voz.

Memoria.

Subagentes.

A2A.

Investigación fundamentada.

Artifacts.

Webhooks.

Plugins.

Integraciones.

Ejecución prolongada.

Corrección durante el turno.

Todo empieza a apuntar hacia una misma arquitectura.


Hermes 0.20 no es solamente un agente más inteligente

Y aquí está mi lectura personal de esta release.

Creo que sería un error analizar Hermes 0.20 simplemente como:

“Una nueva versión de Hermes con más funciones.”

El cambio más interesante está en otro lugar.

Hermes está construyendo infraestructura alrededor del agente.

El agente necesita:

  • memoria;
  • herramientas;
  • canales;
  • otros agentes;
  • mecanismos de verificación;
  • eventos;
  • integración con sistemas externos;
  • interfaces de voz;
  • capacidad de delegación;
  • persistencia;
  • y mecanismos para corregir su comportamiento.

Eso es exactamente lo que empieza a aparecer en Hermes.

Y cuando todas esas piezas se conectan, el concepto cambia.

Ya no tenemos solamente:

“un chatbot que puede ejecutar comandos”.

Tenemos algo mucho más cercano a:

“un nodo dentro de una red de agentes”.


¿Estamos entrando en la era de los equipos de agentes?

Probablemente todavía sea demasiado pronto para decirlo.

Un protocolo no garantiza que los agentes vayan a colaborar bien.

Tampoco significa que lanzar cinco agentes vaya a producir cinco veces más productividad.

De hecho, coordinar agentes introduce nuevos problemas:

  • sincronización;
  • contexto;
  • costos;
  • permisos;
  • seguridad;
  • errores en cascada;
  • comunicación entre agentes;
  • supervisión;
  • y, sobre todo, saber cuándo NO utilizar otro agente.

Pero la dirección tecnológica sí resulta bastante clara.

Los agentes están evolucionando desde:

agente + herramientas

hacia:

agente + herramientas + memoria + otros agentes + sistemas externos.

Y Hermes 0.20 es una muestra muy interesante de esa transición.


El verdadero cambio está en la arquitectura

Quizá dentro de unos meses la función de voz de Hermes 0.20 nos parezca completamente normal.

Los wake words serán normales.

Los artifacts serán normales.

Los webhooks serán normales.

Incluso hablar con otro agente será algo cotidiano.

Pero hay una idea detrás de todas esas funciones que sí vale la pena recordar:

el agente está dejando de ser una aplicación.

Está empezando a convertirse en una pieza de infraestructura.

Y cuando los agentes puedan descubrirse, comunicarse, delegarse tareas y utilizar herramientas independientemente de quién los haya construido…

entonces la pregunta ya no será:

"¿Cuál es el mejor agente de IA?"

La pregunta será:

"¿Cómo construimos un sistema donde cada agente haga aquello para lo que es mejor?"

Y ahí empieza la siguiente historia.

A2A.

MCP.

Multi-agent systems.

Y, eventualmente, equipos completos de agentes trabajando juntos.

Anterior Linus Torvalds y la nueva normalidad: la IA ya está… Siguiente ¿Cuánto cuesta programar en 2026 con IA?