La mayoría de los agentes de IA empiezan cada lunes con amnesia. Quizá recuerden una conversación, pero no necesariamente convierten el procedimiento que tanto costó perfeccionar la semana anterior en una rutina fiable. Hermes Agent parte de una promesa más interesante: cuando un método funciona, puede conservar la lección como una habilidad legible, recuperar experiencia relevante más adelante y mostrar su memoria creciente para que la inspecciones. Se parece menos a contratar a un trabajador temporal brillante y más a mantener un cuaderno de taller que se ordena mejor después de cada proyecto.
Ese ciclo de aprendizaje continúa siendo la diferencia esencial. /learn puede transformar un flujo de trabajo, una carpeta o una fuente en conocimiento reutilizable; /journey permite ver cómo se relacionan los recuerdos; y la aplicación de escritorio convierte ese historial en un grafo editable. Para programar, /goal añade otra disciplina: antes de cantar victoria, el agente puede tener que mostrar pruebas, como una batería de tests superada. Eso no vuelve correcta cada respuesta, pero da a la palabra «terminado» un significado más concreto que un mensaje final escrito con mucha seguridad.
La versión 0.20, el lanzamiento Herald, no reemplaza esa idea. Hace que el bucle del agente sea menos derrochador. Nous afirma haber estudiado 250.000 conversaciones de Hermes junto a NVIDIA Nemo Relay y descubrió que el fallo costoso a menudo no es un prompt gigantesco, sino una pequeña fuga repetida a lo largo de muchos turnos: esquemas voluminosos, salidas de herramientas que ya no son útiles, un parche que casi coincide o una búsqueda que se rinde una letra demasiado pronto. Herald recorta los esquemas, poda los resultados obsoletos de las herramientas, compacta el contexto poco a poco, retiene los mensajes recientes del usuario y ofrece a las herramientas formas de recuperarse antes de que el modelo invente un nuevo plan. Eso importa especialmente cuando el modelo es uno local más pequeño con menos margen para absorber un flujo de trabajo desordenado.
El cambio de mayor calado es que las herramientas ahora ayudan a recuperarse de sus propios fallos cotidianos. Un resultado truncado en el terminal se guarda en un archivo en lugar de convertirse en un punto ciego. patch sabe cómo explicar un cambio ya aplicado o un desajuste de espacios en blanco. Las escrituras se verifican en el disco. Las búsquedas sin resultado buscan aproximaciones. Y el límite predeterminado de llamadas a herramientas sube de 90 a 500, de modo que es menos probable que una tarea larga se detenga por un contador arbitrario. Nada de esto hace que Hermes sea infalible; simplemente aparta los errores mecánicos familiares del camino del modelo. Ese es exactamente el tipo de mejora que puede convertir un modelo más débil de “casi útil” a un asistente viable.
La seguridad también avanza en una dirección sensata. Hermes puede obtener secretos de Bitwarden y 1Password, reduciendo la necesidad de un enorme archivo de entorno en texto plano. Patrones de denegación explícitos bloquean comandos concretos incluso cuando otras comprobaciones se relajan. El alcance limitado de credenciales, la redacción de salidas, los controles comunes de acceso a archivos y los topes de solicitudes cierran más huecos. Sin embargo, el nuevo modo predeterminado de «aprobación inteligente» exige precisión: un segundo modelo de lenguaje decide si un comando marcado parece seguro y puede autorizarlo. Reduce la fatiga de hacer clic, pero un modelo juzgando a otro no equivale a un sandbox ni a los permisos del sistema operativo.
Herald también hace que Hermes se sienta menos como un experimento de terminal y más como un colaborador al que puedes acceder en el lugar adecuado. Añade voz conversacional fluida que se puede interrumpir de forma natural, palabras de activación (wake words) en el dispositivo, Agent-to-Agent v1.0, webhooks firmados, investigación fundamentada con citas verificadas contra el texto fuente, artefactos de escritorio y plugins, y la capacidad de redirigir un turno activo en lugar de parar y empezar de nuevo. Los nuevos comandos son inusualmente prácticos: !command evita gastar un turno del modelo en una acción de shell, /context muestra qué llena la ventana y /diff muestra qué ha cambiado. Los importadores para Claude Code y Codex reducen el coste de probar Hermes junto a una configuración existente.
La conclusión debe ser sobria. Herald es un salto significativo en capacidades porque hace que la misma ambición de agente sea más barata, menos frágil y más fácil de dirigir, particularmente con un modelo como DeepSeek V4 Flash 0731 u otro endpoint local. Subimos a Hermes a 8,5 pero mantenemos el segundo puesto: Nous ha proporcionado una ingeniería de versiones inusualmente detallada, no una comparación independiente de uso de tokens, latencia y éxito en tareas. Elige Hermes si el aprendizaje inspeccionable, los objetivos verificables, la libertad de modelos locales y la orquestación profunda compensan el esfuerzo operativo. Si buscas un electrodoméstico digital donde un único proveedor responda de cada permiso y cada fallo, Hermes todavía te pide demasiado.