Puesto #2 Agentes IA — Software que trabaja mientras duermes
Nous Research

Hermes Agent

Un agente de código abierto de Nous Research que aprende habilidades reutilizables, verifica objetivos de programación y trabaja desde el terminal, el escritorio, la web y las aplicaciones de mensajería. La versión v0.19 Quicksilver convierte esa ambición en algo más práctico: arranque más rápido, subagentes observables, entrega duradera de resultados y mejor protección de secretos.

Actualizado 4 de agosto de 2026 MIT Open SourceSelf-ImprovingSelf-Hosted
Ideal para

Un agente de código abierto de Nous Research que aprende habilidades reutilizables, verifica objetivos de programación y trabaja desde el terminal, el escritorio, la web y las aplicaciones de mensajería. La versión v0.19 Quicksilver convierte esa ambición en algo más práctico: arranque más rápido, subagentes observables, entrega duradera de resultados y mejor protección de secretos.

Por qué gana

Ciclo de aprendizaje cerrado con `/learn` y memoria inspeccionable; contratos de finalización verificables con `/goal`; consejos Mixture of Agents seleccionables; más de 60 herramientas integradas; subagentes en segundo plano visibles y duraderos; integración con Bitwarden y 1Password; mejora declarada por Nous de unos 4,3 a 0,9 segundos en el despacho del primer turno en frío.

Ten en cuenta

Hermes sigue dando a una IA un acceso inusualmente amplio a comandos, archivos, navegadores y cuentas de mensajería. Las aprobaciones inteligentes reducen interrupciones, pero dependen del juicio de otro modelo y no constituyen una barrera de seguridad; los consejos MoA y la multiplicación de subagentes también pueden disparar el gasto.

01

Lo que realmente es

La mayoría de los agentes de IA empiezan cada lunes con amnesia. Quizá recuerden una conversación, pero no necesariamente convierten el procedimiento que tanto costó perfeccionar la semana anterior en una rutina fiable. Hermes Agent parte de una promesa más interesante: cuando un método funciona, puede conservar la lección como una habilidad legible, recuperar experiencia relevante más adelante y mostrar su memoria creciente para que la inspecciones. Se parece menos a contratar a un trabajador temporal brillante y más a mantener un cuaderno de taller que se ordena mejor después de cada proyecto.

Ese ciclo de aprendizaje continúa siendo la diferencia esencial. /learn puede transformar un flujo de trabajo, una carpeta o una fuente en conocimiento reutilizable; /journey permite ver cómo se relacionan los recuerdos; y la aplicación de escritorio convierte ese historial en un grafo editable. Para programar, /goal añade otra disciplina: antes de cantar victoria, el agente puede tener que mostrar pruebas, como una batería de tests superada. Eso no vuelve correcta cada respuesta, pero da a la palabra «terminado» un significado más concreto que un mensaje final escrito con mucha seguridad.

La versión 0.20, el lanzamiento Herald, no reemplaza esa idea. Hace que el bucle del agente sea menos derrochador. Nous afirma haber estudiado 250.000 conversaciones de Hermes junto a NVIDIA Nemo Relay y descubrió que el fallo costoso a menudo no es un prompt gigantesco, sino una pequeña fuga repetida a lo largo de muchos turnos: esquemas voluminosos, salidas de herramientas que ya no son útiles, un parche que casi coincide o una búsqueda que se rinde una letra demasiado pronto. Herald recorta los esquemas, poda los resultados obsoletos de las herramientas, compacta el contexto poco a poco, retiene los mensajes recientes del usuario y ofrece a las herramientas formas de recuperarse antes de que el modelo invente un nuevo plan. Eso importa especialmente cuando el modelo es uno local más pequeño con menos margen para absorber un flujo de trabajo desordenado.

El cambio de mayor calado es que las herramientas ahora ayudan a recuperarse de sus propios fallos cotidianos. Un resultado truncado en el terminal se guarda en un archivo en lugar de convertirse en un punto ciego. patch sabe cómo explicar un cambio ya aplicado o un desajuste de espacios en blanco. Las escrituras se verifican en el disco. Las búsquedas sin resultado buscan aproximaciones. Y el límite predeterminado de llamadas a herramientas sube de 90 a 500, de modo que es menos probable que una tarea larga se detenga por un contador arbitrario. Nada de esto hace que Hermes sea infalible; simplemente aparta los errores mecánicos familiares del camino del modelo. Ese es exactamente el tipo de mejora que puede convertir un modelo más débil de “casi útil” a un asistente viable.

La seguridad también avanza en una dirección sensata. Hermes puede obtener secretos de Bitwarden y 1Password, reduciendo la necesidad de un enorme archivo de entorno en texto plano. Patrones de denegación explícitos bloquean comandos concretos incluso cuando otras comprobaciones se relajan. El alcance limitado de credenciales, la redacción de salidas, los controles comunes de acceso a archivos y los topes de solicitudes cierran más huecos. Sin embargo, el nuevo modo predeterminado de «aprobación inteligente» exige precisión: un segundo modelo de lenguaje decide si un comando marcado parece seguro y puede autorizarlo. Reduce la fatiga de hacer clic, pero un modelo juzgando a otro no equivale a un sandbox ni a los permisos del sistema operativo.

Herald también hace que Hermes se sienta menos como un experimento de terminal y más como un colaborador al que puedes acceder en el lugar adecuado. Añade voz conversacional fluida que se puede interrumpir de forma natural, palabras de activación (wake words) en el dispositivo, Agent-to-Agent v1.0, webhooks firmados, investigación fundamentada con citas verificadas contra el texto fuente, artefactos de escritorio y plugins, y la capacidad de redirigir un turno activo en lugar de parar y empezar de nuevo. Los nuevos comandos son inusualmente prácticos: !command evita gastar un turno del modelo en una acción de shell, /context muestra qué llena la ventana y /diff muestra qué ha cambiado. Los importadores para Claude Code y Codex reducen el coste de probar Hermes junto a una configuración existente.

La conclusión debe ser sobria. Herald es un salto significativo en capacidades porque hace que la misma ambición de agente sea más barata, menos frágil y más fácil de dirigir, particularmente con un modelo como DeepSeek V4 Flash 0731 u otro endpoint local. Subimos a Hermes a 8,5 pero mantenemos el segundo puesto: Nous ha proporcionado una ingeniería de versiones inusualmente detallada, no una comparación independiente de uso de tokens, latencia y éxito en tareas. Elige Hermes si el aprendizaje inspeccionable, los objetivos verificables, la libertad de modelos locales y la orquestación profunda compensan el esfuerzo operativo. Si buscas un electrodoméstico digital donde un único proveedor responda de cada permiso y cada fallo, Hermes todavía te pide demasiado.

02

Puntos fuertes y límites honestos

Puntos fuertes

  • Un aprendizaje que deja algo útil: Hermes puede convertir flujos de trabajo exitosos en habilidades legibles y reutilizables, además de conservar conocimiento entre sesiones. /journey y el grafo de memoria del escritorio permiten inspeccionar lo aprendido, mientras que /goal puede exigir pruebas u otras evidencias antes de considerar terminada una tarea de programación.
  • Quicksilver hace que el agente se sienta mucho más ágil: Según Nous, v0.19 redujo el tiempo en frío entre enviar el primer turno y despacharlo de unos 4,3 a 0,9 segundos. El renderizado incremental del TUI, la pintura por token, los diffs virtualizados y una amplia optimización del escritorio atacan también las esperas que el usuario realmente percibe.
  • El trabajo paralelo ahora se puede observar y es más difícil de perder: Los subagentes en segundo plano generan transcripciones en directo, de modo que es posible revisar sus llamadas a herramientas mientras trabajan. Los resultados sobreviven a reinicios y un registro de entrega separado puede reenviar una respuesta terminada tras una caída del gateway.
  • Una gran elección de modelos sin renunciar a la orquestación avanzada: Hermes funciona con las principales API alojadas, modelos locales, Nous Portal y endpoints compatibles con OpenAI. Los consejos MoA siguen siendo una opción distintiva y ahora admiten controles de razonamiento por modelo y función, para que los asesores caros y el sintetizador no necesiten el mismo presupuesto.
  • Mejoras reales en secretos y control de comandos: Bitwarden y 1Password pueden proporcionar credenciales sin copiar cada clave a un .env en texto plano. Las reglas de denegación definidas por el usuario siguen activas incluso en modos permisivos; el aislamiento de credenciales, la redacción, los controles de lectura de archivos y los límites de webhooks reducen otros riesgos prácticos.
  • Una superficie operativa muy amplia: Más de 60 herramientas integradas cubren archivos, terminal, investigación web, automatización del navegador, medios, tareas programadas y delegación. Un gateway conecta más de 20 plataformas de mensajería, y el enrutamiento por perfiles puede separar trabajo y vida personal —configuración, memoria y secretos incluidos— detrás del mismo bot.
  • Entrada más sencilla sin cerrar el sistema: Los instaladores de escritorio y hermes setup --portal ofrecen un camino mucho más corto que reunir manualmente todas las claves. Nous Portal puede agrupar modelos y servicios gestionados de web, imagen, voz, navegador y sandbox, mientras siguen disponibles el autoalojamiento, los proveedores propios y los modelos locales.

Limitaciones honestas

  • La aprobación inteligente aporta comodidad, no contención: En el modo inteligente predeterminado, un modelo auxiliar puede aprobar automáticamente un comando que considera de bajo riesgo. Las reglas duras ayudan, pero quien conceda acceso al shell, al navegador o al correo debería seguir usando aislamiento, permisos mínimos, copias de seguridad y revisión humana en acciones importantes.
  • Las cifras de rendimiento más llamativas proceden del fabricante: Tanto la mejora del 80% en el arranque como el 14× del procesamiento de Markdown son mediciones de ingeniería publicadas por Nous Research. Son datos plausibles sobre la implementación, pero v0.19 no incluye una evaluación independiente que demuestre mayor acierto en tareas reales que sus rivales.
  • La complejidad de usuario avanzado no ha desaparecido: Un instalador y el acceso a Portal simplifican la primera hora, pero un despliegue serio todavía implica proveedores, perfiles, gateways, permisos, registros, actualizaciones y a veces infraestructura remota. El ritmo gigantesco del proyecto impresiona, aunque también hace que documentación y configuración cambien deprisa.
  • La inteligencia paralela puede producir facturas paralelas: Los consejos MoA, revisores auxiliares, modelos de compresión y subagentes pueden realizar varias llamadas para una sola petición. Nous Portal simplifica la facturación, no la elimina; conviene fijar presupuestos, asignar modelos baratos a funciones secundarias y revisar los informes de uso.
03

El Veredicto

Hermes sigue siendo el agente autoevolutivo más ambicioso intelectualmente de nuestra lista, y v0.19 mejora la ingeniería poco vistosa que decide si esa ambición funciona a diario: latencia, visibilidad, entrega duradera, secretos y enrutamiento. Merece una reseña más actual y favorable, pero no una subida de nota o posición sin pruebas independientes. Se mantiene en 8,2 y en el puesto 2: una opción fascinante para usuarios técnicos que quieran aprendizaje inspeccionable y orquestación profunda, siempre que estén dispuestos a operarlo con cuidado.

04

Preguntas frecuentes