La plupart des agents d’IA commencent chaque lundi frappés d’amnésie. Ils se souviennent peut-être d’une conversation, mais ne transforment pas forcément la méthode péniblement découverte la semaine précédente en procédure fiable. Hermes Agent repose sur une promesse plus intéressante : lorsqu’une démarche fonctionne, l’agent peut conserver la leçon sous forme de compétence lisible, rappeler plus tard l’expérience pertinente et ouvrir sa mémoire grandissante à l’inspection. C’est moins un intérimaire brillant qu’un carnet d’atelier qui se range mieux après chaque chantier.
Cette boucle d’apprentissage reste la signature d’Hermes. /learn peut convertir un processus, un dossier ou une source en savoir-faire réutilisable ; /journey montre les liens entre les souvenirs ; et l’application de bureau transforme cet historique en graphe modifiable. Pour le code, /goal ajoute une seconde discipline : avant de crier victoire, l’agent peut devoir présenter une preuve, par exemple la réussite des tests du projet. Cela ne rend pas chaque réponse correcte, mais donne au mot « terminé » un sens plus concret qu’un message final rédigé avec aplomb.
La version 0.20, la version Herald, ne remplace pas cette idée. Elle rend la boucle de l’agent moins gaspilleuse. Nous indique avoir étudié 250 000 conversations Hermes aux côtés de NVIDIA Nemo Relay et a découvert que l’échec coûteux n’est souvent pas un prompt géant mais une petite fuite répétée sur de nombreux tours : des schémas encombrants, des résultats d’outils qui ne sont plus utiles, un patch qui correspond presque, ou une recherche qui abandonne une orthographe trop tôt. Herald élague les schémas, taille les sorties d’outils obsolètes, compacte le contexte petit à petit, conserve les messages récents de l’utilisateur et donne aux outils des moyens de récupérer avant que le modèle n’invente un nouveau plan. Cela importe particulièrement lorsque le modèle est un modèle local plus petit avec moins de marge pour absorber un flux de travail désordonné.
Le changement le plus lourd de conséquences est que les outils aident désormais à se remettre de leurs propres défaillances ordinaires. Un résultat de terminal tronqué est enregistré dans un fichier plutôt que de devenir un angle mort. patch sait comment expliquer une modification déjà appliquée ou une non-correspondance d’espaces. Les écritures sont vérifiées sur le disque. Les recherches sans résultat cherchent des correspondances proches. Et le plafond par défaut pour les appels d’outils passe de 90 à 500, de sorte qu’une tâche longue a moins de chances de s’arrêter à cause d’un compteur arbitraire. Rien de tout cela ne rend Hermes infaillible ; cela déplace simplement les erreurs mécaniques familières hors du chemin du modèle. C’est exactement le genre d’amélioration qui peut transformer un modèle plus faible de “presque utile” à un assistant viable.
La sécurité évolue elle aussi dans une direction raisonnable. Hermes peut récupérer les secrets dans Bitwarden et 1Password, ce qui limite le besoin d’un interminable fichier d’environnement en clair. Des motifs de refus explicites bloquent certaines commandes même lorsque les autres contrôles sont relâchés. Le cloisonnement des identifiants, le masquage des sorties, les gardes de lecture partagées et les limites de taille ferment d’autres brèches. Le nouveau mode « approbation intelligente » mérite toutefois une formulation prudente : un second modèle de langage juge si une commande signalée semble sûre et peut l’autoriser seul. C’est moins fatigant, mais un modèle qui en surveille un autre ne remplace ni sandbox ni permission du système d’exploitation.
Herald donne également à Hermes un aspect moins expérimental de terminal et davantage celui d’un collaborateur que vous pouvez joindre au bon endroit. Il ajoute une voix conversationnelle en streaming qui peut être interrompue naturellement, des mots de réveil sur l’appareil, Agent-to-Agent v1.0, des webhooks signés, des recherches ancrées avec des citations vérifiées par rapport au texte source, des artefacts de bureau et des plugins, et la possibilité de rediriger un tour actif au lieu de s’arrêter et de recommencer. Les nouvelles commandes sont exceptionnellement pratiques : !command évite de dépenser un tour de modèle pour une action shell, /context montre ce qui remplit la fenêtre, et /diff montre ce qui a changé. Les importateurs pour Claude Code et Codex réduisent le coût d’essayer Hermes aux côtés d’une configuration existante.
La conclusion honnête est mesurée. Herald est un bond de capacité significatif car il rend la même ambition agentique moins chère, moins fragile et plus facile à piloter — en particulier avec un modèle tel que DeepSeek V4 Flash 0731 ou un autre point d’accès local. Nous augmentons Hermes à 8,5 mais conservons la deuxième place : Nous a fourni une ingénierie de publication inhabituellement détaillée, pas une comparaison indépendante de l’utilisation des jetons, de la latence et du succès des tâches. Choisissez Hermes lorsque l’apprentissage inspectable, les objectifs vérifiables, la liberté des modèles locaux et l’orchestration profonde l’emportent sur le fardeau opérationnel. Si vous voulez un appareil avec un seul fournisseur responsable de chaque autorisation et de chaque échec, Hermes vous en demande encore plus que cela.