Classé #2 Agents IA — Des logiciels qui travaillent pendant que vous dormez
Nous Research

Hermes Agent

Un agent open source de Nous Research qui apprend des compétences réutilisables, vérifie ses objectifs de programmation et travaille dans le terminal, sur le bureau, sur le Web et dans les messageries. La version v0.19 Quicksilver rend ce système ambitieux nettement plus pratique grâce à un démarrage accéléré, des sous-agents observables, une livraison durable des résultats et une meilleure gestion des secrets.

Mis à jour 4 août 2026 MIT Open SourceSelf-ImprovingSelf-Hosted
8.5sur 10
Site officiel
Idéal pour

Un agent open source de Nous Research qui apprend des compétences réutilisables, vérifie ses objectifs de programmation et travaille dans le terminal, sur le bureau, sur le Web et dans les messageries. La version v0.19 Quicksilver rend ce système ambitieux nettement plus pratique grâce à un démarrage accéléré, des sous-agents observables, une livraison durable des résultats et une meilleure gestion des secrets.

Pourquoi ça Gagne

Boucle d'apprentissage fermée avec `/learn` et mémoire inspectable ; contrats de finalisation vérifiables avec `/goal` ; conseils Mixture of Agents sélectionnables ; plus de 60 outils intégrés ; sous-agents d'arrière-plan observables et durables ; intégration de Bitwarden et 1Password ; passage annoncé par Nous d'environ 4,3 à 0,9 seconde pour l'envoi du premier tour à froid.

À surveiller

Hermes donne toujours à une IA un accès exceptionnellement large aux commandes, fichiers, navigateurs et comptes de messagerie. Les approbations intelligentes réduisent les interruptions, mais reposent sur le jugement d'un autre modèle plutôt que sur une barrière de sécurité ; MoA et sous-agents peuvent aussi multiplier les coûts.

01

Ce que c'est réellement

La plupart des agents d’IA commencent chaque lundi frappés d’amnésie. Ils se souviennent peut-être d’une conversation, mais ne transforment pas forcément la méthode péniblement découverte la semaine précédente en procédure fiable. Hermes Agent repose sur une promesse plus intéressante : lorsqu’une démarche fonctionne, l’agent peut conserver la leçon sous forme de compétence lisible, rappeler plus tard l’expérience pertinente et ouvrir sa mémoire grandissante à l’inspection. C’est moins un intérimaire brillant qu’un carnet d’atelier qui se range mieux après chaque chantier.

Cette boucle d’apprentissage reste la signature d’Hermes. /learn peut convertir un processus, un dossier ou une source en savoir-faire réutilisable ; /journey montre les liens entre les souvenirs ; et l’application de bureau transforme cet historique en graphe modifiable. Pour le code, /goal ajoute une seconde discipline : avant de crier victoire, l’agent peut devoir présenter une preuve, par exemple la réussite des tests du projet. Cela ne rend pas chaque réponse correcte, mais donne au mot « terminé » un sens plus concret qu’un message final rédigé avec aplomb.

La version 0.20, la version Herald, ne remplace pas cette idée. Elle rend la boucle de l’agent moins gaspilleuse. Nous indique avoir étudié 250 000 conversations Hermes aux côtés de NVIDIA Nemo Relay et a découvert que l’échec coûteux n’est souvent pas un prompt géant mais une petite fuite répétée sur de nombreux tours : des schémas encombrants, des résultats d’outils qui ne sont plus utiles, un patch qui correspond presque, ou une recherche qui abandonne une orthographe trop tôt. Herald élague les schémas, taille les sorties d’outils obsolètes, compacte le contexte petit à petit, conserve les messages récents de l’utilisateur et donne aux outils des moyens de récupérer avant que le modèle n’invente un nouveau plan. Cela importe particulièrement lorsque le modèle est un modèle local plus petit avec moins de marge pour absorber un flux de travail désordonné.

Le changement le plus lourd de conséquences est que les outils aident désormais à se remettre de leurs propres défaillances ordinaires. Un résultat de terminal tronqué est enregistré dans un fichier plutôt que de devenir un angle mort. patch sait comment expliquer une modification déjà appliquée ou une non-correspondance d’espaces. Les écritures sont vérifiées sur le disque. Les recherches sans résultat cherchent des correspondances proches. Et le plafond par défaut pour les appels d’outils passe de 90 à 500, de sorte qu’une tâche longue a moins de chances de s’arrêter à cause d’un compteur arbitraire. Rien de tout cela ne rend Hermes infaillible ; cela déplace simplement les erreurs mécaniques familières hors du chemin du modèle. C’est exactement le genre d’amélioration qui peut transformer un modèle plus faible de “presque utile” à un assistant viable.

La sécurité évolue elle aussi dans une direction raisonnable. Hermes peut récupérer les secrets dans Bitwarden et 1Password, ce qui limite le besoin d’un interminable fichier d’environnement en clair. Des motifs de refus explicites bloquent certaines commandes même lorsque les autres contrôles sont relâchés. Le cloisonnement des identifiants, le masquage des sorties, les gardes de lecture partagées et les limites de taille ferment d’autres brèches. Le nouveau mode « approbation intelligente » mérite toutefois une formulation prudente : un second modèle de langage juge si une commande signalée semble sûre et peut l’autoriser seul. C’est moins fatigant, mais un modèle qui en surveille un autre ne remplace ni sandbox ni permission du système d’exploitation.

Herald donne également à Hermes un aspect moins expérimental de terminal et davantage celui d’un collaborateur que vous pouvez joindre au bon endroit. Il ajoute une voix conversationnelle en streaming qui peut être interrompue naturellement, des mots de réveil sur l’appareil, Agent-to-Agent v1.0, des webhooks signés, des recherches ancrées avec des citations vérifiées par rapport au texte source, des artefacts de bureau et des plugins, et la possibilité de rediriger un tour actif au lieu de s’arrêter et de recommencer. Les nouvelles commandes sont exceptionnellement pratiques : !command évite de dépenser un tour de modèle pour une action shell, /context montre ce qui remplit la fenêtre, et /diff montre ce qui a changé. Les importateurs pour Claude Code et Codex réduisent le coût d’essayer Hermes aux côtés d’une configuration existante.

La conclusion honnête est mesurée. Herald est un bond de capacité significatif car il rend la même ambition agentique moins chère, moins fragile et plus facile à piloter — en particulier avec un modèle tel que DeepSeek V4 Flash 0731 ou un autre point d’accès local. Nous augmentons Hermes à 8,5 mais conservons la deuxième place : Nous a fourni une ingénierie de publication inhabituellement détaillée, pas une comparaison indépendante de l’utilisation des jetons, de la latence et du succès des tâches. Choisissez Hermes lorsque l’apprentissage inspectable, les objectifs vérifiables, la liberté des modèles locaux et l’orchestration profonde l’emportent sur le fardeau opérationnel. Si vous voulez un appareil avec un seul fournisseur responsable de chaque autorisation et de chaque échec, Hermes vous en demande encore plus que cela.

02

Forces et limites honnêtes

Points Forts

  • Un apprentissage qui laisse une trace utile : Hermes transforme les méthodes qui fonctionnent en compétences lisibles et réutilisables, tout en conservant les connaissances d’un projet entre les sessions. /journey et le graphe de mémoire sur ordinateur rendent cet apprentissage inspectable ; /goal peut exiger des tests ou d’autres preuves avant de considérer une tâche de programmation comme terminée.
  • Quicksilver rend l’agent sensiblement plus vif : Selon Nous, v0.19 a ramené le délai à froid entre l’envoi du premier tour et son traitement d’environ 4,3 à 0,9 seconde. Le rendu incrémental du TUI, l’affichage jeton par jeton, la virtualisation des diffs et l’optimisation générale de l’application ciblent aussi les attentes que l’utilisateur ressent réellement.
  • Le travail parallèle devient visible et plus difficile à perdre : Les sous-agents d’arrière-plan écrivent des transcriptions en direct, ce qui permet de suivre leurs appels d’outils pendant l’exécution. Leurs résultats survivent aux redémarrages, tandis qu’un registre de livraison peut renvoyer une réponse terminée après une panne de la passerelle.
  • Un vaste choix de modèles sans sacrifier l’orchestration avancée : Hermes accepte les grandes API hébergées, les modèles locaux, Nous Portal et les endpoints compatibles OpenAI. Les conseils MoA restent distinctifs et disposent désormais de réglages de raisonnement par modèle et par rôle, afin que les conseillers coûteux et le synthétiseur final n’utilisent pas tous le même budget.
  • La protection des secrets et le contrôle des commandes progressent réellement : Bitwarden et 1Password peuvent fournir les identifiants sans recopier chaque clé dans un fichier .env en clair. Les règles de refus définies par l’utilisateur restent actives même dans les modes permissifs ; cloisonnement des identifiants, masquage, gardes de lecture et limites de webhooks réduisent d’autres risques concrets.
  • Une surface opérationnelle très large : Plus de 60 outils intégrés couvrent fichiers, terminal, recherche Web, automatisation du navigateur, médias, planification et délégation. Une passerelle relie plus de 20 messageries, et le routage par profil peut séparer travail et vie privée — configuration, mémoire et secrets compris — derrière le même bot.
  • Une prise en main simplifiée sans fermer l’écosystème : Les installateurs de bureau et hermes setup --portal raccourcissent nettement le chemin par rapport à l’assemblage manuel de toutes les clés. Nous Portal peut regrouper modèles et services gérés de Web, image, voix, navigateur et sandbox ; l’auto-hébergement, les fournisseurs directs et les modèles locaux restent possibles.

Limites Honnêtes

  • L’approbation intelligente apporte du confort, pas du confinement : En mode intelligent par défaut, un modèle auxiliaire peut autoriser seul une commande jugée peu risquée. Les règles de refus strictes sont utiles, mais l’accès au shell, au navigateur ou à la boîte mail exige encore isolation, droits minimaux, sauvegardes et validation humaine pour les actions importantes.
  • Les chiffres de performance les plus forts viennent de l’éditeur : L’amélioration de 80 % au démarrage et le facteur 14 pour le découpage Markdown proviennent des mesures de Nous Research. Ce sont des données techniques crédibles, mais v0.19 ne contient aucun benchmark indépendant montrant qu’Hermes réussit davantage de tâches réelles que ses concurrents.
  • La complexité destinée aux utilisateurs avancés demeure : L’installateur et la connexion Portal simplifient la première heure, mais un déploiement sérieux implique encore fournisseurs, profils, passerelles, permissions, journaux, mises à jour et parfois infrastructure distante. Le rythme de publication impressionne, tout en faisant évoluer rapidement documentation et configuration.
  • L’intelligence parallèle peut engendrer des dépenses parallèles : Conseils MoA, modèles de contrôle, compression et sous-agents peuvent déclencher plusieurs appels pour une seule demande. Nous Portal simplifie la facturation sans la supprimer ; mieux vaut fixer des budgets, réserver les modèles économiques aux rôles secondaires et consulter les rapports d’usage.
03

Le Verdict

Hermes reste l’agent auto-amélioré le plus ambitieux intellectuellement de notre sélection. v0.19 améliore l’ingénierie discrète qui décide si cette ambition résiste au quotidien : latence, visibilité, livraison durable, secrets et routage. Cela mérite une critique actualisée et plus favorable, mais pas une meilleure note ou place sans tests indépendants. Hermes reste à 8,2 et au deuxième rang : un excellent choix pour les utilisateurs techniques qui veulent un apprentissage inspectable et une orchestration profonde, à condition d’accepter de l’exploiter avec soin.

04

Foire aux questions