Classé #2 Agents IA — Des logiciels qui travaillent pendant que vous dormez
Nous Research

Hermes Agent

Un agent open source de Nous Research qui apprend des compétences réutilisables, vérifie ses objectifs de programmation et travaille dans le terminal, sur le bureau, sur le Web et dans les messageries. La version v0.19 Quicksilver rend ce système ambitieux nettement plus pratique grâce à un démarrage accéléré, des sous-agents observables, une livraison durable des résultats et une meilleure gestion des secrets.

Mis à jour 23 juillet 2026 Open SourceSelf-ImprovingSelf-Hosted
8.2sur 10
Site officiel
Idéal pour

Un agent open source de Nous Research qui apprend des compétences réutilisables, vérifie ses objectifs de programmation et travaille dans le terminal, sur le bureau, sur le Web et dans les messageries. La version v0.19 Quicksilver rend ce système ambitieux nettement plus pratique grâce à un démarrage accéléré, des sous-agents observables, une livraison durable des résultats et une meilleure gestion des secrets.

Pourquoi ça Gagne

Boucle d'apprentissage fermée avec `/learn` et mémoire inspectable ; contrats de finalisation vérifiables avec `/goal` ; conseils Mixture of Agents sélectionnables ; plus de 60 outils intégrés ; sous-agents d'arrière-plan observables et durables ; intégration de Bitwarden et 1Password ; passage annoncé par Nous d'environ 4,3 à 0,9 seconde pour l'envoi du premier tour à froid.

À surveiller

Hermes donne toujours à une IA un accès exceptionnellement large aux commandes, fichiers, navigateurs et comptes de messagerie. Les approbations intelligentes réduisent les interruptions, mais reposent sur le jugement d'un autre modèle plutôt que sur une barrière de sécurité ; MoA et sous-agents peuvent aussi multiplier les coûts.

01

Ce que c'est réellement

La plupart des agents d’IA commencent chaque lundi frappés d’amnésie. Ils se souviennent peut-être d’une conversation, mais ne transforment pas forcément la méthode péniblement découverte la semaine précédente en procédure fiable. Hermes Agent repose sur une promesse plus intéressante : lorsqu’une démarche fonctionne, l’agent peut conserver la leçon sous forme de compétence lisible, rappeler plus tard l’expérience pertinente et ouvrir sa mémoire grandissante à l’inspection. C’est moins un intérimaire brillant qu’un carnet d’atelier qui se range mieux après chaque chantier.

Cette boucle d’apprentissage reste la signature d’Hermes. /learn peut convertir un processus, un dossier ou une source en savoir-faire réutilisable ; /journey montre les liens entre les souvenirs ; et l’application de bureau transforme cet historique en graphe modifiable. Pour le code, /goal ajoute une seconde discipline : avant de crier victoire, l’agent peut devoir présenter une preuve, par exemple la réussite des tests du projet. Cela ne rend pas chaque réponse correcte, mais donne au mot « terminé » un sens plus concret qu’un message final rédigé avec aplomb.

La version 0.19, baptisée Quicksilver, ne remplace pas cette idée. Elle rend la mécanique environnante plus agréable. Nous Research annonce que le délai à froid entre l’envoi du premier tour et son traitement est passé d’environ 4,3 à 0,9 seconde. Le TUI affiche désormais le Markdown diffusé progressivement, le raisonnement peut apparaître pendant le travail du modèle, et l’application de bureau a été largement optimisée pour les longues conversations, les gros diffs et les changements de session. Il s’agit de mesures internes d’ingénierie, pas d’une compétition indépendante. Elles corrigent tout de même un vrai défaut : un assistant autonome paraît bien moins intelligent lorsque son interface hésite avant chaque action utile.

La nouveauté la plus importante concerne la durabilité. Les sous-agents délégués écrivent des transcriptions en direct que l’on peut suivre pendant leur travail. On ne les envoie plus dans une pièce fermée en espérant leur retour. Les résultats d’arrière-plan sont enregistrés afin qu’un redémarrage ne les efface pas automatiquement. Les réponses de la passerelle passent également par un registre d’obligation de livraison : si Hermes a fini sa réponse mais plante avant l’accusé de réception de la messagerie, il peut la renvoyer après récupération. Ce n’est pas un score spectaculaire dans un benchmark ; c’est la plomberie nécessaire aux tâches planifiées et sans surveillance.

La sécurité évolue elle aussi dans une direction raisonnable. Hermes peut récupérer les secrets dans Bitwarden et 1Password, ce qui limite le besoin d’un interminable fichier d’environnement en clair. Des motifs de refus explicites bloquent certaines commandes même lorsque les autres contrôles sont relâchés. Le cloisonnement des identifiants, le masquage des sorties, les gardes de lecture partagées et les limites de taille ferment d’autres brèches. Le nouveau mode « approbation intelligente » mérite toutefois une formulation prudente : un second modèle de langage juge si une commande signalée semble sûre et peut l’autoriser seul. C’est moins fatigant, mais un modèle qui en surveille un autre ne remplace ni sandbox ni permission du système d’exploitation.

L’accessibilité est meilleure que ne le laissait entendre notre ancienne critique. Hermes s’exécute toujours sur une machine ou un environnement que vous contrôlez, mais « apportez toutes vos clés et modifiez tout à la main » n’est plus l’unique parcours. Les installateurs facilitent le départ, et Nous Portal propose une connexion OAuth pour un grand catalogue de modèles ainsi que des services gérés de recherche, image, voix, navigateur et sandbox cloud. Les utilisateurs avancés gardent le choix des fournisseurs directs, modèles locaux ou passerelles personnelles. Autrement dit, Portal administre de nombreuses dépendances et factures ; il ne fait pas disparaître la machine ou le serveur qui exécute l’agent.

La conclusion doit rester mesurée. Quicksilver améliore réactivité, observabilité, gestion des secrets et récupération après incident, autant de critères légitimes dans un classement d’agents. Il ne prouve pas indépendamment qu’Hermes résout désormais plus de tâches qu’OpenClaw ou Claude Cowork. Nous conservons donc la note de 8,2 et la deuxième place, au lieu de convertir automatiquement un changelog gigantesque en points. Choisissez Hermes si l’auto-amélioration inspectable, les objectifs de code vérifiables, la liberté de modèle et la délégation sophistiquée compensent la charge d’exploitation. Si vous cherchez un appareil prêt à l’emploi dont un seul fournisseur assume chaque permission et chaque panne, Hermes vous demande encore trop.

02

Forces et limites honnêtes

Points Forts

  • Un apprentissage qui laisse une trace utile : Hermes transforme les méthodes qui fonctionnent en compétences lisibles et réutilisables, tout en conservant les connaissances d’un projet entre les sessions. /journey et le graphe de mémoire sur ordinateur rendent cet apprentissage inspectable ; /goal peut exiger des tests ou d’autres preuves avant de considérer une tâche de programmation comme terminée.
  • Quicksilver rend l’agent sensiblement plus vif : Selon Nous, v0.19 a ramené le délai à froid entre l’envoi du premier tour et son traitement d’environ 4,3 à 0,9 seconde. Le rendu incrémental du TUI, l’affichage jeton par jeton, la virtualisation des diffs et l’optimisation générale de l’application ciblent aussi les attentes que l’utilisateur ressent réellement.
  • Le travail parallèle devient visible et plus difficile à perdre : Les sous-agents d’arrière-plan écrivent des transcriptions en direct, ce qui permet de suivre leurs appels d’outils pendant l’exécution. Leurs résultats survivent aux redémarrages, tandis qu’un registre de livraison peut renvoyer une réponse terminée après une panne de la passerelle.
  • Un vaste choix de modèles sans sacrifier l’orchestration avancée : Hermes accepte les grandes API hébergées, les modèles locaux, Nous Portal et les endpoints compatibles OpenAI. Les conseils MoA restent distinctifs et disposent désormais de réglages de raisonnement par modèle et par rôle, afin que les conseillers coûteux et le synthétiseur final n’utilisent pas tous le même budget.
  • La protection des secrets et le contrôle des commandes progressent réellement : Bitwarden et 1Password peuvent fournir les identifiants sans recopier chaque clé dans un fichier .env en clair. Les règles de refus définies par l’utilisateur restent actives même dans les modes permissifs ; cloisonnement des identifiants, masquage, gardes de lecture et limites de webhooks réduisent d’autres risques concrets.
  • Une surface opérationnelle très large : Plus de 60 outils intégrés couvrent fichiers, terminal, recherche Web, automatisation du navigateur, médias, planification et délégation. Une passerelle relie plus de 20 messageries, et le routage par profil peut séparer travail et vie privée — configuration, mémoire et secrets compris — derrière le même bot.
  • Une prise en main simplifiée sans fermer l’écosystème : Les installateurs de bureau et hermes setup --portal raccourcissent nettement le chemin par rapport à l’assemblage manuel de toutes les clés. Nous Portal peut regrouper modèles et services gérés de Web, image, voix, navigateur et sandbox ; l’auto-hébergement, les fournisseurs directs et les modèles locaux restent possibles.

Limites Honnêtes

  • L’approbation intelligente apporte du confort, pas du confinement : En mode intelligent par défaut, un modèle auxiliaire peut autoriser seul une commande jugée peu risquée. Les règles de refus strictes sont utiles, mais l’accès au shell, au navigateur ou à la boîte mail exige encore isolation, droits minimaux, sauvegardes et validation humaine pour les actions importantes.
  • Les chiffres de performance les plus forts viennent de l’éditeur : L’amélioration de 80 % au démarrage et le facteur 14 pour le découpage Markdown proviennent des mesures de Nous Research. Ce sont des données techniques crédibles, mais v0.19 ne contient aucun benchmark indépendant montrant qu’Hermes réussit davantage de tâches réelles que ses concurrents.
  • La complexité destinée aux utilisateurs avancés demeure : L’installateur et la connexion Portal simplifient la première heure, mais un déploiement sérieux implique encore fournisseurs, profils, passerelles, permissions, journaux, mises à jour et parfois infrastructure distante. Le rythme de publication impressionne, tout en faisant évoluer rapidement documentation et configuration.
  • L’intelligence parallèle peut engendrer des dépenses parallèles : Conseils MoA, modèles de contrôle, compression et sous-agents peuvent déclencher plusieurs appels pour une seule demande. Nous Portal simplifie la facturation sans la supprimer ; mieux vaut fixer des budgets, réserver les modèles économiques aux rôles secondaires et consulter les rapports d’usage.
03

Le Verdict

Hermes reste l’agent auto-amélioré le plus ambitieux intellectuellement de notre sélection. v0.19 améliore l’ingénierie discrète qui décide si cette ambition résiste au quotidien : latence, visibilité, livraison durable, secrets et routage. Cela mérite une critique actualisée et plus favorable, mais pas une meilleure note ou place sans tests indépendants. Hermes reste à 8,2 et au deuxième rang : un excellent choix pour les utilisateurs techniques qui veulent un apprentissage inspectable et une orchestration profonde, à condition d’accepter de l’exploiter avec soin.

04

Foire aux questions