Classé #1 Agents IA — Des logiciels qui travaillent pendant que vous dormez
Nous Research

Hermes Agent

Un agent sous licence MIT de Nous Research qui apprend des compétences réutilisables, vérifie les objectifs de codage et fonctionne sur terminal, bureau, web, voix et messagerie. La version v0.20 Herald transforme sa promesse la plus importante — laisser un agent travailler un moment sans se transformer en une boucle coûteuse — en une proposition beaucoup plus pratique, particulièrement avec de plus petits modèles locaux.

Mis à jour 30 août 2026 MIT Open SourceSelf-ImprovingSelf-Hosted
8.4sur 10
Site officiel
Idéal pour

Un agent sous licence MIT de Nous Research qui apprend des compétences réutilisables, vérifie les objectifs de codage et fonctionne sur terminal, bureau, web, voix et messagerie. La version v0.20 Herald transforme sa promesse la plus importante — laisser un agent travailler un moment sans se transformer en une boucle coûteuse — en une proposition beaucoup plus pratique, particulièrement avec de plus petits modèles locaux.

Pourquoi ça Gagne

Boucle d'apprentissage fermée avec `/learn` et mémoire inspectable ; contrats `/goal` vérifiables ; fournisseurs locaux et hébergés indépendants du modèle ; auto-récupération des outils ; compaction de contexte par tour ; itérations des outils de 90→500 ; citations de recherche fondées ; voix, A2A, webhooks, et amélioration du démarrage à froid (cold-start) signalée par Nous d'environ 14 secondes à 1,8 seconde.

À surveiller

Hermes accorde toujours un accès inhabituellement large aux commandes, fichiers, navigateurs et comptes de messagerie. Ses impressionnantes affirmations d'efficacité sont rapportées par les développeurs plutôt que par des benchmarks de tâches indépendants, l'approbation intelligente n'est pas une barrière de sécurité, et un agent puissant peut toujours multiplier les coûts de modèle ou les erreurs lorsqu'on lui accorde des autorisations souples.

01

Ce que c'est réellement

La plupart des agents d’IA commencent chaque lundi frappés d’amnésie. Ils se souviennent peut-être d’une conversation, mais ne transforment pas forcément la méthode péniblement découverte la semaine précédente en procédure fiable. Hermes Agent repose sur une promesse plus intéressante : lorsqu’une démarche fonctionne, l’agent peut conserver la leçon sous forme de compétence lisible, rappeler plus tard l’expérience pertinente et ouvrir sa mémoire grandissante à l’inspection. C’est moins un intérimaire brillant qu’un carnet d’atelier qui se range mieux après chaque chantier.

Cette boucle d’apprentissage reste la signature d’Hermes. /learn peut convertir un processus, un dossier ou une source en savoir-faire réutilisable ; /journey montre les liens entre les souvenirs ; et l’application de bureau transforme cet historique en graphe modifiable. Pour le code, /goal ajoute une seconde discipline : avant de crier victoire, l’agent peut devoir présenter une preuve, par exemple la réussite des tests du projet. Cela ne rend pas chaque réponse correcte, mais donne au mot « terminé » un sens plus concret qu’un message final rédigé avec aplomb.

La version 0.20, la version Herald, ne remplace pas cette idée. Elle rend la boucle de l’agent moins gaspilleuse. Nous indique avoir étudié 250 000 conversations Hermes aux côtés de NVIDIA Nemo Relay et a découvert que l’échec coûteux n’est souvent pas un prompt géant mais une petite fuite répétée sur de nombreux tours : des schémas encombrants, des résultats d’outils qui ne sont plus utiles, un patch qui correspond presque, ou une recherche qui abandonne une orthographe trop tôt. Herald élague les schémas, taille les sorties d’outils obsolètes, compacte le contexte petit à petit, conserve les messages récents de l’utilisateur et donne aux outils des moyens de récupérer avant que le modèle n’invente un nouveau plan. Cela importe particulièrement lorsque le modèle est un modèle local plus petit avec moins de marge pour absorber un flux de travail désordonné.

Le changement le plus lourd de conséquences est que les outils aident désormais à se remettre de leurs propres défaillances ordinaires. Un résultat de terminal tronqué est enregistré dans un fichier plutôt que de devenir un angle mort. patch sait comment expliquer une modification déjà appliquée ou une non-correspondance d’espaces. Les écritures sont vérifiées sur le disque. Les recherches sans résultat cherchent des correspondances proches. Et le plafond par défaut pour les appels d’outils passe de 90 à 500, de sorte qu’une tâche longue a moins de chances de s’arrêter à cause d’un compteur arbitraire. Rien de tout cela ne rend Hermes infaillible ; cela déplace simplement les erreurs mécaniques familières hors du chemin du modèle. C’est exactement le genre d’amélioration qui peut transformer un modèle plus faible de “presque utile” à un assistant viable.

La sécurité évolue elle aussi dans une direction raisonnable. Hermes peut récupérer les secrets dans Bitwarden et 1Password, ce qui limite le besoin d’un interminable fichier d’environnement en clair. Des motifs de refus explicites bloquent certaines commandes même lorsque les autres contrôles sont relâchés. Le cloisonnement des identifiants, le masquage des sorties, les gardes de lecture partagées et les limites de taille ferment d’autres brèches. Le nouveau mode « approbation intelligente » mérite toutefois une formulation prudente : un second modèle de langage juge si une commande signalée semble sûre et peut l’autoriser seul. C’est moins fatigant, mais un modèle qui en surveille un autre ne remplace ni sandbox ni permission du système d’exploitation.

Herald donne également à Hermes un aspect moins expérimental de terminal et davantage celui d’un collaborateur que vous pouvez joindre au bon endroit. Il ajoute une voix conversationnelle en streaming qui peut être interrompue naturellement, des mots de réveil sur l’appareil, Agent-to-Agent v1.0, des webhooks signés, des recherches ancrées avec des citations vérifiées par rapport au texte source, des artefacts de bureau et des plugins, et la possibilité de rediriger un tour actif au lieu de s’arrêter et de recommencer. Les nouvelles commandes sont exceptionnellement pratiques : !command évite de dépenser un tour de modèle pour une action shell, /context montre ce qui remplit la fenêtre, et /diff montre ce qui a changé. Les importateurs pour Claude Code et Codex réduisent le coût d’essayer Hermes aux côtés d’une configuration existante.

La conclusion honnête est mesurée. Herald représente un bond de capacité significatif, car il rend la même ambition agentique moins chère, moins fragile et plus facile à piloter — en particulier avec un modèle tel que DeepSeek V4 Flash 0731 ou un autre point d’accès local. Hermes obtient 8,4 et la deuxième place : Nous a fourni une ingénierie de publication inhabituellement détaillée, pas une comparaison indépendante de l’utilisation des jetons, de la latence et du taux de réussite des tâches. Choisissez-le lorsque l’apprentissage inspectable, les objectifs vérifiables, la liberté des modèles locaux et l’orchestration profonde l’emportent sur la charge opérationnelle.

02

Forces et limites honnêtes

Points Forts

  • Un apprentissage qui laisse quelque chose d’utile derrière lui : Hermes peut transformer des flux de travail réussis en compétences lisibles et réutilisables, et conserver les connaissances du projet d’une session à l’autre. /journey et le graphe de mémoire de bureau rendent cet apprentissage inspectable, tandis que /goal peut exiger des tests ou d’autres preuves avant qu’une tâche de code ne soit considérée comme terminée.
  • Herald attaque les tours gaspillés, pas seulement la vitesse brute : Nous indique que la version a été façonnée par l’analyse de 250 000 conversations Hermes et NVIDIA Nemo Relay. Des schémas d’outils allégés, un élagage proactif, une micro-compaction par tour, une mise en cache des invites et des suggestions de récupération visent à réduire la charge contextuelle et les erreurs d’outils répétées qui pénalisent les modèles plus faibles ou locaux.
  • Les outils se rétablissent maintenant avant que le modèle ne commence à deviner : Le résultat tronqué du terminal se déverse dans un fichier ; patch détecte les modifications déjà appliquées et les discordances d’espacement ; les écritures sont vérifiées ; les recherches sans résultat sondent pour des correspondances proches ; et le plafond d’itération par défaut passe de 90 à 500. C’est une mise à niveau de fiabilité pratique pour un travail long, pas seulement une fioriture dans les notes de version.
  • Un large choix de modèles sans abandonner l’orchestration avancée : Hermes fonctionne avec les principales API hébergées, les environnements d’exécution locaux, Nous Portal et les points de terminaison compatibles OpenAI. Les conseils MoA restent une option distinctive, avec maintenant des contrôles de raisonnement par modèle et par rôle afin que les conseillers coûteux et le synthétiseur final n’aient pas tous besoin du même budget de réflexion.
  • La gestion des secrets et les contrôles de commandes se sont sensiblement améliorés : Bitwarden et 1Password peuvent fournir des identifiants sans copier chaque clé dans un fichier .env en texte clair. Les règles de refus définies par l’utilisateur restent actives même dans les modes permissifs, tandis que la portée des identifiants, la rédaction, les protections de lecture de fichiers et les limites de webhook réduisent plusieurs surfaces d’attaque pratiques.
  • Il fonctionne désormais plus naturellement comme un collègue multi-surfaces : Herald ajoute la voix conversationnelle en streaming avec interruption, des mots de réveil sur l’appareil, l’Agent-à-Agent v1.0, des webhooks sortants signés, une recherche fondée avec des citations vérifiables, plus des artefacts de bureau, un SDK de plugins, Kanban, et des redirections en cours de tour.
  • Le démarrage est plus facile sans verrouiller le système : Les installateurs de bureau et hermes setup --portal offrent un chemin plus court que d’assembler manuellement chaque clé de modèle et d’outil. Nous Portal peut regrouper l’accès au modèle et les services gérés de web, image, parole, navigateur et bac à sable (sandbox), tandis que l’auto-hébergement et les configurations ‘apportez votre propre fournisseur’ (bring-your-own-provider) restent disponibles.

Limites Honnêtes

  • L’approbation intelligente est une commodité, pas un confinement : Dans le mode intelligent par défaut, un modèle auxiliaire peut approuver automatiquement une commande qu’il considère à faible risque. Les règles de refus strictes sont utiles, mais quiconque accorde à Hermes l’accès au shell, au navigateur ou à la boîte de réception devrait tout de même utiliser l’isolation, des autorisations étroites, des sauvegardes et une révision humaine pour les travaux importants.
  • Les affirmations d’efficacité les plus fortes sont rapportées par les concepteurs : Nous rapporte un démarrage à froid passant de 14 secondes à 1,8 seconde et substantiellement moins de tours gaspillés, mais la v0.20 n’a pas de benchmark indépendant de jetons par succès ou d’achèvement dans le monde réel contre d’autres agents. Traitez les notes de version comme des preuves d’implémentation solides, et non comme un résultat établi dans un classement.
  • La complexité pour l’utilisateur avancé n’a pas disparu : Un installateur de bureau et une connexion Portal simplifient la première heure, mais les déploiements sérieux impliquent toujours des fournisseurs, des profils, des passerelles, des autorisations, des journaux, des mises à jour et parfois une infrastructure distante. La cadence de publication énorme est impressionnante, mais elle signifie également que la documentation et la configuration peuvent évoluer rapidement.
  • L’intelligence parallèle peut devenir une dépense parallèle : Les conseils MoA, les examinateurs auxiliaires, les modèles de compression et les sous-agents en arrière-plan peuvent générer plusieurs appels de modèles pour une seule requête. Nous Portal simplifie la facturation plutôt que de l’éliminer, de sorte que les utilisateurs devraient fixer des budgets, choisir des rôles moins chers le cas échéant et inspecter les rapports d’utilisation.
03

Le Verdict

Hermes reste notre agent d’auto-amélioration le plus ambitieux sur le plan intellectuel, et la v0.20 améliore de manière significative l’ingénierie peu glamour qui décide si un agent est utilisable avec des modèles locaux : la récupération d’outils, la discipline de contexte, le temps de démarrage et le pilotage. Son score de 8,4 corrigé par la formule le place désormais au 2e rang des Agents IA. Le score s’arrête là car Nous a montré un travail de mise en œuvre, et non une preuve indépendante que Hermes accomplit plus de tâches réelles que ses rivaux.

04

Foire aux questions