Tech • IA • Robotique • Jeu

VIDÉO
ENFR

Hermes : votre savoir-faire peut travailler sans vous

7/10
IAIA et Stratégie29 septembre 2026 à 15:3023:22
Lecteur audio
0:00 / 0:00

INTRO

Hermes Agent est présenté comme un moyen open source de dissocier les méthodes de travail de l’IA du modèle de langage sous-jacent, afin de permettre aux entreprises de préserver la mémoire, les routines et les compétences réutilisables tout en changeant plus facilement de fournisseur.

POINTS CLÉS

Flux de travail IA indépendants du modèle

L’idée centrale est de découpler le LLM de la couche logicielle qui l’entoure, celle qui stocke la mémoire, connecte les outils et exécute les tâches planifiées. Cette architecture vise à réduire la dépendance à un fournisseur unique et à faciliter le remplacement d’un modèle par un autre sans reconstruire les flux de travail existants. La question est devenue plus urgente à mesure que les conditions d’accès, les prix et les intégrations des principaux modèles évoluent.

Ce que fait Hermes Agent

Hermes Agent, développé par Nous Research, agit comme couche d’orchestration plutôt que comme intelligence elle-même. Il relie un modèle choisi aux applications de messagerie, à une mémoire persistante, à des outils et à des tâches planifiées, afin que l’assistant puisse recevoir des demandes, conserver le contexte et agir plus tard sans que l’utilisateur reste connecté. Le système est conçu pour être utilisable depuis une interface de chat simple sur ordinateur ou mobile.

Un cas d’usage pour petite entreprise

Une démonstration est centrée sur Ada, qui gère trois clients et veut une mise à jour automatique de statut chaque lundi à 8 h. Au lieu de devoir la demander manuellement chaque semaine, elle veut que le rapport soit prêt au début de la journée. L’exemple montre Hermes stockant les dossiers clients, planifiant des résumés récurrents et les envoyant via Discord, même si Telegram, Slack ou WhatsApp pourraient aussi être utilisés.

Pourquoi un VPS est important

L’installation repose sur un VPS afin que l’agent puisse continuer à fonctionner lorsque l’utilisateur est hors ligne. En pratique, le serveur héberge Hermes, stocke ses fichiers et maintient les tâches planifiées indépendamment de l’ordinateur personnel de l’utilisateur. Cette persistance est essentielle pour les travaux récurrents comme les revues hebdomadaires de clients, les rappels ou les tâches de suivi.

Déploiement et infrastructure

L’installation utilise un déploiement Docker préconfiguré, ce qui évite de configurer chaque composant manuellement. Hermes et ses dépendances s’exécutent dans un conteneur, tandis que les fichiers persistants sont stockés séparément pour survivre aux redémarrages. Le système peut être surveillé depuis un tableau de bord exposant les journaux et les contrôles de redémarrage, ce qui rappelle que les utilisateurs restent responsables de la maintenance et de l’administration.

Mémoire versus méthode

La distinction la plus importante est celle entre conserver l’information et conserver le savoir-faire. Hermes peut mémoriser des faits comme les noms des clients, les échéances et les préférences, mais aussi enregistrer une procédure écrite réutilisable comme une skill. Dans l’exemple, Ada enseigne une méthode de priorisation: une livraison bloquée passe avant une échéance proche, qui passe avant un simple suivi.

Des compétences réutilisables sans réentraînement

Après que les règles de priorité ont été écrites dans un fichier, Hermes a pu consulter cette skill dans une nouvelle conversation et l’appliquer à un scénario modifié. Lorsqu’une livraison d’un client était bloquée et qu’un autre avait une échéance le lendemain, l’agent a classé le cas bloqué en premier, montrant que la méthode avait bien été retrouvée et réutilisée. Aucun réentraînement du modèle n’était impliqué; le comportement venait d’instructions stockées en langage naturel.

Changer de modèle en conservant la méthode

Le test a ensuite remplacé le modèle sous-jacent de Claude Sonnet 4.6 par GPT-5.5 tout en conservant les mêmes fichiers de mémoire et de skill. Sur la même tâche, le second modèle a consulté la méthode stockée et produit le même classement. Cela suggère une voie pratique pour les organisations qui veulent préserver leur logique opérationnelle accumulée tout en changeant de fournisseur d’IA pour des raisons de coût, de qualité ou de disponibilité.

Coûts, retours et limites

L’exemple d’hébergement cité situe le serveur à 172 € HT pour 24 mois, soit environ 7 € par mois en cas de prépaiement, les crédits de modèle étant facturés séparément. Un test bref a consommé 1,32 crédit sur un total initial de 10, mais cela ne suffit pas pour estimer un mois complet d’usage. L’économie réelle dépend non seulement de l’hébergement et des appels au modèle, mais aussi du temps nécessaire pour configurer les tâches, corriger les sorties et définir des conditions d’arrêt afin que l’agent ne gaspille pas de tokens en répétant le travail.

Le contrôle reste essentiel

Cette configuration ne supprime pas le besoin de supervision. Un problème observé concernait une tâche supprimée alors que l’agent affirmait encore qu’elle existait, ce qui illustre pourquoi les journaux, la visibilité des tâches et la vérification comptent. Le contrôle des données reste aussi partiel: les fichiers de mémoire et de skill demeurent sur le VPS administré par l’utilisateur, mais les prompts et le contexte quittent toujours ce serveur lorsque des modèles distants les traitent. En bref, l’infrastructure peut être autogérée, tandis que la couche d’intelligence peut encore dépendre de fournisseurs externes.

CONCLUSION

L’enjeu de fond n’est pas seulement l’automatisation, mais aussi la propriété des méthodes de travail. Si les entreprises peuvent stocker, auditer et réutiliser leur savoir-faire opérationnel en dehors d’un fournisseur unique de modèles, elles gagnent en flexibilité pour s’adapter à l’évolution du marché de l’IA.

Poser une question

Sur le même sujet : IA