Une politique lisible
Chaque appel d'outil est classé puis tranché par une règle écrite, versionnée et relisible. Un modèle de langage n'arbitre pas les autorisations : il n'intervient que sur les cas ambigus, et jamais pour lever une interdiction.
xSOM AI Guard
Un agent qui rédige un texte fait courir un risque de texte. Un agent qui dispose d'outils supprime, paie, envoie, écrit en production. xSOM AI Guard se place entre l'agent et ses outils, et décide — appel par appel — de ce qui passe, de ce qui attend un humain, et de ce qui n'aura pas lieu.
Le déplacement
La plupart des garde-fous s'intéressent à ce qu'on dit au modèle, ou à ce qu'il répond. C'est utile, et insuffisant : le dommage ne se produit pas dans la phrase, il se produit au moment où l'agent appelle un outil.
Le contrôle doit donc porter sur l'action. Supprimer un contact, virer une somme, déployer une version, écrire dans un système client : ces gestes se décident avant d'être exécutés, pas après avoir été racontés.
C'est le seul endroit où un refus est encore un refus.
Le mécanisme
Chaque appel d'outil est classé puis tranché par une règle écrite, versionnée et relisible. Un modèle de langage n'arbitre pas les autorisations : il n'intervient que sur les cas ambigus, et jamais pour lever une interdiction.
Une action irréversible est retenue, présentée en simulation — ce qu'elle ferait, sur quoi — puis exécutée seulement après approbation. Non approuvée, elle n'a pas lieu. Le blocage est tenu par la passerelle, pas confié au modèle.
Chaque décision est écrite en ajout seul et chaînée par empreinte : modifier une ligne rompt la chaîne, et la rupture se voit. Les exports servent la démonstration de conformité plutôt que la promesse de conformité.
Et la règle qui tient les trois : en cas de doute, on refuse. Outil inconnu, service d'approbation injoignable — sur l'irréversible, l'absence de réponse vaut refus, jamais autorisation.
S'interposer
La différence n'est pas un détail d'intégration : elle décide si une action refusée peut malgré tout avoir lieu.
Les outils de l'agent passent par la passerelle. Elle exécute, ou elle n'exécute pas. C'est la seule voie où le refus ne dépend pas de la bonne volonté de l'agent.
Pour un agent dont vous maîtrisez le code : quelques lignes qui demandent un verdict avant d'agir. La garantie vaut ce que vaut l'agent qui l'honore.
Un changement d'adresse de base, sans toucher au code. Contraignante sur ce qui sort, et c'est déjà beaucoup quand le code de l'agent ne vous appartient pas.
Où en est le produit
xSOM AI Guard est un produit en construction, développé par le cabinet. Le socle est opérationnel et testé — passerelle, politique, approbation humaine, journal chaîné — et c'est ce que montre la démonstration.
Ce qu'il ne fait pas, il ne le prétend pas : ce n'est ni un détecteur d'injection de prompt, ni un filtre de données personnelles, ni une offre d'hébergement souverain. Ces sujets relèvent de nos missions de conseil, pas de cet outil.
La démonstration se fait en accès nommé, sur rendez-vous : nous montrons un agent qui tente une action irréversible, sa mise en attente, son refus, et le fait que l'action n'a pas eu lieu.
Prochaine étape
Dites-nous quels outils ils touchent et ce qui vous empêche de dormir. Nous vous montrons ce que la mise sous contrôle changerait, sur votre cas.