Exécution d'agent d'IA

    Les agents agissent. L'exécution vérifiable d'agent d'IA transforme chaque étape, appel d'outil et décision en un registre à intégrité inviolable que tout auditeur, régulateur ou client en litige peut vérifier de façon indépendante.

    L'exécution d'agent d'IA est le comportement d'exécution en plusieurs étapes d'un système autonome. Lorsqu'un agent invoque des outils, met à jour sa mémoire et produit des actions, les journaux d'application et les traces d'observabilité ne peuvent pas prouver à un tiers ce qui a réellement été exécuté. NexArt est la couche de preuves qui comble cet écart, un appel SDK par étape.

    Ce qu'est l'exécution d'agent d'IA

    L'exécution d'agent d'IA est le comportement d'exécution d'un système d'IA autonome ou semi-autonome : les entrées reçues, le modèle invoqué, les outils appelés, le contexte intermédiaire observé et les actions produites. Contrairement à un simple appel de modèle, l'exécution d'agent est une trace en plusieurs étapes où chaque étape peut être contestée ou reconstituée ultérieurement.

    L'exécution vérifiable d'agent d'IA relie chaque étape à un Certified Execution Record, et regroupe les étapes liées dans un Project Bundle avec un Project Hash unique qui préserve l'ordre et l'intégrité inter-étapes.

    Pourquoi les journaux et traces ne suffisent pas

    • Les journaux sont modifiables. Tout opérateur ayant accès à la base de données peut les modifier après coup.
    • Les traces appartiennent à l'opérateur. Un auditeur externe ne peut pas les vérifier sans faire confiance à l'infrastructure de l'opérateur.
    • Le comportement du modèle dérive. Rejouer un prompt ne reproduit pas de façon fiable le comportement original de l'agent selon les versions et fournisseurs.
    • Les journaux d'appels d'outils sont partiels. Ils enregistrent l'appel, pas le contexte qui a conduit l'agent à le choisir.

    Voir Observability vs Execution Evidence pour la comparaison complète.

    Comment fonctionne l'exécution d'agent vérifiable

    1. Envelopper l'étape. Un seul appel SDK à chaque frontière de décision ou d'outil capture l'entrée, la sortie, le contexte du modèle, les paramètres et une liaison d'identité optionnelle.
    2. Sceller le registre. Le SDK produit un Certified Execution Record avec un engagement cryptographique. Les champs sensibles peuvent rester privés en mode engagement seul.
    3. Attester de façon indépendante. Le registre est soumis au nœud d'attestation NexArt, qui renvoie un reçu signé avec un horodatage RFC 3161 émis via l'autorité d'horodatage publique de DigiCert.
    4. Regrouper par exécution. Les exécutions d'agent en plusieurs étapes sont regroupées dans un Project Bundle afin de préserver l'ordre et l'intégrité inter-étapes.
    5. Vérifier n'importe où. Tout tiers détenant le registre et la clé publique du nœud peut vérifier l'intégrité en utilisant verify.nexart.io, la CLI, le SDK ou des bibliothèques cryptographiques standard.

    Pour le modèle de registre sous-jacent, voir Agent Execution Traces.

    Frameworks et compatibilité de pile

    NexArt n'est pas un runtime d'agent. Il fonctionne aux côtés de votre framework et de votre pile de fournisseurs existants.

    • LangChain et LangGraph : instrumentez les nœuds et appels d'outils avec un seul appel SDK.
    • n8n : enveloppez les nœuds IA pour produire des registres certifiés pour chaque exécution.
    • Orchestrateurs personnalisés, API d'agents des fournisseurs et boucles maison : utilisez le SDK directement à chaque frontière de décision.

    Pistes d'audit et agents réglementés

    L'exécution vérifiable d'agent d'IA produit des preuves qui soutiennent les obligations de conservation des registres selon les principaux cadres, notamment l'article 12 de l'AI Act de l'UE, ISO/IEC 42001, le NIST AI RMF et l'intégrité de traitement SOC 2. Le registre est un JSON portable avec un sceau cryptographique, ce qui permet de l'archiver, de le transmettre aux auditeurs ou de le remettre à un régulateur sans dépendre du fournisseur d'origine.

    NexArt fournit des preuves d'exécution. NexArt ne détermine pas si une sortie, une décision ou une action d'agent est légalement conforme, équitable, correcte ou certifiée selon un cadre quelconque.

    Questions fréquentes

    Qu'est-ce que l'exécution d'agent d'IA ?

    L'exécution d'agent d'IA est le comportement d'exécution d'un système d'IA autonome ou semi-autonome : les entrées reçues, le modèle invoqué, les outils appelés, le contexte intermédiaire observé et les actions produites. Contrairement à un simple appel de modèle, l'exécution d'agent est une trace en plusieurs étapes où chaque étape peut être contestée, auditée ou reconstituée ultérieurement.

    Pourquoi l'exécution vérifiable d'agent d'IA est-elle difficile ?

    Les agents enchaînent des appels d'outils, des lectures de mémoire et des invocations de modèle sur plusieurs étapes et services. Les journaux d'application et les traces d'observabilité sont modifiables et détenus par l'opérateur, ils ne peuvent donc pas démontrer à un tiers ce qui a réellement été exécuté. Le comportement du modèle dérive aussi selon les versions et fournisseurs, ce qui signifie qu'un prompt rejoué peut ne pas reproduire le comportement original de l'agent.

    Comment NexArt rend-il l'exécution d'agent d'IA vérifiable ?

    Chaque étape d'agent est enveloppée par un seul appel SDK NexArt qui produit un Certified Execution Record : un registre scellé cryptographiquement de l'entrée, de la sortie, du contexte du modèle, des paramètres et d'une liaison d'identité optionnelle. Les étapes liées sont regroupées dans un Project Bundle avec un Project Hash unique qui préserve l'ordre et l'intégrité inter-étapes. Le résultat est vérifiable de façon indépendante par tout tiers.

    Cela remplace-t-il mon framework d'agent ?

    Non. NexArt est une couche de preuves, pas un runtime d'agent. Il fonctionne aux côtés de LangChain, LangGraph, n8n, des orchestrateurs personnalisés et des API d'agents des fournisseurs. L'instrumentation est un seul appel SDK à chaque frontière de décision ou d'outil.

    Puis-je garder les entrées et sorties privées ?

    Oui. L'exécution confidentielle utilise des engagements cryptographiques de sorte que le registre contient un hachage à clé de l'entrée, de la sortie et des champs d'identité plutôt que les valeurs brutes. La vérification réussit sans révéler les données sous-jacentes.

    Quel est le rapport avec les pistes d'audit d'agent d'IA ?

    Les pistes d'audit d'agent traditionnelles sont des journaux d'application. L'exécution vérifiable d'agent d'IA produit des Certified Execution Records portables et à intégrité inviolable qui répondent aux mêmes questions d'audit avec une intégrité cryptographique, et qui survivent au fournisseur, à l'opérateur et à NexArt lui-même.

    Ajoutez des preuves vérifiables à vos agents d'IA

    Un appel SDK par étape produit des Certified Execution Records que tout tiers peut vérifier de façon indépendante.

    Voir aussi