Gouvernance de l'IA11 février 2026Mis à jour le 15 juillet 202613 min de lecture

Pistes d'audit des agents IA : actions, preuves et rejeu

Découvrez comment créer des pistes d'audit pour les actions d'agents IA, rejouer les décisions, vérifier les preuves de politique et d'approbation, et prouver l'intégrité des enregistrements.

Antonella Serine

Antonella Serine

Fondateur, KLA

Fondateur de KLA, qui construit le plan de contrôle indépendant de la gouvernance de l'exécution pour les agents d'IA réglementés en vertu de la loi de l'UE sur l'IA.

Réponse citable

Objet de citation

Définition

Une piste d'audit d'agent d'IA est un enregistrement ordonné et protégé par l'intégrité reliant une action d'agent à son identité, à ses entrées, à ses versions de modèle et d'invite, à ses outils, à sa décision de politique, à son autorité humaine, à sa sortie, à ses effets secondaires et à son résultat en aval. Il soutient l'enquête et la relecture en préservant le contexte nécessaire pour expliquer pourquoi l'action a été autorisée, retenue, bloquée ou annulée.

Périmètre et exceptions

S’applique lorsque
Utilisez ce modèle de preuve lorsqu'un agent prend des décisions en conséquence, appelle des outils d'écriture, traite des données réglementées ou doit prendre en charge l'audit, la réponse aux incidents, la surveillance ou la relecture.
Exceptions
La télémétrie du développeur peut servir seule au débogage d'ingénierie. Ajoutez des champs de décision, d'autorité, de résultat, de conservation et d'intégrité lorsque le dossier prend en charge une action réglementée ou une demande d'assurance.

Cadre de décision

  1. Lignée de décision : identité, finalité, modèle, agent, politique et autorité humaine.
  2. Application de la politique : règle, version, verdict, codes de motif et calendrier.
  3. Exécution et résultat : appels d’outils ordonnés, changements d’état, effets secondaires et reçus.
  4. Intégrité et contexte : exhaustivité, hachages, signatures, conservation, provenance et entrées de rejeu.

Preuves minimales

  • Exécution, session, processus, parcours, corrélation, agent, modèle, invite et identifiants d'environnement.
  • Saisissez et récupérez les références, le nom et les paramètres de l'outil, la version de la politique, le verdict, l'approbation et l'autorité du réviseur.
  • Sortie, effet secondaire, état avant/après, réception en aval, exception, retour arrière et références d'incident.
  • Hachages des enregistrements, manifeste, signatures, chaîne de conservation, métadonnées de conservation et résultat de la vérification.

Workflow réglementé en pratique

Rejeu d’une décision d’examen de crédit

Scénario: Un agent prépare une recommandation de crédit et achemine un cas limite à un souscripteur avant que la banque n'enregistre le résultat.

Workflow: La piste d'audit lie la référence du cas client, l'identité de l'agent, les versions du modèle et de l'invite, les entrées récupérées, le verdict de la politique, l'autorité de l'examinateur, la justification, la rédaction finale et la notification. L'ensemble de preuves enregistre les hachages et les signatures afin qu'un réviseur puisse vérifier l'exhaustivité et rejouer la séquence de décision sans s'appuyer sur des captures d'écran ou de la mémoire.

Questions des acheteurs

Pourquoi les journaux standards des agents IA sont-ils insuffisants pour un audit ?
Les journaux techniques affichent souvent les horodatages, les jetons et la latence tout en omettant les faits de politique, d'autorité, d'approbation, d'effet commercial, d'exhaustivité et d'intégrité qui établissent la responsabilité d'une action.
Quels champs doivent figurer dans une piste d’audit d’agent IA ?
Capturez des identités stables, des références d'exécution et de cas, des versions de modèle et d'invite, des événements de récupération et d'outil, des résultats de politique et d'approbation, des sorties, des effets secondaires, des reçus en aval, des références de confidentialité et des métadonnées d'intégrité.
Comment rejouer la décision d’un agent IA ?
Résoudre les versions originales, les entrées, les appels d'outils, le contexte de la politique, l'approbation et le résultat à partir d'un identifiant d'exécution. Répétez la décision dans un environnement contrôlé et documentez les résultats déterministes ou une tolérance approuvée.
Qu’est-ce qui prouve qu’une piste d’audit d’agent IA n’a pas été modifiée ?
Utilisez un ensemble de preuves scellées avec un manifeste, des hachages, des signatures, des enregistrements de chaîne de traçabilité, des métadonnées de conservation et une étape de vérification indépendante qui détecte les omissions ou les modifications.

Sources principales

Actualité:

Comment KLA Control Plane met ce contrôle en œuvre

KLA Le plan de contrôle enregistre le verdict de la politique, l'approbation ou l'escalade, les événements d'exécution ordonnés, les résultats en aval et les métadonnées d'intégrité dans la lignée d'exécution. Evidence Room peut présenter le dossier sous la forme d'un Sealed Evidence Bundle à des fins d'examen indépendant.

Limite de périmètre: KLA régit l'action de l'agent et ses preuves. Le système de transaction sous-jacent, l'interprétation de la rétention juridique et la soumission au régulateur restent la propriété de l'organisation et de ses systèmes.

Pour créer des pistes d'audit des actions d'agents IA, capturez les identités de l'agent et des humains, les entrées, les versions de modèle et de prompt, les appels d'outils, les évaluations de politique, les approbations, les sorties, les effets de bord et la preuve d'intégrité sous un identifiant d'exécution unique. Pour auditer et rejouer les décisions d'agents IA, conservez les versions exactes et les événements ordonnés nécessaires pour reconstituer l'action et vérifier de manière indépendante pourquoi elle a été autorisée, bloquée ou soumise à escalade. Le cadre d'audit des agents IA en entreprise inscrit ces preuves d'exécution dans la méthode d'audit complète.

L'illusion de la journalisation

Les chaînes d'outils modernes de développement IA génèrent des volumes impressionnants de données d'observabilité. Chaque appel LLM crée des traces avec le nombre de tokens, les latences et les versions de modèle. Chaque étape d'agent journalise les entrées et les sorties. Les organisations avancées ajoutent une instrumentation personnalisée qui capture les prompts, les réponses et le raisonnement intermédiaire.

Cela crée une illusion de responsabilité. Avec toutes ces données, on devrait pouvoir répondre à n'importe quelle question sur le comportement du système, n'est-ce pas ? L'illusion s'effondre dès que vous devez réellement prouver quelque chose.

Prenons un scénario : votre agent IA a approuvé une demande de crédit que le client conteste désormais. Il affirme que la décision était discriminatoire. Votre équipe juridique doit démontrer que la décision était appropriée. Que pouvez-vous lui montrer ?

Vos traces montreront qu'un appel LLM a eu lieu à un certain horodatage. Elles montreront les tokens consommés et la latence. Mais peuvent-elles montrer quelles données concernant le client ont été prises en compte ? Quelle politique régissait ce type de décision ? Si cette politique a réellement été appliquée ? Qui a examiné la décision ? Pour la plupart des organisations, la réponse est non.

Ce que demandent réellement les auditeurs

Comprendre cet écart suppose de comprendre ce dont les auditeurs, les régulateurs et les équipes juridiques ont réellement besoin. Leurs questions se répartissent en quatre catégories.

  • Lignage de la décision : qui a pris cette décision ? Dans un contexte IA, quelle version de modèle, quelle configuration d'agent, quelles règles de politique ? Et surtout : y a-t-il eu une intervention humaine et, si oui, qui, quand, et pour approuver quoi ?
  • Preuve d'application des politiques : les organisations disposent de politiques encadrant le comportement de l'IA. Les auditeurs veulent constater que ces politiques n'ont pas seulement été rédigées, mais appliquées. Cela suppose de capturer des preuves au point de contrôle de la politique.
  • Vérification de l'intégrité : les auditeurs doivent pouvoir faire confiance aux preuves. Si vous leur remettez des fichiers journaux, comment savent-ils que les journaux sont complets ? Comment savent-ils que les entrées n'ont pas été modifiées, supprimées ou fabriquées ?
  • Reproductibilité et contexte : les auditeurs veulent comprendre la décision dans son contexte. Quelles informations étaient disponibles au moment de la décision ? Quelles étaient les alternatives ? Pourquoi ce résultat a-t-il été retenu ?

Le concept de dossier de preuves

Un dossier de preuves est un ensemble complet et vérifié de tout ce qui est nécessaire pour démontrer qu'une décision a été prise de manière appropriée. C'est le produit d'une infrastructure de gouvernance de niveau audit. Un dossier de preuves bien construit comporte quatre couches. Les équipes regroupent souvent ces artefacts sous forme d'export de lignage d'exécution afin que les auditeurs puissent en vérifier l'intégrité de manière indépendante.

  • Couche 1 - Enregistrement de la décision : le cœur du dossier de preuves capture l'identifiant de la décision, l'horodatage, le type de décision, le résultat et la classification du risque. Tout le reste du dossier de preuves s'y rattache.
  • Couche 2 - Contexte d'entrée : quelles informations étaient disponibles au moment de la décision ? Données d'entrée, état du système, version du modèle, versions de politique en vigueur et contexte antérieur pertinent pour cette décision.
  • Couche 3 - Preuves de gouvernance : cette couche capture les points de contrôle de politique (quelles politiques ont été évaluées et avec quels résultats), les approbations humaines (qui, ce qu'ils ont vu, ce qu'ils ont décidé), les escalades et les événements de dérogation.
  • Couche 4 - Vérification de l'intégrité : manifeste listant tous les artefacts, empreintes cryptographiques de chaque artefact, attestation d'horodatage et enregistrements de chaîne de conservation. Cela permet aux auditeurs de vérifier les preuves de manière indépendante.

Modèles d'architecture pour des systèmes à valeur probante

Construire des systèmes qui produisent des dossiers de preuves plutôt que de simples journaux exige des choix d'architecture délibérés.

  • Stockage en ajout seul (append-only) : l'intégrité des preuves commence par un stockage qui ne peut pas être modifié. Les systèmes de stockage en ajout seul acceptent de nouveaux enregistrements mais n'autorisent ni la modification ni la suppression des enregistrements existants. Une fois la preuve écrite, elle ne peut plus être modifiée.
  • Capture synchrone des preuves : les preuves doivent être capturées au moment de la décision, et non reconstituées après coup. Lorsqu'un point de contrôle de politique procède à une évaluation, celle-ci est écrite dans le magasin de preuves avant que la décision ne se poursuive.
  • Intégrité cryptographique : chaque élément de preuve doit être haché à sa création. L'empreinte devient partie intégrante de l'enregistrement de preuve et permet une vérification ultérieure. Envisagez d'ancrer les empreintes dans des systèmes externes pour des garanties plus solides.
  • Caviardage et confidentialité : les dossiers de preuves doivent souvent concilier exhaustivité et confidentialité. Hachez les valeurs sensibles avant de les stocker. Vous pouvez ainsi prouver que des données précises étaient présentes sans révéler les données elles-mêmes.

Observabilité LLM vs preuves de niveau audit pour la conformité à l'EU AI Act

Les équipes des secteurs réglementés demandent souvent si leur pile d'observabilité LLM leur fournit déjà la journalisation et la piste d'audit qu'attend le règlement européen sur l'IA (EU AI Act). Ce n'est généralement pas le cas. Si vous examinez le paysage actuel des outils de développement IA, vous trouverez des solutions d'observabilité sophistiquées, mais une prise en charge limitée des pistes d'audit à valeur probante : celles qui satisfont à un examen de conformité.

Les plateformes d'observabilité LLM (LangSmith, Langfuse, Arize et similaires) excellent en matière d'expérience développeur. Elles capturent les traces, facilitent le débogage, accompagnent l'itération sur les prompts. Mais elles sont conçues pour des ingénieurs qui cherchent à comprendre le comportement du système, pas pour des auditeurs qui vérifient la gouvernance. Une piste d'audit LLM construite uniquement à partir de traces d'observabilité enregistre qu'un appel de modèle a eu lieu, mais pas quelle politique a régi la décision, si elle a été appliquée, ni qui l'a approuvée.

Les plateformes ML suivent les expérimentations, les versions de modèles et les données d'entraînement. C'est précieux pour la reproductibilité en développement, mais cela ne capture pas la gouvernance des décisions en production.

Cet écart compte tout particulièrement pour la conformité. Les obligations d'enregistrement de l'article 12 et les obligations de journalisation automatique qui l'entourent attendent des journaux qui garantissent la traçabilité de la manière dont une décision à haut risque a été prise : politique, supervision et résultat, pas seulement latence et tokens. Vous pouvez disposer d'une excellente observabilité et échouer malgré tout à un audit, parce que les preuves de niveau audit constituent une exigence différente de l'observabilité opérationnelle. Le marché commence seulement à reconnaître qu'il s'agit de capacités distinctes exigeant des solutions distinctes.

Construire votre stratégie de preuves

Pour les organisations qui prennent au sérieux leur préparation à l'audit de l'IA, nous recommandons une approche par phases pour développer leur capacité de preuve.

  • Phase 1 - Définir vos exigences de preuve : commencez par comprendre ce que vous devrez prouver. Quelles décisions présentent un risque d'audit ? Quelles réglementations s'appliquent ? Associez chaque type de décision à ses exigences de preuve.
  • Phase 2 - Instrumenter les points de décision : identifiez les points de décision de vos agents IA où des preuves doivent être capturées. Construisez une instrumentation qui capture les preuves à ces points comme partie intégrante du processus, et non comme un système séparé.
  • Phase 3 - Construire l'infrastructure d'intégrité : mettez en place un stockage en ajout seul pour les preuves. Ajoutez le hachage cryptographique et la génération de manifestes. Envisagez un ancrage d'horodatage externe pour les preuves à fort enjeu.
  • Phase 4 - Opérationnaliser l'export des preuves : développez la capacité d'exporter des dossiers de preuves à la demande. Créez des formats standard exploitables par les auditeurs. Incluez des outils de vérification pour que les auditeurs puissent contrôler l'intégrité de manière indépendante.

L'impératif réglementaire

Le règlement européen sur l'IA (EU AI Act) rend les exigences de preuve explicites. Pour les mécanismes de contrôle humain liés à l'article 14, consultez Autonomie responsable. L'article 12 impose des capacités de journalisation garantissant une traçabilité adaptée à la destination du système d'IA. L'article 17 exige des systèmes de gestion de la qualité avec documentation des mesures correctives. L'article 20 exige la conservation des journaux générés automatiquement pendant une période adaptée à la destination du système.

Il ne s'agit pas de vagues aspirations. Ce sont des exigences que les régulateurs vérifieront. Les organisations qui exploitent des systèmes d'IA à haut risque dans l'UE devront démontrer leur conformité.

Le déploiement progressif de l'EU AI Act pour les systèmes d'IA à haut risque est en cours. Les organisations qui n'ont pas construit d'infrastructure de preuves feront face à des choix difficiles : se précipiter pour la mettre en œuvre, restreindre le déploiement de l'IA à des cas d'usage à risque minimal, ou accepter un risque de non-conformité.

Foire aux questions

Comment créer des pistes d'audit pour les actions d'agents IA ?

Attribuez un identifiant de corrélation unique à l'exécution et enregistrez les identités de l'agent et des humains, les entrées, les versions de modèle et de prompt, les sources récupérées, les appels d'outils et leurs résultats, les évaluations de politique, les approbations, les sorties, les effets de bord et les horodatages. Scellez l'enregistrement exporté avec un manifeste et des preuves d'intégrité.

Comment auditer et rejouer les décisions d'agents IA ?

Sélectionnez une exécution au sein d'une population définie, vérifiez son manifeste, restaurez les versions enregistrées du modèle, du prompt, de la politique, des outils et des données lorsque c'est autorisé, puis rejouez les événements ordonnés dans un environnement isolé. Comparez les décisions de politique, les effets des outils, les approbations et les résultats finaux avec l'enregistrement scellé et documentez tout écart.

Qu'est-ce qu'un dossier de preuves ?

Un dossier de preuves est un ensemble complet et vérifié de tout ce qui est nécessaire pour démontrer qu'une décision d'IA a été prise de manière appropriée. Il comprend quatre couches : l'enregistrement de la décision lui-même, le contexte d'entrée montrant quelles informations étaient disponibles, les preuves de gouvernance établissant que les politiques ont été appliquées et que des humains sont intervenus lorsque c'était requis, et la vérification de l'intégrité permettant de vérifier de manière indépendante que les preuves sont complètes et non modifiées.

Pourquoi les journaux standard sont-ils insuffisants pour les audits d'IA ?

Les journaux standard capturent l'exécution technique (horodatages, nombre de tokens, latences) mais pas la gouvernance des décisions. Ils ne peuvent pas prouver quelles politiques étaient en vigueur, si elles ont été appliquées, qui a approuvé les décisions, ni que les preuves sont complètes et non modifiées. Les auditeurs ont besoin de preuves qui établissent la responsabilité, pas seulement de données qui décrivent l'exécution.

Qu'est-ce que le stockage en ajout seul (append-only) et pourquoi est-ce important ?

Le stockage en ajout seul accepte de nouveaux enregistrements mais n'autorise ni la modification ni la suppression des enregistrements existants. Cette règle est imposée par l'architecture de stockage, pas seulement par une politique. C'est important parce que l'intégrité des preuves exige la preuve que les enregistrements n'ont pas été altérés. Si les auditeurs ne peuvent pas avoir l'assurance que les journaux sont complets et non modifiés, les preuves n'ont aucune valeur.

Comment l'EU AI Act affecte-t-il les exigences en matière de piste d'audit ?

L'article 12 de l'EU AI Act impose des capacités de journalisation garantissant la traçabilité. L'article 17 exige une documentation de gestion de la qualité. L'article 20 exige la conservation des journaux pendant des périodes appropriées. Les organisations qui exploitent des systèmes d'IA à haut risque doivent démontrer leur conformité à ces exigences, ce qui fait d'une infrastructure de preuves de niveau audit une nécessité réglementaire.

Les outils d'observabilité LLM peuvent-ils servir de piste d'audit au titre de l'EU AI Act ?

Pas à eux seuls. Les outils d'observabilité LLM (LangSmith, Langfuse, Arize) produisent des traces destinées aux développeurs, mais une piste d'audit au titre de l'EU AI Act doit montrer quelle politique a régi une décision, qu'elle a été appliquée, qui l'a approuvée et que l'enregistrement permet de détecter toute altération. C'est la différence entre une piste d'audit LLM assemblée à partir de traces brutes et un dossier de preuves de niveau audit : l'observabilité vous dit ce que le modèle a fait ; la couche de preuves prouve que la décision a été gouvernée.

Points clés à retenir

Une piste d'audit à valeur probante conserve, pour chaque action échantillonnée, le contexte de la décision, le résultat de l'application de la politique, l'autorité humaine, la séquence d'exécution et la preuve d'intégrité. Utilisez la liste de contrôle d'audit des agents IA pour tester ces enregistrements, l'évaluation de préparation pour repérer les lacunes de preuves, et la page du logiciel d'audit des agents IA pour le parcours d'évaluation de la plateforme.

Voir en action

Prêt à automatiser vos preuves conformité ?

Réservez une démo de 20 minutes pour voir comment KLA vous aide à prouver la surveillance humaine et exporter la documentation Annex IV prête à l'audit.

Pistes d’audit des agents IA : preuves et rejeu