Gouvernance de l'IA15 juillet 202628 min de lecture

Programme d'audit des agents IA : portée, échantillonnage, preuves et rapports

Un programme d'audit interne prêt pour le travail sur le terrain pour la portée des agents IA, l'exhaustivité de la population, l'évaluation des risques, les tests de contrôle, l'échantillonnage, les preuves, les conclusions et le suivi.

Antonella Serine

Antonella Serine

Fondateur, KLA

Fondateur de KLA, créant le plan de contrôle de gouvernance d'exécution indépendant pour les agents d'IA réglementés en vertu de la loi européenne sur l'IA.

Schéma éditorial d'une mission d'audit d'un agent d'IA : une population d'actions complète passe par la stratification des risques, les tests d'échantillons, l'examen des preuves et un rapport vérifié.

Faites défiler horizontalement pour examiner le visuel.

Un engagement reproductible réconcilie la population, sélectionne des échantillons à risque et aléatoires, teste chaque action par rapport aux preuves et transmet les résultats jusqu'à une clôture vérifiée.

Ouvrir le visuel en taille réelle

Une mission d'audit interne reproductible pour la planification, le travail sur le terrain, l'échantillonnage, l'évaluation des preuves, les conclusions et le suivi. Le cadre d'entreprise définit le vaste univers d'audit de domaine 12. La liste de contrôle d'audit IA fournit des questions de contrôle rapides et la matrice de responsabilité attribue des rôles. Cette page est propriétaire de la mission elle-même : une question d'assurance limitée, une population réconciliée, une évaluation des risques, des tests de conception et d'efficacité opérationnelle, des échantillons reproductibles, une évaluation des preuves, des rapports et une clôture. Les chiffres travaillés ci-dessous décrivent un audit d'octroi de prêt illustratif et peuvent être remplacés par les décomptes réconciliés d'une mission en direct.

1. Définir l'objectif et les critères de la mission

Rédigez une question d'assurance avant de demander des preuves : Pendant la période d'audit, les actions consécutives des agents ont-elles été autorisées, régies par des contrôles approuvés, enregistrées avec précision dans le système d'entreprise et étayées par des preuves suffisantes ? L'énoncé du périmètre fixe ensuite le processus métier, la population d'agents et de versions, les environnements, la période, les types de décision, l'importance relative, les dépendances, les exclusions et les critères. Chaque procédure de terrain doit résoudre une partie de cette question.

Gardez l'autorité de chaque critère explicite. Le Modèle à trois lignes de l'IIA attribue la gestion des risques aux rôles de première ligne, l'expertise et les défis aux rôles de deuxième ligne, et une assurance indépendante et objective à l'audit interne. Le IIA Artificial Intelligence Auditing Framework est un guide pratique publié que les équipes d'audit personnalisent, et le ISACA Artificial Intelligence Audit Toolkit est une boîte à outils pour les professionnels commerciaux couvrant la conception des contrôles et l'efficacité opérationnelle. NIST AI RMF 1.0 est un cadre volontaire final. La loi applicable n'entre dans la pile de critères qu'une fois que l'organisation a documenté le rôle de l'opérateur, son objectif, sa classification et sa juridiction.

Le programme ci-dessous sépare les obligations légales, les contrôles de gestion, les conseils professionnels et les recommandations de la KLA. La taille de ses échantillons et ses critères de réussite sont des choix de planification de l'engagement. Une opinion d’audit interne porte sur les critères énoncés pour la portée et la période définies. Il ne fournit aucune certification de conformité réglementaire, de sécurité du système ou de performances futures.

Liste de contrôle de planification d'engagement copiable avec une portée d'émission de prêt travaillée
Champ de planificationEntrée obligatoireEntrée d'engagement travailléAcceptation de la planification
Objectif d'assuranceUne question testable couvrant l'autorisation, les opérations de contrôle, l'exactitude des résultats et les preuvesAu cours de 1 April-30 juin 2026, les actions consécutives des agents d'octroi des prêts de production ont-elles été autorisées, précédées de la politique applicable, acheminées vers la décision humaine requise, écrites avec précision dans le système de prêt et étayées par des preuves complètes ?Le sponsor de l'audit, l'auditeur principal et le propriétaire du processus responsable approuvent le libellé exact
Processus métier et limitesÉvénement de début, événement de fin, systèmes inclus, rôles humains et dépendancesRéception de la demande via l'approbation, le refus ou le résultat de référence ; comprend le service d'identité, la couche de récupération, le service de modèle de crédit, KLA Policy Engine, Decision Desk, le système de prêt et Evidence RoomChaque composant capable d'influencer l'autorité, la décision, l'action ou la preuve est nommé
Population et périodeAgents, versions, environnements, actions et date gamme8 produagents d'action ; 27 Releases ; 184,216 action enregistrements ; production uniquement ; 1 April-30 juin 2026Les décomptes sont rapprochés du déploiement, de l'identité, de la passerelle, Lineage Record et des sources du système d'entreprise
Types de décision concernésAutoriser, refuser, faire remonter, remplacer, changement d’état et résultats du rétablissementApprouver, refuser, renvoyer, refuser une politique, passer outre par l'homme, récupérer les données du candidat, obtenir un crédit, émettre une offre, restaurer et révoquer l'accèsChaque type de décision importante a un propriétaire de population et une procédure de test
MatérialitéSeuils financiers, de droits, de données, opérationnels et de preuvesTous les résultats défavorables du candidat ; toutes les approbations supérieures à 25,000 EUR ; tous les accès aux données de catégorie spéciale ou d'identité ; toutes les écritures externes ; tous les incidents, quasi-accidents, dérogations et défauts d'intégrité des preuvesLes seuils sont approuvés avant la sélection de l'échantillon et couvrent l'impact qualitatif
Pile de critèresPolitique, contrat, cadre et critères juridiques applicables avec autorité et versionPolitique de prêt LND-04 v6.2 ; Norme de contrôle des agents ACS-02 v4.1 ; calendrier de conservation RS-17 ; contrats de fournisseurs ; NIST AI RMF comme orientation volontaire ; Dispositions de la [EU AI Act] (https://eur-lex.europa.eu/eli/reg/2024/1689/oj) uniquement lorsque le rôle documenté et la classification à haut risque les rendent applicables Sources : sourceChaque critère est versionné, détenu, en vigueur pendant la période et mappé à un test
Rôles et indépendanceCommanditaire de mission, responsable de l'audit, support technique, propriétaires de preuves et examinateur de la qualitéParrain du comité d'audit ; responsable de l'audit interne ; prise en charge des prêts, de l'IAM, du risque de modèle, des données, de la sécurité et des questions juridiques ; examinateur indépendant de la qualité de l'auditL'audit interne n'a aucun rôle de propriété de contrôle ou d'approbation de la direction dans le processus audité
Exclusions et livrablesExclusions motivées, effet sur l'assurance, le rapport, les documents de travail et les dates de suiviBacs à sable de développement et opérations de formation de modèles internes du fournisseur exclus ; rapport dû le 31 juillet 2026 ; réponses de la direction dues le 14 août ; premier test 30 septembreChaque exclusion a un propriétaire, une justification, un effet de risque et une limite d'opinion déclarée

2. Prouver l'exhaustivité de la population avant de sélectionner les échantillons

L'exhaustivité de la population est une assertion d'audit. Réconciliez le Agent Registry avec les déploiements de production, les identités non humaines, les passerelles de modèles et d'outils, les Lineage Record, les Decision Request et les événements commerciaux en aval. Gelez les extraits réconciliés avec le texte de la requête, les filtres, le temps d'extraction, le nombre de lignes et le hachage. Les différences inexpliquées deviennent des exceptions ou une limitation de la portée avant le début de l'échantillonnage.

NIST AI RMF 1.0 est volontaire et prend en charge le maintien d'un inventaire du système d'IA sous GOVERN 1.6. Une population de travail sur le terrain a besoin de plus de détails : chaque agent, version, modèle, identité, délégation temporaire, outil, action consécutive, résultat politique, décision humaine, incident et effet externe pour la période.

Recherchez des agents fantômes via le trafic de passerelle de modèle, les principes de service cloud, les dépenses en packages et en plate-forme, les extensions de navigateur, les informations d'identification d'automatisation, les appels de passerelle d'outils et les enregistrements commerciaux avec provenance générée par l'IA. Réconciliez les identités temporaires et déléguées par création, expiration, révocation, principal parrain et utilisation observée. Une identité ou une source d'exécution manquante peut invalider l'assertion d'exhaustivité pour chaque échantillon en aval.

Feuille de travail de rapprochement de population copiable pour l'engagement travaillé
Composante de populationSources faisant autorité et corroborantesDécompte travailléProcédure de rapprochementCritère de réussite
Agents de productionAgent Registry ; manifestes de déploiement ; ID client de passerelle modèle8ID d'agent de jointure, environnement, propriétaire, processus et dates d'activité ; enquêter sur chaque client de passerelle absent du registreTous les 8 deployed agents apparaissent dans toutes les sources applicables ; zéro client inexpliqué
Versions et déploiementsAgent Registry ; artefacts de libération immuables ; contrôleur de déploiement ; tickets de modification27 Releases / 31 RolloutsCorrespond à agent_release_id, au hachage de l'artefact, à l'approbation, au temps de déploiement, à l'environnement et à l'historique de restaurationChaque intervalle de production se résout en une version et un déploiement approuvés
Agent et service persistants identitésAnnuaire IAM ; inventaire des secrets ; manifestes de déploiement ; journaux de passerelle19 identitiesFaire correspondre le propriétaire, le type d'entité, les informations d'identification, la portée, l'activation, l'expiration et la dernière utilisation à un agent ou à une dépendance dans le champ d'applicationAucune identité partagée, orpheline, en cours d'utilisation ou sans propriétaire
Identités temporaires et délégationsService de jetons ; instantanés d'autorité ; dossiers de délégation ; événements de révocation31 tempoidentités rares / 286 delegparcoursRéconcilier le problème, le sponsor, l'objectif, la portée, l'expiration, l'utilisation et la révocation ; tester l'utilisation avant l'émission ou après l'expiration100% résoudre un sponsor approuvé et un objectif limité ; aucune utilisation hors fenêtre
Outils et dépendances externesTool Catalog ; Subventions IAM ; passerelle de sortie ; inventaire des fournisseurs ; contrats14 tools, y compris 6 write-capable ; 4 exterdépendances finalesComparez les outils et versions enregistrés avec les points finaux observés et les subventions effectives ; inspecter toutes les destinations inconnuesChaque outil et dépendance observés est approuvé, détenu, versionné et dans Data Boundaries
Enregistrements d'action de l'agentLineage Records ; événements politiques ; passerelle d'outils ; passerelle de modèle184,216Rejoignez record_id, correlation_id, l'heure de l'événement, l'agent, la version, la politique et l'effet de l'outil ; séquencer les identifiants en double et manquantsLes comptes et les clés sont rapprochés ; zéro lacune ou doublon inexpliqué
Actions commerciales consécutivesÉvénements du système de prêt ; Lineage Records ; effets d'outils ; notifications des candidats14,903Réconcilier chaque approbation, refus, référence, demande de crédit, offre et changement d'état dans les deux sens100% correspondance bidirectionnelle par « external_reference » ou « effect_id » ; le montant et le résultat sont d'accord
Événements de contrôle et d'exceptionÉvénements de politique ; 3,842 Decision Requests ; système d'incidents ; Alertes d'assurance1,126 denials ; 214 overrides ; 367 anomaly ou événements de faible confiance ; 11 incidents ou quasi-accidentsRapprocher chaque événement de son action, de son propriétaire, de sa résolution, de son effet en aval et de son enregistrement de preuvesChaque exception a une disposition ; toutes les actions concernées restent dans l'univers d'audit
Résultats de la recherche de l'agent fantômeClients inconnus de la passerelle modèle ; principes du cloud ; dépenser; extensions de navigateur ; coffre-fort d'automatisation3 candidats, 1 agent shadow confirméTracer chaque candidat jusqu'au propriétaire et à l'utilisation ; ajouter l'activité de production confirmée à la portée et à la populationTous les candidats résolus ; l'activité fantôme confirmée est contenue, quantifiée et signalée

3. Classez les agents et les types d'action par risque

Notez le type d'action à sa plus haute autorité crédible au cours de la période. Utiliser 0-3 pour autonomie, réversibilité, sensibilité des données, impact financier ou sur les droits, autorité de l'outil et qualité des preuves ; utilisez 0-2 pour dépendances externes et historique des incidents. Pour la qualité des preuves, 0 means vérifiables et complètes de manière indépendante, tandis que 3 means lacunes matérielles ou sources mutables. La rubrique travaillée en 22 points utilise Critique 17-22, Élevé 12-16, Modéré 7-11 et Faible 0-6.

La partition ordonne le travail sur le terrain et la couverture des échantillons. Cela ne remplace pas le jugement professionnel. Élevez le niveau en cas d'impact catastrophique crédible, de contournement du contrôle actif, d'incident non résolu ou de population incomplète, même lorsque le calcul est inférieur. Documentez les preuves et l’approbateur pour chaque ajustement manuel.

Feuille de calcul de classement action-risque copiable pour l'engagement travaillé
Type d'action de l'agentAutonomieRéversibilitéSensibilité des donnéesImpact financier/droitsAutorité de l'outilDépendances externesHistorique des incidentsQualité des preuvesTotal/niveau
Refus du prêt2333222219 / Critique
Approbation du prêt supérieur à EUR 25,0001333321218 / Critique
Délégation de valorisation entre agents3222322218 / Critique
Rejet du document d'identité2233221116 / Élevé
Récupération de données de crédit tierces3132321116 / Élevé
Notification du statut du demandeur301111018 / Modéré
Classification des documents sans changement d'état302101018 / Modéré

4. Tester la conception du contrôle par rapport aux domaines 12 audit

Un test de conception demande si le contrôle déclaré, s'il est utilisé comme écrit, répond au risque identifié. Inspectez la propriété, l’objectif de contrôle, le déclencheur, la logique de décision, l’autorité, la capture des preuves, la gestion des exceptions, la fréquence, la conservation et l’escalade. Parcourez un cas normal et un cas de défaillance à travers la conception avant de tester les enregistrements de la période.

Le tableau réutilise textuellement la taxonomie enterprise framework. Il s'agit du programme de test d'audit copiable pour la conception. Ajoutez des références et des résultats de documents de travail locaux sans modifier les noms de domaine, la population, la procédure, les preuves ou les critères de réussite.

Programme de test d'audit de conception de contrôle de domaine 12 copiable
ID de test et domaine d'auditPopulation de conceptionProcédurePreuveCritère de réussite
D-01 : 1. Inventaire et portée8 agents, 27 Releases, 31 Rollouts, 14 tools, 4 external dépendancesInspecter le schéma d'inventaire et le contrôle de rapprochement ; tracer un ajout, un changement et un retrait via l'approbation et la découverte de la productionAgent Registry, cartographie des processus, procédure d'inventaire, sortie de rapprochement, enregistrement d'approbationLes objets, propriétaires, environnements, dates d'activité, dépendances et sources de rapprochement requis sont définis ; une activité de production inconnue déclenche une escalade
D-02 : 2. Responsabilité et imputabilité8 agents et tous les 12 control propriétairesCartographier les résultats, l'acceptation des risques, les opérations de contrôle, les incidents, les preuves et les décisions correctives aux rôles nommés avec autorité et adjointsMatrice de responsabilité, chartes de rôle, mandat du comité, voie d'escaladeIl existe un propriétaire de processus responsable ; chaque contrôle et exception a un propriétaire autorisé et une voie d'escalade
D-03 : 3. Identité et délégation19 persistent et 31 temporary identités ; 286 delegated JourneysInspecter l'identité unique, le sponsor, l'objectif, la portée, la durée, l'émission du jeton, l'expiration et la conception de la révocation ; parcourir une délégation et une révocation d'urgenceNorme IAM, revendications de jetons, instantané d'autorité, procédures de délégation et de révocationChaque acteur et délégation est unique, délimité, attribuable, limité dans le temps le cas échéant et révocable avant une utilisation ultérieure
D-04 : 4. Autorisations, outils et limites de données14 tools, outils compatibles 6 write, 19 identités, 7 action typesComparer l'objectif prévu aux subventions effectives, Tool Catalog actions, étendues de ressources, Data Boundaries, limites de valeur et points d'applicationModèle d'accès, subventions, Tool Catalog entrées, Data Boundaries, tests de refusLes restrictions de moindre privilège sont appliquées au moment de l'action ; les outils non enregistrés, les caractères génériques larges et les chemins de contournement directs sont bloqués
D-05 : 5. Classification des risques et assurance de pré-production27 Releases et 9 model ou modifications du fournisseurInspecter la rubrique des risques, l'évaluation d'impact, le plan de test, les seuils, l'approbation des exceptions et la porte de sortie ; tracer un seuil d'échecÉvaluations des risques, évaluations de modèles et de processus, critères de version, approbations, exceptions acceptéesChaque version mappe les risques importants aux tests et aux seuils mesurables ; les échecs bloquent la libération à moins qu'une exception autorisée et limitée existe
D-06 : 6. Application des politiques d'exécution184,216 action enregistrements et versions de politiques applicablesParcourez les chemins d'autorisation, de refus, d'escalade et d'exception ; vérifier les évaluations de politique avant l'exécution et les appels directs à l'outil utilisent la même portePolicy Builder définition, KLA Policy Engine configuration, résultats de simulation, séquence d'événementsChaque chemin conséquent nécessite un verdict préalable à l'exécution approuvé ; Les états de refus et de stratégie obsolète empêchent l'effet de l'outil
D-07 : 7. Approbation humaine et escalade3,842 Decision Requests et 214 overridesInspecter les seuils de routage, l'autorité de l'examinateur, les preuves présentées, la gestion des conflits, l'expiration, la réaffectation, la justification et la prévention des décisions tardivesDecision Desk configuration, matrice de réviseur, schéma de demande, minuteries d'escaladeLes décisions humaines requises sont prises avant l'exécution par un réviseur autorisé à l'aide de preuves définies et d'une justification enregistrée
D-08 : 8. Tracé d'exécution et résultats commerciaux14,903 conseactions quentialTracer l'intention, les entrées, les données récupérées, les appels d'outils, la politique, la décision humaine, l'état avant et après, l'effet en aval et la notification du candidatLineage Record, parcours, réception de l'outil, enregistrement du système de prêt, référence de notificationDes identifiants stables reconstruisent chaque action matérielle et le résultat enregistré est conforme au système commercial
D-09 : 9. Assurance continue et gestion du changement27 Releases, 31 Rollouts, 9 vendor ou modifications de modèle, 367 alertsInspecter la classification des modifications, le déclencheur de régression, l'approbation, la surveillance de la première exécution, les seuils d'alerte, l'examen par le propriétaire et le lien de correction.Les différences de publication, les plans de test, les conditions de déploiement, les alertes d'assurance, les enregistrements de révisionChaque changement important déclenche une réévaluation et une surveillance ; les signaux défaillants créent une correction propriétaire et limitée dans le temps
D-10 : 10. Réponse aux incidents, révocation et restauration11 incidents ou quasi-accidents ; 19 access révocations ; 4 RollbacksDétection de marche, triage, confinement, requête de la population affectée, révocation des informations d'identification, restauration, communication, récupération et leçons apprisesPlan d'incident, runbook, tests de révocation et de restauration, matrice de gravité et de notificationLes propriétaires peuvent arrêter toute action ultérieure, identifier les cas concernés, révoquer l'autorité, restaurer l'état de sécurité et préserver les preuves dans les limites des objectifs approuvés
D-11 : 11. Intégrité, conservation et vérification indépendante des preuves184,216 records dans 91 daily groupes de preuvesInspecter la capture synchrone, la création de manifestes, les hachages, les signatures, la garde, l'accès du vérificateur, la conservation, la conservation légale et les contrôles de suppressionSchéma de preuves, manifestes, clé enregistrements, journal de garde, calendrier de conservation, résultat du vérificateurUn réviseur peut rapprocher, valider et réexécuter des actions échantillonnées ; les modifications ou les enregistrements manquants sont détectables et signalés
D-12 : 12. Dépendances multi-agents et tierces286 delegTrajets séparés, 4 exterdépendances finales, 9 vendor ou modifications de modèleInspecter le transfert authentifié, la propagation des contraintes, l'épinglage de version, les preuves du fournisseur, les tâches en cas d'incident, la résiliation et le repliSchéma de transfert, reçus de passerelle, contrats, rapports d'assurance, inventaire des dépendancesChaque service et agent contributeur est attribuable, autorisé, versionné, contraint et couvert par des conditions de preuve et d'incident

5. Tester l'efficacité opérationnelle sur la période d'audit

Les tests d'efficacité opérationnelle utilisent des enregistrements de période réelle. Exécutez des assertions déterministes sur l'ensemble de la population où l'exhaustivité des sources et la sémantique des champs sont prouvées, puis inspectez les cas échantillonnés pour vérifier le jugement, le contexte et la qualité des preuves. Conservez le texte de la requête, les instantanés de source, le nombre de lignes, les exceptions, les notes du réviseur et les résultats de réexécution dans les documents de travail.

Chaque exception reste liée à son dénominateur. Un verdict politique tardif dans 3 de 14,903 conseactions quantitatives a une exposition différente de 3 cases dans une population non réconciliée. Quantifiez à la fois le taux observé et la limitation de la population, puis étendez les tests lorsque l’échec peut être systémique.

Programme de test d'efficacité opérationnelle copiable avec populations concrètes et critères de réussite
ID du testPopulation et sélectionProcédurePreuveCritère de réussite
OE-01 : enregistrements d'actions et séquence de politiquesTous les 184,216 record ; 14,903 conseactions quantitatives distinctesTestez l'unicité, les champs obligatoires, l'ordre d'horodatage, la version de la politique et le verdict de pré-exécution ; identifier les actions refusées avec un effect_id en avalFrozen Lineage Record et des extraits d'événements de politique ; requête; fichier d'exception100% unique et attribuable ; chaque action consécutive a un résultat d'autorisation ou de remontée préalable applicable ; aucune action refusée n'exécute
OE-02 : refus de politiqueTous les 1,126 denials de manière analytique ; 40 cases sélectionnés parmi la règle, le type d'action, l'agent et la version pour examen humainConfirmer l'arrêt de l'action demandée, aucune nouvelle tentative équivalente n'a contourné la règle, la notification et l'escalade ont suivi la politique et les preuves expliquent la décision.Résultat de la politique, règles correspondantes, chaîne de nouvelle tentative, passerelle d'outils, notification, Decision Requestinterdit les effets zéro ou les contournements équivalents ; chaque refus échantillonné est correct, opportun et reconstructible
OE-03 : approbations humainesTous les 3,842 Decision Request analytiquement ; 60 sampled par risque, réviseur, résultat et moisAutorité du réviseur de tests au moment de la décision, preuves présentées, moment de la décision, justification, conflits, expiration et correspondance avec l'action exécutéeDecision Desk enregistrement, instantané IAM, hachage des preuves présentées, réception de l'outil, résultat commercial100% les approbations requises précèdent l'action ; les décisions échantillonnées ont des examinateurs autorisés, des preuves suffisantes, une justification et des effets de correspondance
OE-04 : remplacements humainsTous les 214 overrides analytiquement ; 50 sampled à travers le verdict initial, l'examinateur, le code de motif, le résultat et la versionComparez l'autorité de dérogation et la justification à la politique ; tracer la décision originale, la nouvelle décision, l'effet de l'outil, la notification et l'incident ou la plainte ultérieurDécisions originales et annulées, instantané de l'autorité, justification, Lineage Record, résultatChaque dérogation est autorisée, motivée, opportune, dans les limites déléguées et reflétée avec précision en aval
OE-05 : Rapprochement de l'état de l'entrepriseToutes les 14,903 conseactions quantitatives de manière analytique ; 60 sampled pour l'inspection à la sourceRejoignez l'action demandée, l'action approuvée, la réponse de l'outil, avant et après les hachages d'état, le montant, le statut final du prêt et la notification du demandeurRéception de l'outil, événement du système de prêt, notification, before_state_hash, after_state_hash, external_reference100% accord de résultat et de montant ; les enregistrements sources échantillonnés prennent en charge l'état enregistré avant et après
OE-06 : versions et premières exécutionsTous les 27 Releases ; première et deuxième exécution consécutive après chaque version, 54 actionsVérifier les versions d'approbation, d'artefact et de politique, les résultats de régression, le temps de déploiement, la surveillance prévue, l'exhaustivité des preuves et l'absence d'exécution de pré-approbationManifeste de version, résultats de test, approbation, enregistrement de déploiement, premières Lineage RecordsChaque version est approuvé avant utilisation ; toutes les 54 first exécutions utilisent les versions prévues et réussissent les contrôles et les vérifications des preuves
OE-07 : révocations d'accèsTous les événements 19 revocation et toutes les activités ultérieures pour les identités concernéesComparez la demande, l'approbation, le temps d'effet, l'expiration du jeton, l'application de la passerelle, les sessions résiduelles et les appels ultérieurs refusés ou réussisÉvénements IAM et de jeton, journaux de la passerelle, instantanés d'autorité, liens d'incidentLa révocation atteint l'objectif approuvé ; aucune utilisation réussie ne se produit après le délai d'effet
OE-08 : incidents et quasi-accidentsTous les 11 event et la totalité de la population affectée par l'action pour chaqueRéexécuter la gravité, la requête sur la population affectée, le confinement, la révocation, la restauration, la notification, la cause première, la correction et la fermeture approbationDossier d'incident, Lineage Records, liste des cas concernés, reçus de révocation et d'annulation, preuves de clôtureChaque événement a une population affectée complète, un confinement rapide, une récupération approuvée, des preuves préservées et une remédiation vérifiée
OE-09 : Intégrité et conservation des preuvesTous les manifestes du bundle 91 daily ; 30 bundles sélectionnés pour la signature et la validation de la chaîne ; chaque action échantillonnéeRecalculer les hachages du manifeste et des enregistrements, valider les signatures et l'ordre en chaîne, confirmer la classe de rétention et la conservation légale, et résoudre les enregistrements via un vérificateur indépendantRegrouper les manifestes, les clés de signature, le journal de conservation, les enregistrements de conservation, les résultats du vérificateurTous les manifestes sont rapprochés des décomptes sources ; tous les 30 validations et chaque enregistrement échantillonné réussissent les tests d'intégrité, de conservation et de conservation
OE-10 : modifications du fournisseur, du modèle et de la délégationTous les 9 vendor ou changements de modèle et 286 delegtrajets analysés ; 50 Journeys échantillonnésTest d'approbation des modifications, conditions du contrat et des preuves, expéditeur et destinataire authentifiés, objectif et contraintes propagés, versions, effets de sous-agent et résultat finalEnregistrement de modification, contrat, reçus de transfert, instantanés d'autorité, versions de composants, résultat du voyageChaque modification est approuvée avant utilisation ; chaque transfert échantillonné est attribuable, limité, versionné et traçable jusqu'au résultat final

6. Sélectionnez un risque reproductible et un échantillon aléatoire

Gelez la population avant la sélection. Enregistrez les requêtes source, le temps d'extraction, les filtres, la graine aléatoire, la méthode de hachage, le propriétaire de l'échantillon, le traitement en double, les remplacements et la liste finale des cas. Conservez chaque balise de strate applicable sur un cas sélectionné afin qu'une action puisse satisfaire plusieurs objectifs de couverture sans disparaître du rapport d'exception.

Les tests automatisés en population complète fonctionnent pour les assertions déterministes sur des enregistrements structurés et rapprochés : unicité, champs obligatoires, ordre d'horodatage, séquence de politique avant action, correspondance de montant, autorité expirée, refus suivi d'exécution et validation de hachage. L'examen humain reste nécessaire pour la justification de la décision, la cohérence sémantique avec l'objectif, la pertinence des données récupérées, la qualité du jugement de l'examinateur, les dommages crédibles en aval, les exceptions en matière de chaîne de traçabilité et les preuves opaques de tiers.

Les décomptes de sélection ci-dessous sont des recommandations de la KLA pour cette population active. Ils constituent un point de départ défendable pour la planification de l’engagement. Documentez l’assurance attendue, l’écart tolérable, la variabilité de la population, la stratégie de dépendance et les règles d’expansion lorsque l’engagement nécessite une inférence statistique.

Matrice d'échantillonnage copiable pour la 1 April-30 juin 2026 population
Strate requisePopulation concrèteMéthode de sélection et tailleProcédure humainePreuvesRègle de réussite et d'expansion
Types d'actions à haut risque2,412 Critidiminutions de niveau cal, approbations supérieures à 25,000 EUR et actions de valorisation entre agents60 cases : 20 higheère valeur ou impact le plus élevé, plus 40 spread pour le type d'action, l'agent, la version et le moisRéexécuter l'autorité, la politique, la décision humaine requise, l'effet de l'outil, le résultat et l'intégrité des preuves de bout en boutLineage Record, instantané de l'autorité, politique, Decision Request, réception de l'outil, état de l'entreprise, manifeste des preuvesZéro effet consécutif non autorisé ou non pris en charge ; tout échec de ce type s'étend à l'ensemble du type d'action concerné et à la version
Échantillon de population aléatoirePopulation de base de 184,216 action enregistrements ; la sélection exclut les cas déjà choisis pour les strates obligatoires80 records sélectionnés par ordre croissant SHA-256 de graine fixe plus record_id ; conserver la graine et interrogerInspecter l'exhaustivité de bout en bout et comparer le but, l'action et le résultat enregistrés avec les enregistrements sourcesTous les groupes de preuves minimales et les enregistrements sources faisant autoritéAucun champ manquant ou incohérent inexpliqué ; une lacune systémique dans le schéma s'étend à tous les enregistrements utilisant cette version de schéma
Exceptions et refus de politique1,126 denials sur 18 policy règlesTest de séquence automatisé sur toute la population ; 40 human révisions couvrant chaque règle importante et tous les 8 agentsConfirmer que l'effet refusé a été arrêté, que les chemins de nouvelle tentative sont restés gouvernés et que l'escalade ou la notification correspond à la politiqueDécision politique, règles correspondantes, chaîne de nouvelle tentative, enregistrement de passerelle, Decision Request, notificationZéro effet refusé ; tout contournement s'étend à toutes les exécutions partageant une règle, un agent, une version, un outil ou un modèle de nouvelle tentative
Remplacements humains 214 overrides par 23 reviewersAutorité de population complète et test de synchronisation ; 50 human avis, y compris chaque évaluateur avec 5 or dérogations supplémentairesÉvaluer les preuves présentées, la justification, l'autorité, le conflit, le calendrier, l'action exécutée et la plainte ou l'incident ultérieurDécision initiale, dérogation, instantané IAM, justification, effet de l'outil, historique des résultatsChaque dérogation est autorisée et motivée avant effet, et délimité; un évaluateur invalide s'étend à toutes les décisions de cet évaluateur
Résultats anormaux ou de faible confiance367 events provenant de règles de nouvelle tentative, de valeurs aberrantes, de dérive, de latence, de qualité des données ou de faible confiance60 cases : 10 from chaque famille d'anomalies, pondérée en actions critiques et élevéesValider l'alerte, l'enquête, la disposition, la voie de décision, l'effet et la correction ; inspecter le risque de faux négatifs autour des seuilsAlerte d'assurance, enregistrements de modèles et d'outils, analyse des examinateurs, résultats, plan de remédiationChaque alerte échantillonnée est opportune et correctement résolue ; toute escalade requise manquée s'étend à la fenêtre de famille et de seuil
Premières exécutions après une versionPremière et deuxième actions consécutives après chacune des 27 Releases : 54 actionsTout tester 54Faire correspondre les versions déployées, l'approbation, les résultats de régression, la politique, les autorisations, la surveillance, les résultats et le schéma de preuvesManifeste de version, enregistrement de déploiement, premiers Lineage Record, alertes d'assuranceToutes les 54 use versions approuvées et contrôles de réussite ; tout échec s'étend à chaque action jusqu'à la correction ou la restauration
Délégation entre agents286 Journeys contenant au moins un transfert d'agent à agent50 Journeys entre l'expéditeur, le destinataire, l'outil, le niveau de risque et la version ; inclure chaque parcours en trois sautsTracer les parties authentifiées, l'objectif délégué, la portée, l'expiration, la propagation des contraintes, l'intégrité des messages, les effets des outils et le résultat finalRéceptions de transfert, instantanés d'autorité, composants Lineage Record, réceptions d'outils, résultat du parcoursChaque transfert est attribuable et dans les limites déléguées ; toute chaîne brisée s'étend à la combinaison expéditeur-destinataire-version
Incidents et quasi-accidents7 incidents et 4 near manquésTestez tous 11 et la population complète des actions affectées pour chaqueRéeffectuer la détection, la gravité, le confinement, la révocation, la restauration, la notification, la cause première, la correction et la fermetureDossier d'incident, requête sur les cas concernés, enregistrements d'actions, reçus de récupération, preuves de fermeturePopulation affectée complète et précise avec une réponse rapide et une fermeture vérifiée ; toute omission rouvre l'événement
Modifications de fournisseur ou de modèle9 changes : 4 model versions, 2 retrifournisseurs d'évaluation, 2 tool API, 1 orchestration serviceTout tester 9 changes et les premières 3 conseactions successives après chacune, 27 action révisions avec chevauchement conservéesInspecter la diligence raisonnable, les termes du contrat et des preuves, la réévaluation des risques, l'évaluation, l'approbation, l'épinglage de version, la surveillance et le repliApprobation des modifications, contrat, évaluation, manifeste, enregistrements de passerelle, premiers résultatsChaque modification est approuvée et testée avant utilisation ; toute utilisation non approuvée s'étend à l'intervalle d'exposition complet

7. Évaluer la suffisance des preuves pour chaque action échantillonnée

Les preuves sont suffisantes lorsqu'elles sont pertinentes pour l'affirmation, fiables, complètes, opportunes, traçables jusqu'à la population et protégées contre les changements non détectés. Documentez le producteur, le système faisant autorité, la méthode d'extraction, la sémantique des champs, la rétention, le mécanisme d'intégrité et la chaîne de traçabilité. Réexécutez le résultat de la politique et réconciliez l’effet en aval chaque fois que les preuves soutiennent ces procédures.

La preuve d'identité doit déterminer l'utilisateur ou le principal parrain, l'agent, le contexte de service, le délégant et l'approbateur. Le Schéma du journal d’audit de l’agent IA fournit le contrat de machine partagé, indépendant du fournisseur. Ce programme d'audit conserve sponsoring_principal_id, agent_identity_id, authority_snapshot_id, delegated_by et reviewer_id comme alias de document de travail ; Les enregistrements IAM liés contiennent le type d'acteur, le cycle de vie des informations d'identification, les subventions effectives et le contexte du service. Conservez ces alias afin que les échantillons puissent se déplacer entre enterprise framework, Lineage Explorer et Evidence Room sans traduction.

Une capture d'écran, un total de tableau de bord ou une représentation de gestion peuvent corroborer un test et ne peuvent pas remplacer l'enregistrement de période sous-jacent. Lorsqu'un groupe requis manque, classifiez l'écart, identifiez la population affectée, tentez une procédure alternative équivalente et nuancez la conclusion lorsque la même affirmation reste sans fondement.

Liste de demande de preuves copiable utilisant les noms de champs de preuves minimum partagés
ID de la demande et groupe de champsChamps minimum exactsSource et format demandésTest de suffisance et de réussite
ER-01 : enregistrement et corrélationrecord_id, occurred_at, environment, tenant_id, process_id, journey_id, correlation_idImmuable Lineage Record extrait plus schéma, fuseau horaire, requête, nombre de lignes et hachage d'extraitLes ID sont uniques ; l’ordre des horodatages est cohérent ; l'enregistrement se réconcilie avec la population gelée et termine le parcours
ER-02 : Agent et versionagent_id, agent_release_id, model_id, model_version, orchestrator_version, prompt_template_versionAgent Registry et manifeste de version signé avec des références d'artefact immuablesChaque version se résout en l'artefact approuvé et déployé à occurred_at
ER-03 : Principal et délégationagent_identity_id, sponsoring_principal_id, delegated_by, session_id, authority_snapshot_id, expires_atIAM, jeton, session, délégation, octroi effectif, contexte de service et révocationUtilisateur ou sponsor, agent, contexte de service et délégation sont attribuables, actifs, limité, non expiré et autorisé pour l'action
ER-04 : Objectif et risquePurpose_code, decision_type, risk_tier, regulatory_classification, classification_basis_versionApprouvé Objectif du processus, catalogue de décisions, évaluation des risques et enregistrement de classificationL'objectif et le niveau enregistrés correspondent à l'utilisation approuvée et à la classification en vigueur pour la version
ER-05 : provenance des donnéesinput_reference[], source_hash[], retrieval_query_hash, data_boundary_id, redaction_profile_idEntrées protégées ou références résolvables, reçus de récupération, versions source, Data Boundaries et enregistrement de rédactionChaque entrée de matériau et élément récupéré est résolu en source, heure, limite et représentation protégée autorisées
ER-06 : action de l'outiltool_id, tool_version, action, resource_scope, requested_args_hash, response_hash, effect_idTool Catalog l'entrée, la demande et la réponse de la passerelle, le contexte d'autorisation effectif et la réception de l'effetL'autorité demandée, l'appel réel, la réponse et l'effet en aval conviennent et restent dans la portée approuvée
ER-07 : Décision politiquepolicy_id, policy_version, policy_decision, matched_rule_ids[], exception_id, evaluated_atPolicy Builder artefact, KLA Policy Engine événement, règles correspondantes, approbation d'exception et entrées de simulationL'auditeur exécute à nouveau le même résultat ; evaluated_at précède l'effet de l'outil gouverné
ER-08 : Décision humainedecision_request_id, reviewer_id, reviewer_role, presented_evidence_hash, decision, rationale, decided_atDecision Desk enregistrement plus instantané IAM du réviseur et les preuves présentées au moment de la décisionL'identité et le rôle de l'approbateur sont autorisés ; les preuves, la décision, la justification et le calendrier soutiennent l'action entreprise
ER-09 : Résultat et récupérationoutcome, before_state_hash, after_state_hash, external_reference, incident_id, rollback_id, revocation_event_idLes dossiers commerciaux avant et après, les notifications, les incidents, les retours en arrière et les reçus de révocation faisant autoritéL'état enregistré et l'effet en aval correspondent au système commercial ; les événements de récupération se résolvent et se séquencent correctement
ER-10 : Intégrité et rétentionevidence_hash, previous_record_hash, bundle_manifest_hash, signature_key_id, sealed_at, retention_class, legal_hold_idSealed Evidence Bundle, manifeste, signature et enregistrement de clé, journal de garde, calendrier de conservation et enregistrement de conservation légaleRecalcul des hachages ; signature et validation de la chaîne ; le scellement arrive à point nommé ; la garde, la rétention et la retenue couvrent l'échantillon

8. Rédiger les conclusions et former une opinion d’audit limitée

Utilisez un modèle de gravité à quatre niveaux. Critique désigne une exposition active ou crédible non autorisée, irréversible, en matière de sécurité, de droits ou financière importante nécessitant un confinement immédiat. Élevé signifie un échec matériel ou systémique du contrôle, une population affectée importante ou une faible prévention des actions consécutives. Modéré signifie une faiblesse de contrôle limitée avec des contrôles compensatoires et une exposition actuelle limitée. Faible signifie une faiblesse isolée de la documentation ou du processus avec un faible impact direct. Enregistrez la probabilité, l’impact, la vitesse, la détectabilité, la population, les contrôles compensatoires et l’acceptation des risques de gestion derrière la notation.

Chaque constatation nécessite une condition, un critère, une cause, une conséquence, la population affectée, des preuves, un propriétaire, une mesure corrective et une date de nouveau test. Séparez une exception de contrôle d’une limitation de preuve. Lorsque l’exhaustivité de la population, l’intégrité des preuves ou une dépendance à un tiers empêchent la procédure, énoncez l’assertion concernée et l’incertitude résiduelle dans une conclusion nuancée.

L'avis final nomme la portée, la période, les critères, le niveau d'assurance, les domaines testés, les populations fiables, les exceptions et les limitations. Il indique si les contrôles ont été conçus de manière appropriée et fonctionnent efficacement pour la mission déclarée. Il ne fournit aucune certification de conformité légale, de sécurité du système, d'exactitude des décisions individuelles en dehors du travail testé ou de l'exploitation future.

Exemple de résultat entièrement écrit et copiable
Champ de rechercheRésultat terminé : IA-AGT-2026-04
Titre et gravitéLes remplacements humains ont été exécutés sans preuve d'approbation contemporaine complète : Élevé
ConditionSur l'ensemble de la population de 214 human remplacements, 37 records avaient une « justification » vide et 12 additenregistrements nationaux utilisaient un « rôle_réviseur » qui ne correspondait pas à la matrice de souscripteur approuvée à « décidé_à ». Cinq de ces 12 decisions ont été enregistrées après l'effet de l'outil capable d'écrire associé. Les 49 unique remplacements concernés représentent 22.9% de la population de remplacement.
CritèrePolitique de prêt LND-04 v6.2 section 7.3 et Norme de contrôle des agents ACS-02 v4.1 control HAO-4 require un souscripteur autorisé pour examiner le présenté preuves, enregistrer une décision et sa justification, et finaliser la décision avant qu'une dérogation n'atteigne le système de prêt.
CauseLa migration IAM de juin a omis le groupe entrepreneur-souscripteur du mappage de rôles Decision Desk. Le schéma de l'API de remplacement autorisait également une justification vide, et la passerelle d'outils acceptait une référence de remplacement sans vérifier « decided_at » par rapport au temps d'effet.
ConséquenceL'organisation ne peut pas démontrer un jugement contemporain et autorisé pour 49 overrides. Cinq effets du système de prêt se sont produits avant la décision enregistrée, créant un contournement direct du contrôle. Les candidats concernés peuvent avoir obtenu des résultats qui ne peuvent pas être étayés par le dossier d'approbation préservé, et la direction manque de preuves fiables pour une plainte, un organisme de réglementation ou un examen interne.
Population affectée49 de 214 overrides entre 1 April et 30 juin 2026 : 31 approvals, 13 declines, et 5 referral changements sur 6 agents et 4 Releases. Les cinq décisions tardives concernaient des demandes sollicitant un total de 286,000 in EUR.
PreuveRequête sur l'ensemble de la population IA-AGT-OE-04 ; le hachage d'extrait Decision Desk congelé 8d61…c4a2 ; Instantanés de rôle IAM ; 49 Lineage Records ; cinq reçus d'outils et événements du système de prêt ; politique LND-04 v6.2 ; contrôle ACS-02 v4.1. Une performance indépendante a confirmé les décomptes et l'ordre des événements.
Propriétaire et date d'échéancePropriétaire responsable : Responsable des opérations de prêt. Propriétaires de support : propriétaire IAM et propriétaire technique de l'agent. Correction due le 15 Septemembre 2026.
CorrectionRendre la « justification » obligatoire pour chaque remplacement ; synchroniser les groupes de réviseurs approuvés à partir d'IAM ; exiger que la passerelle valide l'autorité du réviseur et decided_at avant une écriture ; réexaminer tous les 49 affecdos cas ; corriger les dossiers du demandeur et du prêt si nécessaire ; préserver la lacune initiale et la nouvelle révision en tant que preuves distinctes ; surveiller quotidiennement l’intégralité du remplacement pendant 30 days.
Critère de retest et de clôtureDate de retest : 30 Septemembre 2026. Réeffectuer les tests de conception pour le schéma, la synchronisation des rôles et le séquençage des passerelles ; tester la population complète de correction de 49 cas et tous les remplacements du 16-30 septembre. Clôturez uniquement lorsque chaque cas concerné a une décision approuvée, chaque nouveau remplacement a une décision et une justification préalables autorisées, et le moniteur 30 jours n'a aucun échec.
Effet d'opinionQualifier la conclusion sur l'efficacité opérationnelle pour 7. Approbation humaine et escalade et remplacements consécutifs pendant la période d'audit. Conserver des conclusions distinctes pour les autres domaines lorsque des preuves suffisantes les étayent.

9. Rapporter, suivre et établir une assurance continue

Suivez chaque découverte via un plan de remédiation avec le propriétaire, les actions, les dates d'échéance, les dépendances, le traitement des risques provisoire, les preuves et le statut. L'audit interne reteste l'assertion ayant échoué en utilisant le critère d'origine et en corrigeant les enregistrements d'exploitation. La clôture nécessite une conception vérifiée, un fonctionnement efficace pendant la fenêtre d'observation définie, un traitement complet de la population affectée et une approbation selon la méthodologie d'audit.

Exécutez des analyses récurrentes entre les audits sur le rapprochement de la population, les refus de politique suivis des effets, les approbations tardives, les remplacements, l'autorité expirée, les modifications de version et de modèle, la disposition des anomalies, la clôture de l'incident, l'exhaustivité des preuves et la validation des signatures. La direction est propriétaire de ces contrôles et examens. L'audit interne valide la source, la logique, les seuils, examine les preuves et assure le suivi des problèmes avant de s'appuyer sur les analyses.

Déclenchez un travail d'audit hors cycle pour un nouvel agent à fort impact, une version matérielle, un remplacement de modèle ou de fournisseur, une extension des autorisations, un nouvel outil capable d'écrire, un changement de processus ou de classification, un incident ou un quasi-accident, une variance inexpliquée de population, un échec d'intégrité des preuves, une anomalie de remplacement ou de refus répétée, ou un résultat critique ou élevé en retard. Utilisez l'Agent Audit Readiness Assessment pour évaluer la préparation, puis utilisez le 12-domain Enterprise Framework pour étendre tout domaine faible en procédures plus approfondies.

  • Suivi des mesures correctives : mettre à jour le propriétaire, la date d'échéance, l'action, la dépendance, le contrôle intermédiaire, les preuves et l'acceptation des risques au moins une fois par semaine pour les résultats critiques et élevés.
  • Retest de contrôle : répétez l'étape de conception ayant échoué, testez l'intégralité de la population affectée connue et inspectez une fenêtre de fonctionnement post-correction définie.
  • Preuve de clôture : conserve la configuration corrigée, les approbations, les décisions relatives aux cas concernés, les nouveaux enregistrements de période, les résultats de requête, les résultats du vérificateur et l'approbation de clôture de l'audit.
  • Analyses récurrentes : acheminez les violations vers une alerte d'assurance avec un propriétaire, une gravité, une date d'échéance, une requête sur la population affectée et un plan de remédiation.
  • Travail hors cycle : ouvrez une révision ciblée lorsqu'un déclencheur modifie l'autorité, l'impact, la fiabilité des preuves ou la population d'audit.
Aperçu du rapport final copiable et test d'achèvement
Section du rapportContenu requisArtefact jointCritère d'achèvement
1. Résumé et avisQuestion d'assurance, conclusion, profil de gravité, exposition matérielle, zones fiables et actions requisesAvis signé et résumé du problèmeLa conclusion est limitée aux critères, à la portée, à la période, à la population, aux procédures et aux preuves
2. Objectif, portée et critèresProcessus opérationnel, agents, versions, dates, types de décision, importance relative, exclusions, autorité de chaque critèreListe de contrôle de planification d'engagement approuvéeChaque test renvoie à la question d'assurance et à un critère efficace
3. Limite du système et populationArchitecture, propriétaires, identités, outils, dépendances, décomptes, résultats de rapprochement et recherche d'agent fantômeFeuille de calcul de population, requêtes source, hachages et journal des variancesLa population est complète ou la limitation exacte et les assertions affectées sont indiquées
4. Évaluation des risques et méthodologieRubrique de risque, actions classées, approche de conception et d'efficacité opérationnelle, tests automatisés, méthode d'échantillonnage, semences, tailles et règles d'expansionFeuille de travail sur les risques, programme de test et matrice d'échantillonnageUn examinateur peut reproduire la sélection et comprendre le recours à chaque procédure
5. Résultats par domaine d'auditConclusion de conception, conclusion opérationnelle, population testée, exceptions, taux et qualité des preuves pour tous les 12 domainsIndex des documents de travail et suivi des demandes de preuvesChaque conclusion est étayée par des preuves examinées et des exceptions quantifiées
6. Résultats et actions de gestionCondition, critère, cause, conséquence, population, preuves, gravité, propriétaire, action, date d'échéance et acceptation du risqueFeuilles de résultats et réponses signées de la directionLes actions s'attaquent à la cause profonde et terminent le traitement de la population affectée
7. Limites et conclusions nuancéesPreuves manquantes, alternatives échouées, dépendances indisponibles, incertitude résiduelle et effet d'opinionDocuments de travail sur la limitation de la portée et les procédures alternativesLe lecteur peut identifier chaque assertion en dehors de l'assurance étayée
8. Suivi et assurance continueGouvernance des mesures correctives, plan de retest, critères de fermeture, analyses, propriétaires, seuils, cadence et déclencheurs hors cyclePlans de correction, inventaire analytique et calendrier de suiviChaque problème ouvert et signal récurrent a un propriétaire, une source de preuves, une date d'échéance et un chemin d'escalade
9. AnnexesDéfinitions, versions de critères, populations détaillées, requêtes, liste d'échantillons, exclusions, index de preuves et rubrique de gravitéPackage de reproductibilité et Sealed Evidence Bundle référencesUn réviseur indépendant peut retracer les déclarations du rapport jusqu'aux documents de travail sans exposer les données protégées

Foire aux questions

Qu'est-ce qu'un Programme d'audit des agents IA ?

Il s'agit du plan de travail reproductible pour une mission d'assurance : objectif, critères, population complète, évaluation des risques, conception des contrôles et procédures d'efficacité opérationnelle, échantillonnage, tests de preuves, conclusions, opinion et suivi. Le 12-domain Enterprise Framework plus large définit l'univers d'audit.

Comment l'audit interne doit-il définir la portée de l'engagement d'un agent IA ?

Commencez par le processus métier et la question d'assurance exacte. Nommez les agents, les versions, les identités, les outils, les modèles, les dépendances, les types de décision, la période, l'importance relative, les effets en aval, les magasins de preuves, les exclusions et les critères. Réconciliez l’ensemble de la population avant de sélectionner des échantillons.

Comment les auditeurs doivent-ils échantillonner les actions des agents IA ?

Combinez une référence aléatoire reproductible avec des strates de risque obligatoires : actions à haut risque, refus, remplacements, anomalies, résultats peu fiables, premières exécutions après les versions, délégation entre agents, incidents, quasi-accidents et modifications de fournisseur ou de modèle. Conservez la requête de remplissage, la graine, la logique de sélection et les règles d'expansion.

Quelles preuves sont requises pour une action échantillonnée d'un agent IA ?

L'enregistrement doit résoudre les identités du principal et de l'agent, le contexte de délégation et de service, la version de l'agent et du modèle, les entrées et les références de données récupérées, le contexte de l'outil et de l'autorisation, le résultat de la politique, la décision humaine et la justification, l'état avant et après, l'effet en aval, les horodatages, la conservation, la preuve d'intégrité et la chaîne de traçabilité.

Les tests automatisés peuvent-ils remplacer l'examen d'échantillons humains ?

Les tests automatisés peuvent couvrir des populations complètes pour les assertions déterministes telles que la séquence, les champs obligatoires, l'expiration des autorités, le rapprochement des résultats et la validation du hachage. Un examen humain est toujours nécessaire pour la justification, le contexte, la cohérence sémantique, la qualité du jugement, les dommages crédibles et les limites des preuves.

Que doit dire le rapport d'audit lorsque les preuves sont incomplètes ?

Classifiez l'écart, quantifiez la population affectée, tentez une procédure alternative équivalente et indiquez l'affirmation non étayée et l'incertitude résiduelle. Qualifiez le domaine ou la limite d'opinion pertinente et attribuez une correction avec une date de nouveau test.

Points clés à retenir

Un programme d'audit d'agent IA utilisable commence par une question d'assurance précise et une population complète. Il classe les risques d'action, teste la conception des contrôles et le fonctionnement réel, combine des analyses de population complète avec des échantillons reproductibles, évalue un schéma de preuves cohérent, rédige des résultats quantifiés et vérifie la clôture. Commencez par l'Agent Audit Readiness Assessment, utilisez le enterprise framework pour des critères de domaine plus approfondis et comparez la demande de preuves avec l'échantillon Evidence Room.

Voir en action

Prêt à automatiser vos preuves conformité ?

Réservez une démo de 20 minutes pour voir comment KLA vous aide à prouver la surveillance humaine et exporter la documentation Annex IV prête à l'audit.

Programme d'audit des agents IA : portée, échantillonnage, preuves et rapports | KLA Blog