Échantillonnage adaptatif
Une revue humaine qui s’adapte à mesure que l’agent fait ses preuves.
Une nouvelle version d’agent commence avec une revue de chaque décision. La revue suit ensuite le taux de validation que vous définissez jusqu’à ce que l’agent atteigne son objectif de confiance. En régime stable, le taux suit la largeur de l’intervalle de confiance. Une nouvelle mise en production, un changement de modèle, une alerte de dérive ou un incident l’augmente à nouveau.
Chaque version d’agent gagne son propre taux de revue
La revue commence en phase Nouvelle version, suit le taux de validation pendant que les verdicts échantillonnés renforcent la confiance, puis s’établit à un taux calculé.
Nouvelle version
Chaque décision est revue
Chaque exécution d’une nouvelle version est échantillonnée jusqu’à atteindre le nombre d’exécutions de démarrage configuré.
Confiance en construction
Taux de validation
Les revues suivent le taux de validation configuré. Les verdicts échantillonnés construisent l’estimation de précision jusqu’à ce que son intervalle de confiance atteigne la cible.
Stable
Taux calculé
KLA calcule le taux à partir de la largeur de l’intervalle de confiance, avec un plafond égal au taux de validation. Les contrôles ponctuels se poursuivent pour maintenir la confiance à jour.
02Contrôles de renforcement
Un changement augmente le taux de revue
Tant qu’un déclencheur activé est actif, KLA porte la revue humaine au moins au taux de renforcement configuré. Lorsque le déclencheur est levé, le taux lié à la phase reprend.
Nouvelle mise en production. Une nouvelle version d’agent ou un nouveau manifeste entre en production. Changement de modèle. Le modèle ou le fournisseur sous-jacent change. Alerte de dérive. Assurance détecte un changement dans les sorties ou la répartition des décisions. Incident. Un incident récent est ouvert sur l’agent ou son processus.
Un taux fondé sur des éléments clairs
Le taux combine la précision observée, les bornes configurées et les facteurs de risque associés à l’exécution.
Revues échantillonnées. Les exécutions échantillonnées arrivent dans Decision Desk comme éléments de revue. Chaque verdict consigne le réviseur, l’heure, le résultat et le motif, puis alimente l’estimation de précision.
Intervalle de confiance. En régime stable, le taux de revue suit la largeur de l’intervalle de confiance de la précision observée. Un intervalle large l’augmente. Un intervalle étroit le réduit.
Bornes configurées. Le nombre d’exécutions de démarrage, le taux de validation, l’objectif de confiance et le taux de renforcement sont définis pour chaque agent. Le taux stable calculé ne dépasse jamais le taux de validation.
Pondération du risque. Les facteurs de risque configurés multiplient le taux de base, jusqu’à revoir chaque décision, de sorte qu’une mise en paiement est échantillonnée plus souvent qu’une classification de document à confiance égale.
Une supervision que vous pouvez prouver
Chaque exécution consigne sa phase d’échantillonnage, son taux final, ses codes motif et ses facteurs de risque. Chaque revue terminée consigne le réviseur, l’heure, le résultat et le motif. Les deux éléments sont exportés avec les preuves d’exécution.
exécution 8F31B2 · version d’agent 3.2 · 09:47:12 UTC
phase Confiance en construction · taux final 40 %
codes motif validation, deterministic_sampled
facteurs de risque aucun
revue RV-2048 · 09:53:40 UTC
A. Martin · Opérations risques
Motif : décision conforme à la politique approuvée et aux données sources
Voyez-le sur vos propres agents.
Apportez un agent et un processus. Nous vous montrerons le taux de revue initial et ce qu’il faut pour le réduire.
