Un agente AI necessita dell'approvazione prima dell'esecuzione quando l'azione proposta supera la soglia di autorità, conseguenza, reversibilità, dati, novità, fiducia o impatto a valle di un'organizzazione. Possono essere consentite azioni di routine all'interno dell'autorità esplicita. Un'azione consentita con un segnale di revisione può procedere con un avvertimento. Un'eccezione consequenziale deve essere messa in pausa per un essere umano autorizzato. Un'azione vietata, non autorizzata, non valida, obsoleta o non verificabile deve essere interrotta.
Questa guida risponde alla domanda operativa in tutti i settori. Utilizza allow, warn, require_approval e block come modello decisionale pratico per le azioni dei singoli agenti. La guida all'articolo 14 della legge sull'intelligenza artificiale dell'UE copre il compito separato guidato dalla regolamentazione: implementare le capacità di supervisione umana necessarie per i sistemi di IA ad alto rischio. Questa guida costituisce informazioni generali, aggiornate a 28 luglio 2026, e non sostituisce la consulenza legale, sui rischi o tecnica.
La regola di approvazione dei quattro risultati
Valutare l'effetto collaterale proposto prima che raggiunga lo strumento o il sistema a valle. Applica tutte le regole pertinenti, quindi mantieni il risultato più forte. Un blocco non può essere indebolito da una regola di autorizzazione corrispondente e un'approvazione richiesta non può scomparire perché l'importo è inferiore a una soglia finanziaria.
Il risultato descrive il comportamento di esecuzione. allow rilascia l'azione all'interno dell'autorità corrente. avviso lo rilascia e crea un follow-up definito. require_approval mantiene l'azione esatta finché un essere umano autorizzato non decide. blocca impedisce all'azione di raggiungere l'effetto collaterale governato.
| Risultato | Utilizzare quando | Comportamento di esecuzione | Eccezioni e precedenza |
|---|---|---|---|
| permettere | L'azione è di routine, all'interno dell'autorità delegata, ha poche conseguenze, è reversibile, utilizza dati approvati, proviene da una versione nota e ha un contesto completo. | Eseguire e conservare le azioni ordinarie e il registro delle politiche. | Sono consentiti eventuali override dell'attivazione di blocco, approvazione o avviso. Il contesto di identità, policy o evidenza mancante non viene mai consentito per impostazione predefinita. |
| avvisare | L'azione rimane consentita e reversibile ma è vicina a una soglia, insolita, osservata di recente o selezionata per un campionamento di garanzia. | Eseguire, registrare il segnale e instradare il follow-up definito senza trattenere l'effetto collaterale. | Utilizzare require_approval quando il ritardo dopo l'esecuzione lascerebbe un effetto materiale o difficile da annullare. Utilizzare il blocco quando l'autorità o il contesto richiesto sono assenti. |
| richiede_approvazione | L’azione è materiale, difficile da annullare, lesiva dei diritti, vicina a un limite di autorità, sensibile, nuova, poco sicura o in grado di creare un effetto a valle significativo. | Mantieni l'azione e il set di parametri esatti. Riprendi solo dopo l'approvazione di un revisore idoneo prima della scadenza e il contesto associato rimane aggiornato. | Un revisore non può approvare un'azione vietata. Una richiesta scaduta o sostanzialmente modificata richiede una nuova valutazione e una nuova richiesta di decisione. |
| bloccare | L'azione è vietata, esterna all'autorità, prende di mira un limite di dati proibito, non supera un controllo obbligatorio, contiene un contesto non valido o non può essere valutata o evidenziata in modo sicuro. | Fermati prima dell'effetto collaterale governato e registra il motivo. | Modificare l'azione o la politica attraverso il processo di cambiamento governato. L’autorità rivoluzionaria deve essere un percorso politico separato, limitato nel tempo, con prove proprie e revisione retrospettiva. |
Associare i sette input di approvazione alla politica
Le soglie appartengono all'organizzazione proprietaria dell'azione. Inizia con un inventario delle azioni e definisci le bande testabili per tutti e sette gli input. L’importo finanziario da solo non è sufficiente: una modifica di valore zero dei diritti o la divulgazione di dati riservati può comportare più rischi di un trasferimento reversibile di grandi dimensioni tra conti controllati.
Mantieni gli input come regole separate. Un punteggio combinato può nascondere un fatto decisivo. Una destinazione vietata deve rimanere bloccata anche quando ogni altro input sembra di routine.
| Ingresso | Consenti o avvisa la banda | Richiede fascia di omologazione | Fascia di blocco |
|---|---|---|---|
| Rischio e diritti interessati | Basse conseguenze nell'ambito dello scopo approvato; avvisare per un'anomalia limitata. | Conseguenze materiali per il cliente, il lavoratore, il paziente, il cittadino, la sicurezza o la conformità. | Uso vietato, rischio residuo inaccettabile o azione al di fuori dello scopo approvato. |
| Importo o esposizione | All'interno di un limite esplicito per azione, giornaliero e di destinazione. | Vicino o sopra il limite del produttore o superata una soglia di esposizione aggregata. | Al di sopra dell’autorità assoluta, della liquidità, delle sanzioni o dei limiti della controparte. |
| Reversibilità | Lettura, bozza, simulazione o aggiornamento interno reversibile in modo affidabile. | Comunicazione esterna, pagamento, cancellazione, archiviazione, modifica dei diritti o percorso di compensazione costoso. | Nessun percorso di recupero sicuro per le condizioni attuali. |
| Sensibilità dei dati | Campi approvati all'interno del limite dati assegnato. | Accesso limitato ai dati, divulgazione, esportazione, rischio di reidentificazione o nuovo destinatario. | Categoria, destinazione, scopo, regione vietati o autorità legale mancante. |
| Novità e cambiamento | Rilascio, strumento, percorso, destinazione e modello operativo noti. | Nuova rampa di rilascio, primo utilizzo di uno strumento o di una destinazione, sequenza insolita o modifica della configurazione del materiale. | Componente non approvato, destinazione sconosciuta o versione non verificabile. |
| Fiducia e qualità delle prove | Banda di confidenza convalidata con prove di origine complete e attuali. | Punteggio limite, fonti contrastanti, prove non obbligatorie mancanti o segnale fuori distribuzione. | Prove obbligatorie mancanti, obsolete rispetto alla politica, input non corretti o nessuna base decisionale affidabile. |
| Impatto a valle | Effetto interno e limitato senza impegno esterno. | Crea un impegno legale, finanziario, di sicurezza, cliente, operativo o multi-sistema. | Non è possibile confermare effetti a cascata o incontrollati, dipendenza vietata o contenimento. |
Umano nel loop, nel loop e al comando
Queste etichette descrivono le modalità operative. Si tratta di termini progettuali utili e non di risultati definiti dalla legge UE sull’intelligenza artificiale. Scegliere l'accordo che dia alla persona responsabile tempo, contesto e autorità sufficienti per il rischio dell'azione.
| Disposizione | Ruolo umano | La migliore vestibilità | Prova di controllo |
|---|---|---|---|
| Umano nel giro | Decide su un'azione proposta specifica prima del suo effetto collaterale. | Azioni consequenziali, difficili da revocare, eccezionali o lesive dei diritti. | L'azione rimane sospesa finché la persona giusta non esamina il contesto associato e decide prima della scadenza. |
| Umani in movimento | Monitora l'esecuzione limitata e può intervenire, mettere in pausa, invertire o intensificare. | Attività materiale ma reversibile con rilevamento affidabile e finestra di intervento testata. | Un esercizio realistico dimostra che la persona può rilevare la condizione e raggiungere lo stato sicuro prima che il danno diventi materiale. |
| Umano al comando | Possiede il mandato, la tolleranza al rischio, la politica, i limiti operativi, l'autorità di arresto, il riavvio e la responsabilità. | Ogni sistema di agenti distribuito, compresi i sistemi le cui azioni di routine non ricevono una revisione individuale. | I proprietari nominati possono cambiare autorità, sospendere il sistema, commissionare la revisione, ascoltare ricorsi e dimostrare tali decisioni. |
Utilizzare la separazione maker-checker per le azioni consequenziali
Il produttore crea o sponsorizza la richiesta. Per un'azione dell'agente, il record del produttore dovrebbe identificare l'agente, il suo proprietario responsabile, il principale richiedente e l'esatto effetto collaterale proposto. Il controllore è una persona distinta e qualificata con autorità per quella classe di azioni. Il controllore esamina le prove e sceglie di approvare, rifiutare, richiedere modifiche o eseguire l'escalation.
Applicare la separazione al momento della decisione. Il nome di un gruppo in una definizione di flusso di lavoro non dimostra che la persona che ha agito fosse idonea o indipendente. Risolvere l'identità, il ruolo, la delega, i conflitti attuali e l'origine della richiesta quando viene presa la decisione.
- Associa la richiesta. Hashing o associa in altro modo l'azione, i parametri, la destinazione, gli input delle policy e le prove del revisore in modo che l'approvazione non possa essere riprodotta per una richiesta modificata.
- Risolvere l'idoneità. Controlla l'identità del revisore, il ruolo attivo, il limite di autorità, lo stato della formazione ed eventuali conflitti o relazioni con il richiedente.
- Rendi possibile un giudizio indipendente. Mostra fatti all'origine, incertezze, limitazioni, ragioni politiche, alternative e conseguenze a valle senza preselezionare l'approvazione.
- Registra una decisione. Cattura l'identità, l'istantanea del ruolo, la decisione, la ragione, il riferimento logico, il tempo e le prove digerite dal controllore.
- Riconvalidare prima del rilascio. Rifiutare un'approvazione obsoleta quando l'azione, le prove, la politica, l'identità, l'autorità, la destinazione o lo stato aziendale rilevante sono cambiati.
- Allega il risultato. Conserva la ricevuta dell'esecuzione effettiva e l'effetto a valle sotto gli stessi identificatori di esecuzione e decisione.
Fornire al revisore il contesto necessario per decidere
Un'utile richiesta di decisione risponde alla decisione in un breve racconto, con dettagli strutturati disponibili per la verifica. Il revisore dovrebbe capire cosa accadrà, perché la politica ha indirizzato l'azione, quali fatti rimangono incerti, quale autorità detengono e quando la richiesta diventa obsoleta.
| Contesto | Contenuti utili minimi | Perché cambia la decisione |
|---|---|---|
| Azione e conseguenza | Azione esatta, obiettivo, parametri materiali, parte interessata, sistemi a valle ed effetto aziendale previsto. | Il revisore vede l'impegno che sta autorizzando. |
| Identità e autorità | Richiesta di principale, agente, proprietario responsabile, ruolo di revisore richiesto, limite di autorità e regola di maker-checker. | Il revisore può verificare se sia la richiesta che la decisione sono autorizzate. |
| Risultato politico | Risultato, regole corrispondenti, codici motivo, versione della policy, valori valutati e alternative sicure. | Il revisore vede perché l'azione è stata sospesa e quali vincoli rimangono vincolanti. |
| Evidenza e incertezza | Riferimenti alle fonti, freschezza, fatti mancanti o contrastanti, fiducia, limitazioni e aiuti interpretativi. | Il revisore può contestare la raccomandazione e riconoscere i bias di automazione. |
| Tempo e recupero | Tempo richiesto, scadenza, livello di servizio, percorso di escalation, reversibilità, percorso di compensazione e procedura di stato sicuro. | Il revisore conosce la finestra decisionale e il costo di ritardi o errori. |
Imposta livelli di servizio, scadenza, delega e riassegnazione
Un livello di servizio è un obiettivo operativo. La scadenza è un limite di autorizzazione. Impostare sia in base alle conseguenze, alla reversibilità, alla volatilità delle prove, sia al tempo disponibile per prevenire il danno. Non esiste una durata universale adatta a ogni azione.
Un arresto di emergenza deve rimanere immediatamente disponibile per un operatore autorizzato e non deve attendere dietro una coda di approvazione. Per le richieste ordinarie, le fasce di esempio riportate di seguito costituiscono punti di partenza per un seminario politico. Sostituiscili con valori specifici del sistema e testali in condizioni reali di personale.
- Delega: concede a una persona designata una classe di azione ristretta, un limite di valore, un ambiente, un periodo di validità e un percorso di escalation. Preservare chi ha delegato l'autorità.
- Riassegnazione: richiede una sostituzione idonea, registra il precedente assegnatario e il motivo e mantiene visibili la prova originale e la scadenza.
- Scadenza: invalida la capacità di approvazione. Non trasformare mai il timeout della coda in un'approvazione implicita.
- Staleness: scade anticipatamente quando cambiano gli input materiali, la politica, l'identità, la destinazione, l'importo o i parametri richiesti.
- Controllo non disponibile: blocca o blocca in base alla politica di chiusura in caso di errore dell'azione e chiama l'operatore responsabile.
| Classe | Obiettivo della risposta di esempio | Comportamento in scadenza | Azione in coda |
|---|---|---|---|
| Contenimento di emergenza | Azione immediata dell'operatore; pagina il ruolo responsabile dell'incidente. | L'autorità di arresto è di breve durata e il ripristino richiede un'approvazione corrente separata. | Evita la coda ordinaria attraverso il percorso dell'incidente regolamentato e preserva le prove di rottura del vetro. |
| Decisione pre-esecutiva consequenziale | Minuti o ore, in base alla finestra di attesa sicura. | Rifiutare l'esecuzione alla scadenza. Rivalutare ed emettere una nuova richiesta di decisione. | Passare prima della scadenza a un controllore altrettanto o più autorevole. |
| Eccezione materiale reversibile | Orari entro la giornata operativa. | Scade quando le prove o lo stato aziendale non possono più essere considerati attuali. | Riassegnare con la cronologia completa; mantenere l'assegnatario originario e la motivazione. |
| Revisione di garanzia non bloccante | Obiettivo definito del giorno lavorativo. | Chiudi o riassegna l'elemento da rivedere senza modificare l'azione già consentita. | Tieni traccia della revisione scaduta come errore di garanzia. |
Progettare esclusioni, ricorsi e arresti di emergenza come percorsi separati
Una sostituzione modifica una decisione o un output sotto autorità esplicita. Un ricorso richiede a un diverso ruolo autorizzato di rivedere una decisione. Un arresto di emergenza interrompe il funzionamento attivo o in coda e porta il sistema in uno stato sicuro definito. Combinare i tre pulsanti di amministrazione in un unico oscura l’autorità, i tempi e le prove.
| Sentiero | Autorità e tempismo | Prove richieste |
|---|---|---|
| Sostituisci | Autorità denominata per la classe di azione, con un motivo e l'eventuale regola delle due persone. Valutare prima che venga eseguita l'azione modificata. | Risultato originale, decisione sostitutiva, riferimento all'autorità, codice motivo, logica, vincolo dell'azione, tempo e stato risultante. |
| Appello | Un ruolo indipendente dalla decisione originaria laddove la politica lo richiede. Definire lo stato provvisorio sicuro e l'obiettivo della risposta. | Richiesta originale e decisione, ricorrente, motivi, revisore assegnato al ricorso, prove prese in considerazione, esito, rimedio e notifica. |
| Arresto di emergenza | L'operatore autorizzato può agire immediatamente. Il recupero segue un'approvazione separata dopo la verifica del contenimento. | Interrompere l'attore, il motivo, l'ora, l'ambito, la propagazione, il lavoro annullato e in volo, l'azione delle credenziali, il residuo a valle, lo stato sicuro e l'approvazione del riavvio. |
Riconoscere le modalità di errore del flusso di lavoro di approvazione
Può esistere una schermata di approvazione mentre il controllo fallisce. Testa il percorso completo dalla creazione della richiesta all'effetto downstream, comprese interruzioni, nuovi tentativi, picchi del carico di lavoro e ripristino.
- Approvazione: i revisori approvano troppo velocemente o ripetono ragioni identiche. Misurare la latenza, l'accordo, le sostituzioni e il carico dei revisori; utilizzare campioni indipendenti.
- Autoapprovazione: il richiedente, lo sponsor dell'agente o l'operatore in conflitto possono approvare. Risolvere identità e conflitti al momento della decisione.
- Approvazione obsoleta: prove, importo, destinazione, politica o parametri cambiano dopo la revisione. Associa e riconvalida la richiesta prima dell'esecuzione.
- Attesa orfana: nessun revisore idoneo possiede l'elemento oppure la coda lo perde. Monitorare l'assegnazione, l'invecchiamento, l'escalation e la scadenza come integrità del controllo.
- Riproduzione o esecuzione duplicata: un'approvazione rilascia diverse chiamate o un nuovo tentativo ripete l'effetto collaterale. Utilizzare decisioni monouso e chiavi di idempotenza.
- Effetto a valle parziale: un'azione composta da più fasi fallisce dopo un impegno esterno. Registra ogni effetto ed esegui il percorso di compensazione o incidente.
- Prova scritta troppo tardi: l'effetto collaterale si manifesta prima che la politica o il record di approvazione siano duraturi. Fail chiuso quando non è possibile scrivere il record richiesto.
- Falso arresto: l'interfaccia indica interrotto mentre i lavoratori, le code, le credenziali o i tentativi continuano. Testare la propagazione e riconciliare ogni operazione in volo.
Esempio pratico: una disposizione creditizia sintetica
Lo schema del registro di controllo dell'agente AI pubblico include un record sintetico completo per un agente di revisione del credito che propone un aggiornamento della disposizione EUR 24,000. L'esempio mostra come l'approvazione si collega all'effettivo effetto a valle. Le figure e le identità sono sintetiche.
| Palcoscenico | Record osservato | Controllare il significato |
|---|---|---|
| Richiesta | Un agente di revisione del credito propone credit.application.set_disposition per un'applicazione tokenizzata all'interno di un limite dati di credito UE limitato. | Le versioni richieste di azione, scopo, risorsa, importo, ambiente, versione dell'agente, modello, prompt e orchestratore sono associate a un'unica esecuzione. |
| Politica | La versione della polizza 4.2.1 corrisponde a manual-review-above-20000 e restituisce require_approval con il motivo amount_requires_senior_underwriter. | L'importo in EUR 24,000 supera il limite del produttore. L'esecuzione rimane sospesa per il ruolo senior_underwriter richiesto. |
| Contesto del revisore | La richiesta di decisione contiene l'esatto contesto dell'azione, il risultato della politica, l'ambito dei dati limitati, le versioni dei componenti e una sintesi delle prove presentate. | Il controllore può verificare la richiesta e rilevare la successiva sostituzione del pacchetto prove. |
| Scadenza | La richiesta viene creata alle 09:14:29 UTC e scade alle 10:14:29 UTC. | L'autorità di approvazione dura un'ora. L'esecuzione successiva a quel punto richiede una richiesta appena valutata. |
| Decisione | Un sottoscrittore senior autenticato dalla forza lavoro approva alle 09:14:31 UTC con motivo verificato_applicazione_prova e un riferimento alla motivazione. | Il record vincola il revisore, il ruolo richiesto, la decisione, la ragione, la sintesi delle prove e il tempo. |
| Esecuzione | La chiamata allo strumento governato inizia dopo l'approvazione, utilizza una chiave di idempotenza e ha esito positivo con i digest di argomenti e risultati. | L'approvazione precede l'effetto collaterale dello strumento e può rilasciare solo l'azione associata. |
| Effetto a valle | Il record sintetico del core-banking riporta credit_disposition_updated con sintesi prima e dopo lo stato. | Il percorso di approvazione comporta un record esplicito dei risultati aziendali dopo la decisione politica. |
| Prova | La derivazione ordinata unisce gli eventi di richiesta, policy, approvazione, strumento e completamento. Il record collega gli artefatti della policy e dello strumento e riporta un risultato di verifica dell'integrità valido. | Un revisore può testare l'ordine, l'identità, il vincolo dell'azione, il risultato e l'integrità della registrazione. La completezza della fonte rimane un test di garanzia separato. |
Utilizzare uno schema di prova minimo
Utilizza identificatori stabili e campi leggibili dalla macchina in modo che un revisore o un auditor possa unire la decisione all'esecuzione senza fare affidamento su timestamp o screenshot. KLA pubblica uno schema JSON, esempi e verificatore indipendente dal fornitore per questo record.
| Gruppo di prove | Campi minimi | Risposta alla domanda |
|---|---|---|
| Busta e ambito | versione_schema, event_id, si è verificato, registrato_a, sequenza, correlazione_id, esecuzione_id, organizzazione, ambiente, classe di conservazione | Quali record e confini operativi sono in fase di revisione? |
| Attori e versioni | richiedente, agente, accountable_owner, utente delegato o identità del servizio, rilascio dell'agente, modello, prompt, orchestratore | Chi o cosa ha agito, sotto la responsabilità di chi, utilizzando quali versioni? |
| Azione richiesta | azione, scopo, risorsa, limite dati, importo se rilevante, destinazione, request_at, digest degli argomenti | Quale esatto effetto collaterale è stato proposto? |
| Politica | decision_id, policy_id e versione, policy e input digest, consenti o avvisa o richiedono_approvazione o blocca, regole corrispondenti, codici motivo, rated_at | Perché il controllo ha prodotto questo risultato? |
| Approvazione | request_id, request_at, scade_at, require_role, raccolta delle prove presentate, revisore, decisione, motivo, riferimento logico, deciso_at, riassegnazione, override o ricorso quando utilizzato | Un essere umano idoneo ha deciso in base alle prove attuali prima dell'esecuzione? |
| Esecuzione ed effetto | strumento e versione, chiave di idempotenza, ora di inizio e completamento, digest dei risultati, riferimenti agli effetti downstream, digest prima e dopo, risultato aziendale, rollback o riferimento all'incidente | Cosa è stato eseguito e cosa è cambiato al di fuori del piano di controllo? |
| Lignaggio e integrità | ID evento ordinati, manifest delle prove e sintesi degli artefatti, trattamento della privacy, hash del record, firma, stato di verifica e codici di errore | È possibile riprodurre il record, gestirlo correttamente e verificarne la presenza di modifiche? |
Come KLA implementa il percorso di controllo dell'approvazione
Il Piano di controllo dell'KLA governa le azioni degli agenti strumentati. Il KLA Policy Engine valuta la chiamata di uno strumento proposto rispetto alle regole pubblicate e restituisce allow, warn, require_approval o block. Un risultato require_approval mantiene l'invito proposto e crea una Richiesta di decisione per Decision Desk. Un blocco impedisce alla chiamata governata di raggiungere lo strumento.
Per le richieste decisionali sul piano di controllo, Decision Desk controlla l'autorizzazione decisionale, il ruolo di revisore richiesto, lo stato in sospeso, l'identità del richiedente e del produttore e il tempo dovuto. Impedisce ai richiedenti e ai creatori registrati di decidere la propria richiesta e rifiuta le azioni di approvazione o rifiuto dopo il tempo dovuto. Un controllore idoneo può inoltrare una richiesta scaduta. Registra l'attore decisionale, l'istantanea del ruolo, il risultato, la ragione e il tempo. Questi controlli di separazione e scadenza si basano sulla richiesta che trasporta le identità attuali del produttore e una scadenza. Assicurarsi che ogni percorso di produzione li fornisca e testare l'intero percorso di controllo.
Lineage Explorer e Audit Trail espongono i record di policy, decisioni umane ed esecuzione. Evidence Room può raggruppare i record selezionati in un Sealed Evidence Bundle con firme, hash degli artefatti e una radice Merkle che supporta i controlli di integrità offline. L'organizzazione possiede ancora la classificazione delle azioni, la competenza del revisore, il personale, l'analisi legale, la strumentazione completa, la completezza della fonte, l'intervento su ogni lavoratore e sistema a valle e la progettazione dello stato sicuro.
Riferimenti tecnici
Leggi i contratti dei componenti e il record di esecuzione unita dietro il percorso di approvazione qui descritto.
Fonti primarie e freschezza
Revisione della fonte completata 28 luglio 2026. L'articolo 14 della legge UE sull'intelligenza artificiale richiede un'efficace supervisione umana per i sistemi di intelligenza artificiale ad alto rischio e il monitoraggio dei nomi, la consapevolezza dei bias di automazione, l'interpretazione, il disprezzo, l'override, l'inversione, l'intervento e le capacità di interruzione sicura. Articolo 26(2) impone agli operatori di sistemi ad alto rischio di affidare la supervisione a persone dotate della competenza, della formazione, dell'autorità e del supporto necessari. Considerando 73 spiega il ruolo dell'intervento informato e dei vincoli operativi incorporati.
Il regolamento (UE) 2026/1744 ha modificato le date di applicazione delle norme ad alto rischio del Capo III in 2 dicembre 2027 per i sistemi articolo 6(2) e allegato III e 2 agosto 2028 per i sistemi articolo 6(1) e allegato I. Non ha sostituito il testo di controllo dell'articolo 14.
Il NIST AI RMF Core richiede ruoli differenziati tra uomo e intelligenza artificiale, processi di supervisione documentati, revisione indipendente e meccanismi di ricorso, override, smantellamento, risposta agli incidenti e ripristino. Appendice C del NIST rileva che la necessità di una supervisione umana dipende dal contesto. Il Principio dell’OCSE sull’intelligenza artificiale sui valori incentrati sull’uomo richiede garanzie di intervento umano e di supervisione adeguate al contesto e allo stato dell’arte.
La tabella dei quattro risultati, il quadro dei sette input, gli esempi dei livelli di servizio e lo schema delle prove presenti in questa guida sono modelli di implementazione. Non prevedono una soglia legale universale. Riconfermare la legge applicabile, le linee guida normative, le norme di settore, i fatti del sistema e il testo sorgente attuale prima di fare affidamento su di essi.
Domande frequenti
Quali azioni degli agenti IA richiedono l'approvazione umana?
Richiedere l'approvazione quando un'azione è materiale, difficile da annullare, lesiva dei diritti, delicata, nuova, vicina a un limite di autorità, con scarsa fiducia o in grado di creare un effetto a valle significativo. Blocca azioni proibite, non autorizzate, obsolete, non valide o non verificabili.
Qual è la differenza tra umano nel ciclo, umano nel ciclo e umano al comando?
L'essere umano nel ciclo decide un'azione specifica prima dell'esecuzione. L'essere umano in loop monitora l'attività limitata e può intervenire all'interno di una finestra testata. L'uomo al comando possiede il mandato, i limiti, le politiche, l'autorità di arresto, il riavvio e la responsabilità del sistema.
Come dovrebbe funzionare la separazione maker-checker per un agente AI?
Identificare l'agente, il proprietario responsabile e il principale richiedente come produttore. Instradare la richiesta associata esatta a un controllore qualificato distinto. Verifica identità, ruolo attuale, autorità, delega e conflitti quando il controllore decide, quindi riconvalida la richiesta prima dell'esecuzione.
Di quale contesto ha bisogno un revisore di agenti AI?
Mostra l'azione e le conseguenze esatte, l'identità del richiedente e dell'agente, i limiti di autorità, il risultato e le ragioni della politica, le prove e l'aggiornamento della fonte, l'incertezza e le limitazioni, le alternative, la scadenza, il percorso di escalation e il percorso di ripristino.
Quando dovrebbe scadere l'approvazione?
L'approvazione scade quando termina il periodo di conservazione sicura o quando cambiano prove materiali, policy, identità, autorità, destinazione, importo, parametri o stato aziendale. Una richiesta scaduta non deve essere eseguita; valutare nuovamente l'azione ed emettere una nuova richiesta.
Un essere umano può ignorare una decisione di blocco?
Un revisore non deve convertire un'azione vietata in un'approvazione all'interno della stessa richiesta. Un’eccezione di emergenza legittima necessita di un percorso politico separato, ristretto e limitato nel tempo, con autorità nominata, motivazione, prove, limiti di contenimento e revisione retrospettiva.
Come dovrebbero funzionare i ricorsi e i fermi di emergenza?
Indirizzare un appello al ruolo indipendente definito dalla politica e mantenere il sistema in uno stato provvisorio sicuro. Consentire a un operatore autorizzato di invocare immediatamente un arresto di emergenza, registrare la propagazione e i residui e richiedere un'approvazione corrente separata prima del riavvio.
Cosa dimostra che l'approvazione è avvenuta prima dell'esecuzione?
Utilizza un record correlato con eventi di richiesta ordinata, politica, approvazione, strumento e completamento. Associa l'azione e le prove con i riassunti, l'autorità del revisore del record e la scadenza, utilizza una chiave di idempotenza, allega la ricevuta downstream e verifica l'integrità del record.
Punti chiave
Un utile controllo di approvazione fornisce a ogni azione consequenziale un risultato chiaro, mantiene in sospeso la richiesta esatta quando è necessario un giudizio, fornisce al controllore contesto e autorità sufficienti, fa scadere le decisioni obsolete e attribuisce il reale effetto a valle al record delle prove. Scarica il playbook del flusso di lavoro di approvazione dell'agente AI per definire le regole per un'azione, quindi testare il percorso completo in condizioni normali, scadute, riassegnate, duplicate, di interruzione e di arresto di emergenza.
