Supervisionare un agente AI, giorno per giorno, significa aver deciso in anticipo tre cose: che cosa l'agente deve segnalarti, che cosa può prepararti come proposta e che cosa richiede sempre la tua decisione esplicita. In concreto la supervisione è fatta di notifiche leggibili, soglie scritte e persone reperibili che approvano o rifiutano: la raccolta dei segnali e la preparazione delle analisi restano all'agente, la decisione resta a te.

Notifica, proposta, decisione: i tre livelli della supervisione

Il modo più semplice per intendere la supervisione umana è dividerla in tre livelli, che convivono ogni giorno:

  • Notifica. L'agente osserva e riferisce: cosa è successo, dove, con quali evidenze. Non cambia nulla. La maggior parte del lavoro quotidiano sta in questo livello.
  • Proposta. L'agente prepara un possibile intervento e lo spiega: piano, sistemi coinvolti, conseguenze attese, informazioni ancora mancanti. Anche qui non viene eseguito nulla.
  • Decisione. Una persona approva o rifiuta. L'intervento attivo parte solo dopo l'approvazione prevista, e un rifiuto è un esito legittimo quanto un sì.

Il terzo livello è il cuore della supervisione: se il passaggio dalla proposta all'azione non richiede una scelta umana, la supervisione è solo dichiarata. Nel modello di OverZeus il principio è esplicito: l'assenza di risposta non viene interpretata come autorizzazione. Se nessuno risponde, l'intervento non parte e il caso resta aperto finché qualcuno non decide.

Le soglie: cosa può essere segnalato e cosa richiede un sì

La domanda pratica è: dove metto la linea? Un criterio utile incrocia due dimensioni: l'impatto dell'azione (quante persone, sistemi o dati tocca) e la sua reversibilità (quanto è facile tornare indietro). Segnalare che un disco si sta riempiendo sta sotto la linea: basta una notifica. Ripristinare la configurazione precedente di un servizio secondario può stare sulla linea: proposta con approvazione rapida. Toccare account, dati o controlli di sicurezza sta sempre sopra la linea.

Alcune decisioni, invece, non dovrebbero mai essere delegate all'agente, neanche con una richiesta di conferma frettolosa:

  • Decisioni sulle persone: sospendere o bloccare l'account di un dipendente, limitarne gli accessi, attribuirgli un comportamento scorretto. L'agente può raccogliere evidenze, ma la valutazione spetta a un responsabile.
  • Azioni irreversibili o quasi: cancellazioni di dati, modifiche ai controlli di sicurezza, cambi alle policy che regolano gli agenti stessi.
  • Interventi su sistemi critici per la produzione: fermare o riavviare ciò che tiene in piedi il lavoro richiede una valutazione che include fattori che l'agente non vede, come impegni con i clienti o attività in corso.
  • Tutto ciò che esce dal perimetro concordato: se un intervento non era previsto dal piano, la risposta corretta dell'agente è fermarsi e chiedere, non improvvisare.

Le soglie vanno scritte, non improvvisate: chi può modificarle, con quale procedura e con quale registrazione. Se alzare o abbassare una soglia è un'operazione senza traccia, la supervisione si indebolisce proprio dove dovrebbe essere più forte.

Organizzare la supervisione senza rallentare tutto

Il timore più frequente è che la supervisione umana trasformi ogni evento in una riunione. In realtà il collo di bottiglia nasce solo se le soglie sono sbagliate. Alcune scelte organizzative fanno la differenza:

  • Poche richieste, ben fatte. Se tutto richiede approvazione, le approvazioni diventano automatiche e la supervisione si svuota. Le richieste di sì devono essere rare, motivate e complete di contesto.
  • Turni e reperibilità nominativi. Ogni fascia oraria ha una persona identificata che può decidere, con un sostituto. Non «il team»: un nome.
  • Definire cosa può attendere. Non tutto ciò che accade di notte è urgente. Concorda in anticipo quali casi possono restare in osservazione fino al mattino e quali giustificano una chiamata.
  • Deleghe esplicite. Chi approva cosa, entro quali limiti, in assenza di chi. La delega va documentata come qualsiasi altro potere.

Come riferimento per impostare questo lavoro esiste il NIST AI Risk Management Framework, un quadro volontario del National Institute of Standards and Technology statunitense per incorporare l'affidabilità dei sistemi di intelligenza artificiale in progettazione, uso e valutazione. Non è una legge né una certificazione: è una base per organizzare domande su governance, misura e gestione del rischio. Vale anche una nota di perimetro normativo: nell'AI Act europeo la supervisione umana è un obbligo per i sistemi classificati ad alto rischio, con applicazione prevista dal 2 dicembre 2027 secondo la pagina della Commissione europea. Un agente interno per le operations di sicurezza, di norma, non rientra in quella categoria: per questi casi la supervisione è oggi una scelta di buona governance, non un adempimento legale, e va valutata caso per caso.

Esempio illustrativo: la domenica sera delle spedizioni

Esempio illustrativo. Lo scenario seguente è inventato per mostrare il meccanismo; non descrive un evento reale né un cliente.

Un'azienda logistica ha concordato le sue soglie: gli errori di un servizio vengono segnalati sopra un certo numero; il ripristino di una versione precedente richiede sempre un sì del reperibile; la modifica di qualsiasi regola di rete richiede il responsabile IT, non il reperibile generico. Una domenica sera l'agente rileva che il server delle spedizioni accumula errori dopo un aggiornamento del pomeriggio. Primo livello: notifica al reperibile, con andamento degli errori e collegamento temporale con l'aggiornamento. Secondo livello: proposta di ripristino della versione precedente, con sistemi coinvolti, durata stimata e rischio di perdere le etichette generate nel frattempo. Terzo livello: il reperibile legge, verifica che i magazzini notturni non stiano lavorando e approva dall'app. L'intervento viene eseguito nei limiti approvati e l'esito torna al responsabile.

La stessa sera, in uno scenario alternativo, il reperibile non risponde: il sistema non agisce, mantiene l'osservazione, aggiorna la stima dei servizi a rischio e presenta il caso al primo responsabile disponibile la mattina, con tutto il contesto raccolto. Anche questa è supervisione che funziona: il mancato intervento era previsto dalle regole, non un'improvvisazione.

Chi è responsabile quando l'umano approva

Quando una persona approva una proposta, la responsabilità della decisione resta sua e dell'organizzazione: l'approvazione non è una formalità che trasferisce la scelta al sistema. Proprio per questo la proposta deve essere comprensibile prima del sì — piano, conseguenze, informazioni mancanti — e la decisione deve restare registrata con la sua motivazione. Approvare senza contesto sufficiente equivale a non supervisionare.

In OverZeus questa catena è sostenuta da due agenti. Hermes è l'app dei responsabili: riceve le segnalazioni dal server locale, spiega gli interventi proposti e raccoglie approvazioni o rifiuti, anche da remoto tramite un collegamento VPN su connessione 5G cifrata proprietaria — un canale che richiede connettività, distinto dall'operatività locale del sistema nel CED aziendale. Themis applica privilegi, approvazioni e limiti operativi attraverso controlli esterni al modello AI: verifica che un intervento autorizzato rispetti destinatario, risorse, operazioni e durata dell'autorizzazione, e blocca ciò che non è più valido. La ricostruzione completa di chi ha deciso cosa è un tema a sé, trattato nell'articolo sulla tracciabilità delle azioni degli agenti; la distinzione di responsabilità tra proposta e approvazione è approfondita in l'agente propone, l'umano approva: chi risponde di cosa.

Da dove partire

Se stai introducendo agenti AI in processi sensibili, parti da tre elenchi scritti: le notifiche che vuoi ricevere, le proposte che l'agente può preparare, le azioni che richiedono sempre un sì. Aggiungi i nomi di chi decide, fascia per fascia. La supervisione umana non è un freno all'automazione: è la condizione che la rende sostenibile nel tempo, perché mantiene chiara la responsabilità proprio quando il sistema propone di agire.

Guarda come vengono presentati e autorizzati gli interventi degli agenti.

Contattaci per una dimostrazione

Contenuto realizzato con assistenza AI. Gli scenari descritti sono esempi illustrativi.

Tutti gli articoli OverZeus