Un martedì pomeriggio, l’agente dell’assistenza dice a un cliente che può restituire un ordine personalizzato fuori termine. Non può: quella regola non esiste. Qualcuno del team se ne accorge leggendo la conversazione e la reazione è quasi universale: aprire i log e capire perché l’abbia detto. È la mossa più naturale e quella che prolunga di più il danno.
La tesi in una riga: quando un agente IA sbaglia con un cliente, l’ordine giusto è contenere, delimitare la portata, avvisare e solo dopo diagnosticare. Quasi tutti partono dalla fine e, mentre diagnosticano, l’agente continua a rispondere.
Cosa fare quando un agente IA sbaglia: contenere prima di diagnosticare
Diagnosticare richiede ore; contenere richiede minuti. Mentre cerchi la causa, l’agente resta in produzione con le stesse istruzioni, gli stessi dati e gli stessi strumenti che hanno prodotto l’errore: ogni nuova conversazione è un’altra occasione per ripeterlo. Contenere non è riparare: è ridurre ciò che l’agente può fare finché non sai cos’è successo. E deve essere reversibile, perché lo farai di fretta e senza diagnosi.
Le opzioni, dalla meno alla più drastica:
- Abbassare la sua autonomia. Passarlo a «propone, una persona invia». Il servizio resta attivo e il danno nuovo si ferma. È possibile solo se hai definito prima una scala di livelli di autonomia di un agente.
- Togliergli lo strumento che ha causato il danno. Se ha promesso un rimborso, gli si toglie il permesso di rimborsare; se ha scritto nel CRM, lo si lascia in sola lettura. È il vantaggio pratico di aver ragionato bene sui permessi di un agente IA.
- Passare a una persona gli argomenti coinvolti, con un messaggio fisso e onesto: «Ti risponde una persona del team».
- Spegnerlo del tutto. Ultima risorsa, ma legittima. Richiede un interruttore con un nome e qualcuno autorizzato a premerlo senza chiedere il permesso a tre persone.
La regola: premi il pulsante più piccolo che ferma il danno. Anche un agente spento è un incidente, solo visibile.
Quanti altri clienti hanno ricevuto la stessa risposta sbagliata
È la domanda per cui quasi nessuno è preparato e quella che decide la gravità reale. Un errore isolato e uno schema ricorrente non si gestiscono allo stesso modo, e dalla conversazione di un solo cliente è impossibile sapere quale dei due hai. Delimitare la portata significa rispondere con i dati a tre domande:
- Quanti sono stati esposti: le conversazioni in cui l’agente ha detto la stessa cosa o qualcosa di equivalente, dalla prima volta in cui poteva accadere fino al momento del contenimento.
- Quanti hanno agito di conseguenza: chi ha chiesto il reso, accettato un termine o preso una decisione basandosi su quella risposta.
- Quanti hanno un impegno con denaro o scadenza: gli unici che richiedono oggi una risposta individuale.
Niente di tutto questo è possibile se le conversazioni non vengono conservate e non sono ricercabili. La conservazione dei log si decide di solito per costi di archiviazione o privacy, senza pensare a questo momento; meglio deciderla sapendo che è ciò che ti permette di contare le persone coinvolte, come spiega per quanto tempo conservare il log del tuo agente. Un buon criterio di partenza: la finestra da esaminare inizia dall’ultima modifica dell’agente (istruzione, fonte dati o modello), non dal primo reclamo.
Avvisare: chi, quando e con quale messaggio
Avvisare viene prima della diagnosi, perché il cliente coinvolto lo scoprirà comunque ed è meglio che lo scopra da te. Non serve conoscere la causa per dire l’essenziale: cosa è successo, cosa vale e cosa no, e cosa farai. Tre destinatari, tre momenti:
| Chi | Quando | Cosa gli dici |
|---|---|---|
| Chi decide in azienda (direzione o responsabile del servizio) | Appena confermi un errore con impatto | Cosa ha detto l’agente, da quando, a quanti e cosa hai contenuto |
| Clienti con un impegno di denaro o di scadenza | Il prima possibile, singolarmente, dopo aver delimitato la portata | Che l’informazione era sbagliata, qual è quella corretta e come si risolve |
| Tutti gli altri esposti | Solo se hanno agito sulla risposta o l’argomento è delicato | Una correzione breve, senza drammi |
Due cose che non funzionano: aspettare la causa radice per scrivere al cliente e mandargli un comunicato su «un problema tecnico». Digli cosa ha detto l’agente e cosa è corretto. Mantenere o no ciò che l’agente ha promesso per errore è una decisione di business, presa in modo consapevole dalla persona giusta; ciò che non deve succedere è che la prenda l’agente per impostazione predefinita.
Bisogna avvisare se l’errore ha toccato un solo cliente?
Sì: quel cliente e chi decide in azienda. Cambia il resto: con un caso confermato come isolato dopo aver delimitato la portata, basta una correzione individuale. Ma «isolato» è una conclusione che si dimostra con la ricerca di cui sopra, non un’ipotesi da cui si parte.
Solo dopo: diagnosticare senza riaprire il problema
Con il danno fermato e i coinvolti identificati, la diagnosi non corre più contro il tempo. Cerca la causa in quest’ordine, dal meno al più costoso: l’istruzione (era ambigua o contraddittoria?), la fonte di informazione (un documento obsoleto, una pagina cambiata?), lo strumento (ha restituito un dato errato?) e, per ultimo, il modello. Quasi mai è il modello, ed è l’ipotesi a cui si salta per prima.
Resta un rischio: correggere e riattivare lo stesso giorno. La correzione è una modifica in più e va provata prima di toccare la produzione, con la conversazione che è fallita come primo test. Poi l’autonomia si restituisce a gradini, non tutta insieme.
Le prime due ore, in sintesi
| Fase | Cosa fai | Cosa non fai |
|---|---|---|
| Minuti 0-15 | Contenere: abbassare l’autonomia, togliere lo strumento o passare a una persona | Cercare la causa |
| Minuti 15-60 | Delimitare: contare esposti, coinvolti e impegni di denaro | Dare per scontato un caso isolato |
| Minuti 60-90 | Avvisare: prima chi decide, poi i clienti con impegni | Aspettare la causa radice per comunicare |
| Minuti 90-120 | Iniziare a diagnosticare a danno fermato | Riattivare senza provare la correzione |
Cosa deve essere pronto prima che succeda
Due ore sono possibili solo se i pezzi esistevano prima: un interruttore con un nome e qualcuno autorizzato a usarlo, un registro delle conversazioni consultabile, un elenco di chi avvisare e una bozza di messaggio. Se ci pensi per la prima volta alle sei di sera, saranno più di due ore. Reperibilità, livelli di gravità e il runbook di una pagina che mettono ordine sono in chi risponde quando un’automazione si ferma, e se preferisci non montarlo né sostenerlo tu, è quello che facciamo con la gestione degli incidenti degli agenti IA.
La frase da portarsi via: che un agente sbagli è normale; che continui a sbagliare mentre tu scopri perché, no.