# Runbook di gestione operativa AI

Rendi chiaro chi osserva il sistema e cosa fa quando il lavoro si ferma o peggiora. Monitorare significa anche accorgersi dei casi che non arrivano, non solo degli errori segnalati.

Revisione: 2026-09-24

## Quando usarlo

Prima del passaggio in produzione e quando si definisce il supporto continuativo tra azienda e partner di implementazione.

## Risultato atteso

Istruzioni accessibili al personale incaricato: segnali, allarmi, diagnosi iniziale, ripristino e revisione periodica.

## 1. Definisci cosa osservare

Collega i segnali a un risultato operativo. Un processo può rispondere tecnicamente senza completare il lavoro previsto o senza ricevere tutti gli input.

### Salute del flusso e dati attesi

Indica ultimo evento, casi ricevuti e conclusi, coda, latenza e controllo di assenza anomala degli input.

________________

### Qualità e lavoro residuo

Definisci controlli su errori, correzioni umane, fonti mancanti e casi trasferiti alla gestione manuale.

________________

### Consumo e limiti operativi

Specifica volumi e costi osservabili, chi controlla gli scostamenti e quali limiti richiedono un intervento.

________________

> Esempio illustrativo, da sostituire: Esempio ipotetico: nessun errore registrato ma zero richieste elaborate in una mattina normalmente attiva. Verificare l’ingresso email prima di concludere che il servizio funzioni.

## 2. Rendi gli allarmi azionabili

Ogni allarme deve avere un destinatario e una prima azione. Definisci tempi e copertura concordati senza presumere disponibilità continua del team.

### Segnale, soglia e destinatario

Per ogni allarme scrivi la condizione osservabile, il ruolo avvisato e il canale presidiato.

________________

### Primi controlli e accessi

Elenca dashboard, riferimenti ai log e verifiche non distruttive; non includere segreti.

________________

### Escalation e contenimento

Indica quando chiamare il referente successivo, limitare il flusso o attivare il percorso manuale.

________________

> Esempio illustrativo, da sostituire: Esempio ipotetico: per una coda in crescita, controllare connessione ERP e capacità dei revisori. Se la causa è un blocco ERP, sospendere le scritture e preservare la coda.

## 3. Mantieni il servizio

Il runbook deve essere utilizzabile anche da un sostituto. Verifica periodicamente che link, permessi, fonti e persone indicate siano ancora validi.

### Ripristino e verifica finale

Descrivi come ripartire, riconciliare casi pendenti e controllare effetti parziali o duplicati.

________________

### Revisioni e manutenzione prevista

Elenca controlli su versioni, accessi, fonti, dataset di prova e capacità del servizio.

________________

### Registro interventi e aggiornamento

Indica dove annotare incidenti, modifiche e responsabile della revisione di queste istruzioni.

________________

> Esempio illustrativo, da sostituire: Esempio ipotetico: dopo il ripristino ERP, confrontare richieste e bozze create prima di svuotare la coda. Aggiornare il runbook con il passaggio che ha risolto il guasto.

## Errori da evitare

- Mandare allarmi a una casella che nessuno presidia.

- Misurare disponibilità tecnica senza verificare completamento e qualità.

- Vendere supporto continuativo senza definire copertura, confini e responsabilità.

Stolen Orbit — https://stolenorbit.com/it/modelli/gestione-operativa-ai/

