take two.

Take Two · AI nelle attività IT

Creare un report settimanale sugli incidenti IT dei negozi

Un report settimanale che distingue alert e incidenti, casi aperti e risolti, tempi e cause confermate.

Take Two · · 4 min di lettura

Il numero di alert non coincide con il numero di incidenti. Un servizio può generare decine di notifiche durante lo stesso problema, mentre un singolo guasto può coinvolgere più casse. Per preparare un report utile occorre prima definire cosa contare e come misurare i tempi.

L’automazione raccoglie ticket ed eventi, li collega agli episodi operativi e calcola le misure. L’AI può riassumere i risultati e organizzare le attività successive, conservando le incertezze sulle cause.

Un registro di esempio

Questo esempio usa dati fittizi e un intervallo di osservazione dalle 00:00 del 5 ottobre alle 00:00 del 12 ottobre 2026, Europe/Rome, con termine escluso. Per la prova, ogni riga rappresenta un incidente distinto; in produzione la correlazione va verificata.

Incidente Negozio Inizio Fine Evidenza disponibile
INC101 ST017 5 ottobre 09:00 5 ottobre 09:30 Servizio ripristinato dopo riavvio; causa non confermata
INC102 ST017 6 ottobre 14:00 6 ottobre 14:45 Interruzione di rete confermata nel ticket
INC103 ST018 11 ottobre 23:50 Aperto al termine Invio dati in ritardo; verifica in corso

INC101 e INC102 durano rispettivamente 30 e 45 minuti. INC103 ha dieci minuti osservati nel periodo e resta aperto: quei dieci minuti non rappresentano la durata finale.

Misure che rispondono a domande diverse

Il report contiene tre incidenti iniziati nel periodo, due risolti entro il termine e uno ancora aperto. La durata media dei due risolti è 37,5 minuti, misurata dall’inizio al ripristino registrato. Il conteggio degli aperti deve includere anche eventuali incidenti iniziati prima del periodo e ancora attivi, che qui non sono presenti.

La somma delle durate osservate delle tre righe è 85 minuti. Non è automaticamente il tempo totale di indisponibilità del business: due incidenti possono sovrapporsi o interessare lo stesso servizio. Per calcolare un tempo di indisponibilità devi conoscere il perimetro coinvolto e unire gli intervalli sovrapposti secondo quella definizione.

Non trasformare queste durate in vendite perse: servirebbero dati e un metodo specifico per stimare l’impatto commerciale.

Collegare ticket, alert e ripristini

Il flusso normalizza gli orari, correla gli eventi tramite identificativi stabili e mantiene il riferimento ai ticket sorgenti. Una chiusura amministrativa del ticket può avvenire dopo il ripristino: salva distintamente l’orario di ripristino, quando verificato, e quello di chiusura.

Il riavvio che precede il recupero è un’azione eseguita, non necessariamente la causa del problema. Registra quindi separatamente sintomo, intervento, causa confermata e verifica ancora aperta. Se un ticket non contiene una causa, il report deve conservarne l’assenza.

Il prompt per la sintesi settimanale

Prepara un commento operativo usando le metriche e le righe allegate.
3 incidenti iniziati nel periodo; 2 risolti; 1 aperto al termine.
Durata media dei 2 risolti: 37,5 minuti dall'inizio al ripristino.
INC103 è aperto, con 10 minuti osservati nel periodo.

Separa fatti, cause confermate e verifiche da completare.
Non sommare le durate come indisponibilità complessiva.
Non dedurre impatto economico o cause mancanti.
Indica il numero di casi usato per ogni media.
Riporta identificativi degli incidenti a sostegno delle osservazioni.

Un commento di riferimento è:

Nel periodo sono iniziati tre incidenti. Due risultano ripristinati, con durata media di 37,5 minuti su due casi. INC103 resta aperto al termine dell’osservazione. Il ticket INC102 conferma un’interruzione di rete; per INC101 il ripristino dopo riavvio non chiarisce la causa. Completare la verifica di INC101 e aggiornare lo stato di INC103.

Prove prima di rendere il report periodico

Usa casi con incidenti a cavallo della settimana, ticket duplicati, orari mancanti e intervalli sovrapposti. Un incidente aperto non deve entrare nella media delle durate finali. Un problema precedente alla settimana può essere escluso dai nuovi incidenti ma incluso negli aperti e nella durata osservata del periodo.

Ogni report deve indicare periodo, orario di estrazione e copertura delle fonti. Conserva i collegamenti ai ticket con i permessi appropriati, così chi legge può verificare le conclusioni e assegnare le azioni successive.

Per esercitarti a fornire dati e criteri di verifica all’AI, puoi seguire il mini corso gratuito di prompt engineering, aperto senza registrazione.

Continua a esplorare