Le funzionalità di avviso e di chiamata di Opsgenie sono ora disponibili in Jira Service Management e Compass. Esegui la migrazione dei dati e delle configurazioni di Opsgenie esistenti prima del 5 aprile 2027 utilizzando il nostro strumento di migrazione automatica.Scopri di più
MTBF, MTTR, MTTA, MTTF
Capire alcune delle metriche più comuni sugli imprevisti
Nel mondo sempre attivo di oggi, le interruzioni e gli imprevisti tecnici hanno più peso che mai. I problemi e il tempo di inattività provocano conseguenze concrete: scadenze mancate e ritardi nei pagamenti e nelle consegne dei progetti sono tutti aspetti del costo legato al tempo di inattività.
Ecco perché è importante che le aziende quantifichino e monitorino le metriche relative a tempo di attività, tempo di inattività e velocità ed efficacia con cui i team risolvono i problemi.
Alcune delle metriche più comunemente monitorate del settore sono:
Tempo medio tra i guasti (MTBF), che misura il tempo operativo medio tra i guasti del sistema.
Formula: MTBF = Tempo operativo totale ÷ Numero di guasti
Tempo medio di riparazione, risoluzione, risposta o ripristino (MTTR), che misura la velocità con cui un sistema o servizio viene ripristinato dopo un guasto.
Formula: MTTR = Tempo di inattività totale ÷ Numero di imprevisti
Tempo medio al verificarsi di un guasto (MTTF), che si concentra sulla durata prevista di un sistema non riparabile prima che si guasti.
Formula: MTTF = Tempo operativo totale ÷ Numero di guasti (per sistemi non riparabili)
Tempo medio di riconoscimento (MTTA), che misura il tempo necessario a un team per riconoscere un imprevisto o rispondere.
Formula: MTTA = Tempo di riconoscimento ÷ Numero di imprevisti
Molti esperti sostengono che queste metriche non siano poi così utili da sole perché non consentono di porre domande più complesse su come vengono risolti gli imprevisti, su cosa funziona e cosa no e in che modo, quando e perché la gravità dei ticket aumenta o si riduce.
D'altra parte, MTTR, MTBF e MTTF possono rappresentare buona baseline o un punto di riferimento efficace per avviare conversazioni che conducono a domande più approfondite e importanti.
Una precisazione sull'MTTR
Per quanto riguarda l'MTTR, è facile dare per scontato che si tratti di una singola metrica con un unico significato. Tuttavia, la verità è che rappresenta potenzialmente quattro diverse misurazioni. La R può essere sinonimo di risoluzione, risposta, riparazione o ripristino e, sebbene le quattro metriche si sovrappongano, ciascuna assume una sfumatura di significato propria.
Quindi, se il tuo team sta parlando del monitoraggio dell'MTTR, è utile chiarire a quale MTTR sta facendo riferimento e in che modo lo sta definendo. Prima di iniziare a monitorare i successi e gli insuccessi, il tuo team deve essere informato esattamente su ciò che stai monitorando e assicurarsi che tutti sappiano che stanno parlando della stessa cosa.
MTBF: tempo medio tra guasti
Che cos'è il tempo medio tra guasti?
L'MTBF è il tempo medio che trascorre tra i guasti riparabili di un prodotto tecnologico. Questa metrica viene utilizzata per monitorare sia la disponibilità che l'affidabilità di un prodotto. Quanto maggiore è il tempo che intercorre tra i guasti, tanto più affidabile è il sistema.
L'obiettivo per la maggior parte delle aziende è mantenere il MTBF il più alto possibile, in modo che intercorrano centinaia di migliaia, o addirittura milioni, di ore tra un problema e quello successivo.
Formula dell'MTBF
La formula dell'MTBF è semplice:
MTBF = tempo totale di funzionamento / numero di guasti
Il tempo totale di funzionamento viene solitamente misurato in ore, soprattutto per le apparecchiature utilizzate di frequente. Per calcolarlo, moltiplica le ore di funzionamento giornaliere per il numero di giorni di utilizzo.
Per le apparecchiature che non vengono usate spesso, puoi anche usare i giorni di funzionamento invece delle ore. Quando tieni traccia di apparecchiature che dovrebbero avere una durata molto lunga, invece, puoi usare le settimane.
Esempio di MTBF
Osservare un esempio che utilizza la formula dell'MTBF può aiutarti a capire come calcolare l'MTBF e il ruolo che svolge nella gestione degli imprevisti. In questo esempio, esamineremo un server che funziona 24 ore al giorno per un periodo di un mese.
24 ore * 30 giorni = 720 ore
MBTF = 720 ore / 2 guasti = 360 ore
In questo esempio, il tempo medio tra i guasti sarebbe di 360 ore.
Quando utilizzare l'MTBF (e quando non farlo)
L'MTBF è una metrica utile per quanto riguarda la pianificazione e la manutenzione preventiva. Quando usi l'MTBF per comprendere meglio la frequenza con cui si verificano i guasti e i tempi di inattività, puoi incorporare in modo proattivo strategie e strumenti per la gestione degli imprevisti.
L'MTBF non è ideale in ogni situazione. Per i sistemi non riparabili, è consigliabile utilizzare il tempo medio al verificarsi di un guasto (MTTF) invece dell'MTBF.
Qual è la relazione tra MTBF, MTTR e disponibilità?
Calcolando MTBF e MTTR insieme, puoi determinare la disponibilità del sistema. Ecco la formula:
Disponibilità = MTBF / (MTBF + MTTR)
Un MTBF più alto e un MTTR più basso portano a un miglior tempo di attività del sistema, riducendo il costo legato ai guasti. Tuttavia, è importante notare la differenza tra affidabilità e disponibilità. La disponibilità misura la quantità di tempo durante il quale un sistema è operativo, mentre l'affidabilità misura le prestazioni di un sistema rispetto ai relativi standard.
MTTR: tempo medio di riparazione
Che cos'è il tempo medio di riparazione?
Il tempo medio di riparazione (MTTR) è il tempo medio necessario per riparare un sistema (solitamente tecnico o meccanico). Include sia il tempo di riparazione che l'eventuale durata dei test. L'orologio di questa metrica non si ferma finché il sistema non è di nuovo completamente funzionante.
Come calcolare il tempo medio di riparazione
Puoi calcolare l'MTTR sommando il tempo totale impiegato per le riparazioni in un determinato periodo e poi dividendo quel tempo per il numero di riparazioni.
Quindi, supponiamo di esaminare le riparazioni effettuate nel corso di una settimana. In quel periodo, ci sono state 10 interruzioni e i sistemi sono stati riparati attivamente per quattro ore. Quattro ore equivalgono a 240 minuti che, diviso per 10, fa 24. Ciò che significa che il tempo medio di riparazione in questo caso sarebbe di 24 minuti.
Le limitazioni del tempo medio di riparazione
Il tempo medio di riparazione non sempre equivale al tempo di interruzione del sistema stesso. In alcuni casi, le riparazioni iniziano entro pochi minuti dal verificarsi di un guasto del prodotto o di interruzione del sistema. In altri casi, è presente un intervallo di tempo tra il problema, il momento in cui viene rilevato e l'inizio delle riparazioni.
Questa metrica è molto utile per monitorare la velocità con cui il personale di manutenzione è in grado di risolvere un problema. Non ha lo scopo di identificare problemi relativi agli avvisi di sistema o i ritardi prima della riparazione, che sono entrambi fattori importanti per valutare i successi e gli insuccessi dei tuoi programmi di gestione degli imprevisti.
Come e quando utilizzare il tempo medio di riparazione
Il tempo medio di ripristino (MTTR) è una metrica utilizzata dai team di assistenza e manutenzione per monitorare le riparazioni. L'obiettivo è ridurre il più possibile questo numero aumentando l'efficienza dei processi e dei team addetti alla riparazione.
MTTR: tempo medio di ripristino
Che cos'è il tempo medio di ripristino?
Il tempo medio di ripristino (MTTR) è il tempo medio necessario per il ripristino in seguito a un guasto del prodotto o del sistema. Include l'intera durata dell'interruzione, dal momento in cui il sistema o prodotto smette di funzionare al momento in cui torna completamente operativo.
È una metrica DevOps chiave che può essere utilizzata per misurare la stabilità di un team DevOps, come osservato da DevOps Research and Assessment (DORA).
Come calcolare il tempo medio di ripristino
Il tempo medio di ripristino viene calcolato sommando tutto il tempo di inattività in un periodo specifico e dividendolo per il numero di imprevisti. Supponiamo, ad esempio, che i sistemi siano rimasti inattivi per 30 minuti per due imprevisti separati in un periodo di 24 ore. 30 diviso due fa 15, quindi il tempo medio di ripristino è di 15 minuti.
I limiti del tempo medio di ripristino
L'MTTR è una misura della velocità del processo completo di ripristino. La velocità è in linea con le tue aspettative? Come esce dal confronto con quella dei tuoi concorrenti?
Si tratta di una metrica generale che aiuta a capire se è presente un problema. Tuttavia, se vuoi diagnosticare qual è l'area del processo interessata dal problema (Riguarda il sistema di avvisi? Il team impiega troppo tempo a effettuare le correzioni? I tempi di risposta una richiesta di correzione sono troppo lunghi?), avrai bisogno di maggiori dati, perché sono diverse le operazioni che intercorrono tra guasto e ripristino.
Il problema potrebbe riguardare il tuo sistema di avvisi. È presente un ritardo tra un guasto e un avviso? Gli avvisi impiegano più tempo del dovuto per arrivare alla persona giusta?
Il problema potrebbe riguardare la diagnostica. Sei in grado di capire rapidamente qual è il problema? Ci sono processi che potrebbero essere migliorati?
Il problema potrebbe anche riguardare le riparazioni. L'efficacia dei team di manutenzione è ottimizzata? Se i team impiegano la maggior parte del proprio tempo nelle riparazioni, dov'è che sbagliano?
Per rispondere a queste domande dovrai esaminare più a fondo l'MTTR, ma il tempo medio di ripristino può fornire un punto di partenza per diagnosticare gli eventuali problemi nel processo di ripristino che richiedono un approfondimento.
Come e quando utilizzare il tempo medio di ripristino
Il tempo medio di ripristino (MTTR) è una metrica efficace per valutare la velocità del processo di ripristino complessivo.
MTTR: tempo medio di risoluzione
Che cos'è il tempo medio di risoluzione?
Il tempo medio di risoluzione (MTTR) è il tempo medio necessario per risolvere completamente un guasto. Include non solo il tempo impiegato per rilevare il guasto, diagnosticare il problema e risolverlo, ma anche il tempo necessario a garantire che il guasto non si ripeta.
Questa metrica estende la responsabilità del team che gestisce la correzione, impegnandolo a migliorare le prestazioni a lungo termine. È la differenza tra spegnere un incendio e spegnere un incendio e poi mettere a fuoco la tua casa.
Tra questo MTTR e la soddisfazione del cliente è presente una forte correlazione, pertanto è una metrica a cui prestare molta attenzione.
Come calcolare il tempo medio di risoluzione
Per calcolare questo MTTR, bisogna sommare il tempo di risoluzione completo per il periodo che desideri monitorare e dividerlo per il numero di imprevisti.
Quindi, se i tuoi sistemi sono rimasti inattivi per un totale di due ore in un periodo di 24 ore in un singolo imprevisto e i team hanno impiegato altre due ore ad applicare le correzioni per garantire che l'interruzione del sistema non si ripeta, le ore impiegate nella risoluzione del problema sono quattro in totale. Questo significa che l'MTTR è di quattro ore.
Una nota sul monitoraggio del tempo medio di risoluzione
Tieni presente che viene calcolato più frequentemente utilizzando l'orario lavorativo (quindi, se un giorno effettui il ripristino da un problema all'ora di chiusura e dedichi la mattina dopo alla risoluzione del problema sottostante, il tempo medio di ripristino non includerebbe le 16 ore trascorse lontano dall'ufficio). Se hai team dislocati in più sedi che lavorano 24 ore su 24 o se hai dipendenti su chiamata che lavorano oltre l'orario di ufficio, è importante stabilire come monitorare il tempo per questa metrica.
Come e quando utilizzare il tempo medio di risoluzione
L'MTTR viene in genere utilizzato per gli imprevisti non pianificati, non per le richieste di assistenza (che in genere sono pianificate).
MTTR: tempo medio di risposta
Che cos'è il tempo medio di risposta?
Il tempo medio di risposta (MTTR) è il tempo medio necessario per il ripristino da un guasto di un prodotto o sistema dal momento in cui si riceve il primo avviso sul guasto. Non include l'eventuale ritardo del sistema di avvisi in uso.
Come calcolare il tempo medio di risposta
Per calcolare questo MTTR è necessario sommare il tempo di risposta completo da quando si attiva l'avviso a quando il prodotto o il servizio sarà di nuovo completamente funzionante e dividere il risultato per il numero di imprevisti.
Ad esempio, se in una settimana lavorativa di 40 ore si sono verificati quattro imprevisti che hanno richiesto un'ora in totale (dall'avviso alla correzione), il tuo MTTR per quella settimana sarebbe di 15 minuti.
Come e quando utilizzare il tempo medio di risposta
Questo MTTR viene spesso utilizzato nella sicurezza informatica per misurare il successo di un team nella neutralizzazione degli attacchi al sistema.
MTTA: tempo medio di riconoscimento
Che cos'è il tempo medio di riconoscimento?
L'MTTA (Mean Time To Acknowledge, ovvero tempo medio di riconoscimento) è il tempo medio impiegato dal momento in cui si attiva un avviso a quando si inizia a lavorare sul problema. Questa metrica è utile per monitorare la reattività del team e l'efficacia del sistema di avvisi.
Come calcolare il tempo medio di riconoscimento
Per calcolare l'MTTA, bisogna sommare il tempo tra l'avviso e il riconoscimento, per poi dividere il risultato per il numero di imprevisti.
Ad esempio, se si sono verificati 10 imprevisti e il tempo totale intercorso tra l'avviso e il riconoscimento è di 40 minuti per tutti e 10 gli eventi, dividi 40 per 10 e ottieni una media di quattro minuti.
Come e quando utilizzare il tempo medio di riconoscimento
Il tempo medio di riconoscimento (MTTA) è utile per monitorare la reattività. Il tuo team ha un problema di stress da avvisi e impiega troppo tempo per rispondere? Questa metrica ti aiuterà a segnalare il problema.
MTBF: tempo medio al verificarsi di un guasto
Che cos'è il tempo medio al verificarsi di un guasto?
Il tempo medio al verificarsi di un guasto (MTTF) è il tempo medio che intercorre tra i guasti non riparabili di un prodotto tecnologico. Ad esempio, se i motori delle auto di marca X hanno una media di 500.000 ore prima che si guastino completamente e debbano essere sostituiti, l'MTTF dei motori è 500.000.
Il calcolo viene utilizzato per capire quanto tempo durerà in genere un sistema, determinare se una nuova versione di un sistema sta superando quella vecchia in termini di prestazioni e fornire ai clienti informazioni sulla durata prevista e su quando programmare i controlli sul proprio sistema.
Come calcolare il tempo medio al verificarsi di un guasto
Il tempo medio al verificarsi di un guasto è una media aritmetica che si calcola sommando il tempo operativo di tutti i prodotti presi in esame e dividendo il totale per il numero di dispositivi.
Supponiamo, ad esempio, che tu stia cercando di capire l'MTTF delle lampadine. Quanto durano in media le lampadine di Marca Y prima che si esauriscano? Supponiamo, inoltre, che tu abbia un campione di quattro lampadine da testare (per ottenere dati statisticamente significativi, sarebbe necessario un numero molto più alto, ma per finalità di calcolo anche un numero piccolo va bene).
La lampadina A dura 20 ore. La lampadina B dura 18 anni. La lampadina C dura 21. E la lampadina D dura 21 ore. Il totale è di 80 ore di funzionamento. Diviso per quattro, l'MTTF è di 20 ore.

Il problema del tempo medio al verificarsi di un guasto
Con un esempio come quello delle lampadine, l'MTTF è una metrica molto utile. Possiamo far funzionare le lampadine fino a quando l'ultima non si guasta e usare queste informazioni ottenute per trarre conclusioni sulla loro resilienza.
Ma cosa succede quando misuriamo oggetti che non subiscono guasti altrettanto velocemente? Oggetti destinati a durare negli anni? In questi casi, l'MTTF, sebbene sia utilizzata spesso, non è una metrica altrettanto valida, perché invece di far funzionare un prodotto finché non si guasta, la maggior parte delle volte lo facciamo funzionare per un periodo di tempo definito e misuriamo il numero di prodotti che si guastano.
Ad esempio, supponiamo di voler ottenere statistiche MTTF sui tablet di Marca Z. I tablet dovrebbero durare molti anni, ma la Marca Z potrebbe avere a disposizione solo sei mesi per raccogliere dati e pertanto testa 100 tablet per sei mesi. Supponiamo che un tablet si guasti esattamente dopo sei mesi.
Moltiplichiamo il tempo di operatività totale (sei mesi moltiplicato per 100 tablet) e otteniamo 600 mesi. Solo un tablet non funziona, divideremmo questo valore per uno e l'MTTR sarebbe di 600 mesi, cioè di 50 anni.
I tablet Brand Z durano in media 50 anni ciascuno? È piuttosto improbabile. Quindi, in casi come questi, la metrica non fornisce dati indicativi.
Come e quando utilizzare il tempo medio al verificarsi di un guasto
L'MTTF è efficace per valutare la durata media di prodotti e sistemi con un ciclo di vita breve (ad esempio le lampadine). Inoltre, è pensato solo per i casi in cui stai valutando un guasto completo del prodotto. Se stai calcolando il tempo tra gli imprevisti che richiedono una riparazione, l'inizialismo preferito è MTBF (tempo medio tra guasti).
MTBF, MTTR, MTTF e MTTA a confronto
Qual è la misurazione migliore per il monitoraggio e il miglioramento della gestione degli imprevisti?
La risposta è: tutte.
Sebbene a volte siano utilizzate in modo intercambiabile, ogni metrica fornisce informazioni diverse. Utilizzate insieme, possono fornire un quadro più completo dei risultati ottenuti dal tuo team nella gestione degli imprevisti e delle aree di miglioramento.

Il tempo medio di ripristino indica la velocità alla quale puoi rimettere in funzione i sistemi.
Aggiungi il livello del tempo medio di risposta e avrai un'idea di quanto tempo di ripristino è da attribuire al team e di quanto, invece, è da attribuire al sistema di avvisi.
Applica l'ulteriore livello del tempo medio di riparazione e comincerai a vedere quanto tempo il team dedica alle riparazioni rispetto alla diagnostica.
Aggiungi all'insieme il tempo medio di risoluzione e comincerai a comprendere l'intero ambito della correzione e della risoluzione dei problemi oltre al tempo di inattività effettivamente causato.
Con il tempo medio tra guasti, il quadro diventa ancora più ampio, perché illustra quanto il team è efficace nel prevenire o nel ridurre i problemi futuri.
Infine, aggiungi il tempo medio al verificarsi di un guasto per comprendere l'intero ciclo di vita di un prodotto o sistema.
Jira Service Management offre funzionalità per la creazione di report che consentono al team di tenere traccia dei KPI e di monitorare e ottimizzare la pratica di gestione degli imprevisti.
Domande frequenti
Qual è un buon valore di MTBF?
Un buon valore di MTBF varia a seconda del tipo di sistema che devi gestire. I componenti ad alta affidabilità come gli SSD potrebbero avere un MTBF di 2 milioni di ore, mentre i server potrebbero avere un MTBF di circa 15.000 ore. I componenti di produzione fisici come i motori dei nastri trasportatori sono considerati affidabili se hanno un MTBF di 4.000 ore.
Qual è un buon valore di MTTR?
Un tempo medio di riparazione (MTTR) più basso comporta tempi di riparazione più rapidi e quindi una riduzione dei costosi tempi di inattività. Per i sistemi di produzione, un MTTR inferiore a 5 ore è ideale per massimizzare la produzione. I team IT e di sicurezza puntano in genere a un MTTR quasi pari a zero, quindi qualsiasi valore sotto un'ora è ottimo. L'MTTR dipende anche dai livelli di gravità dei guasti.
L'MTTF dovrebbe essere alto o basso?
Il valore del tempo medio al verificarsi di un guasto (MTTF) dovrebbe essere alto per i sistemi non riparabili, perché il punto di guasto rappresenta la fine della vita di quel sistema. L'MTTF è diverso dall'MTBF, in quanto misura il tempo medio fino al guasto di un componente non riparabile, anziché il tempo medio tra diversi guasti.
Consigliata per te
Tutorial
Scopri di più sulla comunicazione degli imprevisti con Statuspage
In questo tutorial, ti mostreremo come utilizzare i modelli di imprevisti per comunicare in modo efficace durante le interruzioni. Puoi adattarlo a molti tipi di interruzione del servizio.
Modelli ed esempi di comunicazione degli imprevisti
Quando si risponde a un imprevisto, i modelli di comunicazione hanno un valore inestimabile. Scopri i modelli utilizzati dai nostri team e altri esempi di imprevisti comuni.
Scopri di più sulla gestione degli imprevisti
Trova altre guide e risorse per la gestione degli imprevisti in questo hub.