Klockan startar när användarna påverkas och stannar när tjänsten fungerar igen — inte när grundorsaken är åtgärdad. Låg MTTR handlar därför mindre om att aldrig fela och mer om att upptäcka snabbt, förstå snabbt och backa snabbt: bra observability, larm som går att agera på och deployer som går att rulla tillbaka. I de senaste rapporterna kallar DORA mätvärdet failed deployment recovery time och fokuserar på fel som orsakats av en ändring; se DORA:s guide till mätvärdena.
Tillsammans med felbudgeten gör MTTR tillförlitlighet mätbar, och en blameless post-mortem efter varje incident är det som får siffran att sjunka över tid. Följ trenden snarare än enskilda incidenter — en enda lång natt säger lite om systemet.