Ett SLO är ett mätbart mål — till exempel att 99,9 procent av anropen under en månad ska lyckas inom en viss tid — satt utifrån vad användarna faktiskt märker, inte vad tekniken klarar. Målet mäts med en eller flera SLI:er (service level indicators), och felbudgeten är helt enkelt avståndet mellan målet och hundra procent: med 99,9 procent får ungefär 43 minuter i månaden gå fel.
Poängen är att göra avvägningen mellan fart och stabilitet till ett beslut i stället för ett gräl: så länge budgeten håller får teamet deploya ofta och experimentera; när den är slut går releaser på sparlåga tills tillförlitligheten är tillbaka. Begreppet kommer från Googles SRE-bok och är kärnan i Site Reliability Engineering.