SLA-Beispiele und Vorlagen

SLA-Beispiele und Vorlagen: Eine abgerundete, geöffnete Vereinbarungsmappe mit einem Zifferblatt und einem korallenroten Siegel.

Turn this article into takeaways for your work.

Each assistant summarizes the article only for you and suggests best practices for your work.

Die meisten, die nach einer SLA-Vorlage suchen, wollen nicht lernen, was ein SLA ist. Sie haben in drei Wochen eine Vertragsverlängerung, einen Service Desk, der Fristen verfehlt, die nie jemand vereinbart hat, oder einen Lieferantenvertrag mit einer schönen Verfügbarkeitszahl und ohne Definition, wie Verfügbarkeit gemessen wird. Sie brauchen bis Freitag ein Dokument.

Dieser Beitrag ist deshalb eine Bibliothek von Artefakten: Vorlagen und durchgerechnete Beispiele für fünf häufige Fälle, jeweils mit den Messregeln, die entscheiden, ob die Zusage etwas bedeutet. Ein Zielwert ohne Messregel ist ein Wunsch mit angehängter Zahl.

Wichtige Fakten: SLA-Benchmarks zum Übernehmen

  • Amazon sagt für EC2 eine monatliche Verfügbarkeit von 99,99 % auf Regionsebene und 99,5 % für eine einzelne Instanz zu, mit Gutschriften von 10 %, 30 % oder 100 % der betroffenen Gebühren (AWS Compute SLA, 25. Mai 2022).
  • Google Cloud sagt 99,99 % für Compute-Engine-Instanzen in mehreren Zonen und 99,9 % für eine einzelne Instanz zu, aber ein Kunde muss innerhalb von 60 Tagen einen Anspruch geltend machen, um eine Gutschrift zu erhalten (Google Compute Engine SLA).
  • Microsoft formuliert Azure-Support-Zusagen nach Schweregrad, nicht nach Verfügbarkeit: unter 1 Stunde, 24x7, für Severity A bei einem Standard-Plan, gegenüber unter 8 Geschäftsstunden für Severity C (Azure support).
  • 57 % der Befragten gaben an, dass ihr jüngster größerer Ausfall mehr als 100.000 US-Dollar kostete, und jeder Fünfte bezifferte ihn auf über 1 Million US-Dollar (Uptime Institute, 2026).
  • Ein SLA ist ein Vertrag, „der Konsequenzen für das Erreichen (oder Verfehlen) der darin enthaltenen SLOs beinhaltet“ (Google SRE Book).

Die Anatomie eines SLA, Klausel für Klausel

Jedes brauchbare SLA beantwortet dieselben zwölf Fragen. Vorlagen, die vier oder fünf davon auslassen, werden schnell unterschrieben und später umso länger diskutiert.

Wo dieser Beitrag die Grenze zieht

Der Begleitbeitrag, was ein SLA ist und wie Sie interne SLAs festlegen, besitzt das Konzept: die Definition, die drei klassischen Typen und eine Methode in fünf Schritten, sie zu vereinbaren. Dieser Beitrag liefert Ihnen stattdessen die Klauseln und die Zahlen. Ein Fall wird bewusst nicht wiederholt: Die bilaterale Vereinbarung zwischen Marketing und Vertrieb gibt es bereits als SLA-Vorlage für Marketing und Vertrieb.

Die Klausel-Checkliste

Klausel Was sie enthalten muss
Parteien und Geltungsbereich Benannter Anbieter und Kunde, Datum des Inkrafttretens, Laufzeit
Servicebeschreibung Was geliefert wird, in den Worten des Kunden
Servicezeiten Abdeckungszeitraum, Zeitzone, Feiertage, Bereitschaft
Metriken Jede Metrik einmal definiert, mit ihrer Einheit
Zielwerte Die Zahl und der Anteil der Fälle, den sie abdeckt
Messmethode Führendes System, Uhrregeln, Berichtszeitraum
Ausschlüsse Benannt, begrenzt und prüfbar
Berichtswesen Format, Häufigkeit, Herausgeber, Ablageort
Gutschriften und Abhilfen Auslöser, Betrag, wie und bis wann sie geltend zu machen sind
Eskalation Benannte Rollen und zeitliche Auslöser
Review und Änderungssteuerung Rhythmus, Teilnehmende, wie sich Zielwerte ändern
Kündigungsauslöser Die Schwelle wiederholter Verfehlung, die es beendet

Die drei am häufigsten ausgelassenen sind Messmethode, Berichtswesen und Kündigungsauslöser, und sie entscheiden, ob die Vereinbarung Zähne hat. Ein späterer Abschnitt listet auf, wozu jede vage Klausel wird.

SLA, SLO, SLI, OLA und der Underpinning Contract

Fünf Begriffe werden in Meetings austauschbar verwendet und bedeuten auf dem Papier Verschiedenes.

Begriff Was es ist Zwischen wem Konsequenz bei Verfehlung
SLI (Service Level Indicator) Die Rohmessung, etwa der Anteil der Anfragen unter 300 ms Niemandem, es ist eine Metrik Keine
SLO (Service Level Objective) Ein Zielwert oder Zielbereich für einen SLI Meist intern Interne Überprüfung, Prioritätsverschiebung
SLA (Service Level Agreement) Zugesagte Zielwerte mit festgelegten Konsequenzen Anbieter und Kunde Gutschriften, Eskalation, Kündigung
OLA (Operational Level Agreement) Back-to-back-Zusagen, die das SLA möglich machen Teams innerhalb einer Organisation Eskalation im Management
Underpinning Contract Eine Lieferantenvereinbarung, die das Kunden-SLA stützt Sie und ein Dritter Abhilfen gegenüber dem Lieferanten

Die SRE-Praxis von Google bietet den Test, den man sich merken sollte: Fragen Sie, was passiert, wenn der Zielwert verfehlt wird, und „wenn es keine ausdrückliche Konsequenz gibt, haben Sie es mit ziemlicher Sicherheit mit einem SLO zu tun“. Sie warnt auch vor der perfekten Zahl, denn „es ist sowohl unrealistisch als auch unerwünscht, darauf zu bestehen, dass SLOs zu 100 % der Zeit erfüllt werden“ (Google SRE Book).

Das OLA-Vokabular stammt aus ITIL, das inzwischen von PeopleCert herausgegeben wird und dessen aktuelles Schema über ITIL 4 hinaus zu ITIL Version 5 gewandert ist. Die Idee überdauert jede Ausgabe: Versprechen Sie eine Behebung in vier Stunden, obwohl das Datenbankteam, von dem Sie abhängen, nie etwas Schnelleres als einen Tag zugesagt hat, haben Sie den Kalender eines anderen verpfändet.

Die Messdefinitionen, die entscheiden, ob ein SLA ehrlich ist

Zwei Organisationen können identische Zielwerte fahren und allein aufgrund der Uhrregeln völlig unterschiedliche Erfüllungsgrade melden. Klären Sie diese Punkte schriftlich, bevor jemand unterschreibt.

SLA-Messregeln: Eine große Stoppuhr mit einem kleinen Pausenhebel und einem korallenroten Ticket, das durch ihren äußeren Ring gefädelt ist.

Frage Schwache Formulierung Belastbare Formulierung
Wann startet die Uhr? „Bei Eingang der Anfrage“ „Zum Zeitstempel, an dem das Ticket in erstellt wird, einschließlich Tickets, die der Anbieter für den Kunden anlegt“
Wann pausiert sie? Schweigen oder „solange auf den Kunden gewartet wird“ „Nur solange das Ticket den Status Pending Customer hat, wobei pausierte Zeit gesondert berichtet wird“
Geschäfts- oder Kalenderstunden? „Innerhalb von 4 Stunden“ „Innerhalb von 4 Geschäftsstunden, definiert als 09:00 bis 18:00 Uhr , Montag bis Freitag, ausgenommen “
Was ist eine Lösung? „Ticket geschlossen“ „Service wiederhergestellt und vom Anfragenden bestätigt; ein Workaround zählt nur für P3 und P4“
Wie zählen Wiedereröffnungen? Schweigen „Ein Ticket, das innerhalb von Tagen wiedereröffnet wird, kehrt zu seiner ursprünglichen Uhr zurück; die frühere Schließung gilt nicht als erreichter Zielwert“
Welcher Anteil muss erfüllt sein? „Alle Tickets“ „95 % der P1 und 90 % der P2 pro Kalendermonat, über alle in diesem Monat erstellten Tickets“

Drei davon entscheiden die meisten Streitigkeiten. Pausenregeln sind der größte Hebel auf eine Erfüllungszahl, denn ein Team, das ein Ticket auf Pending Customer parken und damit seine eigene Uhr anhalten kann, erreicht jeden Zielwert, den Sie setzen. Geschäftsstunden verändern jede Zahl in der Tabelle: Vier Geschäftsstunden in einem Kalender von 09:00 bis 18:00 Uhr sind fast 24 reale Stunden, wenn die Anfrage am Freitag um 17:30 Uhr eintrifft. Und Wiedereröffnungen schönen eine Lösungszahl, denn eine Schließung, die der Kunde eine Stunde später wiedereröffnet, zählt als ein erreichter Zielwert plus ein neues Ticket. Verfolgen Sie die Wiedereröffnungsquote als eigene Prozess-KPI.

Verfügbarkeit braucht dieselbe Sorgfalt. Das Compute Engine SLA von Google zählt nur „einen Zeitraum von einer oder mehreren aufeinanderfolgenden Minuten Ausfallzeit“, sodass „Teilminuten oder zeitweilige Ausfallzeiten von weniger als einer Minute nicht zählen“ (Google Compute Engine SLA). Ein Dienst kann den ganzen Monat über jeweils fünfzig Sekunden lang flattern und trotzdem perfekte Verfügbarkeit melden.

Uptime-Rechnung: Was jede Neun Sie wirklich kostet

Verfügbarkeitsprozente sind schwer zu fühlen. Minuten nicht. Jeder Wert unten ergibt sich aus (1 minus Verfügbarkeitsprozentsatz) mal der Länge des Zeitraums, mit einem 30-Tage-Monat und einem 365-Tage-Jahr.

Verfügbarkeit Zulässige Ausfallzeit pro 30-Tage-Monat Zulässige Ausfallzeit pro 365-Tage-Jahr
99 % 7 Std. 12 Min. 3 Tage 15 Std. 36 Min.
99,5 % 3 Std. 36 Min. 1 Tag 19 Std. 48 Min.
99,9 % („drei Neunen“) 43 Min. 12 Sek. 8 Std. 45 Min. 36 Sek.
99,95 % 21 Min. 36 Sek. 4 Std. 22 Min. 48 Sek.
99,99 % („vier Neunen“) 4 Min. 19 Sek. 52 Min. 34 Sek.
99,999 % („fünf Neunen“) 26 Sek. 5 Min. 15 Sek.

Zwei Abstände zählen bei Verhandlungen. Zwischen 99,5 % und 99,9 % liegen 2 Std. 52 Min. 48 Sek. pro Monat, der Unterschied zwischen einem Ausfall, den ein Team gelassen abarbeitet, und einem, der einen Nachmittag frisst. Zwischen 99,9 % und 99,99 % liegen nur 38 Min. 53 Sek., aber dieser Sprung erzwingt meist Multi-Zonen-Betrieb und einen echten Bereitschaftsdienst, daher ist er der teure.

Weil die meisten SLAs einen Kalendermonat messen, wandert die Toleranz auch mit dem Monat: Bei 99,9 % erlaubt der Februar 40 Min. 19 Sek., ein Monat mit 31 Tagen 44 Min. 38 Sek., bei identischer Zusage.

Vorlage 1: SLA für Incidents am IT Service Desk

Dies ist die Vorlage, die die meisten Organisationen zuerst brauchen, und die, die am häufigsten ohne ihre Prioritätsmatrix kopiert wird, obwohl diese die eigentliche Arbeit leistet. Die Priorität ist kein Feld, das der Anfragende wählt. Sie wird aus Auswirkung und Dringlichkeit abgeleitet, sodass zwei Personen denselben Ausfall nicht unterschiedlich einstufen können.

SLA-Prioritäten für IT-Incidents: Eine Drei-mal-drei-Prioritätsmatrix für Incidents.

Auswirkung \ Dringlichkeit Hoch (aktuell beeinträchtigt, kein Workaround) Mittel (Workaround vorhanden) Niedrig (keine unmittelbare Wirkung)
Hoch (gesamter Standort, umsatzrelevantes System, regulatorische Frist) P1 P2 P3
Mittel (eine Abteilung oder ein gemeinsam genutzter Service) P2 P3 P3
Niedrig (einzelner Nutzer, kosmetischer Fehler) P3 P3 P4

Reaktion und Lösung sind getrennte Zusagen und sollten nie zu einer Zahl verschmelzen. Reaktion ist der Moment, in dem ein Mensch das Ticket übernimmt und das auch sagt; Lösung ist der wiederhergestellte Service. Ein Team kann bei einem von beiden hervorragend und beim anderen hoffnungslos sein, und eine vermischte Zahl verbirgt das.

Priorität Abdeckung Reaktionsziel Lösungsziel Erfüllungsschwelle
P1 24x7 15 Minuten 4 Stunden 95 % der P1 pro Monat
P2 24x7 1 Stunde 8 Geschäftsstunden 95 %
P3 Geschäftszeiten 4 Geschäftsstunden 3 Werktage 90 %
P4 Geschäftszeiten 1 Werktag 10 Werktage 90 %

Diese Zahlen sind ein Ausgangspunkt, kein Benchmark, den man blind kopiert. Microsoft sagt für Severity A („erheblicher Verlust oder erhebliche Beeinträchtigung von Diensten“) unter 1 Stunde, 24x7, bei einem Standard-Plan und darüber zu, und unter 8 Geschäftsstunden für Severity C (Azure support responsiveness). Beachten Sie, was das ist: eine erste Reaktion, keine Lösung.

Incident-Management-SLA, an 1. Geltungsbereich. Incident-Bearbeitung für . Anfragen, Änderungen und Projektarbeit stehen in . 2. Servicezeiten. P1 und P2 werden 24x7 bearbeitet. P3 und P4 laufen von 09:00 bis 18:00 Uhr , Montag bis Freitag, ausgenommen . 3. Priorität. Wird anhand der obigen Matrix von bei der Triage zugewiesen. Eine Neueinstufung setzt die Uhr nicht zurück. 4. Zielwerte. Gemäß der obigen Tabelle zu Reaktion und Lösung. 5. Messung. Zeiten werden in ab Ticketerstellung erfasst. Die Uhr pausiert nur, solange das Ticket Pending Customer ist, und pausierte Zeit wird gesondert berichtet. 6. Lösung. Service wiederhergestellt und vom Anfragenden bestätigt, oder 2 Geschäftstage ohne Widerspruch. Bei P1 und P2 ist ein Workaround keine Lösung. 7. Wiedereröffnungen. Ein Ticket, das innerhalb von 5 Geschäftstagen wiedereröffnet wird, setzt seine ursprüngliche Uhr fort. 8. Ausschlüsse. Geplante Wartung, die Geschäftstage im Voraus angekündigt wurde, Incidents durch vom Kunden kontrollierte Systeme oder die in Anhang A benannten Dritten sowie Ereignisse außerhalb der angemessenen Kontrolle von . 9. Berichtswesen. Erfüllungsgrad nach Priorität, Wiedereröffnungsquote und die drei häufigsten wiederkehrenden Ursachen, veröffentlicht bis zum fünften Arbeitstag jedes Monats. 10. Eskalation. Ein P1, der bei 50 % seines Lösungsziels ungelöst ist, wird an eskaliert; bei 100 % an , die bis zum Abschluss die Kundenkommunikation verantwortet. 11. Review. Vierteljährlich, unter Teilnahme von . Zielwerte ändern sich nur durch schriftliche Vereinbarung. 12. Wiederholte Verfehlung. Das Verfehlen der P1-Schwelle in drei aufeinanderfolgenden Monaten löst einen Serviceverbesserungsplan aus.

Klausel 8 enthält eine Regel: Jeder Ausschluss muss benannt und prüfbar sein. „Höhere Gewalt“ ist Standard; „Probleme, die aus der Komplexität der Kundenumgebung entstehen“ ist ein Schlupfloch.

Vorlage 2: SLA für den Kundensupport

Ein Support-SLA verhält sich anders. Die Zahl, die die Zufriedenheit am stärksten bestimmt, ist nicht die Lösungszeit, sondern die Folgeantwortzeit, die Wartezeit zwischen Antworten, sobald ein Gespräch läuft. Viele Teams erreichen ihre Ziele für die erste Antwort und frustrieren Kunden trotzdem, weil die zweite Antwort zwei Tage brauchte. Auch die Kanäle unterscheiden sich, sodass ein vermischter Zielwert über Chat und E-Mail bei einem von beiden zu viel verspricht.

SLA für den Kundensupport: Zwei große, abwechselnde, abgerundete Sprechblasen, verbunden durch eine kleine Uhr, die zweite Antwort korallenrot hervorgehoben.

Kanal Erste Antwort Folgeantwort Lösungsziel Zeiten
Live-Chat 2 Minuten 5 Minuten innerhalb der Sitzung Dieselbe Sitzung 09:00 bis 21:00 Uhr
Telefon 60 Sekunden bis zur Annahme Nicht zutreffend Derselbe Anruf oder dasselbe Ticket Geschäftszeiten
E-Mail, Standard-Tarif 8 Geschäftsstunden 1 Werktag 3 Werktage Geschäftszeiten
E-Mail, Priority-Tarif 2 Geschäftsstunden 4 Geschäftsstunden 1 Werktag Geschäftszeiten
Service ausgefallen 30 Minuten 2 Stunden bis zur Wiederherstellung 4 Stunden 24x7

Kundensupport-SLA, an 1. Abgedeckte Kanäle. {Chat, E-Mail, Telefon, In-App}. Soziale Medien und Community-Foren erfolgen nach bestem Bemühen ohne Zusage. 2. Erste Antwort bezeichnet eine inhaltliche Antwort eines Menschen, die auf das konkrete Anliegen eingeht. Eine automatische Eingangsbestätigung erfüllt diese Klausel nicht. 3. Folgeantwort bezeichnet jede weitere Antwort, solange das Gespräch offen ist und auf wartet. 4. Uhrregeln. Die Zeitmessung beginnt, wenn die Nachricht in eingeht, und pausiert nur, solange das Gespräch den Status Awaiting Customer hat. Ein Gespräch, das Tage auf den Kunden wartet, wird automatisch geschlossen und bei jeder Antwort wiedereröffnet, wobei die ursprüngliche Uhr fortgesetzt wird. 5. Erfüllung. Monatlich gemessen am {90.} Perzentil, nicht am Mittelwert. 6. Eskalation und Berichtswesen. Jedes Gespräch, das länger als das -Fache seines Lösungsziels offen ist, geht an und in den wöchentlichen Review. Erfüllungsgrad je Kanal, Wiedereröffnungsquote und Gespräche, die um mehr als Stunden überschreiten, werden monatlich veröffentlicht. 7. Ausschlüsse. Die in Anhang A benannten Drittintegrationen, Anfragen zu Individualentwicklung und angekündigte Wartung.

Zwei Entscheidungen sind dabei bewusst. Ein Perzentil statt eines Mittelwerts verhindert, dass ein Durchschnitt die wochenalten Gespräche verdeckt, die jede Beschwerde erzeugen, und der Ausschluss von Autorespondern bei der ersten Antwort schließt den häufigsten Weg, auf dem ein Support-SLA manipuliert wird.

Beispiel 3: Ein internes Shared-Services-SLA und das OLA dahinter

Interne SLAs werden mit dem geringsten Aufwand geschrieben und am häufigsten gebrochen. Finanzen, HR, Recht und IT bedienen Kunden ohne Vertrag, ohne Gutschriften und ohne alternativen Lieferanten, sodass die einzige Durchsetzung aus Sichtbarkeit und einem Review-Meeting besteht.

Interne SLA-Abhängigkeiten: Drei breite, abgerundete Übergabeablagen entlang einer geschwungenen Kurve, ein vollständiges Anfragepaket wandert von der Aufnahme über eine vorgelagerte Freigabe in eine abschließende Serviceablage.

Anfragetyp Team Zielwert Uhr startet, wenn Hängt ab von
Lieferantenrechnung zur Zahlung freigegeben Finanzen 3 Geschäftstage Eine vollständige Einreichung eingeht (Rechnung, Bestellung, Budgetcode) Einkauf bestätigt die Bestellung innerhalb von 1 Tag
Spesenerstattung Finanzen Nächster Zahlungslauf Einreichung vor dem Stichtag des Laufs Vorgesetzter genehmigt innerhalb von 2 Tagen
Angebotsschreiben an einen Kandidaten versandt People 2 Geschäftstage Eine vollständige Stellenanforderung ist genehmigt Vergütungsfreigabe innerhalb von 1 Tag
Standard-NDA geprüft und zurückgesandt Recht 2 Geschäftstage Die Anfrage erreicht die Eingangswarteschlange des Rechtsteams Nichts
Nicht standardisierte Geschäftsbedingungen geprüft Recht 5 Geschäftstage Ein vollständiges Briefing mit angehängten Änderungsmarkierungen Deal-Verantwortlicher antwortet innerhalb von 1 Tag
Laptop und Konten für neue Mitarbeitende bereit IT 1 Tag vor dem Starttermin People bestätigen den Starttermin 5 Geschäftstage Vorlauf

Jeder Zielwert in der rechten Spalte hängt von jemandem außerhalb des Teams ab, das ihn zugesagt hat, und genau das deckt eine Operational Level Agreement ab. Ohne das OLA absorbiert das Team, das das sichtbare SLA hält, jede vorgelagerte Verzögerung und hört auf, an den Zielwert zu glauben.

Die zweite Abhilfe ist die Definition einer vollständigen Anfrage. Die meisten internen Verfehlungen sind keine langsame Arbeit, sondern Arbeit, die spät begann, weil die Anfrage ohne Budgetcode eintraf. Legen Sie diese Definition in einer Standardarbeitsanweisung fest, halten Sie die Uhr an, bis die Anfrage sie erfüllt, und berichten Sie unvollständige Einreichungen neben der Erfüllungszahl.

Wo der Ablauf Abteilungsgrenzen überschreitet, bilden Sie ihn zuerst ab: Eine Geschäftsprozesslandkarte zeigt die Übergaben und Warteschlangen, und die Lücke zwischen Zykluszeit und Durchlaufzeit verrät, ob der Zielwert Arbeit oder Warten misst. Bewahren Sie die unterzeichnete Vereinbarung bei Ihrer Prozessdokumentation auf, nicht in einer Präsentation.

Beispiel 4: Ein Lieferanten-SLA, aus Sicht des Käufers geschrieben

Lieferanten-SLAs kommen fertig formuliert und auf den Lieferanten optimiert: großzügige Ausschlüsse, Gutschriften, die niemand geltend macht, und eine Messdefinition, die von der messenden Partei geschrieben wurde.

Schutz im Lieferanten-SLA: Eine saubere schildförmige Vertragsklammer, die einen kleinen Schlüssel auf Käuferseite schützt.

Was Sie fordern sollten Was Ihnen angeboten wird Warum es wichtig ist
Ein benanntes führendes System und eine Messmethode „Verfügbarkeit, gemessen von “ Wer die Messung besitzt, besitzt das Ergebnis
Monatliches Reporting, veröffentlicht zu einem festen Datum Reporting „auf Anfrage“ Ein unveröffentlichter Bericht ist einer, den niemand liest
Gutschriften, die automatisch auf Basis der eigenen Daten des Lieferanten angewendet werden Gutschriften auf schriftlichen Antrag innerhalb einer kurzen Frist Antragsfristen laufen ab, und der Lieferant weiß das
Schriftliche Ursachenanalyse für jeden Schweregrad 1 Eine mündliche Erklärung im nächsten Gespräch Ohne sie wiederholt sich derselbe Ausfall
Eine monatliche Obergrenze für ausgeschlossene Wartungszeit Unbegrenzte Wartung mit Ankündigung Wartung verbraucht die Zusage
Vorankündigung, bevor der Lieferant das SLA selbst ändert „Der Lieferant darf durch Veröffentlichung einer Aktualisierung ändern“ Ihr Schutz kann unbemerkt herabgestuft werden
Ein Kündigungsrecht bei chronischem Versagen, numerisch definiert Kündigung nach Belieben, lange Frist Ohne Ausstieg sind Abhilfen Dekoration

Zwei Klauseln sind Verhandlungskapital wert. Die erste ist der Auslöser für chronisches Versagen: „Drei Verletzungen der Verfügbarkeitszusage in beliebigen rollierenden sechs Monaten oder ein einzelner Monat unter 95 % berechtigen , ohne Vertragsstrafe zu kündigen.“ Ein Lieferant, der jedes Quartal verfehlt und jedes Mal eine Gutschrift zahlt, hat Ihre Toleranz in den Deal eingepreist. Die zweite ist die Obergrenze für Ausschlüsse, denn geplante Wartung ist nur legitim, wenn sie begrenzt, angekündigt und außerhalb Ihrer Geschäftszeiten statt der des Lieferanten liegt.

Beispiel 5: Ein Cloud-Uptime-SLA, so gelesen, wie ein Käufer es lesen sollte

Cloud-SLAs sind das beste durchgerechnete Beispiel, weil die großen Anbieter ihre vollständig veröffentlichen. Amazons EC2-Zusage, zuletzt aktualisiert am 25. Mai 2022, lautet 99,99 % monatliche Verfügbarkeit auf Regionsebene, also für Instanzen über mehrere Availability Zones, und 99,5 % für eine einzelne Instanz. Die Gutschriftenleiter ist für beide identisch.

Geltungsbereich des Cloud-Uptime-SLA: Eine große Wolkensilhouette mit zwei kleinen Serverreihen, eine Lupe zeigt ein schmales korallenrotes Zeitfenstersegment nahe dem Boden.

Monatlicher Verfügbarkeitsprozentsatz Servicegutschrift
Unter der Zusage, aber bei mindestens 99,0 % 10 %
Unter 99,0 %, aber bei mindestens 95,0 % 30 %
Unter 95,0 % 100 %

Legen Sie diese Zusagen an die obige Rechnung an. 99,99 % auf Regionsebene erlauben 4 Min. 19 Sek. in einem 30-Tage-Monat; 99,5 % auf Instanzebene erlauben 3 Std. 36 Min. Das ist ein Faktor von etwa fünfzig zwischen zwei Zahlen auf derselben Seite, und er ist vollständig Architektur: Wer in einer Zone läuft, hat das schwächere Versprechen gekauft.

AWS tut außerdem etwas, das sich als Benchmark anderswo lohnt: Es „berechnet Ihnen keine Single-EC2-Instanz, die in einer Uhrstunde länger als sechs Minuten nicht verfügbar ist“, und das „wird automatisch angewendet, und Sie müssen keine Gutschrift beantragen“. Googles Compute Engine SLA sagt 99,99 % für Instanzen in mehreren Zonen im Premium-Tarif und 99,9 % für eine einzelne Instanz der meisten Maschinenfamilien zu, mit einem großzügigeren mittleren Band von 25 %. Der Haken ist der Antrag: „Der Kunde muss den technischen Support von Google innerhalb von 60 Tagen ab dem Zeitpunkt benachrichtigen, an dem der Kunde Anspruch auf eine finanzielle Gutschrift erhält.“

Vergleichen Sie also Messdefinitionen vor den Schlagzeilenzahlen, prüfen Sie, ob die Abhilfe automatisch erfolgt oder beantragt werden muss, und übersetzen Sie jeden Prozentsatz in Minuten.

Servicegutschriften und warum sie den Schaden selten decken

Gutschriften lesen sich wie Entschädigung und wirken als Governance-Signal. Unter dem AWS-SLA „dürfen sie nur auf künftige Zahlungen für Amazon EC2 angerechnet werden“ und „berechtigen Sie nicht zu einer Erstattung oder sonstigen Zahlung von AWS“. Die von Google gehen auf künftige Rechnungen. Beide Vereinbarungen stellen klar, dass dies die gesamte Abhilfe ist: AWS „legt Ihre alleinigen und ausschließlichen Rechtsbehelfe fest“, bei Google „besteht der alleinige und ausschließliche Rechtsbehelf des Kunden“ darin.

Halten Sie das nun gegen den Schaden. Die Ausfallanalyse 2026 des Uptime Institute berichtet, dass „57 % der Befragten angaben, ihr jüngster größerer Ausfall habe mehr als 100.000 US-Dollar gekostet“ und dass „im zweiten Jahr in Folge jeder Fünfte Kosten von über 1 Million US-Dollar meldete“ (Uptime Institute). Eine Gutschrift von 10 % auf die Gebühren des betroffenen Monats ist ein bescheidener Rabatt auf die nächste Rechnung. Die Rechnung soll nicht aufgehen.

Behandeln Sie Gutschriften also als Signal, nicht als Versicherung. Ein Lieferant, der keinen nennenswerten Prozentsatz hinter eine Zahl stellt, glaubt nicht daran. Der echte Schutz liegt woanders: in Redundanz, in Kontinuitätsvorkehrungen und in einem Kündigungsrecht bei chronischem Versagen.

Ein SLA, das den Kontakt mit der Realität übersteht

Ein unterzeichnetes SLA ändert für sich allein nichts. Hinter den Vereinbarungen, die halten, stehen vier Gewohnheiten.

Benennen Sie pro Vereinbarung einen Verantwortlichen. Kein Komitee, sondern eine Person, zu deren Aufgabe es gehört, den Bericht zu veröffentlichen und den Review zu leiten. Ein SLA ohne Verantwortlichen verfällt leise, weil ein Verstoß niemanden etwas kostet, bis zu einer Vertragsverlängerung.

Bringen Sie die Zahlen dorthin, wo die Arbeit stattfindet. Ein Zielwert, der in einem gemeinsamen Laufwerk vergraben ist, ist in dem Moment unsichtbar, auf den es ankommt, nämlich wenn jemand das nächste Ticket wählt. Warteschlangenanzeigen und Teamtafeln sind gewöhnliches Visual Management, und ein SLA, das niemand sehen kann, ist ein SLA, das niemand erreicht.

Eskalieren Sie nach einem Auslöser, nicht nach Stimmung. Übernehmen Sie die Logik von Andon: Wird eine Schwelle überschritten, löst ein Signal aus, und eine benannte Person reagiert. Ein P1 bei 50 % seines Lösungsziels sollte den diensthabenden Manager alarmieren, unabhängig davon, ob der Ingenieur glaubt, es laufe schlecht.

Prüfen Sie Verfehlungen auf Ursachen, nicht auf Schuld. Führen Sie bei den wiederkehrenden eine Ursachenanalyse durch und testen Sie jede Abhilfe in einem PDCA-Zyklus. Eine laufende Prozessüberwachung macht das möglich, denn Sie können nicht prüfen, was niemand messbar gemacht hat. Wo derselbe manuelle Schritt monatlich dieselbe Verzögerung verursacht, zahlt sich Workflow-Automatisierung bei Aufnahme oder Routing schneller aus als eine Neuverhandlung des Zielwerts, und Prozessstandardisierung verhindert, dass ein SLA in drei Regionen drei Dinge bedeutet.

Wie SLAs zur Dekoration werden

Die meisten toten SLAs sind auf dieselben wenigen Arten gestorben.

Warum SLAs zur Dekoration werden: Ein leerer gerahmter Vertrag auf einem schlichten Ständer, daneben ein getrenntes Berichtskabel, ein korallenroter, ausgesteckter Stecker.

  • Ein Zielwert, den niemand misst. Wenn kein System die Zahl automatisch erzeugt, existiert die Zahl nicht.
  • Ausschlüsse, die die Zusage verschlucken. Unbegrenzte Wartung, unbegrenzte „vom Kunden verursachte Verzögerung“ und ein Pausenstatus ohne Regeln höhlen ein 99,9-%-Versprechen aus, ohne die Schlagzeile anzutasten.
  • Kein Verantwortlicher und kein Review-Termin. Beides gehört in den Unterschriftenblock, nicht in den Anhang.
  • Durchschnitte statt Perzentile. Ein Mittelwert verbirgt den Ausreißerbereich, und der Ausreißerbereich erzeugt die Beschwerden.
  • Von einem größeren Unternehmen kopierte Zielwerte. Eine P1-Reaktion in 15 Minuten bedeutet ohne Bereitschaftsdienst nichts.
  • Eine Zusage ohne Back-to-back-Vereinbarung. Ein Versprechen, das von einem Team abhängt, das nie etwas zugesagt hat, ist ein Scheck auf das Konto eines anderen.

Häufig gestellte Fragen zu SLA-Beispielen und Vorlagen

Was sollte eine SLA-Vorlage enthalten?

Zwölf Klauseln: Parteien und Geltungsbereich, Servicebeschreibung, Servicezeiten, Metriken, Zielwerte, Messmethode, Ausschlüsse, Berichtswesen, Gutschriften und Abhilfen, Eskalation, Review und Änderungssteuerung sowie Kündigungsauslöser. Am häufigsten fehlen Messmethode, Berichtswesen und Kündigungsauslöser, die eine Vereinbarung durchsetzbar machen.

Was ist der Unterschied zwischen SLA, SLO und SLI?

Ein SLI ist die Rohmessung, ein SLO der darauf gesetzte Zielwert und ein SLA ein Vertrag, der an das Erreichen oder Verfehlen dieser Zielwerte Konsequenzen knüpft. Googles SRE-Praxis schlägt einen Test vor: Fragen Sie, was passiert, wenn der Zielwert verfehlt wird, und wenn es keine ausdrückliche Konsequenz gibt, haben Sie ein SLO.

Was ist der Unterschied zwischen SLA und OLA?

Ein SLA ist die Zusage an den Kunden. Ein OLA ist die Back-to-back-Zusage zwischen internen Teams, die sie erreichbar macht, etwa wenn ein Datenbankteam zusagt, innerhalb einer Stunde zu reagieren, damit der Service Desk eine Behebung in vier Stunden versprechen kann. Wenn ein externer Lieferant das Versprechen stützt, ist das ein Underpinning Contract.

Wie viel Ausfallzeit erlaubt eine Verfügbarkeit von 99,9 %?

Bei einem 30-Tage-Monat erlaubt 99,9 % 43 Minuten und 12 Sekunden, über ein 365-Tage-Jahr 8 Stunden 45 Minuten und 36 Sekunden. Der Wechsel zu 99,99 % senkt die monatliche Toleranz auf 4 Minuten und 19 Sekunden.

Wie misst man die SLA-Erfüllung fair?

Schreiben Sie die Uhrregeln auf, bevor jemand unterschreibt: wann die Uhr startet, wann sie pausiert, ob Geschäfts- oder Kalenderstunden gelten, was als Lösung zählt und wie ein wiedereröffnetes Ticket behandelt wird. Berichten Sie pausierte Zeit und Wiedereröffnungsquoten neben dem Erfüllungsprozentsatz.

Gleichen Servicegutschriften die Kosten eines Ausfalls aus?

Fast nie. Cloud-Gutschriften werden auf künftige Rechnungen angerechnet statt erstattet, und sowohl AWS als auch Google erklären, dass Gutschriften der alleinige und ausschließliche Rechtsbehelf sind, während das Uptime Institute berichtet, dass 57 % der Befragten ihren jüngsten größeren Ausfall bei über 100.000 US-Dollar ansetzen. Steuern Sie das reale Risiko über Redundanz und ein Kündigungsrecht bei chronischem Versagen.

Nehmen Sie die Vorlage, die passt, füllen Sie die Werte in Klammern aus und investieren Sie dann den eigentlichen Aufwand in Messmethode und Ausschlüsse. Diese beiden Klauseln entscheiden darüber, was die Vereinbarung in dem Monat bedeutet, in dem sie zum ersten Mal auf die Probe gestellt wird.

About the author

Linh Ngo

Linh Ngo

Customer Success Operations Manager

Linh Ngo is Customer Success Operations Manager at Rework, focused on AI-led process automation for operations teams, especially order fulfillment and finance workflows. Linh writes about process management and the AI productivity tools that take manual steps out of daily operations, so teams can see where work stalls and fix the process before adding headcount.