Passwort vergessen?

Ihre Vorteile!

Als angemeldeter Benutzer erhalten Sie nicht nur Zugriff auf exklusive Inhalte und Videos, sondern können außerdem die neuen Wotan Dashboards mit verschiedenen Konfigurationen LIVE testen.

Datenschutz ist uns ein wichtiges Anliegen. Mehr Informationen finden Sie auf unserer Datenschutzseite.

Noch nicht registriert?

Newsletter

IT-Verfügbarkeit: Warum 99,9 Prozent nicht reichen

99,9 Prozent IT-Verfügbarkeit: Das Service Level Agreement ist erfüllt, der Monatsbericht zeigt Grün – und trotzdem sind die Anwender unzufrieden. Die Anwendung reagiert langsam, Buchungen müssen wiederholt werden oder ein wichtiger Arbeitsschritt funktioniert nur über einen Umweg. Wie kann eine gute Verfügbarkeitszahl zu einer so schlechten Erfahrung führen?

Eine IT-Verfügbarkeit von 99,9 Prozent erlaubt bei einem Messzeitraum von 365 Tagen rechnerisch bis zu 8 Stunden, 45 Minuten und 36 Sekunden Ausfallzeit pro Jahr. Ob dieser Wert gut ist, hängt jedoch nicht nur von der Dauer ab. Ein Ausfall während der nächtlichen Wartungszeit hat eine andere Wirkung als dieselbe Unterbrechung beim Produktionsstart, im Monatsabschluss oder während der umsatzstärksten Stunden eines Webshops.

Hinzu kommt: Viele Qualitätsprobleme erzeugen überhaupt keine klassische Downtime. Ein Service kann erreichbar sein und seine Aufgabe dennoch nicht in der benötigten Geschwindigkeit, Richtigkeit oder Zuverlässigkeit erfüllen. Genau deshalb ist IT-Verfügbarkeit eine wichtige Kennzahl – aber kein vollständiger Beweis für gute IT-Qualität.

Was IT-Verfügbarkeit misst

IT-Verfügbarkeit beschreibt den Anteil eines vereinbarten Zeitraums, in dem ein IT-System oder IT-Service wie definiert zur Verfügung steht. Vereinfacht wird sie so berechnet:

IT-Verfügbarkeit = (vereinbarte Servicezeit minus Ausfallzeit) geteilt durch die vereinbarte Servicezeit mal 100

Schon die Formulierung „wie definiert“ ist entscheidend. Wird ein Server per Ping geprüft, bedeutet verfügbar zunächst nur, dass er über das Netzwerk erreichbar ist. Wird eine Anwendung aufgerufen, kann die erfolgreiche technische Antwort als verfügbar gelten. Wird dagegen ein vollständiger Bestell- oder Buchungsprozess geprüft, muss am Ende das erwartete fachliche Ergebnis vorliegen.

Auch der Messzeitraum beeinflusst die Aussage. Zählt die Verfügbarkeit rund um die Uhr oder nur während der Geschäftszeiten? Werden geplante Wartungen abgezogen? Beginnt die Ausfallzeit mit dem technischen Fehler, mit dem Alarm oder erst mit der ersten Anwendermeldung? Ohne eindeutige Definition können zwei Berichte unterschiedliche Werte zeigen und dennoch rechnerisch korrekt sein.

Zur Einordnung der Prozentwerte bei einer Messung über 365 Tage:

  • 99 Prozent erlauben bis zu 3 Tage, 15 Stunden und 36 Minuten Ausfallzeit.

  • 99,9 Prozent erlauben bis zu 8 Stunden, 45 Minuten und 36 Sekunden.

  • 99,99 Prozent erlauben noch rund 52 Minuten und 34 Sekunden.

Je höher der Zielwert, desto kleiner wird die zulässige Ausfallzeit. Doch auch vier Neunen beantworten nicht automatisch die Frage, ob der Service aus Anwendersicht gut funktioniert.

Warum 99,9 Prozent täuschen können

Eine hohe IT-Verfügbarkeit kann ein falsches Sicherheitsgefühl erzeugen, wenn Messpunkt und tatsächliche Nutzung nicht übereinstimmen. Fünf Ursachen treten besonders häufig auf.

Das falsche Objekt wird gemessen

Die Verfügbarkeit eines Hosts beweist nicht die Verfügbarkeit der Anwendung. Ebenso beweist eine erreichbare Startseite nicht, dass Anmeldung, Suche, Buchung und Datenübertragung funktionieren. Der gemessene Gegenstand muss deshalb genau jener Leistung entsprechen, die Anwender benötigen.

Langsam gilt noch als verfügbar

Viele Prüfungen unterscheiden nur zwischen erreichbar und nicht erreichbar. Eine Antwort nach 15 Sekunden wird dann genauso als Erfolg gewertet wie eine Antwort nach einer Sekunde. Für Anwender ist der Unterschied erheblich. Lange Wartezeiten unterbrechen den Arbeitsfluss, führen zu wiederholten Eingaben und erhöhen die Fehlerwahrscheinlichkeit.

Durchschnittswerte verdecken Spitzen

Eine gute mittlere Antwortzeit kann regelmäßige Engpässe verschleiern. Vielleicht funktioniert die Anwendung die meiste Zeit schnell, bricht aber jeden Morgen bei Arbeitsbeginn oder zum Monatsende ein. Genau diese Zeiten können geschäftlich besonders wichtig sein.

Nicht alle Nutzer sind gleich betroffen

Ein Service kann im Rechenzentrum und am Hauptstandort verfügbar sein, während eine Niederlassung, VPN-Nutzer oder externe Kunden Probleme haben. Auch Berechtigungen, Endgeräte und Netzwerkwege beeinflussen die erlebte Verfügbarkeit. Ein zentraler Messpunkt erkennt diese Unterschiede nicht immer.

Das Ergebnis ist fachlich unbrauchbar

Eine Schnittstelle kann Daten erfolgreich übertragen, obwohl diese verspätet, unvollständig oder fehlerhaft ankommen. Technisch war der Dienst verfügbar. Der Geschäftsprozess kann das Ergebnis dennoch nicht verwenden. IT-Verfügbarkeit muss daher dort um Qualitätsprüfungen ergänzt werden, wo Richtigkeit und Aktualität entscheidend sind.

Verfügbar heißt nicht nutzbar

Anwender erleben keine Serverstatistik. Sie erleben einen konkreten Arbeitsablauf. Sie möchten eine Bestellung abschließen, einen Auftrag verbuchen, eine Rechnung erstellen oder auf aktuelle Kundendaten zugreifen.

Nehmen wir ein ERP-System mit 99,9 Prozent ausgewiesener Verfügbarkeit. Die Anmeldung funktioniert, doch das Öffnen großer Aufträge dauert regelmäßig zu lange. Speichervorgänge schlagen sporadisch fehl, und Daten aus einem Vorsystem treffen verspätet ein. Keine dieser Einschränkungen muss als vollständiger Ausfall gewertet werden. Für die Fachabteilung entstehen dennoch Wartezeiten, Nacharbeit und Unsicherheit.

Die entscheidende Frage lautet deshalb nicht nur: „Ist das System erreichbar?“ Sie lautet: „Kann der Anwender seine Aufgabe vollständig, richtig und innerhalb einer akzeptablen Zeit erledigen?“

Genau hier unterscheidet sich technische Uptime von nutzbarer IT-Verfügbarkeit. Die erste betrachtet einen definierten technischen Status. Die zweite bewertet, ob die benötigte Leistung am tatsächlichen Nutzungspunkt ankommt.

Kennzahlen mit Aussagekraft

Uptime bleibt die Grundlage, sollte aber durch wenige gezielt ausgewählte Kennzahlen ergänzt werden. Welche davon sinnvoll sind, hängt vom jeweiligen IT-Service und Geschäftsprozess ab.

  • End-to-End-Erfolgsrate: Welcher Anteil repräsentativer Transaktionen wird vom Start bis zum erwarteten Ergebnis erfolgreich abgeschlossen?

  • Antwort- und Prozesszeit: Wie lange dauern einzelne Funktionen und der gesamte Ablauf – auch während Lastspitzen?

  • Fehler- und Abbruchrate: Wie oft treten technische Fehler, fachliche Abbrüche oder wiederholte Eingaben auf?

  • Datenaktualität: Treffen Informationen vollständig und innerhalb der benötigten Zeit im Zielsystem ein?

  • Anwendermeldungen: Werden Störungen zuerst vom Monitoring oder regelmäßig von Anwendern erkannt?

  • Geschäftswirkung: Wie viele Vorgänge bleiben unvollständig, verzögern sich oder erfordern manuelle Nacharbeit?

Das WOTAN Prozess-Monitoring verbindet technische Komponenten mit digitalen Geschäftsprozessen. Ergänzende End-to-End-Prüfungen kontrollieren repräsentative Abläufe aus Nutzungssicht. KPI-Berichte können die Ergebnisse für IT-Betrieb, Service Desk und Management unterschiedlich verdichten.

Damit entsteht kein größeres Zahlenlager, sondern ein aussagekräftigeres Qualitätsbild: Die Prozessprüfung zeigt, dass eine relevante Leistung beeinträchtigt ist. Infrastruktur- und Applikationsdaten helfen anschließend, die Ursache einzugrenzen.

SLA braucht den richtigen Messpunkt

Ein Service Level Agreement schafft Klarheit über vereinbarte Leistungen. Es kann aber nur das absichern, was konkret definiert wurde. Bezieht sich ein SLA ausschließlich auf die Erreichbarkeit eines Servers, kann es erfüllt sein, obwohl die Anwendung langsam oder ein wichtiger Prozess gestört ist.

Für geschäftskritische Services sollten Unternehmen daher festlegen:

  • welcher Service beziehungsweise Prozess gemessen wird;

  • aus welcher Perspektive die Messung erfolgt;

  • welche Service- und Wartungszeiten gelten;

  • ab welcher Antwortzeit ein Service als eingeschränkt gilt;

  • welche Transaktion erfolgreich abgeschlossen werden muss;

  • wie Teilausfälle und betroffene Nutzergruppen behandelt werden.

Nicht jeder dieser Punkte muss Vertragsbestandteil werden. Interne Qualitätsziele können bewusst strenger sein als das formale SLA. Dadurch wird bereits reagiert, bevor eine vereinbarte Grenze verletzt oder ein Problem für viele Anwender sichtbar wird.

IT-Verfügbarkeit richtig messen

Ein realistisches Messmodell muss nicht die gesamte IT-Landschaft auf einmal erfassen. Ein geschäftskritischer Service bietet einen besseren Startpunkt.

1. Mit dem Anwenderziel beginnen

Definieren Sie, was erfolgreich möglich sein muss. „ERP erreichbar“ ist zu allgemein. „Auftrag innerhalb von drei Minuten vollständig verbuchen“ beschreibt eine prüfbare Leistung.

2. Servicezeiten und Qualitätsgrenzen festlegen

Bestimmen Sie, wann der Service benötigt wird und ab wann er als eingeschränkt gilt. Berücksichtigen Sie dabei Spitzenzeiten, Monatsabschlüsse und andere geschäftskritische Phasen.

3. Mehrere Ebenen verbinden

Infrastruktur-Monitoring, Applikationsprüfungen und End-to-End-Monitoring beantworten unterschiedliche Fragen. Gemeinsam zeigen sie Geschäftsauswirkung und technische Ursache.

4. Reale Nutzungspunkte berücksichtigen

Prüfen Sie nicht ausschließlich aus dem Rechenzentrum. Standorte, Netzwerkwege oder externe Zugriffe können ein anderes Bild liefern.

5. Monitoring und Feedback vergleichen

Stellen Sie Messwerte den Tickets und Anwendermeldungen gegenüber. Werden Probleme regelmäßig zuerst von Nutzern gemeldet, fehlen passende Prüfungen oder Schwellenwerte.

6. Reaktionen verbindlich machen

Eine erkannte Abweichung verbessert noch keinen Service. Eine strukturierte IT-Eskalation legt fest, wer handeln muss, wann eine Vertretung übernimmt und wie die Behebung nachvollzogen wird.

Verfügbarkeit laufend verbessern

IT-Verfügbarkeit ist kein einmal eingerichteter Messwert. Anwendungen, Abhängigkeiten, Nutzerzahlen und Geschäftsanforderungen verändern sich. Auch Prüfungen, Schwellenwerte und Qualitätsziele müssen deshalb regelmäßig überprüft werden.

Der BizResilient-Cycle strukturiert diese Verbesserung in vier Schritten:

  • Plan: Kritische Services, Anwenderziele, Messpunkte und Verantwortlichkeiten festlegen.

  • Do: Technische und prozessorientierte Prüfungen sowie Berichte umsetzen.

  • Check: Monitoring-Daten mit Incidents, Anwenderfeedback und Geschäftsergebnissen vergleichen.

  • Act: Prüfungen, Schwellenwerte, Kapazitäten und Eskalationswege gezielt verbessern.

So wird aus einer rückblickenden Verfügbarkeitszahl ein Steuerungsinstrument für stabile und nutzbare IT-Services.

Fazit: Verfügbarkeit braucht Kontext

99,9 Prozent IT-Verfügbarkeit können ein gutes Ergebnis sein. Sie sind aber kein vollständiger Qualitätsnachweis. Entscheidend ist, was gemessen wird, von welchem Standort aus die Prüfung erfolgt und ob der Anwender seinen Vorgang richtig und rechtzeitig abschließen kann.

Unternehmen sollten Uptime deshalb mit Antwortzeiten, End-to-End-Erfolgsraten, Datenqualität, Anwendermeldungen und geschäftlichen Auswirkungen verbinden. Erst dann zeigt die Kennzahl nicht nur, ob ein technisches System läuft, sondern ob der IT-Service seinen Zweck erfüllt.

Gute IT-Verfügbarkeit bedeutet letztlich nicht, dass ein Server möglichst lange grün angezeigt wird. Sie bedeutet, dass Kunden und Mitarbeitende die benötigte digitale Leistung verlässlich nutzen können.

Sie möchten die Verfügbarkeit Ihrer IT-Services und Geschäftsprozesse aussagekräftiger messen? Erfahren Sie mehr über das WOTAN Monitoring-Tool oder vereinbaren Sie ein unverbindliches Gespräch.

Tanja Dirnberger
Marketing Manager, WOTAN Monitoring | GH-Informatik GmbH
Gratis Paper

BizResilient-Cycle

Leitfaden für hochverfügbare und resiliente digitale Geschäftsprozesse.