Zum Inhalt springen

Ausfallzeit bezeichnet den Zeitraum, in dem ein IT-System, eine Anwendung oder eine Komponente nicht verfügbar ist oder nicht ordnungsgemäß funktioniert. Ursachen reichen von Hardware- und Softwarefehlern über Strom- und Netzwerkausfälle bis hin zu menschlichen Fehlern. In vielen Fällen geht ein Ausfall mit Datenverlust einher, sodass Maßnahmen zur Datenrettung oder Datenwiederherstellung Teil des Wiederanlaufs sein können. Ziel ist es, die Ausfallzeit zu begrenzen und die Funktionsfähigkeit sowie Datenintegrität möglichst schnell wiederherzustellen.

Ausfallzeit in der IT

Ausfallzeiten sind in der IT ein kritischer Faktor mit technischen und wirtschaftlichen Auswirkungen. Sie können zu Produktionsunterbrechungen, finanziellen Verlusten, verpassten Service-Leveln sowie zu Datenverlusten führen. Unternehmen und Organisationen streben daher an, Ausfälle zu vermeiden, schnell zu erkennen und im Störungsfall strukturierte Wiederherstellungsmaßnahmen einzuleiten.

Definition und Abgrenzung

Ausfallzeit ist die Dauer, in der ein System nicht verfügbar ist oder außerhalb spezifizierter Parameter läuft. Sie kann geplant (z. B. Wartung, Updates mit Neustart) oder ungeplant (z. B. Defekt, Störung) auftreten. Die tatsächliche Dauer hängt von der Schwere des Problems, der betroffenen Systemart, der Komplexität von Abhängigkeiten und den verfügbaren Ressourcen zur Fehlerbehebung ab.

Ursachen für Ausfallzeiten

Typische Auslöser sind:

  • Hardwarefehler wie Festplattenabstürze, Controller- oder Netzteildefekte
  • Stromversorgungs- und Netzwerkausfälle, Überspannungen, fehlerhafte USV
  • Softwarefehler, fehlerhafte Updates, Treiberprobleme und Konfigurationsfehler
  • Malware-Befall oder Ransomware mit Beeinträchtigung der Systemverfügbarkeit
  • Menschliches Versagen, etwa versehentliches Löschen, falsche Migrationsschritte oder unbedachte RAID-Rebuilds
  • Physische Schäden durch Umgebungseinflüsse, z. B. Hitze, Feuchtigkeit oder Staub

In der Folge kann es zu Datenverlusten kommen. Je nach Situation ist eine Datenrettung oder Datenwiederherstellung erforderlich, um auf konsistente Datenstände zurückzukehren und den Betrieb fortzusetzen.

Auswirkungen und Messgrößen

Ausfallzeiten beeinträchtigen die Verfügbarkeit von Diensten und die Erfüllung von Service-Leveln. Für Planung und Bewertung haben sich zwei Kenngrößen etabliert:

  • RTO (Recovery Time Objective): angestrebte Zeit, bis ein Dienst nach einem Ausfall wieder funktionsfähig ist.
  • RPO (Recovery Point Objective): maximal tolerierbarer Datenverlust gemessen als Zeitspanne zwischen letztem wiederherstellbaren Stand und Ausfall.

In der Praxis beeinflussen unter anderem Erkennungszeit, Fehlerdiagnose, Ersatzteilverfügbarkeit, Backup-Konzept, Wiederherstellungsverfahren und Abhängigkeiten zu anderen Systemen die tatsächliche Dauer der Ausfallzeit.

Ausfallzeit und Datenrettung

Wenn Backups fehlen oder unvollständig sind, kann eine professionelle Datenrettung helfen, verloren geglaubte Daten zu rekonstruieren. Die Dauer bis zur Wiederaufnahme des Betriebs hängt vom Schadensbild (z. B. logischer Fehler, defekter Datenträger, defektes RAID), vom Datenvolumen und von der erforderlichen Konsistenzprüfung ab. Während eine erfolgreiche Wiederherstellung Ausfallzeit und Datenverlust begrenzen kann, ist der Aufwand je nach Ursache sehr unterschiedlich. Zusätzliche Schreibzugriffe auf beschädigte Datenträger, unkoordinierte Reparaturversuche oder ein unpassendes RAID-Rebuild können die Situation verschlimmern und die Ausfallzeit verlängern.

Maßnahmen zur Reduzierung der Ausfallzeit

  • Solide Backup-Strategie mit klaren RPO/RTO-Vorgaben, regelmäßigen Tests von Wiederherstellungen und dokumentierten Abläufen
  • Redundanz auf geeigneten Ebenen (z. B. RAID mit passender Konfiguration, redundante Netzteile und Netzwerkpfade)
  • Überwachung und Alarmierung, um Störungen frühzeitig zu erkennen
  • Standardisierte Change- und Patch-Prozesse mit Wartungsfenstern (geplante Ausfallzeit) und Rollback-Option
  • Notfall- und Wiederanlaufpläne, die Rollen, Kommunikationswege und Entscheidungskriterien regeln
  • Sorgfältige Diagnostik vor Eingriffen, um Folgeschäden und verlängerte Ausfallzeiten zu vermeiden

Praxisbeispiel

Ein Fileserver mit RAID-5 zeigt Degradierung an, kurz darauf fällt ein zweites Laufwerk aus. Der Dienst ist nicht mehr verfügbar, Nutzer können nicht auf Dateien zugreifen. Liegt ein aktuelles, getestetes Backup vor, kann die Wiederherstellung auf Ersatzhardware oder ein Standby-System die Ausfallzeit deutlich begrenzen. Fehlt ein brauchbares Backup, wird oftmals eine Datenrettung am defekten RAID erforderlich, deren Dauer und Erfolgsaussichten vom konkreten Schaden und der Datenkonsistenz abhängen.

Ausfallzeit – einfach erklärt:

Ausfallzeit ist die Zeitspanne, in der ein IT-System nicht verfügbar ist oder fehlerhaft arbeitet. Sie kann geplant (z. B. Wartung) oder ungeplant (z. B. Defekt) sein und endet, wenn der Dienst wieder funktionsfähig ist. Je nach Ursache können Maßnahmen zur Datenrettung oder Wiederherstellung notwendig werden.

Häufige Fragen und Antworten

Was ist der Unterschied zwischen geplanter und ungeplanter Ausfallzeit?

Geplante Ausfallzeit entsteht durch bewusst angesetzte Maßnahmen wie Wartung, Updates oder Hardwaretausch und wird im Voraus angekündigt. Ungeplante Ausfallzeit tritt unerwartet auf, etwa durch Defekte, Fehlkonfigurationen oder Sicherheitsvorfälle. Beide beeinflussen die Verfügbarkeit, werden in SLAs jedoch häufig unterschiedlich bewertet.

Wie hängen Ausfallzeit, RTO und RPO zusammen?

Die Ausfallzeit ist die tatsächlich verstrichene Dauer bis zur Wiederinbetriebnahme. RTO definiert die Zielzeit, innerhalb derer ein Dienst wiederhergestellt sein soll, RPO den maximal tolerierbaren Datenverlust. Je besser Backup- und Wiederanlaufkonzept zu den RTO/RPO-Vorgaben passen, desto eher bleibt die Ausfallzeit im akzeptablen Rahmen.

Welche Faktoren bestimmen die Dauer einer Datenrettung im Störungsfall?

Entscheidend sind Schadensart (logisch vs. physisch), das betroffene Speichersystem (Einzellaufwerk, RAID, NAS), das Datenvolumen und die erforderliche Konsistenzprüfung. Auch der Zustand der Datenträger und vorangegangene Eingriffe beeinflussen die Dauer. Daher lassen sich pauschale Zeiten nicht seriös angeben.

Was kann ich unmittelbar bei einem Ausfall tun, um die Ausfallzeit nicht zu verlängern?

Nehmen Sie betroffene Systeme aus dem Schreibbetrieb, dokumentieren Sie Symptome und Änderungen und prüfen Sie Logs und Alarme. Vermeiden Sie unkoordinierte Reparaturversuche, unsichere Rebuilds oder Dateisystemchecks auf beschädigten Datenträgern. Orientieren Sie sich an definierten Notfallplänen und ziehen Sie bei Bedarf spezialisierte Hilfe hinzu.

Quelle für Ihr Zitat: Obenstehende Definition darf in kommerziellen und nicht kommerziellen Publikationen (somit auch in Hausarbeiten, Foren, Social Media Seiten) ohne Rückfrage zitiert werden. Kopieren Sie einfach den nachfolgenden Link für Ihr Zitat:

https://www.it-service24.com/lexikon/a/ausfallzeit/

Sie können entspannt sein.
Wir retten Ihre Daten.

Sie können entspannt sein. Wir retten Ihre Daten.
100% kostenlose Analyse!

Senden Sie uns jetzt Ihre unverbindliche Anfrage: Sie erhalten eine kostenlose Analyse und ein unverbindliches Angebot zur Datenrettung mit Festpreisgarantie.

Ihre Daten werden gemäß Datenschutzerklärung verarbeitet, um Ihre Anfrage bearbeiten zu können.
Wir helfen Ihnen gerne!

Häufige Fragen
und Antworten

Für weitere Fragen stehen wir Ihnen gerne zur Verfügung: