IT-Betrieb
RAID, Backup und Redundanz: Drei Dinge, die häufig miteinander verwechselt werden
Mehrere Festplatten bedeuten noch lange nicht, dass die Daten gesichert sind
Im Server stecken mehrere Festplatten, das NAS verwendet RAID und für besonders wichtige Systeme gibt es sogar doppelte Netzteile. Auf die Frage nach der Datensicherung lautet die Antwort deshalb manchmal: „Da kann eigentlich nichts passieren, die Festplatten sind doch gespiegelt.“
Genau an dieser Stelle werden drei unterschiedliche Konzepte miteinander vermischt: RAID, Backup und Redundanz.
Alle drei sollen Auswirkungen technischer Probleme begrenzen, schützen aber gegen unterschiedliche Arten von Ausfällen. Eine gespiegelte Festplatte hilft bei einem Hardwaredefekt, stellt aber keine gestern gelöschte Datei wieder her. Ein Backup kann verlorene Daten zurückbringen, sorgt jedoch nicht automatisch dafür, dass der Server unmittelbar weiterläuft. Zwei Server können wiederum für höhere Verfügbarkeit sorgen, schützen aber ebenfalls nicht zwangsläufig vor versehentlich gelöschten oder verschlüsselten Daten.
Wer diese Unterschiede versteht, kann deutlich besser beurteilen, welche Vorsorge für ein Unternehmen tatsächlich vorhanden ist und an welcher Stelle nur scheinbare Sicherheit besteht.
RAID hält einen Speicher trotz Festplattendefekt am Laufen
Ein RAID fasst mehrere Festplatten so zusammen, dass Daten je nach gewählter Variante redundant über mehrere Datenträger verteilt werden.
Bei einer häufig verwendeten Spiegelung werden dieselben Daten beispielsweise gleichzeitig auf zwei Festplatten geschrieben. Fällt eine davon aus, kann das System mit der verbleibenden Platte weiterarbeiten, während die defekte ersetzt wird.
Andere RAID-Varianten verteilen Daten und zusätzliche Prüfinformationen über mehrere Laufwerke und können ebenfalls den Ausfall einzelner Festplatten verkraften.
Der große Vorteil liegt in der Verfügbarkeit. Ein einzelner Festplattendefekt führt nicht automatisch dazu, dass der Server oder das NAS vollständig ausfällt.
Damit erfüllt RAID eine wichtige Aufgabe.
Es bewahrt allerdings nur den aktuellen Zustand des Speichers trotz bestimmter Hardwarefehler. Genau deshalb ist es kein Backup.
Gelöschte Daten werden auch im RAID zuverlässig gelöscht
Wenn ein Mitarbeiter versehentlich einen wichtigen Ordner entfernt, sorgt ein RAID nicht dafür, dass dieser Ordner auf einer zweiten Festplatte erhalten bleibt.
Das System führt die Löschung ordnungsgemäß auf allen beteiligten Datenträgern durch.
Das Gleiche passiert, wenn Schadsoftware Dateien verschlüsselt. Das RAID speichert die neu verschlüsselten Daten genauso zuverlässig redundant wie vorher die brauchbaren Originaldateien.
Auch beschädigte Daten können auf sämtliche Festplatten geschrieben werden.
Ein RAID kennt keinen Unterschied zwischen einer gewünschten und einer unerwünschten Änderung. Seine Aufgabe besteht darin, den aktuellen Datenbestand trotz bestimmter Hardwaredefekte verfügbar zu halten.
Wer frühere Datenstände benötigt, braucht deshalb eine Datensicherung oder andere geeignete Versionierungsmechanismen.
Ein Backup hält frühere Zustände fest
Ein Backup verfolgt einen anderen Zweck. Es erstellt zusätzliche Sicherungsstände, aus denen Daten nach einem Verlust oder einer unerwünschten Veränderung wiederhergestellt werden können.
Damit schützt es gegen Szenarien, bei denen RAID nicht hilft: versehentliches Löschen, Verschlüsselung, beschädigte Dateien oder den vollständigen Verlust eines Speichersystems.
Ein belastbares Backup-Konzept enthält deshalb mehrere Sicherungsstände und möglichst mindestens eine Kopie, die nicht durch dasselbe Ereignis wie die Originaldaten verloren gehen kann.
Dazu gehört insbesondere eine räumlich getrennte Sicherung, wenn produktive Systeme und lokale Backups im selben Gebäude betrieben werden.
Ein Backup kann damit Daten retten, sorgt aber nicht zwangsläufig für eine unterbrechungsfreie Verfügbarkeit.
Wenn der zentrale Server vollständig ausfällt, sind die Daten vielleicht hervorragend gesichert. Bevor Mitarbeiter wieder arbeiten können, muss trotzdem Ersatzhardware bereitgestellt und das System wiederhergestellt werden.
Ein Backup kann vollständig sein und trotzdem einen langen Ausfall bedeuten
Dieser Unterschied ist für die Geschäftsführung besonders wichtig.
Die Aussage „Wir verlieren keine Daten“ beantwortet noch nicht die Frage „Wie schnell können wir wieder arbeiten?“
Ein Server kann vollständig gesichert sein, während die Wiederherstellung auf Ersatzhardware zwölf Stunden dauert. Bei einem kleineren Büro kann das akzeptabel sein, bei einer Produktionsumgebung möglicherweise nicht.
Deshalb gehört zur Datensicherung immer auch die Frage nach der benötigten Wiederherstellungszeit.
Praktische Wiederherstellungstests zeigen, wie lange der vorgesehene Ablauf tatsächlich dauert und ob alle notwendigen Informationen vorhanden sind.
Wenn diese Zeit länger ist, als das Unternehmen ausfallen darf, wird zusätzliche Redundanz interessant.
Redundanz soll den Ausfall einer Komponente auffangen
Redundanz bedeutet grundsätzlich, dass eine wichtige Funktion nicht ausschließlich von einer einzelnen Komponente abhängt.
Ein Server kann zwei Netzteile besitzen, sodass der Defekt eines Netzteils nicht zum sofortigen Stillstand führt. Zwei Netzwerkverbindungen können unterschiedliche Wege verwenden, oder mehrere Server können so aufgebaut sein, dass ein System beim Ausfall eines anderen dessen Aufgaben übernimmt.
Auch ein RAID ist damit letztlich eine Form von Redundanz auf Ebene der Festplatten.
Im Unternehmensalltag wird mit Redundanz allerdings häufig vor allem die Verfügbarkeit kompletter Systeme gemeint.
Wenn eine Anwendung nur wenige Minuten ausfallen darf, kann beispielsweise eine zweite Serverplattform sinnvoll sein, auf der virtuelle Systeme bei einem Hardwaredefekt weiterbetrieben oder schnell neu gestartet werden.
Wie weit solche Maßnahmen gehen sollten, hängt von den tatsächlichen Ausfallkosten ab.
Zwei Geräte sind nicht automatisch unabhängig
Bei Redundanz lohnt sich ein genauer Blick auf gemeinsame Abhängigkeiten.
Zwei Server bringen wenig, wenn beide ausschließlich auf dasselbe zentrale Speichersystem zugreifen und dessen Ausfall beide gleichzeitig lahmlegt. Zwei Netzteile helfen nur begrenzt, wenn beide an derselben Steckdosenleiste und demselben Stromkreis hängen.
Auch zwei NAS-Systeme im selben Serverschrank sind gegenüber Feuer oder Wasser weiterhin gemeinsam gefährdet.
Eine technische Verdopplung ist deshalb nur dann wirkungsvoll, wenn sie den Ausfallpunkt beseitigt, gegen den sie schützen soll.
Das ist auch der Grund, warum ein Unternehmen bei der Bewertung kritischer Einzelpunkte nicht nur Geräte zählen sollte, sondern gemeinsame Abhängigkeiten untersuchen muss.
RAID und Backup ergänzen sich sehr gut
Bei einem wichtigen Dateiserver oder NAS ist die Kombination aus RAID und Backup normalerweise sinnvoll.
Das RAID sorgt dafür, dass ein einzelner Festplattendefekt den täglichen Betrieb nicht sofort unterbricht. Die defekte Platte kann ersetzt werden, während das System weiterarbeitet.
Das Backup schützt dagegen gegen Datenverlust, Bedienfehler, schwerere Hardwaredefekte und andere Ereignisse, bei denen das RAID selbst nicht ausreicht.
Beide Maßnahmen erfüllen damit unterschiedliche Aufgaben.
Wenn ein Mitarbeiter gestern einen Ordner gelöscht hat, wird er aus dem Backup zurückgeholt. Wenn heute eine Festplatte ausfällt, übernimmt zunächst das RAID.
Diese klare Aufgabenverteilung ist wesentlich sinnvoller als die Erwartung, eine einzelne Technik müsse sämtliche denkbaren Fehler abdecken.
Snapshots sind nützlich, aber ebenfalls kein vollständiger Ersatz
Viele NAS- und Speichersysteme bieten zusätzlich Snapshots an. Damit lässt sich der Zustand eines Dateisystems zu bestimmten Zeitpunkten festhalten, sodass ältere Versionen häufig sehr schnell wiederhergestellt werden können.
Das ist besonders praktisch bei versehentlich gelöschten oder veränderten Dateien.
Snapshots liegen allerdings häufig auf demselben Speichersystem wie die produktiven Daten. Fällt das komplette Gerät aus oder wird der gesamte Speicher zerstört, können damit auch die Snapshots verloren gehen.
Sie sind deshalb eine sehr nützliche zusätzliche Schutzschicht, ersetzen aber weiterhin keine unabhängige Sicherung.
Die Kombination kann beispielsweise aus RAID für Festplattenausfälle, Snapshots für schnelle Rücksprünge und externem Backup für schwerwiegende Schäden bestehen.
Damit decken unterschiedliche Techniken unterschiedliche Szenarien ab.
Auch Cloud-Systeme brauchen diese Unterscheidung
Dass ein Dienst in einer Cloud betrieben wird, ändert den Grundgedanken nicht.
Der Anbieter kann seine Infrastruktur hochgradig redundant aufgebaut haben, sodass der Ausfall einzelner Server für den Benutzer gar nicht sichtbar wird. Das schützt die Verfügbarkeit des Dienstes.
Wenn ein Benutzer selbst Daten löscht oder ein Konto kompromittiert wird, entsteht jedoch eine andere Situation.
Je nach Dienst gibt es Wiederherstellungsfunktionen und Aufbewahrungszeiträume, diese müssen aber zu den Anforderungen des Unternehmens passen.
Deshalb sollte auch bei Cloud-Diensten unterschieden werden, wie der Anbieter für technische Verfügbarkeit sorgt und welche Möglichkeiten bestehen, eigene Datenstände nach einem logischen Fehler wiederherzustellen.
Redundanz beim Anbieter ist nicht automatisch dasselbe wie eine eigene Datensicherung.
Die richtige Kombination hängt vom möglichen Schaden ab
Nicht jedes System benötigt RAID, externe Backups und vollständige Hochverfügbarkeit gleichzeitig.
Ein einzelner Bürorechner kann häufig einfach ersetzt werden, weil wichtige Daten zentral gespeichert werden. Ein Dateiserver benötigt möglicherweise RAID und eine belastbare Sicherung, darf aber bei einem vollständigen Hardwareausfall einige Stunden nicht verfügbar sein.
Eine zentrale Produktionsanwendung kann dagegen so wichtig sein, dass zusätzlich technische Redundanz notwendig wird, weil selbst eine getestete Wiederherstellung zu lange dauern würde.
Die Auswahl sollte sich deshalb aus der geschäftlichen Bedeutung ergeben.
Wie viel Datenverlust wäre akzeptabel? Wie lange darf ein System ausfallen? Welche Fehler sollen ohne Betriebsunterbrechung abgefangen werden, und welche dürfen eine Wiederherstellung auslösen?
Diese Fragen sind wichtiger als die Anzahl der Festplatten oder Server.
Für jede Schutzmaßnahme sollte klar sein, welches Problem sie löst
Die einfachste Möglichkeit, die Begriffe auseinanderzuhalten, besteht darin, bei jeder Maßnahme nach ihrem eigentlichen Zweck zu fragen.
RAID soll in erster Linie verhindern, dass der Defekt einzelner Datenträger sofort zum Ausfall des Speichers führt.
Backup soll verlorene oder unerwünscht veränderte Daten und Systeme aus einem früheren Zustand wiederherstellen können.
Redundanz soll dafür sorgen, dass beim Ausfall einer wichtigen Komponente eine andere deren Funktion übernehmen kann oder zumindest ein schneller Wechsel möglich bleibt.
In einer guten Infrastruktur ergänzen sich diese Maßnahmen, anstatt sich gegenseitig ersetzen zu sollen.
Für die Geschäftsführung reicht deshalb eine einfache Prüfung: Welche Fehler überstehen wir ohne Unterbrechung, welche Daten können wir aus einer Sicherung zurückholen und wie lange dauert es, bis wir nach einem größeren Ausfall wieder arbeiten können?
Wenn diese drei Fragen klar beantwortet sind, ist wesentlich besser erkennbar, wie belastbar die vorhandene IT tatsächlich ist, als mit der bloßen Aussage, dass „alles redundant“ oder „ein RAID vorhanden“ sei.