
RAID-Array im Degraded-Modus: Dringende Schritte zur Datenrettung
RAID-Array im Degraded-Modus: Dringende Schritte zur Datenrettung
Zeigt Ihr RAID-Controller den Status „DEGRADED“? Leuchtet die Verwaltungsoberfläche orange oder rot? Dann haben Sie Stunden, vielleicht nur Minuten, bevor sich die Lage dramatisch verschlechtern kann.
Der Degraded-Zustand bedeutet, dass eine Festplatte ausgefallen ist und das Array ohne volle Redundanz läuft. Das Array funktioniert noch, aber ein weiterer Ausfall bedeutet Datenverlust.
Was der Degraded-Status bedeutet
Definition
Ein RAID-Array ist im Degraded-Zustand, wenn eine oder mehrere Festplatten ausgefallen sind, die Zahl der Ausfälle die Toleranz der RAID-Konfiguration aber noch nicht überschritten hat:
| RAID-Typ | Toleriert | Degraded nach |
|---|---|---|
| RAID 1 | 1 Festplatte | 1 Ausfall |
| RAID 5 | 1 Festplatte | 1 Ausfall |
| RAID 6 | 2 Festplatten | 1–2 Ausfällen |
| RAID 10 | 1 pro Spiegel | 1 Ausfall im Paar |
Wie das Array weiterarbeitet
Werden Daten aus dem Bereich der ausgefallenen Festplatte angefordert, berechnet das Array die fehlenden Daten aus der Parität (RAID 5/6) oder liest sie vom Spiegel (RAID 1/10). Das funktioniert, aber:
- Es ist langsamer
- Es belastet die verbleibenden Festplatten zusätzlich
- Ein weiterer Ausfall = Katastrophe
Warum es ein kritischer Zustand ist
Keine Reserve: Bei einem RAID 5 im Degraded-Zustand bedeutet schon ein einzelner fehlerhafter Sektor auf einer der verbleibenden Festplatten Datenverlust.
Höhere Last: Die verbleibenden Festplatten gleichen den Ausfall aus. Mehr Arbeit = höheres Risiko eines weiteren Ausfalls.
Dominoeffekt: Festplatten aus derselben Charge sind gleich alt. Ist eine ausgefallen, sind die anderen wahrscheinlich nicht weit davon entfernt.
Wie schnell Sie handeln müssen
Risiko im Zeitverlauf
Erste Stunden: Das Array funktioniert, aber jede Minute Betrieb erhöht das Risiko. Die verbleibenden Festplatten stehen unter Stress.
Tage: Das Risiko eines weiteren Ausfalls wächst weiter. Festplatten desselben Modells und Alters haben oft eine ähnliche Lebensdauer – ist eine ausgefallen, kann die nächste bald folgen.
Wochen/Monate: Das Unternehmen ignoriert die Warnungen. „Es läuft doch.“ Bis zu dem Moment, in dem es nicht mehr läuft.
Faustregel
Je älter die Festplatten, desto schneller müssen Sie handeln. Ein Array mit neuen Festplatten lässt Ihnen mehr Zeit. Ein Array mit fünf Jahre alten Festplatten ist eine tickende Zeitbombe.
Das sollten Sie NIEMALS tun
1. Nicht mehrere Festplatten gleichzeitig tauschen
Warum man es tut: „Eine Festplatte ist schon ausgefallen, dann tausche ich die alten gleich alle mit aus.“
Was passiert:
- Sie entfernen mehrere Festplatten
- Der Controller verliert Informationen
- Das Array wird unter Umständen initialisiert (= gelöscht)
- Alle Daten gehen verloren
Richtig: Tauschen Sie nur die eine ausgefallene Festplatte. Warten Sie, bis der Rebuild abgeschlossen ist. Erst dann kommt gegebenenfalls die nächste an die Reihe.
2. Keinen Force Rebuild erzwingen
Was ein „Force Rebuild“ ist: Ein Befehl, der den Controller zwingt, den Rebuild trotz Warnungen zu starten.
Wann er Daten zerstört:
- Wenn der Controller nicht weiß, welche Festplatte die aktuellen Daten enthält
- Wenn die Metadaten beschädigt sind
- Wenn die ausgefallene Festplatte falsch identifiziert wurde
Richtig: Wenn Sie nicht genau wissen, was Sie tun, verzichten Sie auf einen Force Rebuild. Wenden Sie sich an einen Experten.
3. Das Array nicht initialisieren
Unterschied zwischen Initialize und Rebuild:
- Rebuild: stellt die Daten aus der Parität auf einer neuen Festplatte wieder her
- Initialize: legt ein leeres Array an und löscht alles
Warum es passiert: Die Schaltflächen liegen in der Oberfläche nah beieinander. Ein Klick entscheidet über Ihre Daten.
Richtig: Prüfen Sie vor jedem Klick dreimal. Im Zweifel nicht klicken.
4. Keine weiteren Festplatten abziehen
Warum man es tut: „Ich ziehe die Festplatte heraus und stecke sie wieder ein, vielleicht hilft das.“
Was passiert:
- Der Controller verliert die Synchronisation
- Festplatten können vertauscht werden
- Metadaten können beschädigt werden
Richtig: Lassen Sie die Festplatten, wo sie sind. Dokumentieren Sie den Zustand. Holen Sie sich Hilfe.
5. Keine Datenrettungssoftware auf dem Array installieren
Warum es nicht funktioniert: Datenrettungssoftware ist für einzelne Datenträger gedacht, nicht für RAID-Arrays. Sie kann Striping und Parität nicht interpretieren.
Was sie verschlimmern kann: Die Software kann zusätzliche Schreibvorgänge auf dem Array auslösen und dabei Daten überschreiben.
Richtig: Datenrettungssoftware nur auf Sektorkopien der Festplatten einsetzen, nie auf dem laufenden Array.
Was Sie RICHTIG machen
Schritt 1: Betrieb stoppen
- Benutzer über den Ausfall informieren
- Anwendungen beenden, die das RAID nutzen
- I/O auf dem Array minimieren
- Den Server noch nicht ausschalten (Daten im RAM des Controllers würden verloren gehen)
Schritt 2: Dokumentieren
Fotografieren:
- Status-LEDs der Festplatten
- Verwaltungsoberfläche
- Ereignisprotokolle
Notieren:
- Was vor dem Ausfall passiert ist
- Die genaue Uhrzeit
- Alle Fehlermeldungen
Das ist entscheidend für die Diagnose und eine mögliche Datenrettung.
Schritt 3: Sichern, was geht
Wenn das Array noch lesbar ist:
- Die wichtigsten Daten zuerst sichern
- Auf einen externen Speicher kopieren
- Nicht alles auf einmal kopieren (zu hohe Last)
Vorsicht: Das Kopieren belastet die verbleibenden Festplatten. Wägen Sie das Risiko eines weiteren Ausfalls gegen den Wert der Sicherung ab.
Schritt 4: Experten kontaktieren
Was Sie uns mitteilen sollten:
- RAID-Typ (0, 1, 5, 6, 10)
- Anzahl und Kapazität der Festplatten
- Controller-Modell
- Was wann passiert ist
- Wie kritisch die Daten sind
Was Sie vorbereiten sollten:
- Zugang zum Server (physisch oder remote)
- Ansprechpartner in der IT
- Wer Kosten freigeben darf
Kann ich ein RAID im Degraded-Zustand weiter betreiben?
Kurzfristig (Stunden): möglich
Wenn Sie einen kritischen Prozess abschließen müssen, kann ein RAID im Degraded-Zustand weiterlaufen. Aber:
- Last minimieren
- Zustand überwachen
- Auf einen Ausfall vorbereitet sein
Langfristig: NEIN
Risiken des Weiterbetriebs:
Weiterer Festplattenausfall: Ein fehlerhafter Sektor auf den verbleibenden Festplatten = Datenverlust
Überhitzung: Die verbleibenden Festplatten arbeiten mehr und erzeugen mehr Wärme
Stromausfall: Im Degraded-Zustand ist das Array anfälliger
Psychologische Falle: „Es läuft doch“ – bis zu dem Moment, in dem es nicht mehr läuft
Überwachung und Vorbeugung
SMART-Überwachung
Überwachen Sie die SMART-Werte aller Festplatten:
- Reallocated Sector Count: steigend = Festplatte stirbt
- Current Pending Sector: ungleich null = Problem
- Spin Retry Count: ungleich null = mechanisches Problem
Alarmierung
Richten Sie Benachrichtigungen ein für:
- Degraded-Status
- SMART-Warnungen
- Hohe Festplattentemperatur
- Ungewöhnliche Einträge in den Ereignisprotokollen
Hot Spare
Eine Festplatte, die am Array angeschlossen, aber nicht in Benutzung ist. Fällt eine Festplatte aus, übernimmt das Hot Spare automatisch ihren Platz und der Rebuild startet.
Vorteile:
- Automatische Reaktion
- Kürzere Zeit im Degraded-Zustand
Nachteile:
- Der Rebuild bleibt riskant
- Kosten für eine ungenutzte Festplatte
Regelmäßige Prüfungen
- Monatliche Prüfung des RAID-Status
- Vierteljährliche Prüfung der SMART-Werte
- Jährliche Überprüfung von Konfiguration und Kapazität
Fallbeispiel
Ausgangslage
Ein mittelständisches Unternehmen mit einem RAID 5 aus 8 Festplatten im Fileserver. Seit vier Jahren im Einsatz. Eine Festplatte fiel aus.
Was passierte
Der IT-Techniker sah „RAID Degraded“ und bestellte eine neue Festplatte. Da der Server aber „lief“, hatte es niemand eilig. Die Lieferung sollte fünf Tage dauern.
Tag 4: Eine zweite Festplatte fiel aus. Die Daten waren verloren.
Was richtig gewesen wäre
- Den Betrieb sofort minimieren
- Kritische Daten auf eine externe Festplatte sichern
- Die Ersatzfestplatte per Expresslieferung bestellen
- Für einen sicheren Rebuild professionelle Hilfe in Betracht ziehen
Lehren
- Degraded-Status = dringender Zustand
- Die Zeit arbeitet gegen Sie
- Vier Jahre alte Festplatten sind in der Risikozone
- Eine Expresslieferung kostet nur einen Bruchteil verlorener Daten
FAQ
Wie lange kann ein RAID im Degraded-Zustand laufen?
Technisch unbegrenzt. In der Praxis gilt: Je länger, desto höher das Risiko. Wir empfehlen, das Problem innerhalb von Stunden zu lösen, nicht erst nach Tagen.
Kann ich die Festplatte selbst tauschen?
Wenn Sie Erfahrung haben und sich sicher sind: ja. Wichtig ist:
- Die ausgefallene Festplatte richtig identifizieren
- Eine kompatible Ersatzfestplatte verwenden
- Nicht „Initialize“ statt „Rebuild“ wählen
Wenn Sie unsicher sind, kontaktieren Sie uns vorher.
Was passiert, wenn eine weitere Festplatte ausfällt?
RAID 5: Datenverlust (keine Redundanz mehr) RAID 6: Läuft noch, aber in einem sehr kritischen Zustand RAID 10: Hängt davon ab, welche Festplatte ausfällt (anderes Spiegelpaar = OK)
Brauchen Sie Hilfe?
Wenn Ihr RAID im Degraded-Zustand ist und Sie bei den nächsten Schritten unsicher sind, schildern Sie uns Ihren Fall schriftlich – die Ersteinschätzung ist kostenlos, und Sie erhalten ein verbindliches Angebot, bevor die Datenrettung beginnt. Keine Daten, keine Kosten. Für geschäftskritische Systeme bieten wir die Express-Bearbeitung (12–48 h) an.
Kostenlose Ersteinschätzung anfordern →