RAID 5: Eine Festplatte fehlerhaft, zweite zeigt Warnung

Ich habe eine Liste von Dingen, die ich versuchen und ggf. aufnehmen möchte, aber das RAID ist aktuell ausgeschaltet. Ich beantworte nach bestem Wissen und Gewissen die üblichen Fragen am Ende dieses Beitrags:

Ich habe ein RAID5-Array. Bei einer Festplatte wird „Fehlerhaft“ (Faulty) angezeigt. Bei einer zweiten steht „Warnung“. Die Festplatte mit „Warning“ zeigt aber keine Fehler, sondern eben nur den Status „Warning“ an.

Ich habe versucht, die andere Festplatte mit dem Status „Faulty“ zu tauschen, aber das Qnap lässt kein Rebuild des RAID-Arrays zu. Ich vermute, das liegt an dem „Warning“-Status der zweiten Festplatte.

Aktuell klone ich die „Warning“-Festplatte auf eine neue in der Hoffnung, dass ich sie wieder ins QNAP einbauen und das Problem lösen kann …

Möglicherweise versuche ich auch, die fehlerhafte Festplatte zu klonen. Oder ich ersetze sie einfach durch eine neue und lasse das RAID versuchen, sich wiederherzustellen?

Für jeden Rat bin ich sehr dankbar.

Betriebssystem, das du für den Zugriff auf dein NAS nutzt

Windows 10 Ultimate, Zugriff über den Webbrowser.

NAS-Modell

TS-932X

Firmware-Version / Build-Nummern – bitte genau angeben, nicht nur „die neueste“

QTS 5.2.9.3499

Netzwerkeinrichtung (z.B. Einzelport oder Port Trunking)

Einzelport

Bei Festplattenfragen bitte auch angeben:

RAID 5

Anzahl der Festplatten

Fünf 4TB HDD Seagate Ironwolf NAS Drives
HDD1 Modell: ST4000VN008-2DR166 (Warning)
HDD2 Modell: ST4000VN006
HDD3 Modell: ST4000VN006 (Faulty)
HDD4 Modell: ST4000VN006
HDD5 Modell: ST4000VN008-2DR166

Eine 4TB SSD Samsung 870 QVO
Modell: MZ-77Q4T0
SDD1 Modell: SSD 870 QVO 4TB

Zwei ausgefallene Festplatten in einem RAID5 und deine Daten sind verloren – genau hier sind Backups wichtig.

Ich habe nur eine ausgefallene Festplatte. Das System hat den RAID gesperrt, weil auf der anderen Festplatte eine Warnung angezeigt wird, obwohl ansonsten keine Fehler gemeldet werden. Die Warnung scheint aufgrund des Alters der Festplatte aufgetreten zu sein – sie ist seit über 2800 Tagen in Betrieb. Ich weiß nicht genau, wie ich das „Warnung“-Flag auf der alten Festplatte entfernen kann, damit ich die ausgefallene Festplatte wiederherstellen kann. Ich versuche gerade, diese Festplatte zu klonen.

Es gibt auch Möglichkeiten, einen RAID 5 mit zwei Ausfällen wiederherzustellen, allerdings mit etwas beschädigten Daten. Ich bin mir noch nicht sicher, ob ich mir diesen Aufwand machen möchte.

Bei einem QNAP NAS müsstest du das RAID entfernen und neu erstellen.

Über 2800 Tage Nutzung … vermutlich solltest du das Laufwerk ersetzen.

Woher weißt du, dass die Festplatte keinen Fehler hat? Hast du wenigstens einen Bad-Block-Scan durchgeführt? Hast du sie mit dem Tool des Festplattenherstellers getestet?

Das Warnflag zu löschen wäre meines Erachtens möglich, aber falls die Festplatte wirklich Probleme hat, wird das RAID beim Wiederaufbau beschädigt.

Auf jeden Fall solltest du die Daten so bald wie möglich sichern — falls das nicht schon passiert ist.

Du hast zwei problematische Festplatten (das schreibst du ja im Titel), wenn das Problem bei der zweiten Festplatte ein Lesefehler ist… die Daten sind verloren.

Danke, ich weiß, wie RAID 5 funktioniert. Bei einem Laufwerk wurde „Warning“ angezeigt, was meiner Meinung nach etwas ungenau ist. Es wurden ansonsten keine Lese- oder Schreibfehler angezeigt. Ich habe auch ein Backup, aber das umfasst nicht 100 % meiner Daten, daher werde ich versuchen, das Ganze wieder zum Laufen zu bringen, bevor ich aufgebe und alles lösche.

Ich habe die beiden problematischen Laufwerke geklont und die Klone ins Gehäuse eingesetzt. Weiß jemand, ob das QNAP-Betriebssystem (QNAP OS) es erlaubt, das RAID nur zum Lesen zu laden, um eine mögliche Datenkorruption zu verhindern?

Wenn beide geklonten Laufwerke drin sind, was sagt ein md_checker? Falls die Events nicht zu weit auseinander liegen, kannst du einen Soft-Assembly über die CLI versuchen.

Du könntest auch ein Support-Ticket bei QNAP erstellen, und sie könnten die Festplatte möglicherweise diagnostizieren oder manuell für dich wiederherstellen.

Hey, danke! Ja, ich bastle gerade mit dem Qnap. Das Laufwerk mit der Warnung zeigt keine Fehler außer der Meldung, dass es unterhalb des Schwellenwerts arbeitet. Allerdings scheint mich das daran zu hindern, das Array auf der ausgefallenen Festplatte wiederherzustellen.

Ich habe ein Ticket eröffnet. Außerdem habe ich die Spezifikationen für meinen Build in diesem Thread aktualisiert.

Die Screenshots zeigen allerdings mehr als 300 fehlerhafte Sektoren, und das Laufwerk versucht vermutlich gerade, diese zu reparieren oder neu zuzuweisen. Falls das Laufwerk das nicht schafft, hast du keinen Paritätsschutz, um die Daten wiederherzustellen.

Einer meiner HGST-Festplatten läuft schon seit über 2400 Tagen und sie funktioniert einwandfrei. Keine Fehler oder sonstiges.

Ich möchte noch erwähnen, dass man die Warnmeldung irgendwo in QTS anpassen kann. Aber ich glaube nicht, dass das den Rebuild stoppt. Ich wette, es liegt an der ungewöhnlichen Sektoranzahl, wie @dolbyman beschrieben hat.

Danke, dass du mich darauf hingewiesen hast. Mir war nicht klar, dass „abnormal“ einen Fehler darstellt.

Wie kann ich den Status der QNAP-Wiederherstellung von abnormalen Sektoren überprüfen?

Die Festplatte stellt die Sektoren wieder her (oder versucht es zumindest). Manche Festplatten können das nur machen, wenn ansonsten keine „Aktivität“ stattfindet. Das kann Tage, Wochen oder sogar ewig dauern. Es hängt alles davon ab, was das Problem ist und ob die Festplatte diese Sektoren reparieren kann.

Es sieht so aus, als würde ich die Situation nur verschlimmern :nerd_face:. Vielleicht hätte ich die defekten Laufwerke einfach drin lassen sollen, um zu sehen, ob sich das System erholt. Ich habe gerade genug Ahnung von RAID, um am Ende alles schlimmer zu machen. Offenbar hat das Klonen der Laufwerke das System verwirrt, welches Laufwerk verdächtig war.

Danke für deine Hilfe.

Hier ist der md_checker-Bericht

Ich vermute, dass die md1-Festplatte die geklonte Festplatte ist, die nicht automatisch eingebunden wird (weil sie eine andere UUID hat).

Hast du die „Warning“-Festplatte geklont oder irgendwie die „Faulty“-Festplatte?

Danke für die Hilfe. Meine Vorgehensweise war bisher immer, Festplatten alle paar Jahre auszutauschen, auch wenn sie keine Fehler zeigen. Diese habe ich aber irgendwie verpasst. :sad_but_relieved_face:

Weißt du, ob es eine Möglichkeit gibt, das System daran zu erinnern, wenn Laufwerke alt sind? Und auch eine Erinnerung, wenn mit einer Festplatte ein Problem besteht? Ich glaube, die Box hat eine rote LED direkt am Gerät. Noch besser wäre es allerdings, wenn das System einfach auf Nur-Lesezugriff umschalten würde — das würde ich sofort merken und den Server checken.

Ich habe beide Festplatten geklont: die mit der Warnung und die fehlerhafte. Zuerst habe ich versucht, mit der geklonten Warnfestplatte auf das RAID zuzugreifen, während die fehlerhafte Festplatte entfernt war. Als ich keinen Lesezugriff bekommen habe, habe ich die geklonte fehlerhafte Festplatte eingesetzt.

Vielleicht hat das RAID versucht zu starten und wurde dadurch beschädigt? Keine Ahnung.

Aktuell habe ich beide problematischen Festplatten (Warnung & Fehler) wieder eingesetzt, für die der Bericht erstellt wurde.

Schwer zu sagen ohne praktische Erfahrung, du könntest versuchen, ein Ticket zu eröffnen und schauen, was der Support dazu meint.

Andere Alternativen wären RAID-Assemblierungsprogramme wie

Danke für deine Hilfe.

Ich habe ein Ticket eröffnet. Sie haben mit Anweisungen geantwortet, damit sie sich per Remote-Verbindung zum Server verbinden können. Ich bekomme jedoch einen Fehler, den ich ihnen geschickt habe. Bis jetzt habe ich noch nichts von ihnen gehört. Ich bin die Anweisungen aus ihrer E-Mail durchgegangen und habe die Ticketnummer sowie meinen Login mehrfach überprüft.