RAID 5 壞一隻碟唔驚,壞兩隻呢?數據恢復指南
資料恢復 2026-10-08 CentralComputer Team

RAID 5 壞一隻碟唔驚,壞兩隻呢?數據恢復指南

RAID 5 壞一隻碟唔驚,壞兩隻呢?數據恢復指南

RAID 5 壞一隻碟唔驚,壞兩隻呢?數據恢復指南

舊年年尾,荔枝角有間印刷廠打嚟,部 Dell server 行 RAID 5,四隻 2TB 碟,入面係成間廠嘅 ERP 數據同客稿。朝早返工發現 server 著唔起,RAID 卡話兩隻碟 offline。廠長把聲都震埋:「尋日先壞咗一隻,我哋諗住週末先換,點知今朝第二隻都死埋。」我同佢講實話:「RAID 5 死兩隻,係最棘手嘅情況之一,但唔係冇得救。」今日深入講下 RAID 5 嘅原理、點解死兩隻咁大鑊,同埋仲有咩方法救。

RAID 5 原理:用一隻碟嘅空間換安全

用個簡單比喻:RAID 5 就好似四個人夾份做數,每人負責一部份,但係每人手上都有一頁「驗算紙」,記住其他三個人啲數加埋係幾多。如果其中一個人唔見咗,剩低三個人可以用驗算紙計返佢嗰份出嚟。

技術上講:

  • 最少 3 隻碟,通常 4-6 隻
  • Parity(驗證位)分散喺所有碟度,唔係集中喺一隻(嗰個叫 RAID 4,已經冇人用)
  • 可用容量 = (N-1) × 單隻容量:四隻 2TB,實際用到 6TB,一隻嘅空間用嚟做 parity
  • 容許死一隻碟:任何一隻死,剩低嘅 N-1 隻可以用 parity 計返
  • 死兩隻 = 理論上冇得計:因為每個 stripe 淨係得一份 parity,唔見兩份資料,數學上計唔返

點解現實中死兩隻唔係世界末日?

理論上 RAID 5 死兩隻係冇得救,但現實有幾個變數:

  1. 唔係兩隻都完全死:多數情況係一隻完全讀唔到,另一隻係部份壞道。部份壞嗰隻,可能八成 sector 仲讀到,淨係有啲位讀唔到。咁我哋就可以用讀到嘅部份 + parity,逐個 stripe 計,救返大部份。
  2. 壞嘅時間唔一樣:第一隻可能係三個月前死,期間個 RAID 係 degraded 狀態跑緊,parity 資料仲係舊嘅。如果第二隻係最近先死,我哋有機會用第一隻死之前嘅 parity 狀態做參考。
  3. 唔係所有 stripe 都有嘢:硬碟唔係隻隻位都寫滿。如果壞道啱啱喺冇寫嘢嘅空白位,實際損失可能好少。我哋會先分析邊啲 stripe 有實際資料,集中火力救嗰啲。
⚠️ 關鍵概念:RAID 5 嘅「死兩隻冇得救」係指數學上完美情況。現實中硬碟唔會死得咁乾脆,總有啲讀得返、啲讀唔返。專業恢復就係喺呢啲灰色地帶搵出路。

荔枝角印刷廠個案:點樣救返七成

四隻 2TB 碟,編號 0-3。檢查結果:

  • Disk 0:完全死,馬達唔轉(物理損壞,要開盤)
  • Disk 1:部份壞道,約 15% sector 讀唔到
  • Disk 2、Disk 3:健康

我哋嘅策略:

  1. 先救 Disk 0(開盤):無塵室開盤換磁頭,逐個面讀。呢隻最花時間同金錢,但係佢上面有獨一無二嘅資料,唔讀唔得。最後讀返約 70% sector。
  2. Disk 1 做鏡像,跳過壞道:用專業設備,遇到壞道自動跳過,唔硬讀。讀返 85% 可用資料。
  3. Disk 2、3 直接鏡像:呢兩隻健康,完整讀出。
  4. 分析 RAID 參數:呢部係 Dell PERC 卡,RAID 5,stripe size 64KB,parity 輪轉方式係 left-symmetric(Dell 預設)。用咗半日時間確認,因為搞錯 parity 方向,成個重組出嚟都係垃圾。
  5. 逐 stripe 重組:每個 stripe 有 4 個 block(3 data + 1 parity)。如果個 stripe 入面四個 block 都讀到,直接用;如果有一個讀唔到,用 parity 計;如果有兩個讀唔到,就標記為損壞,睇下個檔案系統有冇辦法跳過。
  6. 掛載 NTFS,撈檔案:呢部 server 行 Windows,檔案系統係 NTFS。用咗兩日時間逐個 MFT entry 檢查,最後救返約七成檔案。ERP 數據庫主檔救返,可以開到;有啲舊嘅客稿圖片損壞咗。

成單用咗 8 日,收費 $28,000(包開盤)。廠長話:「七成都好過零,起碼唔使執笠。」之後佢哋即刻買咗兩部 NAS,一部 local RAID 6,一部放喺第二個廠房做異地備份。

RAID 5 vs RAID 6 vs RAID 10:點揀?

經過呢單嘢,好多客問我應該用咩 RAID。簡單比較:

  • RAID 5:死一隻唔驚,死兩隻大鑊。適合 4-6 隻碟、追求容量同速度平衡。唔適合超過 8 隻碟(rebuild 時間太長,風險高)。
  • RAID 6:死兩隻都唔驚(雙 parity)。適合 6 隻以上、資料重要。代價係少咗一隻碟容量,同埋寫入慢啲。而家我哋一律建議重要資料用 RAID 6。
  • RAID 10(1+0):鏡像加條帶,速度最快,死一隻即刻有鏡像頂住。但係容量得返一半(四隻 2TB 得返 4TB 用)。適合數據庫呢啲要速度嘅場景。
  • RAID 0:冇任何保護,死一隻就全散。只適合暫存、cache,或者已經有完善備份嘅情況。唔好放重要嘢。

我嘅建議:而家硬碟平,直接上 RAID 6。多一隻碟嘅成本,換嚟嘅係 rebuild 嗰陣唔使提心吊膽。呢個係我哋幫客設計儲存方案嗰陣嘅標準答案。

硬件 RAID 卡 vs 軟件 RAID

  • 硬件 RAID 卡(Dell PERC、HP Smart Array):RAID 設定喺張卡度,卡死咗要搵返同型號或者兼容型號先讀到。我哋有唔同牌子嘅卡做測試,但係太舊嘅型號可能搵唔到。所以用硬件 RAID 卡,一定要記低型號同 firmware 版本。
  • 軟件 RAID(Linux mdadm、Windows Storage Spaces):設定喺硬碟嘅 superblock 度,搬去邊部機都認到。救起上嚟直接啲,唔使靠張卡。
  • 主機板內建 RAID(Intel RST):半硬件半軟件,最麻煩。換底板可能認唔到,要人手分析。我哋見過唔少呢啲 case,要逐隻碟睇 metadata 先組得返。

收費同成功率老實講

  • RAID 5 死一隻(標準 rebuild 失敗):$5,000-$10,000,成功率 90%+
  • RAID 5 死兩隻(一隻全死一隻部份):$15,000-$30,000,成功率 60-80%,視乎壞道分佈
  • RAID 5 死兩隻(兩隻都要開盤):$30,000 起,成功率 40-60%
  • RAID 卡死(碟冇事):$3,000-$6,000,成功率 95%+(最易救)

每單免費檢查,報實價先開工。開盤係無塵室工序,香港冇幾間做到,我哋係其中一間有自家無塵室嘅。

FAQ

1. 問:RAID 5 rebuild 緊嗰陣可唔可以照用 server?

答:可以,但係唔建議。Rebuild 已經令啲碟好忙,再加正常 workload,會拖慢 rebuild 速度,仲會增加第二隻碟死嘅風險。如果係 production server,最好揀夜晚或者 weekend 做,同埋事先通知 user 會慢。

2. 問:我想由 RAID 5 轉 RAID 6,得唔得?

答:得,但係要加碟同埋要 migrate。大部份 RAID 卡支援 online migration,但係過程要好耐(幾十個鐘),中間唔可以斷電。最安全係先 backup 晒,再重新建立 RAID 6,最後還原。呢啲 migration 我哋有做,收費視乎容量。

3. 問:SSD 行 RAID 5 有冇唔同?

答:有。SSD 冇機械 parts,唔會有壞道擴散問題,但係有寫入壽命(TBW)同埋突然死亡(唔似 HDD 會先有異響預警)。SSD RAID 5 rebuild 快好多,但係如果隻 SSD 係韌體 bug 死,成隻讀唔到,同 HDD 物理死一樣麻煩。另外 SSD 要開 TRIM,但係好多 RAID 卡唔支援,會影響壽命。

4. 問:雲端可唔可以代替 RAID?

答:唔同嘢。RAID 係防硬件死,雲端備份係防成個 site 出事(火災、盜竊、勒索病毒)。最好係兩個都有:local 用 RAID 6 保日常運作,雲端做異地備份。我哋幫客設計親都係咁建議,唔好二揀一。

總結

RAID 5 唔係唔好,但係你要明白佢嘅極限:只係保到一隻碟。而家啲碟容量越嚟越大,rebuild 時間越嚟越長,第二隻碟喺 rebuild 途中死嘅機會越嚟越高。如果你而家仲用緊 RAID 5 放重要資料,認真諗下轉 RAID 6,或者至少確保有完善嘅離線備份。出咗事唔好拖,即刻停機,WhatsApp +852 6558 6806,我哋免費評估。

延伸閱讀:NAS 選購指南、數據備份服務。

覺得這篇文章有幫助?

歡迎分享給您的朋友或同事。

致電我哋