[文長 已更新] synology DS710+ 和 DX510 raid 5 spare 系統崩毀過程

我自己的DS409也曾經發生過類似的狀況, 不過不是機器的問題, 是WD綠標的硬碟,
第一次是我覺得應該不會那麼容易掛, 建了JBOD來存, 結果馬上給我壞一顆(事後測試硬碟SMART異常),
資料幾乎都撈不回來; 第二次就不再相信硬碟了, 在硬碟送修回來後建SHR; 果不其然用一段時間後,
同時買的同一批綠標硬碟又給我掛了一顆, 好險這次有保護, 不然就慘兮兮嘍!!!

同一批新的硬碟不會一起壞, 這實在是見仁見智,
同一批一樣型號的硬碟, 我覺得一起的壞的機會應該是比較大吧?
畢竟是同一批, 可能都有一樣的問題, 我自己和朋友的例子都有看到阿

其實建議, 可以的話, 最好保留命案現場, 請Synology的傻破來幫你分析兇手是誰,
資料應該也可以幫你撈, 看來已經重灌了, 我猜本來有系統的硬碟你應該也破壞了?
如果是這樣的話, 有點小可惜!!!

jahon2013 wrote:
要是我因為機器本身出...(恕刪)
看了樓主的文章,真的很為他難過... 最不想看到的就是丟資料啊...

也很同意 shinex 所說的,我覺得在第一次修復失敗就應該停止所有動作,
直接聯絡原廠了. 遇到不正常狀況,就是先 "請專業的來"...

其他購買設備,自行修復,重新安裝等等的動作,很容易讓情況變得更複雜...
希望往後有人不幸遇到類似狀況的時候,可以注意啊...

也希望樓主可以找到方法把資料救回來了

slk wrote:
其中兩顆是WD綠標沒錯
不過是在synology的正式support list上
雖說WD會建議您用更高階的HD
我也聽過之前的一些問題
不過WD該HD我用了一段時間了
都沒有問題
我相對覺得是少數或是某相批號的問題


這不是少數批號
可以說是先天的缺點
而且support list說明的是可以裝
沒人規定裝多顆硬碟一掉要上RAID(這就是盲點)


引用這篇的內容
http://www.mobile01.com/topicdetail.php?f=297&t=2183686&m=s&s=6&r=6&last=28299927
ST-15K.3 wrote:
WD DESKTOP系列硬碟有錯誤時,硬碟會進入deep recovery cycle模式,並進行2分鐘的修復動作,一般磁碟陣列控制器僅允許修復7~15秒,因此當硬碟沒有回應時,硬碟將被控制器視為故障,因此WD不建議使用 WD Desktop系列硬碟用於磁碟陣列環境之下

白話點就是他牌的再SMART亮警告可能還可以正常運作(可在15秒內完成)
再WD DESKTOP系列亮警告時可能就直接出局(在加上綠標又容易....)
除非急用,不然反而建議硬碟要一顆一顆買
中間也要間隔一些時間,就是避免同一批硬碟一起壞
我的Synology NAS容量預計再兩個月也要滿了
屆時也要升級硬碟容量,預計買3顆3TB回來換,第四個槽仍放一顆現有1TB獨立使用
所以現在就已經買了一顆3TB的放著了...一個月買一顆
我不入敗家地獄,誰入地獄?
真的很謝謝大家的建議
我對於資料救回來的期待不大
也暫沒有足夠的時間去評估受損的狀況
我要確認等到新的NAS到了之後
再看看第二波損毀(raid 6損毀剩下的兩顆HD)可以救回多少資料

其實是第一次遇到這災難
所以處理上可能不是很完善
因為當下的反應就是努力掙扎想要救回資料
沒想到透過修復反倒讓情況更糟

在不能改變的事實下
我只希望可以知道如何避免一樣的錯再發生一次
之後我會在我的Blog內完整更新後續狀況
有興趣知道的朋友可以再去看看

說真的
從一顆HD 40MB用到現在
買過的不同HD應該有不下30顆吧~~~
完全沒壞過
第一次建立了自以為比較安全的Raid
事情比我想的複雜的多
也算是給我上了一課
在這一點上 我還是只好含淚的說"也算值得"...........................
說真的~不同牌子不同型號不同容量....最好不要拿來做RAID..這算常識
通常企業RAID都會多買一些同規格型號硬碟來當spare替換用

另外
WD官網訊息,當WD DESKTOP系列硬碟有錯誤時,硬碟便會進入deep recovery cycle模式,並進行為時2分鐘的修復動作,但一般磁碟陣列控制卡允許修復的時間僅為7~15秒,因此當硬碟沒有回應時,變將硬碟視為故障,而無法正常使用,故WD不建議使用WD Destop系列硬碟用於磁碟陣列環境之下...

尤其綠標....做RAID的災情網路上已經傳遍了....Orz

看你說明的修復流程
推測為新買的2WD一顆是SPARE,一顆做進R5
結果因官網所述問題,R5掛掉...將有同樣問題的SPARE補進來....當然還是一樣下場

你沒說明壞的是哪兩顆~
照理講spare會自動取代掉壞掉的硬碟而變成raid 5是很正常的,並不是啥"降級"
你要做得應該是把壞的抽出來再補SPARE進去吧?
而你在檔案還可以讀取的情況下沒有去備份也是....
做任何修復動作都是有風險的
不然RAID6有何用?就是怕RAID5三掛一"修復的那個時間點"又多掛一顆.....
節哀...
如果對RAID5修復流程,或是啥是SPARE都不太確定的使用者
建議最好還是用RAID1 or 0+1等等...至少掛掉以後資料不容易全毀.....
看過太多R5掛掉修不回來的例子...囧

RAID不是萬能,企業中RAID最常被搞掛掉的原因就是RAID出事的時候"去救援的人"不熟....


slk wrote:
真的很謝謝大家的建議...(恕刪)


wd硬碟的問題...綠標真的 真的不能做raid.........................................................

我之前dell server也毀了一堆資料... 後來全部換黑標...

另外做raid 一開始時要有好習慣.raid 5 6做好..抽換一下硬碟故意讓raid掛點

看看能不能救回來... 如果不行..那就看著辦


sopp0820 wrote:
後來全部換黑標...

黑標應該也有一樣的問題(WD只要是消費級都有這個問題)

yaichintw wrote:
而你在檔案還可以讀取的情況下沒有去備份也是....

確實,這裡有想到的話,至少災難可以降低8成

yaichintw wrote:
說真的~不同牌子不同型號不同容量....最好不要拿來做RAID..這算常識

恩...我只能說這個常識有點古老了,現在新一點的raid卡都能動態升級硬碟容量了(當然也不是說完全沒有風險啦,只是發生機率比以前少很多了)


面對消費級的東西,通常遇到問題的第一步就是立刻備份
連IBM、HP的Raid都很常出問題了,更何況是非伺服器等級的東西
claus950 wrote:
黑標應該也有一樣的問...(恕刪)


個人經驗黑標比企業級少

至於容量不同..廠牌不同..raid最好還是用同廠同型號的

raid 5+spare... 我遇過6顆sas 1500rpm硬碟-_-

1顆損壞 dell 給我六顆 還都大一倍的..為何呢 因為舊的停產了-_-..

dell 工程師說,勸您先把資料備份...

六顆都換下.. 因為你換一顆一顆換應該沒辦法重建成功

2011年發生的 dell r710 server...

後來我備份好不信邪..一顆一顆換.. 第一顆重建成功 換到第二顆就卡住95%-_-...

資料也全掛了..最後一次裝六顆 由備份回復...
看來我還是乖乖買H700(Hitachi 2TBx3 Raid5)+外接硬碟(四顆1TB)定期備份比較好。

軟體RAID還是沒硬體RAID來的安全。
文章分享
評分
評分
複製連結

今日熱門文章 網友點擊推薦!