Jump to content

Recommended Posts

Posted

Котроллер 3-ware 9000.

Перезагрузился 3 винт, после чего при ребилде контроллер обнаружил ошибку на нулевом,

дальше ребилдить отказывается

 

u0    RAID-50   DEGRADED       -      64K     2235.11   OFF    OFF      OFF

Port   Status           Unit   Size        Blocks        Serial
---------------------------------------------------------------
p0     ECC-ERROR        u0     372.61 GB   781422768     WD-WMAMY17090
p1     OK               u0     372.61 GB   781422768     WD-WMAMY17093
p2     OK               u0     372.61 GB   781422768     WD-WMAMY17093
p3     DEGRADED         u0     372.61 GB   781422768     WD-WMAMY17098
p4 - p7 OK

 

Файловая система пока не разрушена.

 

Как аккуратно заменить первый винт?

Или только сливать данные?

Posted

Сейчас у вас рейд работает только на 3-х винтах из четырех, но система еще пока работает, так?

 

Контроллер просто обнаружил что в нулевом есть бэдблок и пока еще работает, но в любой момент все может рухнуть. Лучший способ - взять 4 новых винта, собрать новый рейд на свободных портах контроллера, слить данные и разобрать старый рейд, после чего нулевой и третий винты в гарантию, а с остальными - думать, а что же делать с ними...

 

Если есть возможность взять винты напрокат, то можно взять три винта, скопировать побитно на них три живых еще винта, пройтись по ним какими-то утилитками для восстановления RAID5 (R-TTools например), слить все данные на другие винты, после чего проверить корректность данных, при ошибках - попробовать еще пошаманить с исходными... но это все оччччень долго, все таки 1Тб данных... и винтов свободных надо очень много...

Posted

Как супершаманский вариант можно попробовать вынуть нулевой винт и скопировать на другой машине побитно на точно такой же, после чего вставить новый винт и помолиться, что статус рейда не станет FAILED-UNRECOVERABLE.

 

Если есть свободные винты (любые), то можешь попробовать на свободных портах собрать рейд 5 и попробовать подменить один винт на другой с побитной копией содержимого, если новый рейд не рассыпется, а подхватит копию винта, то можно и с основным попробовать сделать то же самое. Там еще все зависит от прошивки контроллера.

Posted (edited)

Там не один 1 Тб данных, а 2,2. Винтов 8 при этом в 50 рэйде.

Нашли как разрешить ему Ребилд с битым источником.

Во время ребилда пара бэдов появилась еще и на втором.

Не странно ли это, что на нескольких WD RE винтах за 2 года появились бэд блоки?

Стоит ли снова брать массив из WD RE? Или посоветуйте другие.

Все 20 винтов стоят в корзинах по 4, чуть теплые под постоянной нагрузкой.

Edited by Дегтярев Илья
Posted

в hp сервере на один винт некоторое время говорилось "predicatible failure" и всё работало. потом и правда стало просто "failure" и был заменен по гарантии.

 

не знаю, это seagate такие винты делает или hp/seagate прошивки для них или raid-контролер шибко умный, а может для sas это норма - но чуть ли не в первый раз в жизни обнаружилась корелляция между предупреждением софта и смертью винта.

 

а если делать 5 рейд на куче винтов (тем более wd) - нужно периодическое тестирование им устраивать. избыточность небольшая.

Posted

ух, у нас обычные sata. Для сервака с зеркалами линуха и библиотекой большая скорость не нужна.

Так что? Кто использовал WD RE? Сами винты ничего хорошего или просто 2 года - нормальное время жизни?

А для домашнего компа они просто класс - бесшумные и холодные

Join the conversation

You can post now and register later. If you have an account, sign in now to post with your account.

Guest
Reply to this topic...

×   Pasted as rich text.   Paste as plain text instead

  Only 75 emoji are allowed.

×   Your link has been automatically embedded.   Display as a link instead

×   Your previous content has been restored.   Clear editor

×   You cannot paste images directly. Upload or insert images from URL.

×
×
  • Create New...