RAID degraded
Если из массива с избыточностью (1, 5, 6, 10, и другие комбинированные уровни) «выпадает» диск, то есть управляющая утилита помечает его как проблемный, то массив меняет свой статус на degraded или critical – в зависимости от терминологии конкретного оборудования.
Данные при этом доступны, массив продолжает работу. Просто он потерял избыточность и при проблемах с еще одним диском возможна потеря информации.
- Замените «выпавший» диск на новый. При этом не спешите старый диск выбрасывать, перезаписывать или пускать на запчасти. Пусть лежит до самого конца процедуры.
- Запустите «перестроение» (rebuild), если оно не запустилось автоматически.
По окончании процедуры массив примет прежний нормальный статус, к нему вернется избыточность. Пока вы не убедитесь, что данные на месте и все цело, ничего не делайте с вынутым диском.
Чего делать нельзя?
- Не пытайтесь уговорить массив работать с «выпавшим» диском. Не запускайте перестроение с исключенным участником, вживляя его заново.
- Ничего не делайте средствами устройства или контроллера, если в статусе degraded данные не доступны. Это говорит о некорректной работе оборудования. Вам уже нужна помощь специалистов. Перестроение в таком состоянии грозит дополнительными разрушениями, иногда фатальными.
- Не игнорируйте сообщения raid-утилиты. Если она предупреждает, что операция опасна для данных, так оно и есть. Возможно, вы делаете что-то не то. Стоит остановиться.
Перечисленные пункты позже будут проиллюстрированы конкретными примерами из практики. К сожалению, многие наши клиенты столкнулись с серьезными проблемами, допустив ошибки именно в этих простых шагах. Не повторяйте их.
Оставить заявку на консультацию, чтобы задать любые вопросы, можно в форме ниже

Обращайтесь в лучшую компанию по восстановлению данных
Закажите бесплатную диагностику
RAID 5, почему это плохо
В RAID-5 мы платим за отказоустойчивость емкостью всего одного диска, то есть емкость RAID-5 равна (n-1)*hddsize, где n — число дисков, а hddsize — их размер.
Данные «размазаны» по всем входящим в RAID-группу дискам, их блоки дополнены служебной информацией, которая дает возможность восстановить потерю данных в размере любого одного диска, причем сама эта служебная информация не занимает какой-то выделенный диск, а просто часть объема этой группы, равную как раз емкость одного диска. Но она также размазана по всем дискам.
Когда происходит выход из строя (полный или частичный) одного из дисков группы типа RAID-5, то RAID-группа переходит в состояние degraded, но наши данные остаются доступными, так как недостающая часть их может быть восстановлена за счет избыточной информации того самого «дополнительного объема, размером в один диск». Правда обычно быстродействие дисковой группы резко падает, так как при чтении и записи выполняются дополнительные операции вычислений избыточности и восстановления целостности данных. Если мы вставим вместо вышедшего из строя новый диск, то умный RAID-контроллер начнет процедуру rebuild, «перестроения», для чего начнет считывать со всех дисков оставшиеся данные, и, на основании избыточной информации, заполнит новый, ранее пустой диск недостающей, пропавшей вместе со сдохшим диском частью.
Дело в том, и это надо себе трезво уяснить, что на время ребилда RAID-5 вы остаетесь не просто с RAID лишенным отказоустойчивости. Вы получаете на все время ребилда RAID-0, «группа с чередованием» который «RAID» на самом деле только условно, так как отказоустойчивостью не обладает, о чем и говорит цифра 0 🙂 С удовольствием приму помощь от компетентного математика-«вероятниста» в правильном вычислении показателей надежности, впрочем основного посыла в ненадежности RAID-0 это не изменяет)
В случае любого отказа, даже самого маленького, даже, быть может, не отказа диска целиком, а просто сбоя чтения из за помехи, или проблем с кабелями, вы теряете всю на нем информацию.
Выводы:
- Резкий рост объемов дисков, при гораздо более медленном приросте скоростей передачи данных с диска привел к тому, что время восстановления RAID-5 катастрофически удлиннилось и продолжает расти с выходом все более емких дисков. Как следствие, неприемлимо увеличивается период времени, когда данные остаются полностью незащищеными.
- Отсутствие средств контроля областей cold data (редко обновляемых и считываемых данных) в недорогих контроллерах RAID-5 может привести к обнаружению давно возникшей проблемы считывания в критический момент ребилда RAID, когда он полностью незащищен от сбоев, и приведет в полной потере данных.
- Повышенная нагрузка на диски в период восстановления потенциально еще повышает вероятность сбоя.
- Современные диски Desktop-class уже приблизились по объемам к показателям определяемого их изготовителями параметра BER (Bit Error Rate), что еще более повышает вероятность сбоя в ходе массированного считывания всего объема диска.
Все перечисленное доказывает необходимость отказа от использования RAID-5 в качестве отказоустойчивого решения для хранения важных и критичных данных.
Решение:
- Для данных, скорость доступа (и в особенности записи) к которым не так важна — RAID-6. Тип RAID устойчивый к сбою двух дисков. При выходе из строя одного диска, защищающий на время ребилда, от случайных ошибок чтения при восстановлении. Недостаток — относительно невысокая скорость на запись.
- Для данных, к которым требуется максимально быстрый доступ как на запись, так и на чтение — RAID-10. При использовании RAID-10 время ребилда резко сокращается, так как не требуется чтения полного объема RAID, а только копирование содержимого «зеркального» к вышедшему из строя диска. Недостатки — большой расход дисков на обеспечение отказоустойчивости.
- По возможности не экономить, используя для хранения критичной информации не предназначенные для работе в RAID диски Desktop-class, а использовать специальные серверные Enterprise-серии, надежность чтения которых на один-два порядка выше.
Вы собираетесь приобрести сервер для своей компании на заказ и у вас есть сомнения на счет выбора аппаратных комплектующих сервера и его конфигурации?
Есть решение! Получить консультации по выбору коплектующих для Вашего сервера на заказ и выбора RAID технологии для вашего сервера, Вы можете у наших специалистов компании Статус в Санкт-Петербурге.
Звоните по тел. +7-812-385-55-66 в Санкт-Петербурге, наши специалисты помогут Вам принять нужное решение!
Software RAID: Degraded Array в Linux
Добрый день, уважаемые хабраюзеры.
На одной из машин возникла следующая ситуация — вышел из строя жесткий диск.
Поскольку сервер собирался достаточно давно, винты там стояли по 80 Гб (2 штуки), и я решил заменить их на 500 Гб, поскольку разницы в стоимости почти нет, а пользы будет больше 🙂
Диски разбиты таким образом:
/dev/sda1 * 1 6 48163+ fd Linux raid autodetect
/dev/sda2 7 9729 78099997+ 5 Extended
/dev/sda5 7 334 2634628+ fd Linux raid autodetect
/dev/sda6 335 577 1951866 fd Linux raid autodetect
/dev/sda7 578 1793 9767488+ fd Linux raid autodetect
/dev/sda8 1794 9729 63745888+ fd Linux raid autodetect
~# df -h
Filesystem Size Used Avail Use% Mounted on
/dev/md3 9.2G 1.9G 6.9G 22% /
tmpfs 1010M 0 1010M 0% /lib/init/rw
udev 10M 104K 9.9M 2% /dev
tmpfs 1010M 0 1010M 0% /dev/shm
/dev/md0 46M 33M 11M 77% /boot
/dev/md2 1.9G 36M 1.8G 3% /tmp
/dev/md4 60G 11G 47G 18% /var
Вопрос такой: как грамотно перенести все это дело на новые жесткие диски?
Разумеется, нужно будет увеличить раздел /var, а также я хочу сделать еще один раздел для виртуалок openvz.
Intel RAID Degraded
Всем добрый день. Порадовал сегодня сервер вот таким скрином.
На нем собран Raid 1. И диск надо менять, но если нажать контекстное меню, то выводиться Start rebild. Возникает вопрос можно ли в таком виде сделать ребилд и не рассыпется ли эта милая конфигурация райд 1 с двумя дисками после этого ? ), так как диск в обозримом будущем поменять вряд ли удастся или же оставить все как есть до лучших времен и скопировать куда-нить все данные ? Ошибиться можно в этом случае только 1 раз, поэтому и пишу ) Заранее всех благодарю за ответы.
Вложения Админка и внизу логи массива А это как выглядит контекстное меню
gs Сотрудник Тринити
Сообщения: 16650 Зарегистрирован: 23 авг 2002, 17:34 Откуда: Москва Контактная информация:
Re: Intel RAID Degraded
Сообщение gs » 25 июл 2017, 16:14
По-моему, диску каюк настает.
Stranger03 Сотрудник Тринити
Сообщения: 12979 Зарегистрирован: 14 ноя 2003, 16:25 Откуда: СПб, Екатеринбург Контактная информация:
Re: Intel RAID Degraded
Сообщение Stranger03 » 26 июл 2017, 08:43
StarWind
Для начала отцепить диск и проверить его какой-нибудь утилитой, коих в инете полно. Если диагностика покажет, что диск дохлый, то запускать ребилд противопоказано.
С уважением Геннадий
ICQ 116164373
eburg@trinitygroup.ru
StarWind Junior member Сообщения: 15 Зарегистрирован: 17 май 2017, 10:53 Откуда: Санкт-Петербург
Re: Intel RAID Degraded
Сообщение StarWind » 26 июл 2017, 09:23
Stranger03 писал(а): StarWind
Для начала отцепить диск и проверить его какой-нибудь утилитой, коих в инете полно. Если диагностика покажет, что диск дохлый, то запускать ребилд противопоказано.
Геннадий, спасибо. То есть, если я просто вытащу этот диск из массива, ничего не будет — продолжиться работа на одном диске ?
Вот еще нарыл документ, может быть кому — то будет полезен — как расшифровывать сообщения в кодах в программе управления. Если я их правильно понял, то диск точно сыпется.
Попробую тогда так.
Вложения intelraidcontrollersassataloggedalertdecodev10.pdf (276.96 КБ) 345 скачиваний
Stranger03 Сотрудник Тринити
Сообщения: 12979 Зарегистрирован: 14 ноя 2003, 16:25 Откуда: СПб, Екатеринбург Контактная информация:
Re: Intel RAID Degraded
Сообщение Stranger03 » 26 июл 2017, 09:45
StarWind писал(а): Геннадий, спасибо. То есть, если я просто вытащу этот диск из массива, ничего не будет — продолжиться работа на одном диске ?
Он же все равно отвалился с массива, что ему будет то. Если корзина хот-свап, дергайте, подключайте к другой машине и проверяйте. Например HDDScan, HDD Victoria. Там есть глубокий скан смарта и поверхностей диска. По итогам все будет видно.
С уважением Геннадий
ICQ 116164373
eburg@trinitygroup.ru
gs Сотрудник Тринити
Сообщения: 16650 Зарегистрирован: 23 авг 2002, 17:34 Откуда: Москва Контактная информация:
Re: Intel RAID Degraded
Сообщение gs » 26 июл 2017, 11:32
У хитачи штатная утилита DFT (drive fitness test).
На винте еже 92 бэда (medium = поверхность носителя). И 17 тысяч(!) предиктив файлуре.
StarWind Junior member Сообщения: 15 Зарегистрирован: 17 май 2017, 10:53 Откуда: Санкт-Петербург
Re: Intel RAID Degraded
Сообщение StarWind » 02 авг 2017, 15:36
Всем привет, еще раз благодарю за помощь. Перевел я диск в офлайн. И вытащил таки из сервера. После чего загружаться он перестал. Ладно, поставил диск назад. Массив сказал, что ему надо срочно ребилдиться — подождал пока он это сделает. Далее оба диска стали онлайн, массив тоже онлайн, а загрузка так и не пошла. на экране мигает курсор и все. Никаких сообщений. Ладно, стал копировать данные на всякий случай. С данными тоже не очень , так как куча файлов имеет длинные имена, а винды говорят, что так они не копируют. В связи с этим вопрос — какой программой лучше сделать образ уже извлеченных дисков из сервера с целью скопировать лишь один логический диск с данными. Сама серверная система не нужна.
Заранее благодарю за помощь.
gs Сотрудник Тринити
Сообщения: 16650 Зарегистрирован: 23 авг 2002, 17:34 Откуда: Москва Контактная информация: