Одинаковые снаружи, разные внутри

Два диска на 8 терабайт от одного производителя. Одинаковый форм-фактор, одинаковая скорость вращения, схожие заявленные скорости. Разница в цене — вдвое.

Вопрос закономерный: за что переплата и не маркетинг ли это?

Отчасти маркетинг. Но есть несколько отличий, которые действительно определяют, проработает диск в сервере годы или создаст проблему через месяц. Разберём, какие именно.

Главное отличие: поведение при ошибке чтения

Это тот пункт, из-за которого настольные диски разваливают массивы. И он совершенно неочевиден, пока не столкнёшься.

Любой диск иногда не может прочитать сектор с первого раза. Дальше поведение принципиально расходится.

Настольный диск будет пытаться прочитать проблемный сектор упорно и долго — десятки секунд, иногда больше минуты. Логика правильная для домашнего компьютера: там этот сектор может содержать единственную копию ваших фотографий, и лучше подождать, чем потерять данные.

Серверный диск прекращает попытки через несколько секунд и сообщает об ошибке контроллеру. Логика тоже правильная, но для другого случая: в массиве данные продублированы, контроллер восстановит сектор из избыточности быстрее, чем диск сам его дочитает.

Почему это ломает массивы

А теперь то, ради чего этот раздел.

RAID-контроллер ждёт ответа от диска ограниченное время. Если диск молчит дольше — контроллер считает его отказавшим и выбрасывает из массива.

Настольный диск, упорно вычитывающий проблемный сектор минуту, ведёт себя с точки зрения контроллера как сломавшийся. Диск при этом полностью исправен.

Итог: массив из настольных дисков периодически «теряет» вполне живые диски. Каждый такой случай запускает перестроение массива — многочасовую операцию интенсивного чтения и записи, которая с высокой вероятностью спровоцирует ту же ситуацию на другом диске. И тогда массив разваливается уже по-настоящему.

Эта функция называется таймаутом восстановления при ошибке. У разных производителей она носит разные имена, но суть одна. На большинстве настольных моделей она отсутствует или отключена, и включить её нельзя.

Именно это, а не абстрактная «надёжность», — главная причина не ставить настольные диски в массив.

Устойчивость к вибрации

Второе отличие, недооценённое ещё сильнее.

В сервере на 12 или 24 диска каждый вращается со скоростью 7200 оборотов в минуту. Все вместе они создают вибрацию, которая передаётся через корпус на соседей.

Головка чтения парит над пластиной на расстоянии в доли микрона. Вибрация сбивает её с дорожки, приходится позиционироваться заново. Результат — падение производительности, иногда в разы.

Серверные диски снабжены датчиками вибрации и электроникой, компенсирующей колебания в реальном времени. Настольные — нет, они рассчитаны на работу поодиночке.

Практическое следствие: настольные диски в плотной корзине работают не просто медленнее, а тем медленнее, чем их больше. Эффект нелинейный и обнаруживается уже после сборки.

Показатель рабочей нагрузки

Параметр, которого нет в характеристиках настольных дисков, — предельный объём чтения и записи в год.

  • Настольные диски: ориентировочно 55 терабайт в год. Это расчёт на 8 часов работы в сутки с умеренной активностью.
  • Серверные диски: от 180 до 550 терабайт в год в зависимости от класса.

Превышение не означает мгновенную поломку, но выводит диск за пределы условий, на которые он спроектирован, и заметно повышает вероятность отказа.

Прикинуть свою нагрузку несложно: возьмите объём данных, проходящих через диск за сутки, и умножьте на 365. Для файлового сервера небольшого офиса результат обычно укладывается в настольные лимиты. Для системы видеонаблюдения или сервера резервных копий — почти наверняка нет.

Что ещё различается

Заявленный срок службы. Серверные диски рассчитаны на круглосуточную работу, настольные — на неполный день.

Гарантия. Обычно 5 лет против 2–3 у настольных. Косвенный, но честный показатель уверенности производителя.

Интерфейс. Настольные диски бывают только с интерфейсом SATA. Серверные — также с интерфейсом SAS, который даёт двойное подключение для отказоустойчивости, лучшую работу с очередью команд и более информативную диагностику.

Наработка на отказ. Формально различается, но это статистический показатель для больших партий, а не предсказание для конкретного диска. Ориентироваться на него при выборе не стоит.

Отдельно: черепичная запись

Тема, связанная не с делением на серверные и настольные, но способная испортить всё.

Часть дисков использует технологию, при которой дорожки записываются с перекрытием. Это увеличивает ёмкость, но делает изменение уже записанных данных крайне медленным: чтобы поменять один сектор, диску приходится переписывать целую зону.

Для массивов такие диски категорически не подходят. При перестроении массива идёт непрерывная запись часами, и диск замедляется настолько, что операция растягивается на дни, а контроллер может выбросить его как отказавший.

Проблема в том, что технологию не всегда указывают в характеристиках. Перед покупкой конкретную модель стоит проверить по спискам производителей. Правило простое: если технология записи не указана, а диск нужен под запись — не берите.

Когда переплата не нужна

Раздел, которого обычно нет в подобных материалах.

Одиночный диск под архив. Нет массива — нет проблемы с таймаутом. Нет соседей — нет вибрации. Настольного диска достаточно.

Резервные копии с редкой записью. Записали, отложили. Нагрузка минимальна.

Домашнее хранилище на два диска. Здесь можно подумать. Зеркало из двух дисков в тихом корпусе с умеренной нагрузкой — граничный случай, где настольные диски часто работают годами без проблем.

Учебный или тестовый контур. Если потеря данных не критична, а бюджет ограничен, экономия оправдана.

Когда экономить нельзя

Любой массив от четырёх дисков. Таймаут восстановления становится решающим.

Круглосуточная запись. Видеонаблюдение, журналы, потоковые данные — здесь важен показатель рабочей нагрузки.

Плотная корзина. От восьми дисков в одном корпусе вибрация становится ощутимым фактором.

Данные, потеря которых недопустима. Здесь экономия на дисках — самая неудачная статья сокращения бюджета.

Что важнее выбора диска

Итог, который стоит держать в голове.

Массив не заменяет резервное копирование. RAID защищает от отказа диска — и только. От удаления файлов, шифровальщика, ошибки администратора или отказа контроллера он не спасает. Это разные задачи.

Диски одной партии отказывают примерно одновременно. Они одинаково изготовлены и одинаково изношены. Разумная практика — брать диски из разных партий или у разных поставщиков.

Мониторинг важнее модели. Диск обычно предупреждает о скорой смерти ростом числа переназначенных секторов и ошибок чтения. Настроенное оповещение по этим показателям спасает больше данных, чем выбор более дорогой модели.

Коротко

Главное реальное отличие серверных дисков — не мифическая надёжность, а таймаут восстановления при ошибке чтения. Без него настольный диск в массиве периодически выглядит отказавшим, будучи исправным, и запускает перестроения, которые и убивают массив.

Второе по важности — устойчивость к вибрации, критичная в плотных корзинах и незаметная при сборке.

Третье — заявленный годовой объём операций: у настольных дисков он примерно втрое-вдесятеро ниже.

Для одиночного диска или архива с редкой записью переплата не нужна. Для любого массива и круглосуточной нагрузки — нужна обязательно.

И вне зависимости от выбора: настройте мониторинг состояния дисков и держите резервные копии отдельно от массива.

Подбираете дисковую подсистему под конкретную задачу — опишите нагрузку и объёмы, поможем выбрать так, чтобы не переплатить и не сэкономить там, где нельзя.