Избегайте сбоев оборудования
Обеспечение физической защиты вашего сервера
Очень часто у тех, кто размещает сервер самостоятельно, нет надлежащего хранилища для своей системы. Размещение сервера в разных местах, в местах с высокой проходимостью, доступных детям или домашним животным, или в плохо проветриваемом помещении может быстро привести к катастрофе.
Защитите свои жесткие диски
В идеале жёсткие диски следует крепить, чтобы предотвратить вибрации, которые могут ускорить износ оборудования или даже снизить его производительность, особенно если рядом находится другой диск.
Уменьшите количество операций подкачки для SD-карт и SSD-накопителей
Если вы используете файл подкачки на SSD или SD-карте с чрезмерной загрузкой файла подкачки, ваш носитель информации может преждевременно выйти из строя из-за слишком большого количества операций записи.
Чтобы этого избежать:
cat /proc/sys/vm/swappiness
Если значение выше 10:
sysctl vm.swappiness=10
nano /etc/sysctl.conf
Если параметр vm.swappiness присутствует, измените его значение на 10. В противном случае добавьте следующую строку:
vm.swappiness = 10
Избыточность хранилища
Для минимизации аппаратных сбоев носителей информации целесообразно настроить кластер зеркальных дисков (RAID, ZFS). Идея заключается в том, что все данные, записанные на один диск, будут записаны и на другой. Таким образом, если один диск выйдет из строя, другой продолжит работать, и сервер останется полностью работоспособным.
Существуют также более продвинутые кластеры, обеспечивающие максимальную отказоустойчивость (отказ двух дисков, как в RAID6) или больший объём хранения данных (см. RAID 5).
Однако эти методы кластеризации дисков не следует рассматривать как резервное копирование. RAID-массив следует рассматривать как единый носитель информации. Действительно, если этот метод предотвращает необходимость переустановки в случае возможного сбоя диска, то риск далеко не нулевой.
Вот несколько примеров ситуаций, известных профессиональным системным администраторам:
- Диски кластера, собранные из дисков одной марки, могут выйти из строя практически одновременно в течение нескольких часов
- Без мониторинга состояния дисков высока вероятность того, что отказ одного диска в кластере будет замечен только тогда, когда выйдет из строя второй (><)
- Если у вас нет запасного диска, задержка с его приобретением может привести к сбою другого диска
- Полуисправный диск, выдающий ошибки, может распространять свои ошибки по всему кластеру
- Разъемы дисков или RAID-контроллер также могут создавать проблемы или выходить из строя
- Чем сложнее архитектура с большим количеством компонентов, тем выше вероятность отказа одного из них
Если вы хотите настроить RAID-массив или использовать btrfs, проще всего сделать это во время установки с помощью ISO-образа YunoHost в экспертном режиме (при разметке системы).