Кондиционирование серверной: как не потерять сервер в июльскую жару
Каждое лето у меня одна и та же история: звонит клиент, у которого сервер стоит в бывшей кладовке без окон, и говорит — «что-то тормозит всё, может вирус?». Захожу удалённо, смотрю температуру процессора — 92 градуса. Никакого вируса, обычная жара и сдохший кондиционер за стеной. За пятнадцать лет в аутсорсинге я вынес одно железное правило: сервер убивает не нагрузка, а перегрев, о котором никто не знал вовремя. Расскажу, как настроить всё это в маленькой компании, где нет ни выделенной серверной, ни бюджета на дата-центр.
Серверная в подсобке — это норма, а не ошибка
Если у вас до 50 рабочих мест, отдельной серверной с фальшполом и прецизионным кондиционером у вас скорее всего нет. И это нормально. Я видел серверы в бухгалтерии за шкафом, в кабинете директора под столом, в каморке рядом с санузлом — и это не всегда катастрофа, если понимать риски и закрывать их правильно.
Проблема начинается не с того, что сервер стоит в неподходящем месте. Проблема в том, что про это место забывают. Летом температура в такой комнате может подняться до 35-38 градусов к обеду, особенно если она на солнечной стороне или там же стоит принтер, который тоже греет воздух. А сервер спроектирован работать при 18-27 градусах на входе воздуха — это стандарт ASHRAE, которым пользуются все производители, от Dell до HPE.
У одного клиента, торговая компания на юге Москвы, сервер с 1С стоял в комнате без окон, зато рядом с трубами отопления, которые летом почему-то оставались тёплыми от солнца через крышу. Сервер работал стабильно до июня, а потом начал зависать раз в два-три дня. Оказалось — банальный перегрев, никто просто не мерил температуру в помещении вообще.
Что реально происходит с железом при жаре
Начну с неприятного. Современный сервер сам себя защищает — это заложено в BIOS и в контроллерах. При достижении критической температуры процессор начинает троттлить, то есть снижать частоту, чтобы меньше греться. Производительность падает в разы, а сотрудники в этот момент жалуются, что 1С «тупит». Это не глюк программы. Это железо честно спасает само себя ценой скорости.
Если троттлинг не помог и температура продолжает расти, срабатывает аварийное отключение. В лучшем случае сервер просто выключится и вы потеряете рабочий день на восстановление. В худшем — при регулярных циклах перегрева выходят из строя блоки питания, деградируют конденсаторы на материнской плате, а жёсткие диски начинают сыпать bad-блоками намного раньше срока. Я считаю, что каждый градус выше 30 на протяжении месяцев списывает с ресурса диска примерно 10 процентов — это не точная наука, но статистика по замене дисков у наших клиентов летом растёт заметно.
Отдельно скажу про батарейки в ИБП. При температуре выше 30 градусов свинцово-кислотный аккумулятор в APC или Ippon стареет в два раза быстрее паспортного срока. То есть вы купили ИБП на пять лет, а через два с половиной года при первом же скачке напряжения он просто не держит нагрузку. И вы узнаёте об этом не заранее, а в момент, когда свет мигнул и сервер выключился жёстко.
Мониторинг температуры: без него вы летите вслепую
Вот с чего я всегда начинаю у новых клиентов летом — ставлю датчик температуры и влажности в помещение, где стоит сервер. Не в сам сервер, хотя про это тоже расскажу, а именно в комнату. Стоит датчик копейки — Xiaomi Mi Temperature Sensor с Zigbee-шлюзом обойдётся в 2-3 тысячи рублей за комплект, есть решения посерьёзнее вроде AKCP или NetBotz, но для маленького офиса это избыточно и дорого.
Второй уровень — встроенный мониторинг самого сервера. У любого нормального сервера (Dell PowerEdge, HP ProLiant, даже китайские Huawei и Inspur) есть IPMI или iDRAC/iLO — отдельный контроллер управления с собственным сетевым портом, который живёт даже когда сервер выключен. Через веб-интерфейс IPMI видно температуру процессора, памяти, дисков, скорость вращения вентиляторов — всё в реальном времени, без установки агентов на саму систему.
Третий уровень, который я настоятельно рекомендую всем клиентам без своего айтишника — Zabbix. У нас в компании это основной инструмент, мы через него следим за температурой на десятках объектов клиентов. Zabbix умеет опрашивать IPMI по SNMP, снимать показания с Zigbee-датчиков через MQTT-мост, и при превышении порога — скажем, 28 градусов в помещении или 75 на процессоре — сразу слать алерт в Telegram. Настройка занимает у нас день-два, а спасает потом не один сервер за сезон.
Резервное охлаждение — то, о чём вспоминают, когда уже поздно
Сплит-система в серверной — это правильно, но сплит ломается. У меня в практике было минимум пять случаев за последние три года, когда именно в июле, в самую жару, дохла компрессорная часть кондиционера — банально не выдерживает постоянной работы на максимум неделями подряд. И вот тут встаёт вопрос: а что дальше, пока мастер едет менять фреон или компрессор?
Ответ — резервный контур охлаждения, и он не обязан быть дорогим. Самый простой вариант — мобильный кондиционер на 3000-5000 рублей в месяц аренды, с воздуховодом на улицу или в соседнее помещение с окном. Держим его свёрнутым в углу серверной постоянно, чтобы включить за пять минут, а не искать по городу, когда основной сплит уже встал. Стоит такой кондиционер, если покупать, от 25 до 45 тысяч рублей — в сравнении с простоем 1С на день для торговой компании это копейки.
Второй вариант, который я люблю за надёжность — просто вентиляция на вытяжку плюс открытая дверь в кондиционируемый общий офис. Звучит примитивно, но если серверная небольшая и рядом есть общая зона с кондиционером, поставленный на пол мощный вентилятор с вытяжкой тёплого воздуха наружу через окно снижает температуру на 5-8 градусов буквально за полчаса. Это не решение на постоянку, но как аварийный план на 2-3 часа, пока едет мастер — вполне рабочая схема.
Автоматика важнее человека, который может не успеть
Мониторинг без реакции — это просто красивый график, на который никто не смотрит в субботу вечером. Поэтому вторая часть системы — это правила автоматического реагирования. У нас настроено так: при 26 градусах в помещении — уведомление ответственному в Telegram. При 30 — уведомление плюс автоматическое включение резервного кондиционера, если он у клиента на умной розетке. При 35 или при температуре процессора выше 85 — управляемая остановка второстепенных сервисов, чтобы снизить нагрев, и эскалация звонком, а не просто сообщением.
Умная розетка с измерением мощности, вроде Sonoff или Tuya-совместимых устройств, стоит 700-1500 рублей и интегрируется в тот же Zabbix или Home Assistant. Резервный кондиционер включается сам, без человека, в 2 часа ночи в субботу — и это реально спасает, потому что именно в такие моменты никто не сидит и не смотрит на градусник.
Отдельно скажу про самое неприятное — аварийное выключение сервера по достижении критической температуры вместо аппаратного отключения по перегреву. Штатное завершение работы через скрипт (мы пишем такие на PowerShell для Windows Server или на bash для Linux) не портит файловую систему и базу 1С, а жёсткое отключение по превышению термозащиты иногда приводит к битой базе данных, которую потом восстанавливать сутками. Разница в цене между этими двумя сценариями — как между простоем в час и простоем в неделю.
Кейс из практики: как это выглядит вживую
Клиент — юридическая фирма, 18 рабочих мест, сервер с терминальным доступом и 1С в отдельной комнате без окна, бывшая кладовка. В июле прошлого года мы поставили туда датчик температуры за 2500 рублей, настроили алерты в Zabbix и купили на всякий случай мобильный кондиционер на 32 тысячи. Клиент сначала спросил — а точно надо, у нас же сплит есть? Сказал — на всякий случай, страховка дешевле убытков.
Через три недели, в аномально жаркий вторник, основной сплит встал именно из-за перегрузки — компрессор ушёл в защиту. Температура в комнате начала расти, в 14:40 пришёл алерт на 27 градусов, в 15:10 — на 30, автоматика включила резервный кондиционер. К вечеру, когда мастер по холодильному оборудованию добрался до офиса, температура держалась в норме весь день, сервер работал без единого сбоя. Сотрудники даже не заметили, что что-то случилось.
Без мониторинга эта история закончилась бы иначе: сервер бы простоял без присмотра до утра, температура за ночь легко ушла бы за 40 градусов, и утром юристы получили бы либо зависший сервер, либо, что хуже, битую базу с договорами и историей клиентов. Цена вопроса — 34,5 тысячи рублей за страховку против потенциального дня простоя всей фирмы плюс риска потери данных.
Что сделать уже сейчас, до следующей волны жары
Первое — узнайте, какая сейчас температура в комнате с сервером. Прямо сегодня. Если у вас нет датчика, зайдите с обычным бытовым термометром хотя бы раз. Если больше 27 градусов днём — у вас уже проблема, просто она пока не выстрелила.
Второе — проверьте, когда в последний раз обслуживали кондиционер в серверной. Заправка фреона и чистка раз в год перед летним сезоном — это 3-5 тысяч рублей, и это в разы дешевле, чем менять компрессор в разгар жары по завышенной летней цене мастера, который расписан на две недели вперёд.
Третье — заведите хоть какой-то резервный план охлаждения, даже самый простой: список из двух-трёх контор, которые привезут мобильный кондиционер за час, или собственный запасной прибор в углу. И четвёртое, самое важное — настройте мониторинг с алертами, чтобы узнавать о проблеме не от расстроенных сотрудников, а от системы, за 20-30 минут до того, как станет по-настоящему плохо. Мы делаем такую настройку клиентам обычно за один визит, вместе с проверкой ИБП и резервного копирования — благо это всё звенья одной цепи.
Частые вопросы
Сколько стоит организовать нормальный мониторинг температуры для маленькой серверной?
Минимальный комплект — датчик температуры-влажности плюс настройка алертов в Zabbix или Home Assistant — обходится в 5-10 тысяч рублей с работой специалиста. Если сервер поддерживает IPMI или iDRAC, добавляем мониторинг температуры процессора и дисков практически бесплатно, это уже встроено в железо.
Обязательно ли покупать резервный кондиционер, если основной новый и на гарантии?
Гарантия не спасает от простоя, пока едет мастер. Даже новый сплит может встать из-за скачка напряжения или банального засора фильтра в жару. Резервный контур — это не про недоверие к оборудованию, а про то, что счёт идёт на часы, а не на дни.
Что делать, если сервер уже перегревается, а поставить кондиционер прямо сейчас нельзя?
Временно — вентилятор на вытяжку тёплого воздуха плюс открытая дверь в более прохладное помещение, это снижает температуру на несколько градусов за полчаса. Параллельно можно временно перенести нагрузку на менее критичные сервисы и остановить всё, без чего офис проживёт день-два.
Как понять, что жёсткое отключение сервера от перегрева уже повредило данные?
После аварийного выключения первым делом проверяем журналы событий и статус файловой системы, а для 1С — тестируем базу через конфигуратор на предмет ошибок целостности. Не всегда есть повреждения, но лучше проверить сразу, чем узнать об этом через месяц, когда бэкап уже перезаписан.
Настроим мониторинг температуры и резервное охлаждение для вашей серверной за один визит — звоните, пока не началась следующая волна жары.
Бесплатная консультация →
Подпишитесь на рассылку ITfresh
Раз в неделю — практические гайды для руководителя и сисадмина: безопасность, 1С, миграции, резервные копии, лайфхаки из реальных проектов.
