Машиностроительный завод эксплуатировал серверный парк, собранный в 2017–2019 годах: разнородные стоечные серверы нескольких вендоров, прямые DAS-хранилища на дисках SATA и несовместимые между собой версии гипервизора на разных узлах. Каждое расширение требовало ручной миграции ВМ и сопровождалось часовыми окнами обслуживания. IT-директор зафиксировал три инцидента за год, связанных с неплановым простоем из-за отказов дисков в DAS. Расширение виртуальной среды стало невозможным без полной реструктуризации платформы — IT-служба обратилась за проектом к ВИСТЛАН.
Задача клиентаПостроить однородный кластер виртуализации из четырёх вычислительных узлов с единой внешней СХД. Ключевые требования: не менее 120 виртуальных машин на платформе zVirt (российский гипервизор на базе oVirt), резервирование на уровне питания, сети и хранения, автоматическое восстановление ВМ при отказе любого узла. Все существующие ВМ должны быть перенесены без остановки производственных процессов в течение рабочей недели.
Ограничения и требованияПредприятие входит в перечень стратегических объектов — всё оборудование должно происходить из реестра российской радиоэлектронной продукции Минпромторга. Иностранное серверное оборудование категорически исключено требованиями службы безопасности. Бюджет проекта — не более 12 млн рублей с НДС. Срок ввода в эксплуатацию — 15 рабочих дней с момента выставления счёта. Серверная располагается в стойке 42U с доступной мощностью 16 кВт; свободно только 20U под новое оборудование.
Что предложилиДля вычислительных узлов выбраны Yadro Vegman R660 G2 — двухпроцессорный сервер 2U с двумя Intel Xeon Platinum 8358 (по 32 ядра, 2.1–3.4 ГГц) и 512 ГБ DDR4 ECC 3200 МГц. Четыре узла в конфигурации High Availability под управлением zVirt дают 256 физических ядер и 2 ТБ оперативной памяти — достаточно для 150+ ВМ с запасом вычислительных ресурсов на 3 года роста.
В роли разделяемого хранилища — Yadro Tatlin.Unified 760 с двойным контроллером Active-Active, 24 SSD SAS по 3.84 ТБ Seagate Nytro и 16 HDD SAS по 16 ТБ Seagate Exos. Полезная ёмкость после RAID 6 на каждом тире — около 200 ТБ. Два контроллера с интерфейсами 2×100GbE каждый обеспечивают пиковую полосу 20 Гбит/с суммарно — без «бутылочных горлышек» при одновременном Storage vMotion нескольких ВМ.
Каждый вычислительный узел оснащён RAID-контроллером LSI MegaRAID SAS 9560-16i с 8 ГБ кэша для локальных загрузочных дисков. Сеть хранения — выделенная fabric на двух коммутаторах Eltex ESR-200 25/100GbE, полностью изолированная от клиентской сети ВМ.
Состав поставки по подсистемам- Вычисление: 4 × Yadro Vegman R660 G2 (2×Xeon Platinum 8358, 512 ГБ ECC), каждый с RAID-контроллером LSI MegaRAID SAS 9560-16i
- Хранение: 1 × Yadro Tatlin.Unified 760, 24×SSD SAS 3.84 ТБ + 16×HDD SAS 16 ТБ, 4×100GbE
- Сеть хранения: 2 × Eltex ESR-200 25/100GbE + 16 × DAC SFP28 3 м
- Электропитание: 2 × ИБП Delta Amplon RT-6K 6000 ВА, дублирование по PDU
ВИСТЛАН является авторизованным партнёром Yadro с 2021 года и имеет партнёрский статус, позволяющий получать прямые цены без дистрибьюторской надбавки на серверы линейки Vegman и СХД Tatlin. Проектная скидка была дополнительно согласована с вендором под конкретный тендер — это стало возможным благодаря технической экспертизе нашей команды, подтверждённой при pre-sales аудите конфигурации. Итоговая экономия относительно публичного прайса составила 18% — около 2,1 млн рублей при общей стоимости проекта 11,2 млн рублей.
Этапы и срокиДни 1–2: аудит текущей инфраструктуры (инвентаризация ВМ, профилирование нагрузки, расчёт ресурсов), финализация конфигураций оборудования. Дни 3–4: резервирование оборудования на складе Yadro и ВИСТЛАН. Дни 5–9: поставка на объект, монтаж в стойку, кабельная разводка 25GbE и 100GbE, подключение ИБП. Дни 10–11: развёртывание zVirt Enterprise, настройка кластера HA, подключение СХД Tatlin.Unified, создание пулов хранения. День 12: миграция первой очереди ВМ (40 штук), тестирование автоматического HA-переключения с имитацией отказа узла. Итого — 12 рабочих дней.
РезультатЗаказчик получил производительный однородный кластер на 120 виртуальных машин с суммарными ресурсами 256 vCPU, 2 ТБ RAM и разделяемой СХД 200 ТБ. Автоматическое восстановление ВМ при отказе узла занимает менее 30 секунд — проверено на трёх тестовых failover-сценариях. Миграция всех 120 ВМ завершена без остановки производственных процессов. За 8 месяцев эксплуатации незапланированных простоев не зафиксировано. Общая сумма поставки — 11 200 000 рублей с НДС. Плановый ресурс кластера без расширения при текущем темпе роста нагрузки — не менее 5 лет.
Почему выбрали насВИСТЛАН ведёт проекты виртуализации с 2008 года: за это время реализовано более 60 кластеров на платформах VMware, Hyper-V и российских гипервизорах. Опыт миграции на zVirt с существующих платформ, прямое партнёрство с Yadro, инженерный штат с сертификатами производителя и проверенная методология безостановочной миграции — совокупность факторов, которая определила выбор в нашу пользу по результатам сравнения с тремя другими интеграторами. Команда из трёх инженеров работала на объекте посменно в течение всего срока проекта.
Технические детали реализацииСеть хранения данных построена по топологии dual-fabric: каждый из четырёх узлов Yadro Vegman R660 G2 подключён двумя интерфейсами SFP28 25GbE к двум независимым коммутаторам Eltex ESR-200. СХД Yadro Tatlin.Unified 760 подключена к обоим коммутаторам через интерфейсы 100GbE — по два на каждый коммутатор. Таким образом, отказ любого коммутатора или любого кабеля не прерывает работу ни одной виртуальной машины. Мультипасинг на уровне гипервизора zVirt настроен в режиме Active-Active LACP, что дополнительно увеличивает суммарную полосу хранения до 8 Гбит/с на узел.
Для виртуальных машин СУБД PostgreSQL и MS SQL Server настроен отдельный пул хранения на SSD SAS тире с политикой QoS — гарантированные 5 000 IOPS и 200 МБ/с на ВМ. Производственные серверы CAD/CAM выделены в отдельный пул на HDD-тире с менее строгой политикой. Автоматическая тиеризация блоков данных между SSD и HDD тирами выполняется планировщиком Tatlin каждые 4 часа на основе тепловой карты обращений.
Мониторинг кластера организован через Zabbix 6.4: агенты установлены на всех узлах Vegman R660, контроллерах Tatlin.Unified и коммутаторах Eltex. Дашборд отображает утилизацию CPU, RAM, IOPS, latency и состояние дисков СХД в реальном времени. При пороговом превышении (CPU > 80%, latency > 5 мс) автоматически отправляется алерт в корпоративный Telegram-канал IT-службы. Инженер ВИСТЛАН обеспечил первичную настройку всех шаблонов мониторинга и передал администраторам.
Планы расширенияАрхитектура кластера проектировалась с расчётом на трёхлетний горизонт роста. Добавление пятого узла Yadro Vegman R660 G2 займёт 4–6 часов без остановки кластера. Ёмкость СХД Tatlin.Unified 760 расширяется добавлением полок JBOD — до 4 полок по 24 диска — без замены контроллеров. ВИСТЛАН предоставил дорожную карту расширения с оценкой стоимости каждого этапа при достижении пороговых значений утилизации ресурсов.
Гарантийное и постгарантийное обслуживаниеСерверы Yadro Vegman R660 G2 поставляются с гарантией производителя 3 года NBD (Next Business Day): при обнаружении неисправного компонента инженер YADRO или авторизованного сервисного партнёра прибывает на объект на следующий рабочий день с запасным блоком. Для данного проекта согласован расширенный SLA: при наступлении гарантийного случая ВИСТЛАН как авторизованный партнёр является первой линией поддержки — мы принимаем заявку, диагностируем удалённо и координируем замену компонента. СХД Yadro Tatlin.Unified 760 имеет аналогичные условия: запасные диски, блоки питания и контроллеры хранятся на региональном складе ВИСТЛАН для экстренной замены в течение 4 часов. После окончания гарантийного срока ВИСТЛАН предлагает договор постгарантийного обслуживания с гарантированным SLA и фиксированными ценами на запасные части на весь срок действия договора.
Конфигурации, производители и цены носят ориентировочный характер и могут изменяться. Точные параметры согласовываются индивидуально при оформлении заказа.