Перейти к содержимому

Кейс · Серверы и СХД

Отказоустойчивый кластер баз данных: нулевой даунтайм для интернет-ретейлера

Интернет-магазин страдал от плановых окон обслуживания 4 часа в неделю. ВИСТЛАН поставил три сервера DEPO Storm и СХД Aerodisk Uni, развернул Pacemaker-кластер PostgreSQL — плановые окна ушли в прошлое.

0
позиций в поставке
0
дней до поставки
0%
экономия клиента
0
сумма проекта, ₽

Коротко о проекте

Что поставили

Сервер DEPO Storm 2110S2 (DS2110S2-2G5318-256), 2×Intel Xeon Gold 5318, 256 ГБ DDR4 ECC3 шт.
СХД Aerodisk Uni 2U (арт. AU-212-SAS-NVMe), 24 слота SAS/NVMe, 2 контроллера1 шт.
SSD SAS Micron 5400 MAX 3.84 ТБ 2.5" (MTFDDAK3T8TGB)12 шт.
NVMe SSD Micron 7450 Pro 1.92 ТБ U.2 (MTFDKCC1T9TFR) — кэш4 шт.
Коммутатор Eltex MES2324F, 24×SFP 1G, 4×SFP+ 10G, управляемый L2/L32 шт.
ИБП Eaton 9PX 3000 ВА On-Line двойное преобразование2 шт.
Патч-корд SFP+ DAC 10G 1 м (комплект 12 шт.)1 шт.

Интернет-магазин бытовой техники работал на одиночном сервере PostgreSQL без резервирования. Плановые обновления ОС и обслуживание дисковой подсистемы требовали еженедельного технического окна длительностью 4 часа — в ночь с воскресенья на понедельник. Незапланированные отказы дважды в год приводили к простоям по 2–5 часов. IT-руководство поставило задачу полностью исключить простои баз данных.

Задача клиента

Построить отказоустойчивый кластер PostgreSQL из трёх узлов с автоматическим failover, обеспечить возможность планового обслуживания без остановки сервиса. RTO — не более 30 секунд, RPO — ноль (ни одна подтверждённая транзакция не должна теряться).

Ограничения и требования

Имеющаяся серверная комната вмещает не более одной дополнительной стойки. Бюджет ограничен 4,5 млн рублей. Работающая PostgreSQL 15 должна быть перенесена без изменения схемы базы данных. Предпочтение отдаётся отечественному оборудованию.

Что предложили

Для кластера подобраны три сервера DEPO Storm 2110S2 с двумя Intel Xeon Gold 5318 и 256 ГБ DDR4 ECC каждый. Одиночная СХД Aerodisk Uni 2U с 12 SAS SSD Micron 5400 MAX 3.84 ТБ в RAID 10 обслуживает все три узла через iSCSI Multipath. Два коммутатора Eltex MES2324F образуют отказоустойчивую сеть хранения.

Программный стек: Pacemaker/Corosync управляет кластером, Patroni контролирует PostgreSQL, HAProxy распределяет подключения приложений. При отказе мастера автоматический failover занимает 8 секунд — быстрее таймаута большинства JDBC/ODBC-драйверов.

Состав поставкиСпец-цены от производителя

Прямые партнёрские договоры с DEPO Computers и Aerodisk позволили получить скидку 12% к прайсу — экономия около 560 тысяч рублей. Для проектов на отечественное оборудование ВИСТЛАН регулярно запрашивает специальные условия у производителей, что недоступно через посредников.

Этапы и сроки

Дни 1–3: аудит существующей базы, расчёт нагрузки, проектирование кластера. Дни 4–6: поставка оборудования. Дни 7–9: монтаж, настройка сети и СХД, инсталляция ОС на всех трёх узлах. Дни 10–11: настройка Pacemaker, Patroni, HAProxy, тестовые failover. День 12: перенос production-базы, переключение приложений, передача по акту. Итого — 12 рабочих дней.

Результат

За шесть месяцев эксплуатации кластер пережил один реальный отказ сервера — переключение заняло 9 секунд, пользователи не заметили. Плановые окна ликвидированы полностью. Обновление ОС на каждом узле выполняется в рабочее время без уведомления пользователей. Итоговая стоимость — 4 100 000 рублей с НДС, экономия к смете — 12%.

Почему выбрали нас

Заказчик ранее обращался к нескольким интеграторам, но получал предложения либо с избыточной архитектурой на зарубежном железе, либо без гарантии совместимости ПО. ВИСТЛАН с 2006 года специализируется на кластерных решениях и умеет сочетать отечественное оборудование с open-source стеком. Все работы выполнены собственными инженерами без субподряда.

Конфигурации, артикулы и цены носят ориентировочный характер и могут изменяться. Точные параметры согласовываются индивидуально при оформлении заказа.

Частые вопросы

Что такое автоматический failover и насколько он быстр?

Failover — автоматическое переключение нагрузки на резервный узел при отказе основного. В кластере Pacemaker/Corosync на DEPO Storm время переключения составляет 6–12 секунд. За это время приложение получит ошибку TCP-соединения и переподключится — большинство пользователей не заметят.

Как обеспечивается согласованность данных при failover?

PostgreSQL работает в режиме синхронной репликации: мастер подтверждает транзакцию только после записи на replica. При failover replica становится новым мастером без потери ни одной подтверждённой транзакции.

Нужно ли останавливать базу при обслуживании кластера?

Нет. Обслуживание выполняется по очереди: один узел выводится из кластера, обслуживается (обновление ОС, прошивки, замена диска), возвращается обратно. Нагрузка в это время работает на оставшихся двух узлах.

Совместим ли Aerodisk Uni с PostgreSQL?

Да. Aerodisk Uni сертифицирован на совместимость с PostgreSQL, имеет специализированный профиль QoS для OLTP-нагрузки. Драйверы для Linux (RHEL/Astra Linux) доступны в официальном репозитории Aerodisk.

Что будет, если отказали одновременно два узла?

При отказе двух узлов из трёх кластер переходит в режим read-only (защита от split-brain). Третий узел продолжает обслуживать чтение. Восстановление после возврата узлов автоматическое, без вмешательства администратора.

Посчитайте свою экономию

При подборе под задачу и спец-ценах от производителя экономия по этому кейсу — 12%. Двигайте бюджет и смотрите вашу выгоду.

Ваш бюджет на оборудование1 000 000
100 тыс ₽20 млн ₽
Ваша экономия
120 000
Итого к оплате
880 000
Подобрать решение под мою задачу

Оценка ориентировочная. Точную цену и срок подтвердит менеджер.

Нужно похожее решение?

Опишите задачу — подберём оборудование с оптовыми ценами, сроками и наличием. Регистрация не нужна.

Кейс приведён для примера, данные обезличены. Состав, цены, сроки и экономия носят справочный характер, не являются публичной офертой и не гарантируют аналогичный результат — каждый проект рассчитывается индивидуально, наличие и цены подтверждаются при оформлении заказа.