← Все кейсы
FoodTech / Аналитика Аналитическая платформа

Переезд в облако и отказоустойчивая инфраструктура

Аналитическая платформа для ресторанного бизнеса

Вызов

Платформа помогает менеджерам ресторанов принимать решения на основе данных: топ блюд, план/факт выручки, поток посетителей, онлайн-продажи, рекомендации по загрузке персонала. При росте клиентской базы стало очевидно: собственная инфраструктура без резервирования стала тормозом для развития.

01 Переезд с собственных серверов в облако без остановки сервиса
02 Построение отказоустойчивости для всех критичных компонентов
03 Надёжное хранение данных с возможностью восстановления на любой момент

Что было сделано

Миграция в облако с полным резервированием на каждом уровне: база данных, брокер событий, аналитическое хранилище и сервисная сеть.

Отказоустойчивая база данных в двух зонах

Основная реляционная база переведена в кластерную конфигурацию с резервным узлом в отдельной зоне доступности. Добавлен непрерывный бэкап с хранением за последние 7 дней и возможностью восстановления на произвольную точку времени.

Кластер обмена сообщениями

Единственный брокер событий на отдельной виртуальной машине заменён на кластер из трёх узлов, размещённых в разных зонах доступности. Потеря одного узла не прерывает поток данных.

Управляемое аналитическое хранилище

Хранилище аналитических данных переведено в управляемый облачный сервис с горизонтальным разделением нагрузки на два шарда и отдельным кластером координации.

Программируемая сервисная сеть

Внутренний трафик между микросервисами переведён под управление единого service mesh. Это дало предсказуемую и наблюдаемую сеть, шифрование трафика и централизованное управление входящими запросами.

KubernetesPostgreSQLRabbitMQClickHouseIstioYandex Cloud

Было / Стало

Before БД без резервного узла, только файловый бэкап
After Кластер БД в 2 зонах + непрерывный бэкап с PITR
Before Брокер событий: 1 узел на отдельной машине
After Кластер из 3 узлов в разных зонах внутри облака
Before Аналитическое хранилище на одной ВМ
After Управляемый сервис с шардированием и координацией
Before Собственные серверы, единая точка отказа
After Облако, мульти-зональность, резервирование на каждом уровне
Раньше падение любого компонента означало инцидент и ручное восстановление на несколько часов. Теперь инфраструктура держит отказы узлов без вмешательства команды.
Инженерная команда Аналитическая платформа

Лежит прод, теряются заказы?

Подключимся в течение часа. Договор — потом.

Связаться сейчас