Breadcrumbs

Журналы задач и событий системы

Наблюдаемость операций платформы: каждое действие — это асинхронная задача, а все изменения фиксируются в журнале событий.

Задачи

Любая операция (создание ВМ, аплинка, порт-группы, балансировка, обновление, инициализация хоста) выполняется как задача и раскладывается в дерево микрозадач, часть из которых идёт параллельно. По каждой задаче видно цель, статус, автора и время. Статусы: в ожидании, в очереди, запущена, завершена, отклонена, провалилась, отменена, отложена. При ошибке срабатывает система ревертов — уже созданные сущности откатываются, и инфраструктура остаётся в согласованном состоянии.

ac-tasks.png

Задачи: имя операции, цель (кластер / Switch / глобально), статус, автор и время — с полной историей по инфраструктуре.

События

Журнал событий — для аудита и диагностики: что и когда происходило в системе. Записи нормализованы (дата, время, источник, описание); предупреждения ставятся не только на ошибки, но и на действия, способные привести к компрометации. События отдаются во внешние SIEM-системы через API.

ac-events.png

Журнал «События»: тип, цель, дата и связанная задача по каждой записи.

Event Sourcing

Журнал событий — не просто лог: платформа построена на Event Sourcing. Состояние системы хранится как история событий, наслаивающихся друг на друга, поэтому можно перемещаться по дереву событий вверх и вниз и восстанавливать состояние на любой момент. На этом же механизме работает система ревертов, а отказоустойчивость служебной базы совпадает с отказоустойчивостью Центрального сервера — без ручных репликаций.

Скриншоты предыдущей версии интерфейса (будут заменены)
image-20240403-141934.png
image-20240403-142007.png