Работаю с IT-инфраструктурой с 2015 года. Выстраиваю SRE- и DevOps-практики с нуля: управление инцидентами, наблюдаемость, дежурства и автоматизацию операционной работы. Сейчас руковожу командой SRE в RWB; ранее возглавлял команду Observability в Dodo Engineering и занимался техническим развитием SRE в Финаме.
Преподаю в образовательных программах Яндекса, ИТМО и Слёрма. Автор интенсива по SRE, член программных комитетов DevOops и PerfConf.
5–7 мин
От сигнала до запуска реагирования в RWB. Ранее — 2–3 часа.
25 → 160
Рост количества настроенных алертов в RWB.
−90%
Time-to-market за год в РТК-Солар.
01 / КАРЬЕРА
Опыт работы
RWB
Декабрь 2025 — настоящее время
Team Lead SRE
Сократил время от сигнала о проблеме до запуска процесса реагирования на инцидент с 2–3 часов до 5–7 минут.
Выстроил SRE-процессы с нуля; руковожу командой из 4 человек.
Развил алертинг: количество настроенных алертов выросло с 25 до 160.
Внедрил управление инцидентами, постмортемы и регулярные разборы.
Организовал аналитику инцидентов для дальнейшего развития процессов.
Развиваю инструменты дежурств и реагирования на инциденты.
Dodo Brands
Сентябрь 2023 — декабрь 2025
SRE-инженер → Руководитель команды Observability
Руководитель команды — с начала 2025 года
Вырос из SRE-инженера в руководителя команды Observability из 4 человек.
Внедрял Grafana Stack и Mimir, оптимизировал Trickster.
Развивал мониторинг с использованием Grafana и Prometheus Operator.
Поддерживал инфраструктуру в Yandex Cloud, Azure и managed Kubernetes.
Участвовал в дежурствах и решении эксплуатационных задач.
Southbridge
Март 2023 — сентябрь 2023
Архитектор
Разрабатывал систему мониторинга на базе VictoriaMetrics.
Автоматизировал её развёртывание с помощью Ansible и GitLab CI/CD.
Финам
Февраль 2020 — март 2023
Tech Lead SRE → Руководитель Ops-команды
Переход к руководству Ops — примерно за два месяца до ухода
С нуля внедрял и развивал SRE-практики: алертинг, управление инцидентами, постмортемы, разборы и аналитику.
Определял технические подходы и помогал командам внедрять их совместно с руководителями команд.
Развивал CI/CD и инфраструктуру разработки с поддержкой в режиме 24/7.
Автоматизировал обновление сервисов и доставку приложений в Kubernetes и на серверы.
В последние два месяца работы возглавил Ops-команду.
РТК-Солар
Февраль 2019 — февраль 2020
DevOps-инженер
Самостоятельно выстроил DevOps-практики с нуля, выполняя инженерную работу по направлению в одном лице.
Внедрил CI/CD на Jenkins и автоматизацию инфраструктуры на Ansible и AWX.
Развивал и оптимизировал инфраструктурные сервисы.
За год бэклог сократился на 70%, time-to-market — на 90%.
Инженерный опыт
2015 — февраль 2019
Системное администрирование и эксплуатация инфраструктуры
Администрировал Linux и Windows Server, серверные приложения и сетевую инфраструктуру.
Разворачивал и сопровождал виртуализацию на VMware, Proxmox и OpenStack.
Работал с системами хранения, резервным копированием и восстановлением.
Внедрял мониторинг и сбор логов на Zabbix, Grafana и ELK.
Развивал контейнеризацию, Kubernetes и автоматизацию доставки приложений.
02 / ПРОЕКТЫ
Проектная работа
Innovative People
Ноябрь 2017 — октябрь 2023
DevOps / System Administrator
Проектная работа по договору ГПХ
Разворачивал и сопровождал инфраструктуру на OpenStack и CloudStack.
Настраивал мониторинг и сбор логов на Prometheus, Grafana и ELK.
Внедрял GitLab, CI/CD и Kubernetes для клиентских проектов.
Настраивал хранение контейнерных образов в Nexus и автоматическую публикацию релизов.
03 / ОБУЧЕНИЕ
Преподавание
Слёрм
С 2021 года. Автор и спикер «Интенсива по SRE», спикер курса «Управление надёжностью систем на основе данных».