РЕЗЮМЕ

Максим Гусев.

SRE Team Lead · Москва

Работаю с IT-инфраструктурой с 2015 года. Выстраиваю SRE- и DevOps-практики с нуля: управление инцидентами, наблюдаемость, дежурства и автоматизацию операционной работы. Сейчас руковожу командой SRE в RWB; ранее возглавлял команду Observability в Dodo Engineering и занимался техническим развитием SRE в Финаме.

Преподаю в образовательных программах Яндекса, ИТМО и Слёрма. Автор интенсива по SRE, член программных комитетов DevOops и PerfConf.

5–7 мин

От сигнала до запуска реагирования в RWB. Ранее — 2–3 часа.

25 → 160

Рост количества настроенных алертов в RWB.

−90%

Time-to-market за год в РТК-Солар.

01 / КАРЬЕРА

Опыт работы

RWB

Декабрь 2025 — настоящее время

Team Lead SRE

  • Сократил время от сигнала о проблеме до запуска процесса реагирования на инцидент с 2–3 часов до 5–7 минут.
  • Выстроил SRE-процессы с нуля; руковожу командой из 4 человек.
  • Развил алертинг: количество настроенных алертов выросло с 25 до 160.
  • Внедрил управление инцидентами, постмортемы и регулярные разборы.
  • Организовал аналитику инцидентов для дальнейшего развития процессов.
  • Развиваю инструменты дежурств и реагирования на инциденты.

Dodo Brands

Сентябрь 2023 — декабрь 2025

SRE-инженер → Руководитель команды Observability

Руководитель команды — с начала 2025 года

  • Вырос из SRE-инженера в руководителя команды Observability из 4 человек.
  • Внедрял Grafana Stack и Mimir, оптимизировал Trickster.
  • Развивал мониторинг с использованием Grafana и Prometheus Operator.
  • Поддерживал инфраструктуру в Yandex Cloud, Azure и managed Kubernetes.
  • Участвовал в дежурствах и решении эксплуатационных задач.

Southbridge

Март 2023 — сентябрь 2023

Архитектор

  • Разрабатывал систему мониторинга на базе VictoriaMetrics.
  • Автоматизировал её развёртывание с помощью Ansible и GitLab CI/CD.

Финам

Февраль 2020 — март 2023

Tech Lead SRE → Руководитель Ops-команды

Переход к руководству Ops — примерно за два месяца до ухода

  • С нуля внедрял и развивал SRE-практики: алертинг, управление инцидентами, постмортемы, разборы и аналитику.
  • Определял технические подходы и помогал командам внедрять их совместно с руководителями команд.
  • Развивал CI/CD и инфраструктуру разработки с поддержкой в режиме 24/7.
  • Автоматизировал обновление сервисов и доставку приложений в Kubernetes и на серверы.
  • В последние два месяца работы возглавил Ops-команду.

РТК-Солар

Февраль 2019 — февраль 2020

DevOps-инженер

  • Самостоятельно выстроил DevOps-практики с нуля, выполняя инженерную работу по направлению в одном лице.
  • Внедрил CI/CD на Jenkins и автоматизацию инфраструктуры на Ansible и AWX.
  • Развивал и оптимизировал инфраструктурные сервисы.
  • За год бэклог сократился на 70%, time-to-market — на 90%.

Инженерный опыт

2015 — февраль 2019

Системное администрирование и эксплуатация инфраструктуры

  • Администрировал Linux и Windows Server, серверные приложения и сетевую инфраструктуру.
  • Разворачивал и сопровождал виртуализацию на VMware, Proxmox и OpenStack.
  • Работал с системами хранения, резервным копированием и восстановлением.
  • Внедрял мониторинг и сбор логов на Zabbix, Grafana и ELK.
  • Развивал контейнеризацию, Kubernetes и автоматизацию доставки приложений.

02 / ПРОЕКТЫ

Проектная работа

Innovative People

Ноябрь 2017 — октябрь 2023

DevOps / System Administrator

Проектная работа по договору ГПХ

  • Разворачивал и сопровождал инфраструктуру на OpenStack и CloudStack.
  • Настраивал мониторинг и сбор логов на Prometheus, Grafana и ELK.
  • Внедрял GitLab, CI/CD и Kubernetes для клиентских проектов.
  • Настраивал хранение контейнерных образов в Nexus и автоматическую публикацию релизов.

03 / ОБУЧЕНИЕ

Преподавание

04 / СООБЩЕСТВО

Программные комитеты и выступления

Член программного комитета PerfConf

Спикер DevOops 2023

Доклад «Инструменты и практики SRE, которые помогают освободиться от рутины и добиться гладкой работы систем».

Выступления и лекции

Внедрение SRE, дежурства, управление инцидентами и сокращение операционной рутины.

05 / ПРАКТИКА

Основной стек

SRE и управление
Внедрение SRE-практик · Управление инцидентами · Постмортемы · Дежурства · Observability · Техническое лидерство · Руководство командами
Инфраструктура
Linux · Kubernetes · Docker · Yandex Cloud · Azure
Observability
Grafana Stack · Mimir · Prometheus · Prometheus Operator · Trickster · VictoriaMetrics · ELK
CI/CD и автоматизация
GitLab CI/CD · TeamCity · Jenkins · Ansible · Bash
Инфраструктурные сервисы
Vault · Consul · Nexus · Artifactory

Русский — родной. Английский — B2.

НА СВЯЗИ

Обсудим задачу?

Напиши в Telegram или выбери время для встречи.