Ищем опытного Incident Commander — человека, который управляет самыми сложными авариями в нашей сети и сервисах. Это не роль «дежурного инженера». Это роль лидера, принимающего решения в условиях неопределённости и высокой цены ошибки
Задачи
Что тебе предстоит: Управлять критическими инцидентами уровня P1/P2, выполняя роль Incident Commander по модели IC-DC-SMC и координируя работу кросс-функциональных команд
За 2–3 минуты оценивать severity, организовывать WAR Room, определять стратегию реагирования и приоритеты: stop the bleed
stabilization
root cause remediation
Координировать выполнение мероприятий по восстановлению сервисов, принимая совместно с инженерными командами решения об откате релизов, failover ЦОДа, переключении трафика, частичной деградации сервисов и других мерах по снижению влияния инцидента
Вести incident timeline (detection
response
mitigation
resolution) в Jira, PagerDuty, Opsgenie и обеспечивать регулярную коммуникацию со стейкхолдерами и бизнесом
Организовывать проведение blameless postmortem, выполнять RCA и контролировать реализацию action items
Развивать процессы Incident Management: совершенствовать runbooks, playbooks, процессы on-call-ротации, организовывать Game Days и chaos engineering, анализировать и улучшать показатели MTTD, MTTR, MTBF, SLI/SLO attainment
Обучать новых Incident Commander, проводить ретроспективы и внедрять лучшие практики управления инцидентами
Требования
Опыт управления критическими инцидентами (P1/P2) в высоконагруженной или распределенной ИТ-инфраструктуре
Уверенное понимание сетевых технологий (TCP/IP, BGP, MPLS, DNS, HTTP/S), архитектуры LTE/5G Core, принципов работы Linux и инженерных инструментов диагностики (strace, tcpdump, iostat, journalctl)
Опыт работы с инструментами Observability: Prometheus, Grafana, Zabbix, ELK/OpenSearch, Jaeger/Zipkin
Понимание процессов CI/CD, стратегий релизов (Canary, Blue-Green), жизненного цикла Kubernetes Pods, Helm, а также принципов работы PostgreSQL (connection pool, replication lag), Redis и Kafka
Знание процессов ITIL/ITSM (Event
Incident
Change Management)
Умение принимать решения в условиях высокой неопределенности, эффективно управлять несколькими потоками работ (debug, escalation, communications, stakeholders, timeline), выстраивать коммуникацию с бизнесом и техническими командами, демонстрировать leadership without authority и придерживаться blameless mindset
Будет преимуществом: Опыт работы в telecom или крупных распределенных сервисах (e-commerce, cloud provider, CDN)
Практический опыт проведения Game Days, chaos engineering и fault injection (Gremlin, Chaos Mesh, Litmus)
Знакомство с требованиями РКН, 152-ФЗ, СОРМ
Опыт подготовки RCA или postmortem, повлиявших на архитектуру сервиса и повышение его надежности
Условия
Реальная ответственность и влияние на надёжность сервисов миллионов абонентов
Современный стек: k8s, Terraform, GitOps, собственный observability platform Полис добровольного медицинского страхования, обслуживаемый в лучших клиниках, а также чек-ап для сотрудников 40+
Страхование жизни, страхование от несчастных случаев и критических заболеваний, страхование выезжающих за рубеж
Материальную помощь
Детские подарки
Доплату по листу нетрудоспособности Корпоративные скидки на товары и услуги от партнеров компании
Служебную сотовую связь
Кафетерий льгот — возможность самостоятельно выбрать дополнительные корпоративные льготы и бонусы (спорт, здоровье, обучение, путешествия, транспорт и др.)
Доступно после испытательного срока
Удалёнка / гибрид / офис — на выбор
Паспорт вакансии
История публикации
Появилась в Вакандии28 дней
Перепубликациинетпубликовалась один раз
Проверяли на источникеВидели 28 дней назад
Среди похожихНет данныху карточки не хватает полей, чтобы найти похожие
Откуда что взялось
Отмечено то, что вывели мы. Без пометки — значение назвал работодатель.
Грейдне указан
Формат работыГибридвычитано из текста вакансии
ГеографияМосква, Россиявычитано из текста вакансии
Зарплата≈ 90 000 RUB в месяцнаша оценка, в вакансии не названа
Почему на этом месте в выдаче
Порядок выдачи объявлен контрактом: свежесть решает между днями, полнота и зарплата — внутри дня.
Полнота карточки753 из 4 полей: грейд, формат, география, зарплата
Зарплата названа0вилки работодателя нет, показана наша оценка
Проверка Вакандии
Источники и свежесть
Тип источника
Агрегатор вакансий
Найдено публикаций
1
Посмотреть публикации и даты
hcareersОсновная публикация · 2026-08-05
Б
Работодатель
Билайн
9 активных вакансий · вилка работодателя указана в 0%