DevOps-инженер в городе Москва с опытом работы от 3 до 6 лет
Middle · Удалённо из России · Москва, Россия
Не указано: требование к английскому
Навыки
Ansible
Резервное копирование
Cassandra / Scylla
CI/CD
Дашборды и витрины
DNS / DHCP
Docker
Ещё 17
Форензика и реагирование
GitLab CI
Grafana
Helm
Kafka
Kubernetes
Linux
Микросервисы
Мониторинг и observability
Ответственность за результат
PostgreSQL
Prometheus
RabbitMQ
Redis
Маршрутизация и NAT
Работа со стейкхолдерами
TCP/IP
О компании и продукте
Предприятие. Москва, НЛМК-Информационные технологии
Задачи
DevOps-инженер
Обеспечение развёртывания и эксплуатации решений стороннего вендора в рамках внутренней инфраструктуры: настраивать пайплайны, устанавливать релизы, проводить их проверку и контролировать соответствие техническим требованиям
Автоматизация процессов: запуск, обновление, масштабирование и сопровождение новых и действующих сервисов
Настройка мониторинга, логирования и оповещений — чтобы сервисы были прозрачными, а возможные проблемы выявлялись до возникновения инцидентов
Взаимодействие с вендором: оформлять тикеты, передавать баги, отслеживать их статус, участвовать в тестировании новых решений
Ведение документации по сервисам, архитектуре и процессам в своей зоне ответственности. Делиться знаниями и помогать развивать DevOps-экспертизу внутри команд
Требования
Уверенное практическое владение Linux-системами (предпочтительно RPM-based дистрибутивами) и диагностика системных проблем (опыт от 3 лет)
Контейнеризация приложений: написание и оптимизация Dockerfile, сборка, публикация и сопровождение образов
Развёртывание и сопровождение приложений в Kubernetes/OKD с использованием Helm (шаблоны, зависимости, релизы, values-файлы)
Построение и поддержка CI/CD-процессов на GitLab CI: разработка пайплайнов, работа с переменными, шаблонами и артефактами
Настройка и автоматизация инфраструктуры с использованием Ansible (плейбуки, роли, inventory-файлы)
Администрирование баз данных PostgreSQL и Cassandra: настройка, резервное копирование и восстановление
Настройка мониторинга и алертинга на базе Prometheus и Grafana: сбор метрик, построение дашбордов, управление алертами
Опыт построения отказоустойчивой и масштабируемой инфраструктуры с высокой доступностью (24/7): резервирование, репликация, мониторинг состояния систем
Опыт работы
От 3 до 6 лет
Будет плюсом
Практический опыт работы с Kafka, RabbitMQ и Redis — настройка, интеграция с микросервисами, мониторинг брокеров и очередей
Проактивность: умение самостоятельно выявлять проблемы, предлагать решения и инициативы, не дожидаясь отдельного запроса
Ответственность: готовность брать на себя технические участки и доводить задачи до результата в соответствии со сроками и приоритетами команды
Развитые коммуникативные навыки: способность чётко и аргументированно выражать технические идеи, эффективно взаимодействовать с разработкой, сопровождением и заинтересованными бизнес-стейкхолдерами
Командный подход: ориентация на общий результат, способность работать в кросс-функциональной среде и помогать коллегам, выходя за рамки своей технической зоны
Работа в группе НЛМК - это
Обучение и развитие: английский язык в лучших языковых школах, большое количество обучающих курсов от внутреннего корпоративного университета, посещение митапов и конференций
Возможность принять участие в интересных и сложных проектах с лучшими специалистами индустрии
Условия
Удаленная работа
Полная занятость
Группа НЛМК - международная сталелитейная компания с активами в России, США и пяти странах Европы
Производство вертикально интегрировано, это позволяет контролировать всю цепочку создания металлопродукции от добычи сырья до финальной обработки и поставки стали потребителям
Сейчас наша команда расширяется и мы ищем DevOps-engineer
Вас ждет
Поддержание стабильной работы производственных систем, состоящих из 100+ микросервисов: оперативно реагировать на сбои, мониторить узкие места, участвовать в устранении и разборе инцидентов, анализе причин
Полностью удаленный или гибридный график работы
Конкурентный уровень заработной платы и ежегодная индексация