Удалённо из России · Ростов-на-Дону, Россия · Английский не нужен
Не указано: грейд
Навыки
Ansible
CI/CD
ClickHouse
Confluence
Docker
ELK / Elastic Stack
Форензика и реагирование
Ещё 17
Grafana
Hadoop
HBase / Hive
Java
Jira
Kafka
Kubernetes
Linux
MongoDB
Мониторинг и observability
PostgreSQL
Prometheus
SRE-практики
Потоковая обработка
Terraform
Windows
Windows Server
О компании и продукте
Делаем инновации доступными и полезными Мы выбираем лучшее из мира технологий и превращаем в реальные ИТ-решения, которыми пользуются миллионы сотрудников крупнейших компаний
Мы создаём инновационные решения для лидеров рынка, объединяем более 4000 профессионалов и работаем во всех ключевых отраслях страны. Присоединяйтесь к нам и станьте частью команды, которая меняет будущее ИТ в России!
Задачи
Развертывание, поддержка и масштабирование Hadoop + Kubernetes кластеров
Подготовка и проведение deployment-приложений в кластер
Автоматизация рутинных процессов и инфраструктуры как кода
Настройка и поддержка систем мониторинга, алертинга и логирования
Участие в разборе инцидентов (on-call, root cause analysis)
Документирование инфраструктуры и процессов (Jira / Confluence)
Помощь разработчикам и пользователям в решении инфраструктурных задач
Постоянное улучшение стабильности и отказоустойчивости систем
В нашей команде у тебя есть все ресурсы и возможности, чтобы раскрыть свой потенциал и реализовать таланты, делая то, чем будешь гордиться
Требования
Опыт построения и поддержки CI/CD для Java-приложений (Tomcat)
Знание Infrastructure as Code (Terraform / Ansible предпочтительно)
Опыт контейнеризации (Docker) и оркестрации (Kubernetes или Docker Swarm) хотя бы части стека
Настройка мониторинга, логирования и алертинга стека (Prometheus + Grafana + ELK/EFK или аналог)
Опыт обеспечения высокой доступности и disaster recovery для перечисленных компонентов
Умение работать с mixed environment (Linux + Windows)
Уверенный опыт администрирования и эксплуатации следующих СУБД: MongoDB, PostgreSQL, ClickHouse
Опыт работы с Apache Kafka (настройка кластеров, мониторинг, tuning, Schema Registry, Kafka Connect)
Глубокие знания и опыт эксплуатации Java-приложений на Apache Tomcat (Catalina), включая настройку JVM, thread pools, memory management, SSL, session replication
Опыт работы с Apache Atlas (установка, интеграция с Kafka/Hive/HBase, настройка lineage, классификация данных, business glossary)
Уверенное владение Windows Server и управление Windows Services (создание, мониторинг, отказоустойчивость, PowerShell-скриптинг)
ЗДЕСЬ ТЫ ИМЕЕШЬ ЗНАЧЕНИЕ Мечтай, думай, создавай в IBS!