Яндекс · Yandex Cloud
Разработчик на Java в команду Alerting & Notifications (Monium)
Навыки
- API (интеграции)
- Java
- Мессенджеры
- Machine Learning
- Мониторинг и observability
- SRE-практики
- Телефония
Ещё 2
- Временные ряды
- Yandex Cloud
О компании и продукте
- Наша команда отвечает за развитие и поддержку четырёх основных сервисов. Алертинг — сервис, рассчитывающий пользовательские алерты поверх метрик. Мы предоставляем возможность создавать различные виды алертов (PromQL-подобные выражения, SLO-алерты, алерты на аномалии с применением ML-алгоритмов, агрегаты над алертами). Алертинг в числах. 24М алертов, рассчитываемых каждую минуту. 3М+ RPS на чтение временных рядов и обслуживание пользовательских запросов. 900+ серверов. 29 TB RAM. Сервис уведомлений , который позволяет задать шаблон и через единый API отправлять в SMS, мессенджерах и по телефону и простые уведомления, и их сложные последовательности («Напиши, а если не ответили в течение 10 минут — позвони»)
- Система событийного мониторинга , которая позволяет формировать верхнеуровневое (агрегированное) состояние сервиса на основании входных данных о его здоровье из разных источников (а это десятки миллионов уникальных событий) по правилам, заданным пользователем. Система синтетического мониторинга — новый сервис платформы — позволяет настраивать проверки по типу пинговалки: проверку живости хоста, проверку сертификатов. Какие задачи вас ждут Масштабировать системы в соответствии с ростом нагрузок. Стабильный рост нагрузки (порядка 30% в год) требует проводить регулярное масштабирование: искать узкие места, заниматься RnD вариантов решения, реализовывать горизонтальное масштабирование
Задачи
- Разработчик на Java в команду Alerting & Notifications (Monium)
- Почти все команды Яндекса пользуются возможностями платформы для мониторинга состояния своих сервисов — как внешних, так и внутренних
- Кроме этого, сервис доступен пользователям Yandex Cloud
- Внедрять отказоустойчивость
- Если алертинг не работает — пользователи остаются без приборов по своему продакшену и могут пропустить проблему, которая приведёт к серьёзному инциденту
- Поэтому необходимо, чтобы алертинг успевал просчитывать все алерты и был отказоустойчив
- Вам предстоит реализовать режим работы hot-standby в балансировщике, причём так, чтобы во время отказа стойки или модуля в дата-центре мы не потеряли обе реплики
- Помимо этого, нужно изолировать проекты, чтобы проблемы одного не влияли на другие
- Прорабатывать технические и продуктовые решения для пользовательских сценариев
- Наши пользователи — это такие же разработчики, как и мы сами. Проблемы, с которыми сталкиваются пользователи, актуальны и для нас. Поэтому разработчики всегда участвуют в обсуждении и проработке и технических, и продуктовых решений. Например, как должны выглядеть SLO-алерты
- как сделать так, чтобы пользователю было понятно, что такое good events и bad events
- как в этой парадигме создать SLO-алерт на тайминги
- Упрощать пользовательские сценарии работы с алертами
- Первое, с чем сталкивается пользователь, — как завести алерт для конкретного сценария
- Тут мы хотим предоставлять типовые алерты: на отклонение, тренд, резкие взлёты и падения, SLO
- Затем пользователю предстоит понять, что алерт отловил проблему
- Алерты нужно уметь просчитывать в прошлом, чтобы создать не сильно чувствительный алерт, который ловит реальные проблемы
- А после того как алерт создан, важно понять причину его срабатывания: это одна из реплик не ответила, это лаг поставки данных или же реальная проблема
- Разрабатывать общую платформу
- Понадобится адаптировать существующую функциональность для запуска в Yandex Cloud с доступом внешних пользователей, а также для создания единой monium platform для других сотрудников компании
- Больше о бэкенде в Яндексе — в канале Yandex for Backend
Требования
- Умеете писать и понимаете многопоточный код: весь алертинг работает асинхронно с использованием акторной модели
- Готовы писать код на Java и Go (соотношение 80% на 20%)
- Понимаете ключевые аспекты построения отказоустойчивых распределённых систем
- Смотрите другие вакансии направления Yandex Cloud Monium по ссылке
- Как в Яндексе проходят алгоритмические секции собеседований
- Как мы нанимаем бэкенд-разработчиков
- Задачи для подготовки к собеседованиям
- От 5 лет
Условия
- Гибридный
- Удалённая работа
- Наши сервисы — часть платформы Monium — позволяют создавать алерты и уведомлять об изменении состояний через каналы нотификаций (телеграм, телефонные звонки, клауд-функции и др.)
- Наша цель — предоставить пользователю лёгкий и быстрый способ получить однозначный ответ о состоянии систем в любой момент
Паспорт вакансии
История публикации
Появилась в Вакандии27 дней
Перепубликациинетпубликовалась один раз
Проверяли на источникеВидели 27 дней назад
Среди похожихНет данных74 из 30 · у похожих вакансий почти одинаковый возраст — сравнивать нечего
Откуда что взялось
Отмечено то, что вывели мы. Без пометки — значение назвал работодатель.
ГрейдMiddleвыведено из другого признака
Формат работыГибридвычитано из текста вакансии
ГеографияРоссия
Зарплатане указана
Почему на этом месте в выдаче
Порядок выдачи объявлен контрактом: свежесть решает между днями, полнота и зарплата — внутри дня.
Полнота карточки753 из 4 полей: грейд, формат, география, зарплата
Зарплата названа0вилки нет вовсе
Проверка Вакандии
Источники и свежесть
- Тип источника
- Карьерный сайт работодателя
- Найдено публикаций
- 1
Посмотреть публикации и даты
- careerОсновная публикация · 2026-07-10
Безопасность
Отклик уходит на сайт источника
Вакандия показывает вакансию, но не отправляет отклик и не проверяет работодателя. Сам отклик вы оставляете на внешнем сайте — yandex.ru.
Признаки мошенничества
- Просят предоплату, «залог» или деньги за обучение и оборудование.
- Требуют код из SMS, данные банковской карты или доступ к «Госуслугам».
- Быстро уводят в мессенджер и торопят с решением.
- Обещают большой доход без опыта и без деталей задач.
Настоящий работодатель не просит денег и платёжных данных до трудоустройства.
Продолжить поиск
Похожие вакансии
Причина сходства указана на каждой карточке
Подробнее - Подробнее
Почему похожа: похожая специализация · та же страна
Fabrique — Python-разработчик (Django, DRF)
- Junior
- Удалённо из России
- Москва, Россия