ML-разработчик в команду распознавания речи (направление «Инклюзия
Middle · Гибрид · Чита, Россия · Английский не нужен
Навыки
ASR / TTS
Big Data
C++
Machine Learning
NLP
Python
PyTorch
О компании и продукте
ML-разработчик в команду распознавания речи (направление «Инклюзия»)
Наша команда занимается R&D в области распознавания речи. Мы развиваем базовые NLP-технологии для сервисов Яндекса, которые работают с голосом: от Станций с Алисой и перевода видео в Браузере до Яндекс Клавиатуры и Переводчика. Одно из важных направлений работы — повышение инклюзивности наших систем. Например, мы улучшаем качество распознавания для людей с особенностями речи в Алисе и Яндекс Разговоре, развиваем автоматические субтитры для слабослышащих пользователей Кинопоиска. Даниил Волгин. Руководитель группы ASR. Ищем опытного ML-разработчика, готового много экспериментировать с базовым качеством моделей, работать с речевым доменом и доводить исследовательские идеи до использования в продакшене
В этой роли важно не только получать хорошие офлайн-метрики, но и понимать, как модель будет работать в реальных пользовательских сценариях, какие данные вам нужны для улучшения и как превращать исследовательские результаты в продуктовые возможности. У вас будет проверенная инфраструктура для экспериментов и ресурсы для разметки данных
Мы хотим развивать в нём потоковое разделение речи говорящих и распознавание в различных сценариях использования
Задачи
Вы сможете быстро видеть результаты своей работы в продуктах, которыми пользуются миллионы людей
О первых шагах в распознавании сложных нарушений речи в Алисе мы уже рассказывали на Хабре
Какие задачи вас ждут Улучшение качества распознавания речи для людей с особенностями речи
Вам предстоит исследовать современные подходы к обучению моделей распознавания, читать статьи, формулировать гипотезы, проводить эксперименты, заказывать разметку данных и анализировать ошибки
Нужно будет доводить полученные улучшения до продакшена и так повышать доступность продуктов для пользователей
Развитие новых функций в Яндекс Разговоре
Яндекс Разговор — флагманское приложение для наших инклюзивных технологий, оно помогает общаться людям с особенностями слуха и речи
Создание автоматических субтитров
Вы будете исследовать особенности данных в фильмах и сериалах и улучшать качество автоматических субтитров для таких данных
Кроме распознавания речи, мы хотим научиться описывать звуки — музыку, шумы и события в кадре
Требования
Хорошо знаете Python и PyTorch
Имеете опыт DL-разработки, например в области NLP или CV
Умеете читать современные научные статьи, разбираться в них и превращать идеи в рабочие эксперименты
Готовы работать с данными: анализировать ошибки, формулировать требования к разметке и проверять гипотезы на реальных сценариях
От 3 лет
Имеете опыт работы с большими данными
Будет плюсом
Работали с DL в области речевых технологий
Владеете C++ на базовом уровне
Условия
Гибридный
Удалённая работа
Паспорт вакансии
История публикации
Появилась в Вакандии28 дней
Перепубликациинетпубликовалась один раз
Проверяли на источникеВидели 28 дней назад
Среди похожихНет данных105 из 30 · у похожих вакансий почти одинаковый возраст — сравнивать нечего
Откуда что взялось
Отмечено то, что вывели мы. Без пометки — значение назвал работодатель.
ГрейдMiddleвыведено из другого признака
Формат работыГибридвычитано из текста вакансии
ГеографияЧита, Россиявычитано из текста вакансии
Зарплатане указана
Почему на этом месте в выдаче
Порядок выдачи объявлен контрактом: свежесть решает между днями, полнота и зарплата — внутри дня.
Полнота карточки753 из 4 полей: грейд, формат, география, зарплата
Зарплата названа0вилки нет вовсе
Проверка Вакандии
Источники и свежесть
Тип источника
Карьерный сайт работодателя
Найдено публикаций
1
Посмотреть публикации и даты
careerОсновная публикация · 2026-07-08
Я
Работодатель
Яндекс
50 активных вакансий · вилка работодателя указана в 1%