Middle · Гибрид · Москва, Россия · Английский не нужен
Навыки
API (интеграции)
Bash / shell
Креативность
Анализ данных
Docker
Финтех и платежи
Git
Ещё 8
Machine Learning
MLOps
152-ФЗ / персональные данные
Python
PyTorch
RAG
Робототехника
Transformers / HuggingFace
О компании и продукте
Ищем инженеров-исследователей для двух стримов нашей команды. Native Omnimodality & VLA. Omnimodal Reasoning & Tool-Call. Никаких API-костылей и заморозки весов. Только фундаментальная архитектура, joint pretraining и работа на стыке ИИ, видео, аудио и робототехники. Ищем Middle AI Engineer для создания нативных омни-модальных архитектур — новых способов кодирования и совместного обучения в доменах изображений, аудио, видео и т.д
Задачи
Разработка принципиально новых мультимодальных представлений и кодирования информации (vision, audio, video, text)
Создание универсальных энкодеров и shared latent spaces
Vision-Language-Action (VLA) архитектуры и стрим взаимодействия с роботами
Исследование end-to-end омни-модальных моделей и обучение на масштабных мультимодальных датасетах
Кутузовская) Санкт-Петербург (м
Новочеркасская) Гибрид
Технологии/инструменты Python 3 PyTorch Bash Git Docker DVC Transformers Рассматриваем кандидатов из Москвы и Санкт-Петербурга
Требования
Отличный Python 3, опыт с PyTorch, bash, git, Docker, DVC
Глубокое понимание representation learning и multimodal learning