ML-инженер в команду аудиоязыковых моделей
Наша команда обучает аудиоязыковые модели нового поколения. Мы хотим, чтобы одна модель могла понимать звучащий вокруг мир: речь, интонацию, настроение собеседника, фоновые события, музыку, шумы и другие сигналы. Ищем ML-инженера, который сможет влиять на архитектуру, обучение и качество моделей: от исследовательских гипотез до работающих пайплайнов.
Какие задачи вас ждут
- Обучение аудиоязыковых моделей: участие в полном цикле обучения моделей — претрейне, SFT и GRPO. Проектирование экспериментов, анализ качества, поиск слабых мест и улучшение моделей на сложных срезах данных.
- Исследование архитектур и рецептов обучения: разбор современных подходов к LLM, audio encoders, speech/audio understanding, multimodal alignment и обучению по reward-сигналам. Отслеживание развития области, обсуждение идей с командой и проверка гипотез.
- Работа с данными и метриками качества: участие в построении датасетов, формулировка задач для обучения и оценки, выбор метрик для разных сценариев.
- Развитие исследовательской и инженерной инфраструктуры: обеспечение воспроизводимых экспериментов, эффективных пайплайнов, стабильного обучения, анализ логов, оптимизация узких мест и аккуратная работа с большими вычислениями.
Мы ждём, что вы
- Обучали LLM или мультимодальные модели
- Понимаете полный цикл ML-разработки
- Умеете разбираться в ML-статьях, формулировать на их основе гипотезы, проводить эксперименты и делать выводы
- Готовы отвечать за направление, архитектурные решения или крупный исследовательский трек
Будет плюсом, если вы
- Работали с аудио, речевыми технологиями, ASR, TTS, speaker/audio understanding или audio representation learning
- Обучали мультимодальные модели или применяли SFT, RLHF, DPO, GRPO и другие методы посттрейна
Наши бонусы
Мы заботимся о детях яндексоидов и устраиваем детские дни в офисе.