Специалист по Data Operations для AI/ML-проектов
AI-стартап в сфере conversational AI. Создают голосовых и текстовых AI-агентов для продаж, поддержки, консультаций и debt collection.
Ищут специалиста, который возьмёт на себя всю систему подготовки данных для AI/ML-моделей.
Задачи
- Выстроить полный цикл работы с данными: сбор, закупка, подготовка, разметка, проверка и приёмка.
- Определять требования к датасетам вместе с ML-инженерами.
- Выбирать модель работы: команда, подрядчики, краудсорсинг или гибрид.
- Формировать команды аннотаторов и экспертов.
- Разрабатывать инструкции и стандарты разметки.
- Внедрять системы контроля качества.
- Анализировать ошибки данных и находить системные причины.
- Автоматизировать разметку и проверку.
- Координировать работу с разными языками и проектами.
- Масштабировать успешные процессы между проектами.
Требования
- Опыт построения процессов подготовки и разметки данных для AI/ML.
- Понимание влияния качества и объёма данных на модели.
- Опыт управления аннотаторами, подрядчиками или распределёнными командами.
- Умение выстраивать контроль качества и методологию.
- Самостоятельность и готовность отвечать за результат.
- Понимание data operations, ML и people management.
- Знакомство с Label Studio, Toloka, Scale AI или аналогами.
- Русский и английский языки.
- Готовность работать из офиса в Москве.
Будет плюсом
- Опыт с ASR/TTS и речевыми данными.
- Опыт с LLM, conversational AI и AI-агентами.
- Опыт с мультиязычными датасетами.
- Опыт с human-in-the-loop и model-assisted labeling.
- Опыт с golden sets, double annotation, honeypot-задачами.
- Опыт с метриками качества разметки.
Опыт именно с речевыми данными не обязателен — важнее сильная методология и умение самостоятельно выстраивать процессы.