О компании
Компания AVP VIGILANT TECHNOLOGY PVT LTD создаёт AI-продукты нового поколения на основе больших языковых моделей и интеллектуальной автоматизации для решения сложных бизнес-задач. Инженерные команды сочетают современные AI-технологии с масштабируемой разработкой ПО для создания надёжных, безопасных и готовых к продакшену решений на базе генеративного ИИ.
О роли
Ищем GenAI-инженера для проектирования, разработки и развёртывания приложений генеративного ИИ на основе LLM, RAG, Python и LangChain. Работа охватывает полный жизненный цикл AI-приложений: от прототипирования и экспериментов до продакшен-развёртывания и оптимизации.
Локация
Сан-Франциско, Калифорния; Нью-Йорк, Нью-Йорк; Сиэтл, Вашингтон; Остин, Техас.
Ключевые обязанности
- Проектирование и разработка готовых к продакшену приложений генеративного ИИ на основе LLM.
- Построение и оптимизация RAG-пайплайнов для точных и контекстно-зависимых ответов.
- Разработка AI-воркфлоу и компонентов приложений с использованием Python и LangChain.
- Интеграция коммерческих и открытых больших языковых моделей в корпоративные приложения.
- Разработка процессов приёма документов, чанкинга, эмбеддингов, поиска и реранжирования.
- Внедрение промт-инжиниринга, структурированных выводов, вызова инструментов и AI-агентов.
- Оценка качества, релевантности, задержки и надёжности моделей с помощью соответствующих методов.
- Оптимизация приложений по производительности, масштабируемости, стоимости и качеству ответов.
- Создание API и сервисов, интегрирующих возможности GenAI с существующими программными платформами.
- Совместная работа с инженерами, дата-сайентистами, продакт-менеджерами и бизнес-стейкхолдерами.
- Мониторинг продакшен-систем и непрерывное улучшение производительности моделей и приложений.
- Соблюдение лучших практик ответственного ИИ, безопасности, приватности и разработки ПО.
Требования
- 2–5 лет профессионального опыта в разработке ПО, машинном обучении, AI-инжиниринге или смежной области.
- Уверенное программирование на Python.
- Практический опыт создания приложений на основе LLM.
- Опыт разработки приложений на базе RAG.
- Опыт работы с LangChain или аналогичными фреймворками для LLM-приложений.
- Понимание эмбеддингов, векторных баз данных, семантического поиска и информационного поиска.
- Глубокое понимание промт-инжиниринга и архитектуры LLM-приложений.
- Опыт работы с API и продакшен-разработкой ПО.
- Навыки отладки, аналитического мышления и решения проблем.
Желательно
- Опыт с LangGraph, LlamaIndex или аналогичными фреймворками.
- Опыт с векторными базами данных: Pinecone, Weaviate, Milvus или pgvector.
- Знакомство с фундаментальными моделями OpenAI, Anthropic, Google, Meta и других.
- Опыт с облачными платформами AWS, Azure или Google Cloud.
- Знание Docker, Kubernetes, CI/CD и MLOps-практик.
- Опыт в оценке LLM, наблюдаемости, guardrails и безопасности ИИ.
- Знакомство с концепциями NLP, машинного обучения или глубокого обучения.
Условия
- Полная занятость.
- Зарплата $130,000–$210,000+ в год в зависимости от опыта и квалификации.
- Медицинская, стоматологическая и офтальмологическая страховка.
- 401(k) и пенсионные выплаты.
- Оплачиваемый отпуск и корпоративные праздники.
- Возможности профессионального развития и обучения.
- Гибкий или гибридный формат работы в зависимости от локации.
- Возможность работать над высокоэффективными продуктами генеративного ИИ.