Направление

Вакансии ML-инженеров

Модели, данные, MLOps, NLP и computer vision.

17 вакансийРазместить

Поиск

Подбор вакансий

Инструмент: RAG
Логотип Далее/

ML-инженер

Далее/СНГ / РоссияОфис4 авг.

Мы — Далее, и мы занимаемся разработкой и поддержкой сложных digital-решений для крупных клиентов: от веб-сайтов до приложений, от Сбербанка до Nestle. Мы — один из крупнейших независимых продакшнов в России, работаем с 2005 года, сейчас в штате более 550 человек. Мы занимаем 1-е место в рейтинге Adindex Digital Index в сегменте web-production, входим в топ-20 Tagline. Сейчас мы ищем ML-инженера в команду, которая реализует AI-решения для различных проектов компании. Предстоит разрабатывать и внедрять ML-модели, участвуя во всем жизненном цикле продукта. Обязанности: Поддерживать текущие алгоритмические решения. Проектировать и внедрять AI-агентов (LLM, GPT-like модели) в различные процессы. Разрабатывать методологию и проектировать NLP/LLM решения. Адаптировать и дообучать LLM (например, LLaMA, Mistral, YaLM 2) под специфику продукта. Интегрировать LLM API (OpenAI, Claude) с fallback-механизмами. Проводить исследования, тестировать новые идеи, оценивать жизнеспособность и качество моделей, реализовывать R&D-подходы на реальных бизнес-данных. Разрабатывать RAG-пайплайн для поиска и обработки данных (POI, отзывы, описания). Настраивать векторные БД (Pinecone/Weaviate/Qdrant) и оптимизировать кэширование. Заниматься prompt engineering — создавать и тестировать промты для различных сценариев. Вести рабочую документацию и создавать отчеты о результатах работы. Мониторить ключевые показатели эффективности процессов, анализировать отклонения и их воздействие на общие показатели. Участвовать в проектировании архитектуры, CI/CD, мониторинге и оптимизации сервисов. Требования: Высшее образование в области математики, информатики или смежных дисциплин. Знание современных AI-фреймворков и библиотек (LangChain, LlamaIndex и других). Навыки создания ML-пайплайнов и backend-сервисов. Уверенное владение Python и PyTorch/TensorFlow, понимание принципов работы алгоритмов (GBDT, CNN, Transformers). Практический опыт работы с API, Docker/Kubernetes и базами данных. Понимание процессов Fine-tuning LLM и оценки качества моделей. Опыт внедрения RAG. Умение писать unit-тесты. Будет плюсом: Позитивный опыт внедрения RAG агентов в существующие бизнес-процессы. Реализованные проекты с существенной пользовательской нагрузкой. Понимание инфраструктуры для ML-сервисов (GPU, CPU). Мы предлагаем: Полностью белую заработную плату. Ориентируемся на ваши пожелания, опыт и навыки. Оформление по ТК РФ, оплачиваемый отпуск и больничный с первого рабочего дня. Работу в компании с аккредитацией в Минцифры. Расширенный пакет ДМС со стоматологией. 8-часовой рабочий день, удаленный формат работы. Спорт – корпоративный волейбол, беговой клуб и киберспортивные турниры). Яркую корпоративную жизнь – более 400 мероприятий в год (2 корпоратива с оплатой трансфера, разговорный клуб английского, совместные походы в музей, квизы, книжный и киноклуб, мем-чат и многое другое). Обучение и участие в профессиональных конференциях.

PythonDockerKubernetesCI/CD+7
По договорённости
Habr CareerОтклик на сайте источника
Логотип Контур

AI application security engineer, middle+/senior

КонтурСНГ / РоссияОфис4 авг.

Контур — экосистема для бизнеса. Наши сервисы помогают каждой третьей компании России делать рабочие процессы проще и эффективнее: вести бухгалтерию, сдавать отчетность в госорганы, обмениваться документами без бумаги, общаться друг с другом на удаленке и многое другое. С нами жизнь 3,1 миллионов предпринимателей и их сотрудников становится легче. О команде Мы — команда безопасности ИИ в Центре киберзащиты Контура. Ищем специалиста по кибербезопасности, который поможет внедрять и сопровождать решения на базе AI — от продуктовых сервисов и RAG-систем до внутренних AI-инструментов разработки. В Контуре активно развивается использование AI-ассистентов и агентов. Наша задача — сделать так, чтобы эти инструменты были безопасными, а разработчик получал защищенный результат, соответствующий ИБ-политикам, без необходимости погружаться во все тонкости ИБ. Задачи Проводить анализ защищенности (преимущественно Whitebox) LLM-приложений, AI-агентов, RAG, векторных БД, Low-Code/No-Code-систем (Dify, n8n) и интеграций с внешними API / облачными моделями. Выявлять специфичные для AI векторы атак: prompt injection, indirect prompt injection, jailbreak, data poisoning, excessive agency, unsafe tool calls и over-privileged agents. Настраивать и валидировать защитные механизмы: фильтры PII / конфиденциальных данных, ограничения контекста, rate limiting, контроль вызова tools и ручные подтверждения для критичных операций. Укреплять внутренний AI/ML-тулинг совместно с платформенными командами. Строить систему правил, скиллов и хуков, чтобы встраивать политики ИБ непосредственно в среду разработки: skills, rules, hooks, MCP-серверы. Проверять безопасность локального запуска LLM и агентов в Kubernetes и Linux-песочницах: изоляция сессий, памяти, контейнеров, RBAC, NetworkPolicy, Secrets Management. Формировать требования к аудиту и трассировке AI-систем: trace ID, логирование prompt/response, фиксация вызовов моделей и действий агентов. Консультировать команды, помогать внедрять безопасный код и выстраивать понятные процессы. Мы ожидаем Опыт в сфере ИБ от двух лет в одном или нескольких направлениях: AppSec, DevSecOps, Cloud/K8s Security, Product Security или ML Security. Уверенное владение одним из языков программирования: Python, Go, C, TS, Rust. Умение читать чужой код, искать уязвимости и писать PoC. Знание AI/LLM-стека: понимание устройства языковых моделей, RAG, векторных БД (Milvus, Qdrant, pgvector и др.), AI-агентов, agent memory, tool calling, а также стандарта взаимодействия MCP. Знание AI-угроз: понимание рисков OWASP for LLM, MITRE ATLAS (prompt injection, раскрытие system prompt, утечки данных, необдуманное выполнение кода агентами). Знание основ Linux и базовое понимание безопасности Kubernetes: RBAC, ServiceAccount, NetworkPolicy, Secrets, изоляция контейнеров. Знание классических веб-уязвимостей, механизмов аутентификации и авторизации OAuth2, OIDC, JWT, RBAC и безопасной разработки — Secure SDLC, Threat Modeling. Умение аргументированно объяснять риски, находить компромиссы с разработкой. Мы предлагаем Гибридный формат работы в Екатеринбурге. Офис на ул. Малопрудной, 5. Предоставим все необходимое: технику, рабочее место, библиотеку с профессиональной литературой, место для отдыха и кухонную зону с фруктами и снеками. Уровень дохода, который зависит от ваших технических знаний и навыков. Регулярно пересматриваем зарплаты с учетом профессионального роста. Финансовые бонусы тоже есть. Сильное инженерное комьюнити. Регулярно проводим внутренние технические конференции, обмениваемся опытом между командами. Вы всегда найдете с кем посоветоваться. Возможность сменить продукт, команду или предметную область внутри компании. Поддерживаем развитие в любом направлении. Общение на «ты» и максимум горизонтальных связей в коллективе, чтобы быстрее договариваться и решать рабочие задачи. Возможность делиться экспертизой. Помогаем выступать на конференциях, участвовать в подкастах или видео, писать статьи. Поддержку профессионального развития. Организуем внутреннее и внешнее обучение.

LLMLinuxn8nRAG+2
По договорённости
Habr CareerОтклик на сайте источника
Логотип Финам

Backend-разработчик/Инженер автоматизации IT-операций (Python, AI/LLM)

ФинамСНГ / РоссияОфис3 авг.

Задачи - Разрабатывать MCP-серверы и интеграции с внутренними IT-системами. - Создавать цифровые роли Avatar для обработки заявок, диагностики и подсказок инженерам. - Автоматизировать типовые операции IT Operations. - Подключать источники данных: мониторинг, логи, CMDB, Jira/ITSM, базы, внутренние API. - Делать простые backend-сервисы, скрипты, воркфлоу и API-обвязки. - Работать с RAG, памятью, skill-ами, tool calling, LLM API. - Разбирать реальные кейсы инженеров и превращать их в работающие MVP. - Писать документацию: как работает интеграция, как поддерживать, как диагностировать. Требования - Уверенная backend-разработка или automation engineering. - Python как основной рабочий инструмент; Go / TypeScript — плюс. - Опыт работы с REST API, JSON, SQL, Git, Docker. - Понимание Linux, сетей, логов, мониторинга, базовой эксплуатации. - Умение писать надежные интеграции, а не только прототипы. - Понимание LLM-инструментов: prompts, tools, agents, RAG, function calling. - Готовность работать с внутренними legacy-системами и неполной документацией. - Самостоятельность: сам разобрался, уточнил, сделал, задокументировал. Условия - Официальное трудоустройство и полный пакет социальных льгот (ДМС, компенсация фитнеса/обучения/путешествия, скидки и бонусы от партнеров, специальные условия и тарифы на продукты «Финама»). - Стабильную заработную плату и социальные гарантии. - Возможность профессионального роста, обучения и постоянного развития в области digital-innovations вместе с командой. Лучшие конференции и мастер-классы за счет компании. - Участие в проектах, которые формируют цифровую трансформацию финансового сектора. - Комфортный офис в центре Москвы с зоной отдыха на крыше, кофе-поинтами, а также собственный тренажерный зал. - Гибридный формат работы (2 дня офис), возможен удалённый формат. - Корпоративная культура: внутрикорпоративные мероприятия, сообщества по интересам, возможность проявлять свои творческие, спортивные, интеллектуальные, социальные интересы.

PythonGitDockerLinux+3
По договорённости
Habr CareerОтклик на сайте источника
Логотип Финам

Инженер по созданию агентов ИИ/AI Agent Engineer

ФинамСНГ / РоссияОфис31 июл.

Мы строим собственную агентскую платформу корпоративного уровня Avatar— enterprise-аналог открытых агентских систем.Ищем сильного AI Agentic Engineer уровня Senior / Expert. Это инженерная роль на стыке agent engineering, backend и platform/infra-подхода. Вам не нужно быть архитектором всей агентской платформы, но нужно уметь проектировать устройство конкретных агентов и агентских сценариев внутри Avatar. Стек: LLM, MCP, RAG, Python, Rust, TypeScript Чем предстоит заниматься: Проектировать внутреннюю логику агентов и агентских сценариев в Avatar. Определять, где нужен agent, где tool, где sub-agent, а где deterministic-код. Строить agent loop: планирование, вызов инструментов, обработка ошибок, память, эскалации, ограничения действий. Проектировать multi-agent сценарии: роутинг задач, специализация агентов, контроль состояния. Разрабатывать MCP/tool-интеграции и подключать агентов к внутренним системам. Настраивать eval-харнессы, regression-эвалы и контроль качества агентов. Работать с observability: traces, tool calls, latency, retries, failure modes, cost tracking. Проектировать работу с контекстом: что инжектится на каждом turn, как работает память, как не раздувать историю. Участвовать в развитии self-hosted / sovereign agent stack: локальные модели, model-agnostic слой, OpenClaw-подобные рантаймы, SGLang/Ollama/vLLM/LiteLLM. Помогать продуктовым и инженерным командам правильно применять агентский подход. Наши ожидания: Реальный опыт разработки AI-агентов или agentic-систем. Понимание LLM, tool calling, function calling, RAG, memory, context management. Опыт с агентскими фреймворками или SDK: OpenAI Agents SDK, LangGraph, AutoGen, CrewAI, Semantic Kernel, OpenClaw-подобные рантаймы или аналогичные решения. Умение проектировать логику работы агента, а не только писать промпты. Сильный backend-опыт на Python или TypeScript. Опыт интеграций с API, MCP, внутренними системами, очередями, БД. Понимание Docker, Linux, Kubernetes, сетей, логов и эксплуатации. Опыт построения evals: наборы кейсов, regression-тесты, метрики качества, разбор деградаций. Понимание безопасности агентов: prompt injection, ограничение action space, sandboxing, права, audit trail. Умение считать performance/cost: latency, токены, retries, кэширование, параллелизация, выбор модели. Особенно ценно: Агент или агентский сценарий, который реально работал в production. Опыт self-hosted AI-инфраструктуры. Опыт OpenClaw / Claude Code-подобных / Claw-подобных runtime-подходов. Опыт MCP-серверов и skill-based architecture. Опыт построения reusable-подходов для других команд, а не только одного агента под одну задачу. Наличие постмортемов, дашбордов, eval-отчетов, метрик стоимости и качества. Сильное мнение о том, когда агента использовать не надо. Мы предлагаем: Официальное трудоустройство и полный пакет социальных льгот (ДМС, компенсация фитнеса/обучения/путешествий, скидки и бонусы от партнеров, специальные условия и тарифы на продукты «Финама»). Стабильную заработную плату и социальные гарантии, которые дают уверенность в настоящем и открывают перспективы в будущее. Возможность профессионального роста, обучения и постоянного развития в области digital-innovations вместе с дружной командой. Лучшие конференции и мастер-классы за счет компании. Участие в проектах, которые формируют цифровую трансформацию финансового сектора. Гибридный формат работы (2 дня офис). Комфортный офис в центре Москвы с зоной отдыха на крыше, кофе-поинтами с ароматным кофе, а также собственный тренажерный зал. Богатую корпоративную культуру: классные внутрикорпоративные мероприятия, сообщества по интересам, возможность проявлять свои творческие, спортивные, интеллектуальные, социальные интересы и участвовать в креативных проектах.

LLMLanggraphLangChainRAG+7
По договорённости
Habr CareerОтклик на сайте источника
Логотип Финам

Дата инженер ИИ/AI Data Engineer

ФинамСНГ / РоссияОфис31 июл.

Мы строим собственную агентскую платформу корпоративного уровня — enterprise-аналог открытых агентских систем. Ищем инженера, который возьмёт на себя ядро системы и будет развивать его, опираясь на актуальные исследования и production-практику. Эта роль на стыке глубокой инженерии (производительное ядро) и работы с LLM/ML. Стек: ClickHouse, SQL, LLM, ETL Чем предстоит заниматься: Проектирование и развитие корпоративного DWH на ClickHouse: архитектура, модель данных, выбор движков таблиц (семейство MergeTree), партиционирование, шардирование, материализованные представления. Построение и поддержка ETL/ELT-пайплайнов загрузки данных из внешних систем-источников. Разработка системы стандартов на данные (data contracts): единые требования к структуре, форматам, типам и качеству данных, поступающих из источников. Создание и ведение каталога данных / data dictionary с детальным описанием структуры и бизнес-смысла каждого набора данных (метаданные, документация, семантический слой). Контроль качества данных: валидация, тесты на данные, мониторинг. Оптимизация производительности хранения и аналитических запросов. Проектирование и разработка агентского слоя (LLM-агентов) поверх данных DWH, закрывающего произвольные аналитические запросы пользователей (text-to-SQL / диалоговая аналитика). Интеграция LLM, разработка инструментов и функций для агентов, организация семантического слоя для корректной работы агентов с данными. Настройка процессов оценки и улучшения качества ответов агентов (evals). Настройка разграничения прав доступа к данным средствами СУБД: RBAC, row-level и column-level политики в ClickHouse. Документирование архитектуры и принятых решений Наши ожидания: Опыт в data-инжиниринге от ~4 лет, уровень Senior. Глубокий опыт работы с ClickHouse (или сильный опыт с другими OLAP/колоночными СУБД + готовность быстро войти в ClickHouse): движки таблиц, оптимизация. Опыт проектирования DWH с нуля, владение подходами к моделированию данных (Kimball / Data Vault / wide tables и т.п.). Уверенный SQL и навыки оптимизации запросов. Опыт построения ETL/ELT-пайплайнов (Airflow / dbt / аналоги). Python (или другой язык для дата-инжиниринга и интеграции с LLM). Практический опыт с LLM и построением агентов: агентские фреймворки (LangChain / LlamaIndex / аналоги), function/tool calling, RAG, text-to-SQL. Понимание подходов к управлению качеством данных и data governance / data contracts. Опыт настройки разграничения прав доступа в СУБД. Будет большим преимуществом: Опыт с semantic / metrics layer. Опыт LLMOps и оценки качества агентов (evals, мониторинг). Опыт с инструментами каталогизации данных (DataHub / OpenMetadata / Amundsen). Опыт работы с большими объёмами данных и высоконагруженными системами. Мы предлагаем: Официальное трудоустройство и полный пакет социальных льгот (ДМС, компенсация фитнеса/обучения/путешествий, скидки и бонусы от партнеров, специальные условия и тарифы на продукты «Финама»). Стабильную заработную плату и социальные гарантии, которые дают уверенность в настоящем и открывают перспективы в будущее. Возможность профессионального роста, обучения и постоянного развития в области digital-innovations вместе с дружной командой. Лучшие конференции и мастер-классы за счет компании. Участие в проектах, которые формируют цифровую трансформацию финансового сектора. Гибридный формат работы (2 дня офис). Комфортный офис в центре Москвы с зоной отдыха на крыше, кофе-поинтами с ароматным кофе, а также собственный тренажерный зал. Богатую корпоративную культуру: классные внутрикорпоративные мероприятия, сообщества по интересам, возможность проявлять свои творческие, спортивные, интеллектуальные, социальные интересы и участвовать в креативных проектах.

ClickHouseDockerSQLLLM+4
По договорённости
Habr CareerОтклик на сайте источника
Логотип Telegram

Ищем MLOps Engineer (AI / LLM) — удалённо

РоссияУдаленка29 июл.

Ищем MLOps Engineer (AI / LLM) — удалённо Компания Selecty развивает экосистему цифровых сотрудников на базе передовых LLM/VLM-моделей. Создаём AI-агентов, которые автоматизируют бизнес-процессы и повышают эффективность компаний. Формат работы - Формат: Remote (РФ) - Заработная плата: 250–340 тыс. ₽ gross - Занятость: Full-time Задачи - проектировать и развивать CI/CD для деплоя AI-агентов и мультиагентных систем - разворачивать и оптимизировать LLM/VLM (vLLM, Triton Inference Server, SGLang) - обеспечивать масштабирование и стабильность AI-сервисов - внедрять мониторинг инфраструктуры и ML-метрик (качество генерации, дрейф данных, тональность ответов) Требования - опыт вывода LLM-решений в production - Python + asyncio - Kubernetes (Helm, управление кластерами) - GitLab CI / Jenkins - понимание RAG-архитектур, embeddings, reranking - оптимизация инференса: квантизация, continuous batching, PagedAttention Будет плюсом - опыт с графовыми БД - мультиагентные системы Стек Python, FastAPI, LangChain / LlamaIndex / Haystack, Kubernetes, Docker, S3, PostgreSQL, Vector DB Условия - оформление по ТК РФ - ДМС + стоматология - компенсация фитнеса - скидки на английский (Skyeng) - индексация зарплаты - современная техника

RAGLangChainPython
250–340 тыс. ₽ gross
TelegramОтклик на сайте источника
Логотип BGStaff

Data Scientist (LLM / AI Agents)

BGStaffСНГ / РоссияОфис28 июл.

Data Scientist (LLM / AI Agents) Требования - Опыт: от 4-х лет в коммерческой разработке на позиции DS/ML Engineer (из них минимум 1 год плотной работы с NLP/LLM). - LLM & NLP: Глубокое понимание архитектуры трансформеров, опыт работы с RAG, контекстным окном, методами оптимизации инференса. - Разработка: Уверенное знание Python (asyncio, aiohttp/FastAPI), опыт написания чистого, поддерживаемого кода. - Big Data: Опыт работы с распределенными вычислениями (Spark/PySpark, Hive) и оркестрацией (Airflow). - Инфраструктура: Понимание процессов MLOps, опыт deployment сервисов на GPU (on-premise или Cloud). - Безопасность: Понимание принципов работы с персональными данными и безопасности при использовании LLM в энтерпрайзе. Будет преимуществом - Опыт разработки собственных MCP (Model Context Protocol) сервисов для расширения функционала агентов. - Участие в Kaggle, хакатонах или наличие pet-проектов в области Generative AI (ссылка на GitHub). - Опыт работы с отечественными LLM-платформами (например, GigaChat API) или локальными моделями (Llama, Qwen, Mistral). - Опыт построения сложных графов агентов (LangGraph, AutoGen). Обязанности - Разработка AI-агентов: Проектирование и внедрение мультиагентных систем (Prompt Engineering, RAG, Tools, Function Calling) в реальные банковские процессы. - Работа с LLM: Оптимизация и Fine-tuning моделей под домен бизнеса (SFT, RLHF), работа с открытыми и проприетарными моделями. - MLOps & Production: Вывод моделей в пром, построение пайплайнов обработки данных на GPU-кластере, организация мониторинга качества и дрейфа моделей. - Оценка качества: Разработка метрик качества генерации (LLM Eval), проведение A/B тестов. - Интеграция: Разработка сервисов на Python (API), взаимодействие с командой разработки и продуктовыми аналитиками для контроля и экспертизы требований к данным и функционалу. Условия - Обсуждаемая ЗП по вашим навыкам и грейду - Удаленная работа, а также варианты с гибридным форматом - Оформление по ИП с нашей поддержкой - Несколько проектов на выбор - Карьерный рост без постоянных поисков работы Как начать - Откликнитесь на вакансию - Пройдите собеседование с рекрутером - Попадите на бенч и получайте предложения по проектам

RAGLLMApache SparkApache Airflow+2
По договорённости
Habr CareerОтклик на сайте источника
Логотип Telegram

ML Engineer в «Максима Прайдекс

РоссияГибрид22 июл.

ML Engineer в «Максима Прайдекс» Мы создаем системы управления очередью для крупных клиентов (ПСБ, ФНС, МФЦ). Ищем специалиста для развития ИИ-сервисов, создания пайплайнов обработки данных и умной аналитики. Что предстоит делать - Audio Processing: развитие пайплайна (диаризация спикеров -> распознавание речи -> NLP-модерация). - LLM & RAG: разработка корпоративной RAG-системы (поиск по истории чатов, файлам и регламентам). - Smart Analytics: предиктивная аналитика для банковских терминалов (оптимизация работы операторов). - Production: интеграция ML-моделей и обеспечение их стабильной работы. Что мы ожидаем - Опыт: коммерческая разработка на Python от 1 года. - Backend & Инфраструктура: уверенное использование Docker, создание API на FastAPI, проектирование асинхронной обработки тяжелых ML-запросов. - NLP / LLM: практический опыт построения RAG, векторный поиск и эмбеддинги, LangChain. - Speech-to-Text: работа с распознаванием речи (Vosk, Whisper, GigaAM) и диаризацией. - Data Science: PyTorch, Pandas, NumPy, базовые алгоритмы и метрики ML. - Английский: от B1 (свободное чтение документации). Будет плюсом - Apache Airflow - Celery Мы предлагаем - Аккредитованная ИТ-компания. - Оформление по ТК РФ - Заработная плата 120 000 руб. после вычета налогов, полностью официальная, периодическая индексация. - Офис у м. Стахановская / Гибридный формат после испытательного срока. - Удобный график (базово 9:00–18:00, можно согласовать свой).

PythonEngineerвакансияRAG+3
120 000 руб
TelegramОтклик на сайте источника
Логотип Telegram

ML Engineer в «Максима Прайдекс

РоссияГибрид22 июл.

ML Engineer в Максима Прайдекс Мы создаем системы управления очередью для крупных клиентов (ПСБ, ФНС, МФЦ). Ищем специалиста для развития ИИ-сервисов, создания пайплайнов обработки данных и умной аналитики. Обязанности - Audio Processing: развитие пайплайна (диаризация спикеров -> распознавание речи -> NLP-модерация) - LLM & RAG: разработка корпоративной RAG-системы (поиск по истории чатов, файлам и регламентам) - Smart Analytics: предиктивная аналитика для банковских терминалов (оптимизация работы операторов) - Production: интеграция ML-моделей и обеспечение их стабильной работы Требования - Опыт: коммерческая разработка на Python от 1 года - Backend & Инфраструктура: уверенное использование Docker, создание API на FastAPI, проектирование асинхронной обработки тяжелых ML-запросов - NLP / LLM: практический опыт построения RAG, векторный поиск и эмбеддинги, LangChain - Speech-to-Text: работа с распознаванием речи (Vosk, Whisper, GigaAM) и диаризацией - Data Science: PyTorch, Pandas, NumPy, базовые алгоритмы и метрики ML - Английский: от B1 (свободное чтение документации) Будет плюсом - Apache Airflow - Celery Условия - Аккредитованная ИТ-компания - Оформление по ТК РФ - Заработная плата 120 000 руб. после вычета налогов, полностью официальная, периодическая индексация - Офис у м. Стахановская / Гибридный формат после испытательного срока - Удобный график (базово 9:00–18:00, можно согласовать свой)

PythonEngineerвакансияRAG+3
120 000 руб
TelegramОтклик на сайте источника

Forward Deployed AI Engineer

asahantechpartners.comLas Vegas, United StatesУдаленка20 июл.

Компания: asahantechpartners.com Вакансия: Инженер по внедрению ИИ Тип занятости: Полная занятость Формат работы: 100% удалённая работа Уровень опыта: Senior Наш клиент ищет инженера по внедрению ИИ для непосредственной работы с клиентами и поставки готовых к эксплуатации решений на базе ИИ. Это практическая инженерная и консультационная роль. Вы будете изучать бизнес-процессы клиентов, определять практические сценарии использования ИИ, создавать работающие решения и руководить внедрением от прототипа до производства. Идеальный кандидат сочетает сильные навыки в области ИИ и разработки ПО с отличными коммуникативными способностями и умением эффективно работать в удалённой среде, ориентированной на взаимодействие с клиентами. Обязанности - Проведение удалённых технических сессий по выявлению потребностей с клиентами. - Понимание рабочих процессов, данных, систем и технических ограничений клиента. - Преобразование бизнес-требований в архитектуру ИИ и планы реализации. - Создание приложений с использованием LLM, RAG, AI-агентов, машинного обучения и автоматизации рабочих процессов. - Разработка бэкенд-сервисов, API, конвейеров данных и системных интеграций. - Подключение решений ИИ к базам данных, хранилищам документов, SaaS-платформам и внутренним API. - Реализация структурированных выводов, вызова инструментов, рабочих процессов с одобрением человеком, защитных механизмов и логики отката. - Оценка точности моделей, качества поиска, задержки, надёжности, безопасности и стоимости. - Развёртывание сервисов ИИ в облачных или корпоративных средах клиента. - Устранение технических неполадок на этапе внедрения и ввода в эксплуатацию. - Информирование заинтересованных сторон клиента о ходе работы, рисках и технических решениях. - Документирование архитектуры системы, процедур развёртывания и решений по реализации. - Обмен повторно используемыми решениями и отзывами клиентов с внутренними инженерными командами. Требования - Пять и более лет профессионального опыта в разработке ПО. - Сильный опыт промышленной разработки на Python. - Опыт создания и развёртывания приложений на базе LLM, машинного обучения, NLP или ИИ. - Опыт работы с RAG, эмбеддингами, векторными базами данных, вызовом инструментов или рабочими процессами AI-агентов. - Опыт разработки бэкенд-сервисов с использованием FastA...

EcommercePythonСеньорRAG+2
15 000 ₽
GeekJobОтклик на сайте источника

Архитектор решений (AI)

РОСГОССТРАХСНГ / РоссияОфис14 июл.

О нас РОСГОССТРАХ — лидер российского страхового рынка. Задачи - Проработка решений для инициатив в области AI/ML и генеративного ИИ - Проектирование интеграции AI-сервисов с корпоративными системами и платформами данных - Проработка применения LLM, RAG и агентных сценариев; проектирование доступа моделей к корпоративным источникам данных Требования Основные требования - Опыт проектирования корпоративных информационных систем, интеграционных и распределённых решений от 5 лет - Опыт работы в роли Solution / Domain / Lead Architect или аналогичной от 3 лет - Навыки взаимодействия с бизнес-подразделениями, продуктовыми командами и инженерными функциями Архитектура и безопасность - Интеграционная архитектура корпоративного уровня, подход API-first - Опыт работы с решениями с повышенными требованиями к безопасности и разграничению доступа - Умение определять и проверять нефункциональные требования - Знание observability, мониторинга и аудита; ведение ADR (Architecture Decision Records) AI/ML - Понимание устройства современных LLM-платформ и принципов построения RAG - Опыт интеграции AI-сервисов с корпоративными источниками данных - Понимание агентных систем и вызова внешних инструментов - Знакомство с Model Context Protocol (MCP) - Базовый опыт в MLOps и управлении жизненным циклом моделей Будет плюсом - Опыт оценки и выбора моделей, векторных хранилищ, orchestration-фреймворков и компонентов AI-платформ - Опыт работы с корпоративными AI-ассистентами и платформами для работы с LLM - Опыт в области интеллектуального поиска и обработки документов - Работа с аналитическими, скоринговыми или страховыми моделями - Участие в программах цифровой или технологической трансформации крупных организаций Условия - Возможность работать в составе крупной компании-лидера страхового рынка - Полное соблюдение норм Трудового кодекса РФ - Полностью «белая» заработная плата, своевременные выплаты - График работы 5/2 в удалённом формате - Подключение к ДМС после успешного прохождения испытательного срока - Корпоративные скидки на страховые продукты (автострахование, страхование выезжающих за рубеж и другие) - Корпоративные скидки на фитнес, магазины-партнёры, книги и другое - Доступ к электронной библиотеке (более 3000 книг на актуальные темы бизнеса, науки и личностного развития, включая мировые бестселлеры) с возможностью офлайн-чтения с любого мобильного устройства

RAGLLMРабота в команде
По договорённости
Habr CareerОтклик на сайте источника
Логотип Telegram

Senior ML Engineer - LLM Training & Serving

Unimatch LabEU, Albania, Andorra, Bosnia and Herzegovina, the United Kingdom, Iceland, Liechtenstein, Moldova, Monaco, Montenegro, NУдаленка14 июл.

Старший ML-инженер — обучение и обслуживание LLM О компании Unimatch Lab — ИИ-венчурная студия из Кремниевой долины. Мы создаём портфель ИИ-продуктов и развиваем собственный ML-стек: локальные кластеры для LLM, обучение и обслуживание моделей на своей инфраструктуре. Мы ищем старшего ML-инженера, который возьмёт на себя полный внутренний цикл: от данных до продакшена. Никакой работы только с промптами или сторонними API — все персональные и чувствительные данные остаются на наших серверах. Задачи - Файн-тюнинг LLM и VLM моделей (LoRA, QLoRA, дистилляция) с получением готовых к промышленной эксплуатации весов. - Оценка качества как обязательный этап релиза: метрики на уровне отдельных полей, отложенные выборки, проверки на утечку данных между обучением и тестом. - Управление полным циклом работы с данными: разметка с помощью учителя, версионирование датасетов, контроль качества синтетических данных. - Запуск и поддержка собственного инференса под нагрузкой: vLLM, пакетная обработка запросов, квантизация, генерация структурированных JSON-ответов. - Документирование ML-процессов от начала до конца, чтобы цикл не зависел от одного конкретного инженера. Требования - Опыт от 5 лет в запуске ML-систем в продакшен, включая работу с высоконагруженным ИИ. - Вы сами обучаете модели (веса), а не ограничиваетесь промпт-инжинирингом или интеграцией RAG. - Опыт развёртывания собственных LLM в продакшен (vLLM или аналоги). - Реализованные проекты полного цикла: данные → файн-тюнинг → оценка → реальный продакшен-трафик. - Уверенное владение Python, Docker/Kubernetes, CI/CD. Понимание принципов работы с конфиденциальными данными на собственной инфраструктуре. Условия работы - Формат: удалённо. - Локация: Европа (EU, Великобритания, Исландия, Норвегия, Швейцария и др.), Латам. - Уровень: старший (Senior). - Компенсация: от $5,000 в месяц (базовая ставка).

RAGAIremoteML+1
from $5,000 month base
TelegramОтклик на сайте источника

AI/ML Engineer

СберСпасибоСНГ / РоссияОфис14 июл.

СберСпасибо: AI/ML Engineer О проекте Мы разрабатываем корпоративных AI-агентов и RAG-системы для умного поиска по внутренней документации. Часть решений уже в эксплуатации, часть — в активной разработке. Сейчас мы ищем специалиста, который займётся качественной составляющей систем: повышением надёжности RAG, выстраиванием методологии оценки, тестирования, защит и промпт-инжинирингом. Это прикладная позиция — мы не обучаем модели, а используем готовые через корпоративный шлюз. Весь фокус на инжиниринг, оценку и тонкую настройку поведения агентов. Задачи - Повышение качества RAG-агентов по трём направлениям: поиск по технической документации, нормативной базе и бухгалтерской документации - Промпт-инжиниринг и контекст-инжиниринг для всех агентов команды - Подготовка эталонных наборов для оценки качества - Реализация методологии автоматических регрессионных проверок (LLM-as-a-judge) - Настройка защит (guards) для production-агентов: фильтры от инъекций в промпт, валидация структуры и контента выходов, защита от утечек ПДн, anti-hallucination механизмы - A/B-тестирование промптов и моделей для подбора лучших конфигураций - Тюнинг качества на основе обратной связи пользователей и трассировок из Langfuse Требования - Опыт коммерческой разработки на Python от 2 лет - Практический опыт создания и поддержки RAG-систем в продакшене (от начала до конца, не прототип): эмбеддинги, векторные базы (Qdrant, FAISS или pgvector), переранжирование, чанкинг - Практический опыт оценки качества LLM-систем: подготовка эталонных наборов, offline-метрики, LLM-as-judge, регрессионные проверки; опыт работы с фреймворками оценки (Ragas, DeepEval или аналоги) - Практический опыт настройки защит для LLM-приложений: защита от инъекций в промпт, валидация структуры и контента выходов, защита от утечек персональных данных - Опыт промпт-инжиниринга и контекст-инжиниринга в реальных проектах: итеративная настройка промптов, structured output, function calling - Понимание архитектуры RAG: стратегии нарезки документов, метаданные, выбор моделей эмбеддингов, переранжирование, точность ссылок на источник - Практический опыт работы хотя бы с одним LLM-фреймворком: LangChain, LangGraph, PydanticAI, OpenAI API или аналоги - Практический опыт A/B-тестирования промптов и моделей в продакшене - Опыт работы с агентскими протоколами (MCP) или собственным tool-layer для агентов - Базовые знания SQL и работы с реляционными базами

RAGБазы данныхRESTPython+1
По договорённости
Habr CareerОтклик на сайте источника
Логотип Telegram

Опытного DevOps-инженера для развертывания и сопровождения LLM-инференс платформ, а также развития…

KODEРоссияУдаленка9 июл.

DevOps-инженер (LLM / AI платформа) Компания: KODE Формат: удалённо (только из городов РФ) или гибрид в Калининграде Зарплата: 170 000–230 000 ₽ gross Занятость: полный день Задачи - Разворачивать и сопровождать LLM-платформы (vLLM, SGLang, Ollama). - Развивать AI-платформу в Kubernetes, управлять GPU-ресурсами. - Настраивать LiteLLM (AI Gateway), маршрутизацию запросов, квоты и политики доступа. - Оптимизировать производительность инференса (batching, KV Cache, semantic cache). - Настраивать мониторинг и observability (Prometheus, Grafana, OpenTelemetry, Langfuse, SigNoz). - Автоматизировать CI/CD и GitOps-процессы. - Поддерживать RAG/Agentic AI, векторные базы и сервисы памяти. - Обеспечивать стабильность и высокую доступность AI-инфраструктуры. Требования - Опыт DevOps от 4 лет. - Production-опыт с Kubernetes, Docker, Helm, GitOps. - Опыт работы с LLM inference (vLLM, SGLang, Ollama, TGI). - Понимание LLM, KV Cache, batching, streaming, квантования и RAG. - Опыт работы с NVIDIA GPU/CUDA. - Linux, Python, CI/CD, Prometheus, Grafana, OpenTelemetry. - Redis, PostgreSQL, API Gateway. Будет плюсом - LiteLLM, KEDA, Qdrant, Milvus.

RAGPython
170 000–230 000 ₽ gross
TelegramОтклик на сайте источника
Логотип Telegram

We're Hiring: AI/ML Associate Software Engineer (1-Year Apprenticeship Program)

Не указаноОфис6 июл.

🚀 We're Hiring: AI/ML Associate Software Engineer (1-Year Apprenticeship Program) 🎓 Fresh graduates and final-semester students are encouraged to apply! Are you passionate about Generative AI, Large Language Models (LLMs), and building AI-powered applications? Join our team as an AI/ML Associate Software Engineer through a 1-year contractual apprenticeship and gain hands-on experience with cutting-edge AI technologies. 🔹 What We're Looking For ✅ Strong understanding of Large Language Models (LLMs), their architectures, and use cases ✅ Experience with LLM APIs (OpenAI, Anthropic, Gemini, etc.) ✅ REST API development and integration ✅ LangChain and AI Agent frameworks ✅ RAG (Retrieval-Augmented Generation) pipelines ✅ Python and Node.js development ✅ React.js for frontend development ✅ MySQL and database management ✅ Prompt engineering and AI application development 👨‍💻 Who Can Apply? Final-semester students who have completed their examinations Recent graduates in Computer Science, IT, AI/ML, or related fields Candidates with AI/ML projects, hackathon experience, internships, or personal AI applications Self-motivated learners eager to work with the latest AI technologies 🚀 What You'll Do Build AI-powered applications and intelligent workflows Develop and integrate LLM-based solutions Work on RAG pipelines, LangChain, and AI agent systems Design, consume, and integrate REST APIs Collaborate on full-stack AI products using Python, Node.js, React, and MySQL 📍 Position: AI/ML Associate Software Engineer 📅 Duration: 1-Year Contractual Apprenticeship 🏢 Work Mode: 5 days/week, Work from Office

RAGReactGeminiOpenAI+3
По договорённости
TelegramОтклик на сайте источника
Логотип Telegram

Ищем Senior AI Engineer (ML/DS)

Raft Digital SolutionsРоссияУдаленка3 июл.

Компания Raft Digital Solutions Название позиции Senior AI Engineer (ML/DS) Формат работы - Удалённо - Full-time (40 часов в неделю) - Оформление: B2B (ИП) Стек технологий OpenAI, GigaChat, MCP, Python, PostgreSQL, Langfuse, LangChain, CI/CD, Docker, Kubernetes Обязанности - Разрабатывать AI-ассистентов с текстовыми и голосовыми интерфейсами - Анализировать качество генеративных моделей и улучшать их работу - Исследовать современные AI-подходы, best practices и open-source решения - Деплоить сервисы в Kubernetes и настраивать мониторинг - Проводить Code Review и участвовать в развитии архитектуры Требования - 5+ лет коммерческого опыта в Python / Data Science - Понимание архитектуры AI-агентов (orchestration, memory, tools) - Опыт разработки AI/LLM-приложений: RAG, AI Agents, векторные БД, Tool/Function Calling, Workflows - Опыт с LangChain, LlamaIndex, Haystack или аналогами - Опыт вывода сервисов в production Предлагаем - Полностью удалённую работу - Гибкий график - Современные AI-проекты и сложные технические задачи - Команду сильных специалистов и профессиональный рост

DataSciencePythonвакансияRAG+4
По договорённости
TelegramОтклик на сайте источника
Логотип Telegram

Специалиста, которому интересно создавать современные AI-решения, а не поддерживать устаревшие системы

Не указаноОфис22 июн.

AI ВАКАНСИИ НЕЙРОСЕТИ ИИ РАБОТА Ищем специалиста, которому интересно создавать современные AI-решения, а не поддерживать устаревшие системы. Фокус позиции: AI-агенты, LLM-инструменты, OpenClaw, системы памяти, интеграции и автоматизация бизнес-процессов. Что предстоит делать: • проектировать архитектуру AI-решений; • собирать MVP и доводить их до production; • создавать AI-агентов, цифровых ассистентов и автоматизации; • настраивать интеграции с Telegram, CRM, календарями, БД и внешними сервисами; • работать с RAG, векторными хранилищами, семантическим поиском и памятью AI-систем; • участвовать в code review и технической приёмке решений. Что важно: • понимание LLM, AI-агентов, tool-calling, RAG, API и баз данных; • опыт backend / fullstack разработки; • уверенная работа с Python, Node.js, Go или похожим стеком; • умение быстро тестировать гипотезы и собирать рабочие прототипы; • самостоятельность, инициативность и продуктовый подход. Что предлагаем: • конкурентную оплату; • задачи на стыке AI, медицины, данных и автоматизации; • свободу в выборе технических решений;

RAGNode.jsPythonCRM
По договорённости
TelegramОтклик на сайте источника