Биржа вакансий в сфере ИИ, ML
Агрегатор и биржа вакансий для поиска работы в современном IT: разработка с ИИ, ML-инженеры, вайбкодинг, ИИ-креаторы и дизайнеры, автоматизация процессов. Собираем лучшее в ру и зарубежном сегменте!
Фильтр вакансий
Сбросить все фильтрыВедущий DevSecOps / MLOps-инженер
- Формат
- Удалённо
- Страна
- Россия
- Город
- Не указан
- Грейд
- Lead
Позиция: Ведущий DevSecOps / MLOps Инженер Название компании: Агрохолдинг Формат: удалённая работа Занятость: полная, долгосрочный проект Оформление: аутстафф ИП, СЗ Ставка: от 270 000 до 280 000 RUB Гражданство — РФ/РБ, локация — РФ, РБ Ищем ведущего DevSecOps/MLOps-инженера для внедрения ИИ и цифровой трансформации. Роль сочетает техническую экспертизу, архитектуру и бизнес-анализ: будете проектировать инфраструктуру для AI/ML- и RAG-сервисов, выстраивать DevSecOps-практики и интегрировать ИИ-решения с корпоративными системами. Ключевые требования: - Опыт от 3 лет в DevSecOps с фокусом на ИТ- и AI-решениях, проекты в промышленной эксплуатации. - Проектирование AI/ML/RAG-инфраструктуры (LLM, векторные БД, GPU-инференс, оркестрация). - CI/CD (Jenkins, K8s, Helm), IaC (Terraform, Ansible), Linux, сетевые контуры (VLAN, DMZ). - Мониторинг и безопасность: Prometheus/Grafana, SAST/DAST, Trivy, Vault; знание 152-ФЗ, 187-ФЗ. - Инструменты и стек: Python 3.10+, SQL, JS/TS, vLLM, Qdrant/Weaviate, Airflow, MLflow, Keycloak, Dify/LangGraph. - Архитектурные навыки: C4, UML, BPMN; интеграция с 1С, CRM, DWH, BI. Будет плюсом: - Построение DevSecOps с нуля или развитие практик. - MLOps/LLMOps: версионирование, мониторинг качества моделей. - Облака (Yandex Cloud, AWS, GCP), сертификаты DevOps/Kubernetes/ИБ. Основные задачи: - Проектировать и сопровождать инфраструктуру (DataHub, AI/ML, RAG, чат-боты, базы знаний). - Развивать DevSecOps: CI/CD, IaC, управление секретами, контроль уязвимостей, аудит. - Настраивать пайплайны сборки, тестирования и доставки в dev/test/preprod/prod. - Обеспечивать надёжность, отказоустойчивость, масштабирование и оптимизацию затрат. - Собирать требования бизнеса, формировать ТЗ, совместно с DE/DS/ML определять архитектуру ИИ-решений. - Интегрировать ИИ-сервисы с корпоративными системами.
Senior Fullstack-инженер, JavaScript/TypeScript
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
- Грейд
- Senior
О роли Работа на стыке инженерии и продукта: создание функций, развитие ядра CMS, расширение возможностей платформы и участие в AI-функциях. Использование современных AI-инструментов разработки. Самостоятельность, инициативность, работа в команде. Чем предстоит заниматься - Развитие ядра CMS: улучшение производительности, надёжности и developer experience. - Разработка и поддержка расширений и интеграций. - Участие в AI-функциях продукта. - Выявление и исправление проблем на основе мониторинга, обратной связи и продуктового чутья. Задачи и обязанности - Работа в кросс-функциональной автономной команде: поставка функций и улучшений, часто на основе черновых прототипов. - Перевод бизнес-потребностей в технические решения совместно с продуктовой командой, участие в разговорах с клиентами. - Использование AI-инструментов разработки (Cursor, Claude, Codex или аналогичных). - Проактивное выявление и исправление проблем через мониторинг и observability. - Участие в архитектурных решениях для масштабируемости, надёжности и поддерживаемости платформы. - Обмен знаниями, обучение коллег, совместная работа. Ожидания по этапам 1 месяц: онбординг по продукту, стеку, инфраструктуре и видению; знакомство с кодовой базой; первые правки; понимание того, как клиенты используют Hygraph. 3 месяца: уверенная поставка функций и улучшений в продакшен; понимание продукта и архитектуры; вклад идеями, не только кодом; рабочие отношения с тимлидом, PM, дизайнерами и инженерами. 6 месяцев: значимый вклад в продукт и команду; свежие перспективы; повышение стандартов производительности, архитектуры и процессов; команда полагается на вас. Требования - Опыт (обычно от 6 лет) создания и владения продакшен-системами. - Сильные full-stack навыки в JavaScript/TypeScript, глубокий бэкенд-опыт, понимание масштабируемости и производительности (желательно Node.js). - Опыт создания пользовательских интерфейсов, желательно на React. - Опыт разработки хорошо протестированных API на GraphQL. - Уверенное знание реляционных баз данных (особенно PostgreSQL), включая проектирование схем и оптимизацию запросов. - Активное использование AI-инструментов разработки (Claude, Cursor, Codex или аналогичных). - Знакомство с cloud-native разработкой (AWS, GCP). - Опыт работы с мониторингом и observability (New Relic, Datadog или аналогичные). - Готовность к on-call и операционной работе (расследования, инциденты). - Умение работать с неопределённостью: черновые прототипы, меняющиеся требования, неполная информация. - Сильное продуктовое чутьё: понимание «зачем», а не только «как». Будет плюсом - Опыт с Golang. - Знание infrastructure as code (Pulumi, Terraform). - Опыт работы с клиентами или в клиентоориентированных ролях. - Знакомство с headless CMS или контентной инфраструктурой.
Senior Архитектор облачных решений
- Формат
- Офис
- Страна
- Россия
- Город
- Не указан
- Грейд
- Senior
Компания «Базис» ищет специалиста на вакансию «Архитектор облачных решений». Локация: Москва (Россия), Санкт-Петербург (Россия). Формат работы: полный рабочий день. Требуемые навыки: - Senior - AWS - Linux - VMware - PostgreSQL - Kubernetes - Ansible - Terraform - Объектное хранилище S3 - Docker - n8n
Архитектор облачных решений
- Формат
- Офис
- Страна
- Россия
- Город
- Не указан
Компания «Базис» — российский разработчик программных продуктов для оказания облачных услуг и платформы динамической инфраструктуры. Ищем архитектора для развития облачных продуктов Basis Cloud Control и Basis Automation Studio. Продукты предоставляют платформу управления облачной инфраструктурой с моделью предоставления облачных ресурсов как сервис. Основные обязанности: Проработка решений для новых бизнес-задач заказчиков и развитие облачной платформы; Развитие технических компетенций смежных команд: проведение демонстраций, консультирование; Участие в определении архитектурных подходов, интерфейсов и стандартов совместно с командами разработчиков, аналитиков и инженеров; Взаимодействие с разработчиками, тестировщиками, аналитиками, инженерами и смежными продуктовыми командами для решения архитектурных задач и интеграции продуктов, реализации разработанных решений; Экспертная консультация в предпродажных активностях и эксплуатации продуктов; Формирование и поддержка архитектурной документации. Необходимый опыт работы: Опыт не менее 6 лет в инфраструктурных или облачных технологиях; Опыт участия в разработке архитектуры продуктов от 2 лет; Опыт работы с сервисами в публичных облаках (AWS, Azure, GCP, Alibaba и т.д.); Опыт работы с продуктами VMware (vSphere, Cloud Director, NSX-T, vRealize), OpenStack, ManageIQ, OpenShift, Cozystack, n8n и т.д.; Опыт работы с PostgreSQL, ClickHouse, Redis; Опыт работы с S3-решениями; Опыт работы с Ansible, Terraform/OpenTofu, понимание концепции IaC; Опыт работы с Podman, Kubernetes; Опыт работы с Linux-based системами на уверенном уровне. Профессиональные знания и навыки: Навыки разрешения проблем в технических решениях и продуктах; Знание принципов работы сетей передачи данных и сетей хранения данных; Понимание принципов работы современных микросервисных приложений и инструментов; Умение создавать и разрабатывать технические архитектуры (HLD, LLD) и диаграммы в нотации C4; Навыки проектирования интеграционных компонент, разумный подход к выбору способа интеграции с учетом ФТ/НФТ; Понимание принципов и функционирования контейнеризации и виртуализации; Понимание принципов построения комплексной ИТ-инфраструктуры больших компаний (сети, серверы, СХД, СРК, ИБ, ИС); Понимание принципов и функционирования систем высокой доступности и катастрофоустойчивости. Будет плюсом: Практический опыт использования Python и/или Golang для скриптов или разработки; Опыт работы с VMware SRM, NetApp MetroCluster, Huawei HyperMetro, Hitachi GAD, MIND Guard, Hystax Acura; Опыт работы с инструментами Observability; Опыт работы с ADR; Практический опыт использования AI/ML для рабочих задач. Условия: Трудоустройство согласно ТК РФ в IT-компании со всеми соответствующими бонусами; Заработная плата состоит из оклада и квартальной премии; График работы 5/2 пн-пт, гибкое начало дня; Социальный пакет (ДМС, оплата мобильной связи); Обучение внутри компании и на внешних курсах; Корпоративная программа лояльности (профессиональное обучение, фитнес-активности, обучение языкам и т.д.).
Staff-системный инженер, IT-инфраструктура и ITSM
- Формат
- Удалённо
- Страна
- США
- Город
- Не указан
Staff Systems Engineer, IT — старшая инженерная роль для универсального специалиста, готового отвечать за широкий набор платформ. Вы будете владеть системами и интеграциями, обеспечивающими жизненный цикл сотрудника: онбординг, изменение ролей и офбординг. Системы строятся как инфраструктура-как-код с применением SRE-практик, чтобы они были версионированы, наблюдаемы и надежны. Вы станете техническим владельцем ITSM-платформы GitLab и AI-возможностей поверх неё: виртуальные агенты, агентные рабочие процессы и базы знаний, которые решают запросы до превращения их в тикеты. Также вы отвечаете за общую IT-инфраструктуру в облаке. Работая с AI-ориентированной ITSM, вы замените повторяющуюся ручную работу устойчивой автоматизацией и будете партнёром для End User Services, Security, People и Finance при масштабировании решений на всю компанию. Ключевые метрики: покрытие автоматизацией процессов жизненного цикла, доля AI-отклонений (deflection rate) и надёжность создаваемых систем. Задачи - Проектировать, строить и владеть сквозной автоматизацией жизненного цикла сотрудника: онбординг, переводы, изменение ролей и офбординг, чтобы предоставление и отзыв доступа происходили точно и с минимальным участием человека. - Быть техническим владельцем ITSM-платформы GitLab: дизайн каталога услуг, рабочие процессы, процессы запросов, инцидентов и изменений, интеграции и обновления платформы. - Повышать долю AI-отклонений для всех пользователей ITSM за счёт развёртывания и настройки виртуальных агентов, AI-поиска и агентного разрешения, а также измерения того, что реально решает запросы без участия человека. - Находить повторяющиеся ручные процессы в IT и партнёрских командах и заменять их автоматизацией, построенной в ITSM и Serval. - Создавать и поддерживать интеграции между ITSM-платформой и ключевыми системами GitLab: Okta, Google Workspace, Slack, Zoom, JAMF, Fleet, Workday и сам GitLab. - Управлять IT-инфраструктурой как кодом в облачных средах, чтобы каждое изменение проходило через контроль версий, код-ревью и автоматизированный, аудируемый путь в продакшн. - Применять SRE-принципы к сервисам IT: значимый мониторинг и алертинг, понятные цели надёжности, учёт ёмкости и стоимости, безобвинительный разбор инцидентов. - Развивать управление знаниями и self-service-опыт, которые питают AI-отклонения: хорошо структурированные статьи, элементы каталога и диалоговые сценарии, остающиеся точными при изменении систем. - Инструментировать автоматизацию и производительность AI понятными метриками и дашбордами: доля отклонений, время решения, покрытие автоматизацией, частота отказов — и публично итерировать по результатам. - Задавать инженерные стандарты для стека IT-автоматизации: контроль версий, тестирование, код-ревью, управление окружениями и контроль изменений, а также наставлять инженеров поддержки в IT-организации. - Партнёрствовать с Security и Compliance, чтобы автоматизация жизненного цикла и AI-рабочие процессы соответствовали требованиям доступа, аудита и контроля, включая SOX и SOC 2. - Документировать архитектуру, runbook и проектные решения в handbook, чтобы создаваемые системы были прозрачными, поддерживаемыми и управляемыми всей командой. Требования - Широта кругозора как у универсального системного инженера: вы владели широким спектром платформ от начала до конца и достаточно быстро осваиваете незнакомые, чтобы полностью взять их на себя. - Уверенный опыт работы с инфраструктурой-как-кодом (Terraform или аналоги).
Senior DevOps-инженер, Kubernetes и AWS
- Формат
- Удалённо
- Страна
- Болгария, Ирландия
- Город
- Не указан
- Грейд
- Senior
О компании Muck Rack — ведущая SaaS-платформа для специалистов по связям с общественностью и коммуникациям. Миссия — помогать организациям строить доверие, рассказывать свои истории и демонстрировать ценность заработанных медиа. Платформа на основе ИИ объединяет базу медиа, мониторинг и отчетность, оптимизируя PR-процессы. Компания находится под контролем основателя, полностью распределена и устойчиво растет. Получила несколько наград за культуру и продукт от Inc., Quartz, G2 и BuiltIn. Ценности: устойчивость, прозрачность, ответственность и преданность клиентам. О роли Ищем коллегиального и самостоятельного Senior DevOps-инженера в команду DevOps. Вы поможете инженерной организации выполнять работу с высокой отдачей, улучшая инфраструктуру, инструменты и системы развертывания. Вы будете участвовать в разработке стандартизированной инфраструктуры и «проторенных путей» для надежного предоставления, развертывания и эксплуатации сервисов в масштабе. Вы будете тесно сотрудничать с командами прикладной разработки, чтобы контейнерная инфраструктура была масштабируемой, экономичной и надежной для широкого круга задач. Задачи - Проектировать и улучшать стандартизированную инфраструктуру, процессы развертывания и CI/CD-пайплайны совместно с командами DevOps и прикладной разработки. - Строить, эксплуатировать и непрерывно улучшать контейнерную инфраструктуру с фокусом на надежность, масштабируемость и экономическую эффективность. - Применять глубокую экспертизу в Kubernetes и его экосистеме, определять лучшие практики и поддерживать внедрение в командах. - Управлять и развивать облачную инфраструктуру на AWS, включая вычисления, сети и системы хранения. - Улучшать наблюдаемость, мониторинг и готовность к инцидентам в производственных системах. - Участвовать в общей дежурной ротации (примерно 1 неделя каждые 5 недель), реагируя на производственные инциденты и устраняя их. - Наставлять коллег и делиться знаниями для улучшения инженерных практик и операционной зрелости организации. Требования - 5+ лет опыта в DevOps, инфраструктуре или платформенной инженерии. - Сильный практический опыт работы с Kubernetes в производственных средах. - Опыт работы с инструментами инфраструктуры как код, такими как Terraform. - Уверенный опыт работы с AWS (например, EKS, S3, IAM, RDS, VPC, Route53). - Опыт создания и поддержки CI/CD-пайплайнов с использованием таких инструментов, как GitHub Actions, CircleCI, Jenkins или Argo CD. - Опыт работы с контейнерными системами, такими как Docker и containerd. - Знание лучших практик облачной безопасности и современных подходов к защите инфраструктуры, включая принципы shift-left. - Опыт эксплуатации и масштабирования высоконагруженных систем и крупномасштабных платформ данных в производственных средах. - Сильные навыки решения проблем и методичный подход к отладке и проектированию систем. - Умение четко общаться с техническими и нетехническими заинтересованными сторонами в распределенной среде. Будет плюсом - Опыт улучшения процессов разработки и снижения трения в развертывании и инфраструктуре. - Знакомство с инструментами экосистемы Kubernetes, такими как Helm, Argo CD и Karpenter. - Опыт улучшения наблюдаемости через системы мониторинга, оповещения и логирования. - Опыт участия в документации по инфраструктуре и внутренних обучающих инициативах. - Интерес к постоянной оценке и внедрению новых технологий там, где они приносят явную пользу. Личные качества - Ответственность за свою работу и проактивный поиск возможностей для улучшения. - Эффективное сотрудничество между командами и вклад в сильную инженерную культуру. - Баланс между скоростью и прагматизмом с долгосрочной надежностью и поддерживаемостью систем. - Комфортная работа независимо при согласовании с распределенной командой. - Четкая коммуникация, умение давать и получать обратную связь, поддержка коллег. - Проактивное использование ИИ-инструментов в повседневной работе для повышения производительности и ускорения доставки. Процесс отбора - Вводный звонок с представителем команды талантов. - Видеоинтервью. Обратите внимание: это ожидаемый процесс; мы можем запросить дополнительную информацию или добавить шаг перед финальным решением.
Staff-инженер, виртуальная сборочная линия
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
Компания 1KOMMA5° строит энергосистему будущего с Heartbeat AI. Солнечные панели, батареи, тепловые насосы и электромобильность объединяются в интеллектуальную интегрированную систему виртуальной электростанции, напрямую подключенную к рынку электроэнергии в реальном времени. К 2030 году компания планирует перевести 1,5 миллиона домохозяйств на возобновляемую энергию. Над этим ежедневно работают более 3000 человек в более чем 80 локациях по всему миру. Позиция предполагает работу в команде Virtual Assembly Line (VAL), которая развивает системы роста и операций: MarTech, CRM, Payment, Fulfillment и Installation. Задачи: - Определять техническое направление в домене growth и operations инженерии VAL, поддерживая архитектуру в соответствии с продуктовым направлением и обеспечивая последовательную реализацию решений командой. - Задавать техническую планку для команд, самостоятельно решая самые сложные проблемы. - Транслировать бизнес- и продуктовые требования в технические решения, масштабируемые по мере цифровизации установочных подразделений. - Проектировать системы и API так, чтобы AI-агенты работали как пользователи первого класса с машиночитаемыми контрактами. - Осуществлять переход VAL к агентной инженерии, меняя подход к работе команды: агенты действуют безопасно, ответственность остается на людях. - Наставлять инженеров VAL для ускорения их роста. - Формировать высокопроизводительную инженерную культуру в команде VAL. - Встраивать безопасность и надежность как прямую ценность для клиента. Используемые технологии: - AI-ассистированная разработка с Cursor / Claude и агентные кодинг-процессы. - Языки: TypeScript (React, Nest.js, Next.js, VueJS), Ruby on Rails, Flutter. - Облако и инфраструктура: Google Cloud Platform, GKE (Kubernetes), Cloud Run, Terraform/IaC, Vercel, Datadog. - Данные и BI: PostgreSQL, BigQuery, SQLMesh, Looker. - Инструменты: Linear, Notion, Figma, Miro. Требования: - Опыт разработки ПО на нескольких языках общего назначения от 10 лет. - Подтвержденный опыт проектирования масштабируемых и безопасных систем с высокими стандартами качества. - Опыт проектирования и реализации API для интеграции между системами, включая нечеловеческих и автоматизированных потребителей, таких как AI-агенты. - Гибкое и ориентированное на результат мышление, нацеленность на сотрудничество и командную работу. - Опыт общения с заинтересованными сторонами на языке бизнеса и понимание технических последствий их требований. - Опыт обеспечения технического согласования в команде в быстро меняющейся среде, включая принятие и доведение до конца критических технических решений. - Опыт проведения команды через крупные изменения в рабочих процессах или инструментах, с пониманием, где автоматизация (включая AI-агентов) безопасна, а где обязательна человеческая проверка. - Способность вести функции от постановки задачи до выпущенного и поддерживаемого продукта в тесном сотрудничестве с продакт-менеджерами и бизнес-стейкхолдерами. - Отличные устные и письменные коммуникативные навыки на английском языке; знание немецкого будет преимуществом. Условия: - Работа в международной, динамичной и высокомотивированной команде. - Прямое влияние на ускорение энергетического перехода и климат. - Прямой контакт с ключевыми лицами, принимающими решения. - Возможности для полной занятости в одном из наиболее быстрорастущих стартапов Европы. - Удаленная работа по всей Германии, офисы в Гамбурге, Берлине или Мюнхене. - Программа здорового баланса EGYM Wellpass. - Льготы и скидки через Futurebens. - Лизинг городского или электрического велосипеда (job bike). - Индивидуальные возможности профессионального развития. - Подчинение непосредственно CTO.
Staff-инженер Heartbeat AI, ИИ-системы
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
О компании 1KOMMA5° развивает энергетическую систему будущего с помощью Heartbeat AI. Компания объединяет региональное мастерство и масштабируемое ПО: солнечные панели, батареи, тепловые насосы и электромобильность управляются как интеллектуальная интегрированная система в виртуальной электростанции. Система напрямую связана с рынком электроэнергии в реальном времени и полностью автоматизирована. Цель — к 2030 году перевести 1,5 миллиона домохозяйств на возобновляемую энергию. Над этим ежедневно работают более 3000 человек в более чем 80 локациях по всему миру, от Финляндии до Австралии. Задачи - Определять техническое направление в инженерном домене Heartbeat AI (мобильные приложения, данные об энергии, IoT-платформа и другие), поддерживая соответствие архитектуры продуктовому направлению. - Отвечать за последовательную реализацию технических решений в своём домене, задавая чёткое направление и контролируя исполнение командой. - Задавать техническую планку для команды, самостоятельно решая самые сложные проблемы, а не только направляя других. - Преобразовывать бизнес- и продуктовые требования в технические решения. - Наставлять и развивать инженеров Heartbeat AI, ускоряя их рост. - Формировать высокопроизводительную инженерную культуру в команде Heartbeat AI. - Встраивать безопасность и надёжность как непосредственную ценность для клиента. - Проектировать системы и API так, чтобы ИИ-агенты работали как пользователи первого класса: с машиночитаемыми контрактами и структурированными ошибками, позволяющими агентам самокорректироваться. - Обеспечивать переход Heartbeat AI к агентной инженерии, меняя подход к работе так, чтобы агенты действовали безопасно, а ответственность оставалась на людях. - Отвечать за архитектуру ИИ-систем, лежащих в основе продукта, от EMS до энергетического тарифа. Технологии - ИИ-ассистированная разработка с Cursor и агентные рабочие процессы. - Облако и инфраструктура: Google Cloud Platform, GKE (Kubernetes), Cloud Run, Terraform/IaC, Vercel. - Обмен сообщениями и IoT: Eclipse Hono, MQTT, Mender. - Данные и BI: PostgreSQL, BigQuery, SQLMesh, Looker. - Наблюдаемость: Datadog, OpenTelemetry. - Языки: TypeScript (Nest.js, Next.js), Java, Go, Flutter. - DevOps: CI/CD-пайплайны (GitHub Actions). - Инструменты: Linear, Notion, Figma, Miro. Требования - Практический опыт разработки ПО на нескольких языках программирования общего назначения не менее 5 лет. - Подтверждённый опыт проектирования масштабируемых и безопасных систем с высоким стремлением к качеству. - Обширный опыт проектирования и реализации API, обеспечивающих бесшовную интеграцию и взаимодействие систем. - Гибкое и ориентированное на результат мышление, с акцентом на сотрудничество и командную работу. - Опыт общения со стейкхолдерами на бизнес-языке и понимание технических последствий их требований. - Опыт обеспечения технического согласования в команде в быстро меняющейся среде, включая принятие и доведение до конца критических технических решений. - Опыт проектирования систем и API для потребления агентами, со структурированными ошибками и чёткими контрактами, позволяющими агентам самокорректироваться. - Способность провести инженерную команду через переход к агентной инженерии, меняя рабочие процессы так, чтобы агенты действовали безопасно, а люди отвечали за каждый результат. - Опыт проектирования ИИ/ML-ориентированных или интенсивно работающих с данными систем (например, прогнозирование, конвейеры реального времени), желательно в энергетическом или IoT-контексте. - Отличные навыки устного и письменного общения на английском языке; знание немецкого считается плюсом. Условия - Работа в международной, динамичной и высокомотивированной команде. - Прямое влияние на ускорение энергетического перехода и климат. - Возможность учиться у коллег. - Прямой контакт с ключевыми лицами, принимающими решения. - Лучшие шансы на полную занятость в одном из самых быстрорастущих стартапов Европы. - Удалённая работа по всей Германии, офисы в Гамбурге, Берлине или Мюнхене. - Программа EGYM Wellpass для поддержания баланса между работой и жизнью. - Льготы и скидки через Futurebens. - Лизинг велосипеда (городской или электронный) через job bike. - Индивидуальные возможности профессионального развития. - Прямое подчинение CTO.
LLM DevOps / Inference Engineer
- Формат
- Удалённо
- Страна
- Любая
- Город
- Не указан
Xaxis Solutions ищет LLM DevOps / Inference Engineer для поддержки платформы оценки и бенчмаркинга ИИ в сфере здравоохранения. Роль включает владение инфраструктурой для тестового стенда, стеком самостоятельного хостинга моделей и надежностью платформы, включая предоставление GPU-инфраструктуры, оптимизацию инференса моделей и управление облачными системами AWS. Задачи: - Строить и поддерживать AWS-инфраструктуру с помощью Terraform, включая сети, вычисления, оркестрацию, секреты, наблюдаемость и CI/CD - Развертывать и управлять самостоятельным хостингом LLM-инференса на GPU-инфраструктуре - Внедрять стратегии батчинга, квантизации, автоскейлинга и мульти-GPU для эффективного инференса - Разрабатывать стандартизированные процессы быстрого подключения новых моделей - Создавать слои абстракции провайдеров для API-моделей, таких как OpenAI, Anthropic и Gemini, а также для самостоятельного хостинга моделей - Внедрять ограничение скорости, повторы, экспоненциальную задержку, управление квотами, логирование запросов и ответов и атрибуцию затрат - Обеспечивать воспроизводимость и экономичность бенчмарк-запусков через закрепленные версии моделей и контейнеров и оптимизированную облачную мощность - Строить дашборды наблюдаемости, охватывающие пропускную способность, задержку, использование токенов, стоимость GPU-часов, сбои и производительность по моделям - Поддерживать пиковые нагрузки, предотвращая осиротевшие или ненужные облачные ресурсы - Участвовать в архитектуре доверенной среды исполнения (TEE) и оценивать AWS Nitro Enclaves и аналогичные решения конфиденциальных вычислений Требования: - Практический опыт запуска и управления контейнерами инференса - Сильный опыт построения и поддержки AWS-инфраструктуры как кода, включая сети, вычисления, оркестрацию, секреты, наблюдаемость и CI/CD - Опыт работы в стартапе или среде с быстрым темпом - Сильный опыт работы с ИИ/LLM и модельной инфраструктурой - Отличные коммуникационные навыки - Граждане США получат приоритет - Активный и полный профиль LinkedIn - Опыт работы с продакшн-масштабной AWS-инфраструктурой - Сильное знание EKS/ECS, EC2 GPU-инстансов (G5/G6, P4d/P5), VPC, IAM, KMS, Secrets Manager, ECR, CloudWatch и Service Quotas - Сильный опыт Terraform / Infrastructure as Code - Практический опыт с обслуживанием LLM-моделей и оптимизацией инференса - Практические знания стратегий батчинга, поведения KV-кэша, квантизации и мульти-GPU шардинга - Опыт управления GPU-нагрузками с EKS/ECS, автоскейлингом узлов и контейнерными пайплайнами на CUDA - Сильный опыт в области надежности и оптимизации затрат, включая SLO, мониторинг, алертинг и оптимизацию облачных затрат - Опыт с AWS SageMaker и Bedrock - Сильные навыки разработки на Python - Знание конфиденциальных вычислений, включая Enclaves, удаленную аттестацию и защищенный выпуск ключей - Понимание комплаенса в здравоохранении, включая сервисы, соответствующие HIPAA, требования BAA, аудит-логирование и контроль доступа к PHI - Опыт усиления безопасности, сканирования образов и контроля сетевого исходящего трафика Компания Xaxis Solutions — консалтинговая компания по управлению, предоставляющая клиентам экономически эффективные решения. Основана в undefined, штаб-квартира в Миссиссоге, Онтарио, Канада, штат 2–10 сотрудников.
Платформенный инженер, Platform Enablement
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
О компании Constructor — AI-first платформа для электронной коммерции, запущенная в 2019 году. Она помогает покупателям находить нужные товары и позволяет мировым брендам увеличивать выручку и конверсию. О роли Команда Platform Enablement — это SRE-команда, ориентированная на разработчиков. Мы поддерживаем базовые слои, влияющие на ежедневные рабочие процессы: observability, CI/CD и оркестрацию нагрузок. Цель — упростить и ускорить развертывание и управление сервисами. Задачи - Развивать внутреннюю экосистему observability (Grafana, VictoriaMetrics, OpenSearch) для самостоятельного решения проблем командами. - Улучшать CI/CD и инструменты разработчиков с помощью Jenkins и GitHub Actions. - Внедрять Kubernetes и стандартизировать шаблоны развертывания нагрузок. - Тесно взаимодействовать с инженерными командами для решения технических узких мест и создания собственных инструментов. - Участвовать в разработке и поддержке внутренней платформы разработчика на базе Backstage. - Разрабатывать и поддерживать специализированные инструменты для AI-инициатив. Требования - Более 5 лет профессионального опыта в SRE или DevOps с явным фокусом на успех разработчиков. - Развитые межличностные навыки и эмпатия к задачам разработчиков. - Подтверждённый опыт работы с AWS и Kubernetes, владение Infrastructure as Code через Terraform или аналоги. - Практический опыт управления мониторингом и пайплайнами деплоя в масштабе. - Склонность к созданию автоматизированных, переиспользуемых систем, предпочтение self-service ручному вмешательству. - Опыт интеграции AI-инструментов в инженерные процессы для повышения продуктивности. Будет плюсом - Знакомство с экосистемой ClickHouse, Sentry или порталами разработчика типа Backstage. - Понимание принципов FinOps и оптимизации инфраструктурных расходов. - Опыт создания или масштабирования внутренних платформ разработчика. Условия - Безлимитный отпуск (рекомендуется минимум 3 недели в год). - Полностью удалённая команда. - Выплата на обустройство домашнего офиса. - Ноутбуки Apple для новых сотрудников. - Бюджет на обучение и развитие, обновляется каждый год. - Декретный отпуск для соответствующих сотрудников. - Зарплата: $80,000–$120,000 в год, зависит от знаний, навыков, опыта и результатов собеседования. - Регулярные командные оффсайты.
Senior DevOps-инженер, платформенная инфраструктура
- Формат
- Офис
- Страна
- Бразилия, Латинская Америка
- Город
- Не указан
- Грейд
- Senior
Luxury Presence — AI-платформа роста для сферы недвижимости. Компания серии C с годовой выручкой $100 млн, поддерживается Bessemer Venture Partners. Более 90 000 специалистов по недвижимости, включая более 30% топ-100 агентов WSJ Real Trends в США, используют платформу. Ищем Senior DevOps-инженера для создания AI-нативной self-service инфраструктурной платформы, на которой компания поставляет программное обеспечение. Платформа позволяет каждому разработчику, человеку или агенту, проверять изменения за минуты, быстро понимать причины сбоев и уверенно выпускать релизы. Вы присоединитесь к небольшой команде инфраструктуры с высокой отдачей, задача которой — умножить возможности каждого инженера и агента через автоматизацию, self-service и встроенные защитные механизмы. Цель — платформа, где self-service является нормой, а ручное вмешательство — исключением. Задачи: - Строить и эксплуатировать self-service инфраструктурную платформу, делая правильное действие простым, а безопасное — стандартным. - Создавать golden paths для инженеров и агентов: в рамках технического направления, заданного Staff-инженерами, строить и эксплуатировать слои, на которые они опираются (единый CI/CD-конвейер, GitOps-доставка на ArgoCD, каталог IaC-модулей, шаблоны для новых сервисов), владея конкретными компонентами от начала до конца. Цель — чтобы инженеры и агенты могли предоставлять инфраструктуру и выпускать изменения в рамках guardrails без ручного написания Terraform/Kustomize и ожидания тикетов. - Сделать агентов полноценными разработчиками: обобщить паттерн изоляции агентов в переиспользуемые примитивы платформы — sandboxed runtime, workload identity, audit trails, approval gates. Каждое действие агента должно работать на тех же рельсах идентичности, аудита, владения, распределения затрат и согласования, что и действия человека. - Строить и эксплуатировать платформу валидации и quality gates: предоставлять рельсы для проверки изменений перед продакшеном — эфемерные PR-окружения с автоудалением, а также gates безопасности, производительности и нагрузочного тестирования. Внедрять новые gates по мере роста покрытия, поддерживать их скорость и низкий уровень ложных срабатываний, переводить сервисы на эти gates. Делать результаты gates и тестов машиночитаемыми и вызываемыми вне PR-процесса, чтобы агенты и люди могли напрямую реагировать на сбои. - Отвечать за надежность и наблюдаемость создаваемого: создавать дашборды и операционные контроли, делающие поверхности, за которые вы отвечаете, наблюдаемыми и улучшаемыми по мере роста пропускной способности: pass rates gates, тренды approval-rate и self-service ratio, типичные сценарии отказов, распределение затрат, метрики DORA. Нести on-call для этих поверхностей, вести инциденты от обнаружения до разбора, превращая повторяющуюся рутину в автоматизацию и runbooks, которые используют другие инженеры. Требования: - Опыт уровня Senior в SRE, DevOps или Platform Engineering: построение и эксплуатация продакшен-инфраструктуры в масштабе, владение значимым направлением работы от начала до конца с ограниченным контролем. - Активное и осознанное использование AI-инструментов разработки (Claude Code, Codex и т.п.) в собственном инфраструктурном процессе: изменения Terraform, отладка Kubernetes, автоматизация, операционные расследования. Наличие собственной позиции о том, где эти инструменты полезны, а где нет. - Глубокий опыт с Kubernetes (EKS) и AWS (IAM, VPC, ECR, SSM/Secrets Manager, S3, SQS, Lambda, RDS/Aurora). - Сильный опыт с IaC (Terraform) и GitOps, включая PR-управляемые apply-процессы (Atlantis или аналоги) и ArgoCD. - Глубокие знания CI/CD (GitHub Actions): кэширование/параллелизм, управление артефактами, надежность тестов, наблюдаемость конвейеров. - Полный опыт владения инцидентами: on-call для созданных систем, ведение инцидентов от обнаружения до разбора. - Отличные кросс-командные коммуникации: умение переводить ограничения платформы в удобные для разработчиков решения и документацию. Будет плюсом: - Опыт с identity, access и policy-as-code: workload/service identity (SPIFFE/SPIRE, OIDC), короткоживущие credentials, управление секретами (Vault), enforcement политик. - Опыт построения self-service платформ для разработчиков, эфемерных окружений, CLI, инструментов шаблонизации или внутренних порталов разработчика (Backstage или кастомные). Отношение к инфраструктуре как к продукту. - Осознанность в затратах: построение распределения затрат, бюджетов или rightsizing в платформе. Технологический стек: - Инфраструктура: AWS, EKS, Terraform (с Atlantis), Vault, Docker, OPA (Open Policy Agent). - CI/CD: GitHub Actions, ArgoCD + Kustomize (GitOps). - Обмен сообщениями: Kafka (Confluent Cloud). - Наблюдаемость: Datadog, OpenTelemetry. - Языки и приложения: Node.js/TypeScript микросервисы, Python, React фронтенды.
Инженер платформы, Kubernetes и bare metal
- Формат
- Удалённо
- Страна
- Испания
- Город
- Не указан
Grafana Labs — компания, стоящая за открытой облачной платформой наблюдаемости. Grafana Cloud — полностью управляемая платформа наблюдаемости, построенная для масштабирования. Более 35 миллионов пользователей и 7000+ клиентов, включая Anthropic, Bloomberg, NVIDIA, Microsoft и Salesforce, доверяют Grafana Labs обеспечение надёжности своих приложений и систем. Компания полностью удалённая, 1600+ сотрудников в 40+ странах. Позиция удалённая. Рассматриваются кандидаты только из Великобритании, Испании и Ирландии. О платформе: Grafana Cloud обрабатывает миллионы метрик, логов и трейсов в секунду из окружений клиентов, обеспечивая высокую доступность и низкую задержку. Внутренняя инженерная платформа (IEP), создаваемая группой Foundations, предоставляет инженерам приложений инструменты, системы и Kubernetes-кластеры для сборки, развёртывания и запуска их нагрузок. Новая команда «Metal» будет отвечать за создание и предоставление ресурсов — хранилищ, сетей и Kubernetes-кластеров — в новых окружениях, начиная с собственного физического оборудования. Команда предоставит Kubernetes control plane и базовые ресурсы вне публичного облака остальной части инженерного отдела. Задачи: - Управление физическим окружением «Metal» от bare metal до Kubernetes. - Управление компонентами кластерной сети: балансировка нагрузки, NAT, DNS, CNI, межкластерная связь, протоколы маршрутизации, архитектура. - Управление планированием и автоматическим масштабированием. - Поддержка Crossplane-композиций и Terraform-модулей для общих ресурсов CSP, а также управление версионированием и совместимостью Crossplane и Terraform core и провайдеров. - Работа с пользователями (командами приложений Grafana Cloud) для понимания их потребностей и инвестирования в нужные возможности. Требования: - Опыт работы с распределёнными системами. - Опыт эксплуатации собственного кода. - Опыт работы с дата-центрами. - Участие в дежурствах (on-call rotation). - Основной стек: Go, Python, Shell. - Готовность работать в удалённой компании, коммуникабельность, умение работать по консенсусу и следовать командным решениям. - Целостный подход к разработке: от написания дизайн-документов до интеграционного тестирования. Бонусы: - Опыт работы с Cluster-API, Tinkerbell, Talos и/или Ceph. - Опыт участия в open source или других сообществах. - Опыт работы с несколькими облачными провайдерами (AWS, GCP, Azure; управляемые Kubernetes-сервисы EKS, GKE, AKS). - Опыт эксплуатации и управления нагрузками на Kubernetes.
Инженер-программист платформы Metal
- Формат
- Удалённо
- Страна
- Ирландия
- Город
- Не указан
О компании Grafana Labs — компания, стоящая за открытой облачной платформой наблюдаемости. Grafana Cloud — полностью управляемая платформа наблюдаемости, гибкая и рассчитанная на масштабирование. Более 35 миллионов пользователей и 7 000+ клиентов, включая Anthropic, Bloomberg, NVIDIA, Microsoft и Salesforce, используют Grafana Labs для обеспечения надёжности приложений и систем, быстрого разрешения инцидентов и оптимизации телеметрии. Компания полностью удалённая: 1 600+ сотрудников в 40+ странах. Инвесторы: Lightspeed Venture Partners, Sequoia Capital, GIC, Coatue, J.P. Morgan, CapitalG и Lead Edge Capital. О платформе Grafana Cloud обрабатывает миллионы метрик, логов и трейсов в секунду из окружений клиентов, используя высокодоступный стек с низкой задержкой, который обрабатывает и хранит данные, а также отдаёт их в дашборды и инструменты оповещения. Планируется рост до сотен миллионов в секунду, поэтому важно улучшать производительность, надёжность и эффективность. Внутренняя инженерная платформа (IEP), создаваемая группой Foundations, предоставляет инженерам приложений инструменты, системы и Kubernetes-кластеры для сборки, развёртывания и запуска нагрузок. Открывается новая команда Foundations "Metal", которая будет отвечать за создание и предоставление ресурсов, включая хранилища, сети и Kubernetes-кластеры в новых окружениях, начиная с собственного физического оборудования. Команда будет предоставлять контрольную плоскость Kubernetes и базовые ресурсы вне публичного облака для остальной части инженерного отдела. Задачи - Управление физической средой "Metal" от bare metal до Kubernetes. - Управление компонентами кластерной сети: балансировка нагрузки, NAT, DNS, CNI, связь между кластерами, протоколы маршрутизации, архитектура. - Управление планированием (scheduling) и автоматическим масштабированием. - Поддержка Crossplane-композиций и Terraform-модулей для ресурсов облачных провайдеров, общих для пользователей. Также управление версионированием и совместимостью Crossplane и Terraform (ядро и провайдеры). - Работа с пользователями (командами приложений Grafana Cloud) для понимания их потребностей и инвестирования в нужные возможности. Требования - Готовность работать с инженерами и с управленческими структурами, которые поддерживают команду. - Комфортная работа в remote-first компании; важна коммуникация. Работа строится на сотрудничестве, дружелюбии и уважении. Решения принимаются консенсусом: вы можете участвовать в обсуждении, но затем присоединяетесь к командному решению. - Интерес к распределённым системам (компания высокораспределённая). - Желание учиться и развиваться. - Целостный подход к разработке: команда владеет полным жизненным циклом кода — от написания дизайн-документов до анализа обратной связи от разработчиков и интеграционного тестирования. - Опыт работы с Go, Python и Shell (основной стек платформенной команды). - Опыт эксплуатации своего кода. - Опыт работы в дата-центрах. - Участие в дежурствах (on-call rotation). Будет плюсом - Опыт работы с Cluster-API, Tinkerbell, Talos и/или Ceph. - Опыт участия в open source или других проектах на основе сообщества. - Опыт работы с несколькими облачными провайдерами (CSP). Grafana Cloud работает на AWS, GCP и Azure с использованием управляемых Kubernetes-сервисов EKS, GKE, AKS. - Опыт эксплуатации и управления нагрузками на Kubernetes. Условия - Удалённая работа. - Рассматриваются кандидаты из Великобритании, Испании и Ирландии.
Staff DevOps инженера
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
Staff DevOps инженер Мы строим AI-платформу для mental health в США: лицензированные врачи + собственные AI-инструменты, которые забирают рутину (charting, follow-ups, планы лечения), чтобы врачи занимались пациентами, а не бумагами. Ищем Staff DevOps инженера, который сам решает, куда двигать инфраструктуру. Что на тебе - Vision и квартальный роадмап инфры, проактивно, с трейд-оффами и метриками - AWS + Kubernetes (EKS): Karpenter, Kyverno, zero-downtime - IaC end-to-end: Terraform, AWS CDK (TS) + GitLab CI (self-managed) - Observability, которой реально пользуются: Prometheus, Grafana, OpenTelemetry - Blue-green деплои, health-gated rollback, zero-downtime миграции PostgreSQL - Security в HIPAA-среде: секреты, Vault as code - Agentic AI (Claude Code и подобные) как часть ежедневной работы, а не «на посмотреть» Стек AWS · EKS · Terraform · AWS CDK (TS) · GitLab CI · Prometheus / Grafana / OTel · Vault · PostgreSQL · Node.js / TS Условия - Remote - Долгосрочный контракт, B2B - Русский свободно, английский от B1 - $6.000-7.500 gross/monthly - Медстраховка после испытательного, компенсация спорта и wellness, 19 дней отпуска + 4 wellness-дня, English на Preply
AI-инженер, платформа и агентные системы
- Формат
- Удалённо
- Страна
- Любая
- Город
- Не указан
Команда строит платформу ИИ-инженерии, которая обеспечивает доставку ИИ-решений. В зоне ответственности — жизненный цикл разработчика, инфраструктура развёртывания, наблюдаемость, автоматизация качества, конвейеры обработки документов и переиспользуемые паттерны агентов. Это практическая инженерия с прямым выходом на миллионы пользователей. Обязанности - Паттерны агентов, поиск и защитные механизмы для агентных ассистентов, которые отвечают на вопросы участников и выполняют операции от их имени. - MCP-сервер, предоставляющий реестр навыков для ИИ-агентов прямо в IDE. - Переиспользуемые паттерны агентов в LangGraph: мультиагентная оркестрация, память, безопасность использования инструментов и защитные механизмы. - Платформа оценки агентов (DeepEval, Ragas) с качественными гейтами, блокирующими неудачные развёртывания в CI/CD. - Конвейеры обработки и поиска документов: разбиение на чанки, эмбеддинги, векторный поиск, реранкинг и цитирование. - Автоматизация CI/CD и развёртывания ИИ-агентов на AWS (ECS, Fargate, Agent Core). - ИИ-совместимые devcontainer'ы с инструментарием, валидацией и тестированием. - Инструментирование OpenTelemetry, дашборды и отслеживание стоимости LLM и токенов для продакшн-нагрузок. - Контроль управления, преобразованный в проверки конвейера, с автоматическим сбором доказательств. - Семантическое кэширование, ограничение скорости и корректная деградация для агентных нагрузок. - Эталонные реализации, SDK и CLI-инструменты, документация для других инженеров. Требования - Владение Python (3.10+) — основной язык команды. - Рабочее знание AWS: ключевые сервисы (IAM, ECS/Fargate, сети), уверенность в cloud-native окружении. - Дисциплина программной инженерии: контроль версий (Git/GitHub), код-ревью, тестирование, документация, чистый код. - Осведомлённость о безопасности: работа с чувствительными данными, секреты, права доступа, защита данных по умолчанию. - Экспертиза в одной из шести областей: - Разработка ИИ-агентов: LangGraph или аналоги, мультиагентная оркестрация, память, использование инструментов, защитные механизмы, проектирование промптов и рабочих процессов. - Инженерия данных и поиска: разбиение на чанки, эмбеддинги и векторный поиск, RAG, гибридный поиск, реранкинг, оценка поиска. - Качество и оценка: фреймворки оценки агентов (DeepEval, Ragas), качественные гейты в CI/CD, метрики обоснованности и безопасности, автоматизация тестов для ИИ-систем. - Платформа и инфраструктура: CI/CD, Terraform, оркестрация контейнеров на AWS (ECS, Fargate), секреты и IAM, прогрессивное развёртывание. - Наблюдаемость и эксплуатация: трассировка OpenTelemetry, дашборды и алертинг, отслеживание стоимости LLM и токенов, циклы обратной связи. - Опыт разработчика: MCP-серверы, devcontainer'ы, CLI и SDK-инструменты, библиотеки промптов, документация и эталонные реализации.
Staff-инженер SRE, облачные базы данных
- Формат
- Удалённо
- Страна
- Германия
- Город
- Не указан
О компании Grafana Labs — компания, развивающая открытую платформу наблюдаемости Grafana Cloud. Платформа предоставляется как управляемый сервис. Более 35 миллионов пользователей и 7000+ клиентов, включая Anthropic, Bloomberg, NVIDIA, Microsoft и Salesforce. Компания полностью удалённая: 1600+ сотрудников в 40+ странах. О роли Ищем Staff-инженера SRE для поддержки самых ценных клиентов Grafana Cloud за счёт повышения надёжности облачных баз данных на основе Mimir, Loki, Tempo и Pyroscope. Базы данных предоставляются как SaaS-продукт из AWS, GCP и Azure во всех регионах. SRE-команда встроена в продуктовые команды Mimir, Loki и Tempo и отвечает за надёжность продуктов баз данных для клиентов с высокими SLA. Задачи - Тесно работать с продуктовыми командами (встроенная модель). - Отвечать за производственную надёжность сред с высокими SLA и сложных клиентских окружений. - Проектировать и внедрять автоматизацию для масштабирования практик надёжности. - Обеспечивать достижение клиентами целей SLO. - Определять и развивать пер-тенантные SLO и модели надёжности. - Проактивно снижать сжигание SLO для предотвращения повторных инцидентов. - Быть основной точкой эскалации и на связи (on-call) при инцидентах. - Руководить реагированием на инциденты, влияющие на клиентов, и проводить пост-инцидентные разборы. - Участвовать в проектировании (design docs) и ревью кода. - Влиять на дизайн функций для обеспечения масштабируемости и эксплуатационной пригодности. - Строить автоматизацию для устранения рутинной работы (toil). - Улучшать качество алертов и снижать шумные эскалации. Требования - 8+ лет инженерного опыта, из них 4+ в SRE/CRE/production engineering. Предпочтителен формальный опыт в customer reliability engineering. - Сильный опыт работы с Kubernetes в AWS, GCP или Azure, знакомство с инструментами infrastructure-as-code (Helm, Terraform, Jsonnet и т.п.). - Сильный опыт технического лидерства: ведение команды через проекты, наставничество инженеров, роль force-multiplier. - Опыт эксплуатации мультитенантных систем в production. - Сильный опыт проектирования и внедрения SLO. - Опыт с одним или несколькими языками программирования (например, Go, Python, Java). - Опыт с внутренностями операционной системы Linux, базовые знания сетей, облачного хранения и масштабирования. - Отличные навыки решения проблем и траблшутинга. - Опыт спокойного и активного участия в безобвинительном реагировании на инциденты, отслеживании действий и написании качественных PIR (post-incident reviews). - Способность рассуждать о производительности, масштабировании и режимах отказа. - Комфортная работа в инженерной команде с высокой степенью автономии и самонаправленности. - Способность глубоко взаимодействовать с продуктовыми командами. - Ценятся любознательность, прозрачность, склонность к действию и доброжелательность. Условия - Удалённая работа. Рассматриваются кандидаты из Великобритании, Швеции, Испании или Германии. - Компания предоставляет оплачиваемый бюджет на использование современных AI-ассистентов для разработки (инструменты на выбор в рамках политики безопасности), а также доступ к передовым моделям (например, GPT-Codex, Claude Opus, Gemini 3 Pro).
Staff-инженер по надежности баз данных
- Формат
- Удалённо
- Страна
- Ирландия
- Город
- Не указан
Компания: Grafana Labs. Формат: удалённая работа. Рассматриваются кандидаты из Великобритании, Швеции, Испании, Германии или Ирландии. Роль: Staff Software Engineer — SRE для облачных баз данных Grafana Cloud (Mimir, Loki, Tempo, Pyroscope). Базы данных предоставляются как SaaS на AWS, GCP и Azure во всех регионах. SRE-команда встроена в продуктовые группы Mimir, Loki и Tempo. Задачи - Тесное партнёрство с продуктовыми инженерными командами (встроенная модель). - Обеспечение надёжности production-среды для клиентов с высокими SLA и сложных окружений. - Проектирование и внедрение автоматизации для масштабирования практик надёжности. - Обеспечение достижения клиентами целевых показателей SLO. - Определение и развитие пер-тенантных SLO и моделей надёжности. - Проактивное снижение выгорания SLO для предотвращения повторных инцидентов. - Выполнение роли основного эскалационного контакта и дежурного (on-call) при инцидентах. - Руководство разбором инцидентов, влияющих на клиентов, и пост-инцидентными ревью. - Участие в проектировании (design docs) и код-ревью. - Влияние на дизайн функций для обеспечения масштабируемости и эксплуатационной пригодности. - Создание автоматизации для устранения рутинной работы (toil). - Улучшение качества алертов и снижение шумных эскалаций. Требования - 8+ лет инженерного опыта, из них 4+ в SRE/CRE/production engineering. Предпочтителен формальный опыт в customer reliability engineering. - Сильный опыт работы с Kubernetes на AWS, GCP или Azure, знакомство с инструментами infrastructure-as-code (Helm, Terraform, Jsonnet и т.п.). - Сильный опыт технического лидерства: ведение команды через проекты, наставничество инженеров, роль force-multiplier. - Опыт эксплуатации мульти-тенантных систем в production. - Сильный опыт проектирования и внедрения SLO. - Опыт с одним или несколькими языками программирования (например, Go, Python, Java). - Опыт с внутренностями ОС Linux, знание сетей, облачного хранения и масштабирования. - Отличные навыки решения проблем и диагностики. - Опыт спокойного и активного участия в blame-free инцидент-менеджменте, выполнения последующих действий и написания качественных PIR (Post Incident Reviews). - Умение рассуждать о производительности, масштабировании и режимах отказов. - Комфортная работа в инженерной команде с высокой степенью автономии и самонаправленности. - Способность к глубокому партнёрству с продуктовыми командами. - Ценятся интеллектуальное любопытство, прозрачность, склонность к действию и доброта. Условия - Удалённая работа (из указанных стран). - Компания предоставляет бюджет на использование современных AI-ассистентов для кодирования (в рамках политики безопасности), а также доступ к передовым моделям (например, GPT-Codex 5/3, Claude Opus 4.6, Gemini 3 Pro).
Platform & Security Operations Engineer
- Формат
- Гибрид
- Страна
- ОАЭ
- Город
- Дубай
Platform & Security Operations Engineer Компания: название под NDA. Регулируемая OTC crypto-платформа, работающая в Дубае под лицензией VARA. Занятость: полная, гибрид, оформление в штат. Локация: Дубай, ОАЭ. Зарплата: 32 000–36 000 AED в месяц. Зона ответственности: - Владение production-инфраструктурой и Kubernetes-кластерами. - Развитие инфраструктуры на Terraform/Terragrunt: network, data и identity. - Поддержка и развитие GitOps-процессов. - Построение security monitoring: алерты, detection rules, настройка false positives. - Разработка incident runbooks и запуск процесса дежурств. - Реагирование на production- и security-инциденты, проведение postmortem. - Развитие CI/CD и безопасности software supply chain. - Настройка сканирования зависимостей, образов и подписи артефактов. - Формализация инфраструктурных регламентов и процессов. - Подготовка технических свидетельств для внешних аудитов. Требования: - Сильный production-опыт с Kubernetes: upgrades, workload identity, network policies, autoscaling и расследование инцидентов. - Опыт с Terraform и Terragrunt, Atlantis или аналогичными инструментами. - Практический опыт GitOps с Flux, ArgoCD или аналогами. - Глубокое знание AWS: VPC, multi-AZ, KMS, OIDC federation, DNS. - Опыт прохождения внешних аудитов: ISO 27001, SOC 2, PCI DSS, HIPAA или аналогичных. - Практический опыт security monitoring и detection engineering: алертинг, настройка правил, снижение ложных срабатываний. - Опыт работы с production-системами, где сбои или утечки приводят к серьёзным финансовым и регуляторным последствиям. - Опыт работы с AI-инструментами разработки и понимание ограничений генерируемого ими кода. - Английский C1.
Senior Solution Architect, AWS и Cloud Security
- Формат
- Офис
- Страна
- Не указана
- Город
- Не указан
- Грейд
- Senior
Компания Rockstardevelopers, основанная в 2015 году в Мангейме, с офисами в Штутгарте и Мюнхене, — разработчик ПО с опытом сотен индивидуальных проектов для корпоративных клиентов и среднего бизнеса. Короткие пути, честная обратная связь, без политических игр. Между тобой и людьми, принимающими решения, нет уровней иерархии. Задачи: - Проектирование и развитие платформенной архитектуры на AWS: EKS, ECR, Fargate, дизайн кластеров, стратегии namespace, высокая доступность. - Концепции безопасности для регулируемых сред: Zero Trust, IAM/RBAC, безопасность контейнеров, шифрование, аудит-логирование, сегментация сети. - Проектирование асинхронных слабосвязанных систем: Kafka/MSK, EventBridge, SNS/SQS, включая Saga, CQRS и Event Sourcing. - Реализация Everything-as-Code: Terraform или CDK, Policy-as-Code с OPA/Gatekeeper, GitOps-деплой через ArgoCD или Flux. - Участие в эксплуатации: инциденты, пост-инцидентные разборы и вытекающие из них архитектурные решения. - Продуктивная разработка с AI-инструментами: Claude Code, Copilot, Cursor. Большинство сотрудников приходят в один из офисов один-два дня в неделю. Принуждения нет. Выезды к заказчику — только на отдельные встречи раз в несколько недель. Проекты: крупные корпорации, такие как Deutsche Bahn / DB Systel, государственный сектор (Bundesagentur für Arbeit, ITZBund, Bundesdruckerei), а также корпоративные клиенты и средний бизнес — платформенные и архитектурные задачи. Требования: - Senior-уровень, более пяти лет опыта. Клиентам нужны специалисты, которые выдают результат с первого дня и работают самостоятельно. - Опыт создания и эксплуатации Kubernetes-платформ на AWS, а не только использования: EKS, ECR, Fargate. - Опыт архитектуры безопасности в сложных корпоративных средах: Zero Trust, IAM/RBAC, безопасность контейнеров, соответствие требованиям. - Опыт Event-Driven Architecture с Kafka или аналогами AWS, включая паттерны согласованности. - Опыт Infrastructure as Code и GitOps: Terraform, CDK или Pulumi, ArgoCD или Flux. - Опыт ITIL-эксплуатации с собственным техническим вкладом, а не только управлением. Будет плюсом: SAFe и PI-планирования, BPMN 2.0 с Camunda (Platform 7 или 8), сертификаты AWS (Solutions Architect, DevOps Engineer), Kubernetes CKA/CKS. Не обязательно уметь всё. Важно быстро разбираться в новых средах. Немецкий язык — свободное владение в письменной и устной форме, английский — уровень C2. AI-инструменты обязательны, не бонус: Claude Code, Copilot, Cursor — нужно уметь работать с ними продуктивно. Не потому что это модно, а потому что клиенты этого ожидают, и компания так работает. Если AI-инструменты считаются хайпом и предпочитаешь всё печатать сам — это не та компания. Внутри компания инвестирует в развитие AI-навыков. Условия: - Homeoffice, офис или микс — решаешь сам. - MacBook (если заказчик не предоставляет собственное оборудование). - Разные клиенты и проекты. - Основатели — твои прямые контактные лица. - Внутреннее обучение AI-разработке.
DevOps
- Формат
- Гибрид
- Страна
- Россия
- Город
- Москва
DevOps Компания: Федеральное Медико-биологическое агентство Локация: Москва Занятость: Полная, гибридный формат Оформление: ТК РФ ЦСП ФМБА занимается научными исследованиями, связанными с геномом человека и анализом полученных данных. Группа разработки создает внутренние сервисы для автоматизации движения, обработки и распределенного хранения больших объемов данных. Требования - Уверенные знания Linux (Debian/Ubuntu), сетей, контейнеризации - Опыт развертывания и эксплуатации продуктовых Kubernetes кластеров - Опыт работы с инструментами автоматизации (Ansible, Terraform) - Опыт использования GitOps инструментов (FluxCD, ArgoCD) - Опыт работы с системами мониторинга: Grafana, Prometheus, ELK Stack, Sentry - Понимание процессов и опыт работы с инструментами CI/CD (GitLab CI) Важно: - Законченное высшее образование - Гражданство РФ Чем предстоит заниматься - Поддержка инфраструктуры, развернутой на bare metal серверах и VM - Развертывание и эксплуатация кластеров Kubernetes - Поддержка инфраструктурных сервисов: GitLab, Harbor и другие - Администрирование баз данных: PostgreSQL, Elasticsearch, Redis, ClickHouse - Администрирование Airflow - Автоматизация инфраструктуры с использованием Ansible, Terraform, Flux - Настройка системы мониторинга: VictoriaMetrics, Grafana - Обеспечение непрерывной работоспособности и доступности сервисов - Документирование процессов и систем Условия - Оформление по ТК РФ - Работа в команде профессионалов на стыке передовых ИТ и науки. Работа с Big Data и ML, собственный корпоративный ЦОД - Возможность профессионального роста, обучение - График работы 5/2, гибрид, плавающее начало рабочего дня
Бэкенд-разработчика, которому интересно строить надёжные сервисы
- Формат
- Гибрид
- Страна
- Россия
- Город
- Не указан
Бэкенд-разработчик в команду поездов и расписаний Яндекс Путешествия — сервис, который поможет спланировать поездку за несколько минут: подобрать билеты, отель или апартаменты, прочитать отзывы и оплатить всё картой. Группа бэкенда поездов и расписаний — небольшая и сфокусированная команда: четыре разработчика и тимлид. Входит в продуктовую команду, где есть все нужные специалисты и всё для того, чтобы принимать решения быстро и видеть результат своей работы. Ищем бэкенд-разработчика, которому интересно строить надёжные сервисы. Вы будете влиять на архитектуру и запускать новые решения в продакшен. Задачи - Разработка сервисов поиска билетов на разные виды транспорта. Предстоит самостоятельно вести новый функционал: продумывать интеграции с внешними партнёрами, выстраивать быстрый пайплайн доставки оферов до пользователя, разрабатывать новые способы оплаты. Участие в код-ревью, проведение технического проектирования. - Развитие инфраструктуры бэкенда сервисов. Задачи — улучшать мониторинг и стабильность: работа с телеметрией сервисов, выстраивание системы мониторинга и роутинга событий, распределённые системы. Настройка CI/CD-пайплайнов, выступление в роли DevOps для настройки окружения сервиса и управления трафиком. Требования - Опыт коммерческой разработки на Go более пяти лет - Умение декомпозировать задачи и работать самостоятельно - Готовность разбираться в чужом коде и отсутствие страха перед легаси Будет плюсом - Опыт работы с Terraform, gRPC, PostgreSQL, Nginx, Kafka - Знание Python или Java: в команде есть сервисы на этих языках - Использование AI-агентов для разработки Условия Предоставляется полный набор, который поможет уберечься от тревожности и выгорания: ежегодные медицинские чекапы, йога и психотерапия. Полный список бонусов доступен на сайте.
DevOps-инженер LLM-инференса
- Формат
- Удалённо
- Страна
- Любая
- Город
- Не указан
LLM DevOps/Inference Engineer Локация: удаленно Контекст: работа над платформой оценки и бенчмаркинга ИИ-моделей для здравоохранения. Начальная цель — клинические задачи прогнозирования: сепсис, дни до смерти, прогнозирование трендов лабораторных показателей. Оценка проводится на нескольких frontier-моделях и отраслевых моделях. Обязанности: - Построение и поддержка AWS-инфраструктуры платформы оценки как кода: сеть, вычисления, оркестрация, секреты, наблюдаемость, CI/CD. - Запуск self-hosted трека инференса для нишевых медицинских моделей: GPU-инфраструктура с батчингом, квантизацией, автоскейлингом и стандартным онбордингом новых моделей. - Создание слоя абстракции провайдеров совместно с ИИ-инженерами: единый интерфейс для API-моделей (OpenAI, Anthropic, Gemini и др.) и self-hosted моделей. Ответственность за rate limiting, ретраи, управление квотами, логирование запросов и ответов, атрибуцию затрат на запуск. - Обеспечение воспроизводимости и оптимизации затрат на бенчмарк-запуски: закрепление версий моделей и контейнеров, стратегия spot и reserved capacity, устранение простоя GPU. - Построение наблюдаемости: пропускная способность, задержка, стоимость токенов и GPU-часов, таксономия сбоев, дашборды по моделям. - Поддержка волновой нагрузки: возможность для группы ИИ-инженеров запускать эксперименты и уходить без поломок и осиротевших ресурсов. - Участие в архитектуре Trusted Execution Environment (TEE): оценка AWS Nitro Enclaves и аналогичных подходов для сценария bring-your-own-data / bring-your-own-model, включая аттестационный выпуск ключей и практические ограничения инференса внутри enclave. Требования: - AWS-инфраструктура на продакшн-масштабе: EKS или ECS, GPU-инстансы EC2 (G5/G6, P4d/P5) и их ограничения, проектирование VPC, IAM, KMS, Secrets Manager, ECR, CloudWatch, Service Quotas. - Инфраструктура как код: Terraform. Без ручного создания ресурсов через консоль. - Опыт работы с LLM: практическое владение стратегией батчинга, поведением KV cache, компромиссами квантизации, мульти-GPU шардированием. - Оркестрация контейнеров и планирование GPU: ECS/EKS с GPU-нагрузками, автоскейлинг нод, пайплайны сборки образов для CUDA-зависимых стеков. - Надежность и оптимизация затрат: SLO, алертинг, подтвержденный опыт снижения облачных расходов без потери функциональности. - Опыт запуска инференс-контейнеров. - Опыт в ИИ и LLM. - Опыт работы в здравоохранении (HIPAA, HL7 и др.). - Сильные коммуникативные навыки. Желательно: - Опыт с AWS SageMaker endpoints и Bedrock. - Практический опыт Python для работы с harness и слоем адаптеров провайдеров. - Основы конфиденциальных вычислений: enclaves, remote attestation, sealed key release, границы безопасности TEE. - Комплаенс в здравоохранении: выбор HIPAA-совместимых сервисов, BAA scope, аудит-логирование, контроль доступа к PHI. - Усиление безопасности: сканирование образов, контроль исходящего сетевого трафика для замкнутого контура. Будет плюсом: - Опыт хостинга медицинских изображений или мультимодальных моделей. - Nitro Enclaves в продакшене или аналогичный опыт TEE. - Опыт поддержки self-service сред, чистых границ тенантов и быстрого предоставления учетных данных.
Senior AI-инженер инфраструктуры, LLM/AI-платформы
- Формат
- Удалённо
- Страна
- Любая
- Город
- Не указан
- Грейд
- Senior
Вакансия удаленная, открыта для кандидатов из США. Компания — глобальный лидер в области кибербезопасности, специализирующийся на предотвращении взломов с помощью продвинутых платформ на базе ИИ. Ищут Senior AI Infrastructure Engineer для проектирования, создания и масштабирования ИИ-инфраструктуры для продуктов, с фокусом на большие языковые модели (LLM) и ИИ-системы. Обязанности - Предоставление и настройка крупных GPU-кластеров и вычислительных ресурсов для задач обучения, дообучения и инференса LLM. - Оптимизация инфраструктуры обслуживания LLM-моделей, включая развертывание и оптимизацию различных фреймворков инференса. - Управление жизненным циклом моделей: версионирование, контрольные точки и воспроизводимость в процессах обучения и инференса. - Проектирование и внедрение надежных фреймворков оценки для проверки производительности, точности и надежности моделей, обеспечивая соответствие ИИ-систем производственным стандартам. - Выявление и устранение узких мест использования GPU и эффективности памяти GPU, применение таких техник, как квантование, пакетная обработка и кэширование. - Проектирование и поддержка платформ и пайплайнов данных, специально предназначенных для поддержки LLM, RAG (Retrieval-Augmented Generation) и ИИ-систем в производственной среде, с акцентом на производительность, сопровождаемость и строгость тестирования, обеспечивая быструю поставку без ущерба качеству. - Применение экспертизы в моделировании данных, нормализации и семантическом каталогизировании для AI/ML-нагрузок. - Определение и внедрение лучших практик MLOps/DataOps для LLM, включая мониторинг, наблюдаемость и механизмы восстановления для ИИ-сервисов. - Тщательное документирование архитектурных решений и донесение технических деталей до заинтересованных сторон. - Взаимодействие с Data Scientists, Product Managers и другими инженерными командами для превращения исследовательских прототипов в надежные сервисы производственного уровня. Требования - Степень бакалавра в области компьютерных наук, инженерии данных или STEM; магистерская степень приветствуется. - 6+ лет опыта в инфраструктурной/дата-инженерии, как минимум 2 года в создании и поддержке платформ/пайплайнов, поддерживающих LLM-системы и приложения. - Подтвержденный практический опыт в LLM-инфраструктуре: предоставление кластеров, оптимизация обучающих нагрузок и поддержка инференс-пайплайнов. - Исключительная способность писать чистый, элегантный, поддерживаемый и хорошо протестированный код, а также сильный фокус на быстрой поставке результатов. - Глубокое понимание инженерных практик, включая эффективные ревью кода и отказоустойчивую архитектуру. - Проявление технического лидерства и наставнических качеств. - Подтвержденный опыт использования ИИ-технологий для улучшения принятия решений, оптимизации рабочих процессов и процессов, повышения эффективности и бизнес-результатов. - Практический опыт с MLOps-инструментами (MLflow, SageMaker, AI). - Сильное понимание основ CUDA, драйверов, GPU и TPU. - Опыт работы с фреймворками инференса, такими как vLLM и Triton Inference Server. - Владение фреймворками обучения: PyTorch, Ray, Megatron, JAX. - Экспертный уровень владения высокоуровневым языком программирования (Python). - Глубокие знания контейнеризации и оркестрации (Slurm, Airflow). - Владение инструментами Infrastructure as Code, такими как Terraform и Ansible. - Опыт работы с облачными платформами (AWS, GCP или OCI) и сервисами данных. - Опыт работы в сфере кибербезопасности, разведки или отраслях с высокими требованиями к соответствию. - Опыт создания, развертывания и управления LLM в производственной среде. - Опыт работы с распространенными фреймворками рабочих процессов. - Опыт работы с фреймворками обработки данных (например, Dask, Flink). Условия - Право на бонусы. - Гранты на акции. - Комплексный пакет льгот: медицинская страховка, 401k, оплачиваемый отпуск, конкурентоспособная компенсация и акции. - Комплексные программы физического и психического здоровья. - Конкурентоспособный отпуск и праздники, отпуск по уходу за ребенком и усыновлению. - Возможности для развития для всех сотрудников независимо от уровня или роли. - Сети сотрудников, географические сообщества и волонтерские возможности для установления связей. - Офисная культура с удобствами мирового класса. - Сертификация Great to Work Certified™ по всему миру.
Senior бэкенд-инженер, инфраструктура
- Формат
- Офис
- Страна
- Германия
- Город
- Не указан
- Грейд
- Senior
О компании Soda — платформа мониторинга качества данных и ИИ. Клиенты: Disney, Ralph Lauren, CBRE, HelloFresh, 2K Games, Nubank. Open-source движок Soda Core используется компаниями Tesla, Slack, Adyen, Walmart, JPMC. Компания основана в 2019 году. Инвесторы: Point 9 Capital, Hummingbird, Singular, Eurazeo. О роли Присоединение к Platform-команде: полный путь от бэкенд-сервиса до продакшена — Java-сервисы Soda Cloud и AWS/Kubernetes-инфраструктура. Роль — в первую очередь бэкенд-инженер: большинство времени уходит на проектирование и разработку сервисов. Инфраструктура — часть работы, позволяющая доводить сервисы до продакшена. Это не DevOps и не SRE-позиция. Инженеры продукта: общение с пользователями, совместная разработка решений с продакт-менеджером, сквозная поставка. Используются AI-кодинг-агенты. Задачи - Проектировать и разрабатывать бэкенд-сервисы и API на Java для мультитенантной SaaS-платформы. - Поставлять продуктовые функции end-to-end, работать напрямую с продуктом и клиентами. - Повышать надёжность, производительность и масштабируемость сервисов, доводить их до продакшена на AWS/Kubernetes. - Поддерживать скорость разработки: CI/CD-пайплайны, GitOps-процессы, наблюдаемость. - Улучшать системы для агентной разработки: быстрая CI-обратная связь, надёжные dev-среды, защитные механизмы для безопасной работы агентов. - Принимать архитектурные решения — от дизайна сервисов до эволюции платформы. Требования - 5+ лет разработки бэкенда в продуктовой компании: проектирование, разработка и владение продакшен-сервисами. - Сильный Java: API, асинхронная обработка, конкурентность, оптимизация производительности. - Уверенный SQL в бэкенд-контексте: проектирование схем, оптимизация запросов, миграции в продакшене. Используются MySQL и ClickHouse. - Архитектурное мышление: понимание влияния дизайна API и сервисов на потоки данных, паттерны запросов, задержки и сценарии отказов. - Запуск собственных сервисов: опыт работы с Kubernetes и AWS (EKS, IAM, networking, RDS, S3) в продакшене. - CI/CD, GitOps и инфраструктура как код: GitHub Actions, ArgoCD/Flux, Terraform или Pulumi, скриптинг. - Наблюдаемость как привычка: метрики, логирование, трейсинг (Prometheus, Grafana, OpenTelemetry), написание тестов. - Агентная инженерия: разработка продакшен-кода с AI-кодинг-агентами (Claude Code, Cursor или аналоги) в цикле, умение направлять их при сохранении высокого стандарта качества. - Самостоятельность: работа в распределённой асинхронной команде из 12+ стран без постоянного контроля. - Свободный английский. Будет плюсом - Мультитенантный SaaS в масштабе; опыт работы в быстрорастущем стартапе. - Python: стек data engineering работает на нём. - Опыт в регулируемой среде (ISO27001, SOC2). - Опыт создания агентных рабочих процессов в продукте: функции на LLM, агенты с инструментами, AI-автоматизация для реальных пользователей. - Опыт в области качества данных, управления данными, наблюдаемости данных или мониторинга ML. Условия - Компенсация €85,000–120,000 в год + опционы. - Полная удалённость (в странах ЕС), доступен офис в Бельгии. - Доступ к токенам всех передовых моделей. - Реальная ответственность. Процесс отбора - Скрининг резюме. - 20-минутный телефонный разговор. - Первое техническое интервью (45 минут). - Второе техническое интервью (60 минут). - Интервью на соответствие культуре (45 минут). - Ответ каждому кандидату в течение 3–5 дней после каждого этапа.
Senior Backend Engineer, ML-инфраструктура
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
- Грейд
- Senior
О компании Constructor — AI-first платформа для поиска и обнаружения товаров в электронной коммерции, запущена в 2019 году. Помогает покупателям находить нужные товары и позволяет мировым брендам электронной коммерции увеличивать выручку и конверсию. О роли Команда ML Infrastructure создаёт и поддерживает общие бэкенд-сервисы и платформенные возможности, которые команды ML и продуктов используют для разработки, развёртывания и запуска машинного обучения в масштабе — от сервинга моделей (включая LLM) до специализированных хранилищ и пайплайнов данных. Это сервисная команда: дорожная карта формируется потребностями продуктовых команд. Ищем Senior Backend Engineer, готового брать полную ответственность за ключевые сервисы. Ближайшие и среднесрочные направления: - Упрощение запуска, масштабирования и эксплуатации ML-нагрузок для всех команд. - Предоставление self-service и настраиваемых компонентов инфраструктуры для ML и продуктовых команд. - Развитие ключевых ML-сервисов и связанных пайплайнов с высокими требованиями к надёжности и производительности. Задачи - Проектировать, создавать и эксплуатировать высоконагруженные распределённые бэкенд-сервисы, обеспечивающие ML-инфраструктуру компании. - Владеть ключевыми ML-сервисами и связанными пайплайнами данных: от дизайна и реализации до развёртывания, наблюдаемости и постоянного улучшения. - Взаимодействовать с ML и продуктовыми командами, превращая их потребности в надёжные и переиспользуемые платформенные возможности. - Принимать и защищать технические решения: оценивать компромиссы, сначала проектировать, отвечать за результат. - Отвечать за свою работу и работу команды. Требования - 5+ лет профессионального опыта в бэкенд- или платформенной инженерии. - Глубокие знания Python (основной язык). - Практический опыт разработки в публичном облаке (AWS, GCP или Azure) или с self-managed Kubernetes. AWS — основная платформа, но не ограничиваясь ей. - Опыт проектирования и создания распределённых высоконагруженных сервисов и API. - Сильные знания структур данных, алгоритмов и их компромиссов. - Инженерный подход, ориентированный на проектирование: среда поддерживает использование AI-инструментов, но вы ведёте за счёт системного дизайна и понимания их применимости. - Ответственность и проактивность: не закрывать глаза на проблемы, решать их и отвечать за результаты. - Дружелюбие и готовность помогать коллегам. Будет плюсом - Опыт с Rust (или C/C++/Go) — существенный плюс. - Опыт разработки или участия в ML-платформах или ML-инфраструктуре — существенный плюс. - Опыт настройки и эксплуатации векторных баз данных (Qdrant, Milvus, Weaviate, OpenSearch, pgvector и т.п.) — существенный плюс. - Опыт с сервингом моделей / инференс-инфраструктурой, включая LLM. - Опыт с Infrastructure as Code (Terraform или аналоги). Условия - Безлимитный отпуск (рекомендуется минимум 3 недели в год). - Полностью удалённая команда — можно жить где угодно. - Стипендия на работу из дома для обустройства домашнего офиса. - Ноутбуки Apple для новых сотрудников. - Бюджет на обучение и развитие для каждого сотрудника, обновляется каждый год. - Оплачиваемый отпуск по беременности и уходу за ребёнком для соответствующих сотрудников. - Работа с умными людьми, которые помогают расти и влиять на результат. - Базовая зарплата: $80,000–$120,000 USD в зависимости от знаний, навыков, опыта и результатов интервью. - Опционы на акции в дополнение к базовой зарплате. - Регулярные командные оффсайты для общения и совместной работы.
Staff DevOps инженера
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
Публикатор: Karolina Staff DevOps Engineer at MEDvidi Мы строим AI-платформу для mental health в США: лицензированные врачи + собственные AI-инструменты, которые забирают рутину (charting, follow-ups, планы лечения), чтобы врачи занимались пациентами, а не бумагами. Ищем Staff DevOps инженера, который сам решает, куда двигать инфраструктуру. Что на тебе: Vision и квартальный роадмап инфры, проактивно, с трейд-оффами и метриками AWS + Kubernetes (EKS): Karpenter, Kyverno, zero-downtime IaC end-to-end: Terraform, AWS CDK (TS) + GitLab CI (self-managed) Observability, которой реально пользуются: Prometheus, Grafana, OpenTelemetry Blue-green деплои, health-gated rollback, zero-downtime миграции PostgreSQL Security в HIPAA-среде: секреты, Vault as code Agentic AI (Claude Code и подобные) как часть ежедневной работы, а не «на посмотреть» Стек: AWS · EKS · Terraform · AWS CDK (TS) · GitLab CI · Prometheus / Grafana / OTel · Vault · PostgreSQL · Node.js / TS Условия: Remote Долгосрочный контракт, B2B Русский свободно, английский от B1 $5.000-7.000 gross/monthly медстраховка после испытательного, компенсация спорта и wellness, 19 дней отпуска + 4 wellness-дня, English на Preply Отклик на вакансию: https://medvidi.com/careers/co/remote-eu/96.F64-87.60C/staff-devops-engineer/all vacancy вакансия работа devops remote удаленка B2B
Senior Backend Engineer (Golang)
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
- Грейд
- Senior
вакансия golang Senior Backend Engineer (Golang) Удаленная работа приветствуется! Мы в Persona ищем талантливого и опытного Backend инженера для создания новых передовых технологий и улучшения текущих пайплайнов обработки фото и видео для приложений Gradient и Persona. Gradient - мобильное приложение для редактирования фото и видео - Самое скачиваемое приложение в мире за месяц в 2019, 2020 годах - Best of 2019 среди приложений по мнению Apple Persona - передовой бьюти фото и видео редактор с уникальными технологиями обработки селфи Совокупно наша аудитория составляет больше 100 миллионов пользователей Ваши задачи - Поддержка / развитие текущего API - Администрирование / тонкая настройка GCP, AWS, GKE с большим количеством инстансов - Деплой ML моделей Требования - 3+ года коммерческого опыта. - Экспертное владение Golang: backend-разработка, gRPC / HTTP. - Уверенный DevOps-бэкграунд. - Облако: GCP или AWS, продакшн-уровень. - Linux / Bash на уровне администрирования и трейблшутинга. - Kubernetes (в т.ч. GKE) и Docker, продакшн-опыт. - Terraform. - Опыт деплоя ML-моделей в production. - Глубокий опыт настройки мониторинга и алертинга. - Опыт работы с высоконагруженными приложениями. Будет плюсом: - Знание Python - Postgres, Metabase Что предлагаем мы: - Удаленная работа - Увлеченная команда настоящих профи - Атмосфера стартапа из Кремниевой Долины - Участие в разработке популярных приложений с большим количеством пользователей Компания: Persona Заработная плата: от 450 000 ₽ за месяц, на руки Полезные ссылки: 🍏 Мобильный трудоголик - Канал про мобильную разработку. 🔹 Flutter & Dart | Мобильный трудоголик - Канал про разработку на Flutter. 🐈 Кот Денисова - Канал про разработку и жизнь в ИТ.
Senior Full Stack Engineer with AI
- Формат
- Офис
- Страна
- Не указана
- Город
- Не указан
- Грейд
- Senior
вакансия ai Senior Full Stack Engineer with AI Sigma Software is an international technology partner with over 24 years of experience delivering impactful digital solutions for global businesses. With a team of 2,000+ professionals, the company collaborates with leading brands such as AstraZeneca, Viaplay, Volvo, and Scania, helping them scale, innovate, and stay competitive in rapidly evolving markets. Operating across more than 20 countries, with 40+ offices in Europe and the Americas, Sigma Software combines global reach with strong local expertise. The company has delivered projects for over 500 clients, spanning industries such as fintech, healthcare, automotive, and media. Role OverviewWe are looking for a Senior AI Software Engineer with strong full-stack experience to help design, develop, and operate modern cloud-based software products. The engineer should be comfortable working across frontend, backend, and DevOps domains while integrating AI-native capabilities into business applications. Technology Stack - React, Angular - Java / Spring Boot, Python, C - Kafka, Terraform - Kubernetes, Helm, ArgoCD - Azure OpenAI or similar AI platforms Engagement - Full-time engagement - Strong English communication skills required Customer in the medical domain.Working on applications for doctors, clinics. Job Description Key Responsibilities - Develop and maintain modern web applications. - Design and implement AI-powered features and agentic workflows. - Build and operate cloud-native services with strong focus on reliability, security, and scalability. - Collaborate with product, UX, architecture, and engineering teams. - Drive engineering excellence and AI adoption within development teams. Qualifications Required Skills - Senior-level full-stack development experience. - Strong frontend expertise in React or Angular. - Strong backend expertise in Java / Spring Boot or Python or C. - Experience with cloud-native architectures and DevOps practices. - Demonstrated practical use of AI tools in software engineering. - Degree in Computer Science or equivalent technical background. Preferred Qualifications - Experience building AI agents, workflows, or automation solutions. - Familiarity with modern LLM ecosystems and AI tooling. - Understanding of product development processes. Компания: ИП ООО SIGMA SOFTWARE TASHKENT Заработная плата: Уровень дохода не указан Полезные ссылки: 🍏 Мобильный трудоголик - Канал про мобильную разработку. 🔹 Flutter & Dart | Мобильный трудоголик - Канал про разработку на Flutter. 🐈 Кот Денисова - Канал про разработку и жизнь в ИТ.
Payment Solution Engineer
- Формат
- Офис
- Страна
- Не указана
- Город
- Не указан
vacancy 🚀 Payment Solution Engineer В Unlimit открыта позиция Payment Solution Engineer — для инженера с глубоким опытом в платежной инфраструктуре, банковских интеграциях и запуске новых payment rails. Unlimit — международная fintech-компания, 16 лет на рынке. Развиваем собственную экосистему финансовых продуктов: payment processing, альтернативные платежные методы, multicurrency business accounts, card issuing, BaaS и crypto on/off-ramp решения. Будущий коллега будет самостоятельно вести интеграции с центральными банками, национальными clearing-системами и BaaS-провайдерами — от первого контакта и сертификации до production launch. ✅ Основные задачи: • подключение новых локальных платежных и clearing-систем; • взаимодействие с регуляторами, банками и внешними провайдерами; • настройка test environments, прохождение certification cases и запуск в production; • проектирование и реализация интеграций; • управление сроками и всем процессом подключения end-to-end; • документирование решений и передача их engineering и operations-командам. Основной стек: Java / Kotlin, Spring Boot, jOOQ, Temporal, REST, SOAP/XML, ISO 20022, Kafka, AWS, Docker, Kubernetes, Terraform, GitLab CI/CD. ✅ Что важно: • 5+ лет опыта в payments, banking или integration engineering; 8+ лет опыта на JVM • практический опыт с SWIFT, SEPA и другими payment schemes; • понимание clearing и settlement flows; • опыт с ISO 20022, MT/MX, SOAP/REST; • опыт подключения к центральным банкам или national clearing systems; • английский для общения с международными партнерами и регуляторами; • практический интерес к AI-инструментам и их применению в engineering-процессах- мы активно пишем агентов для рабочих задач Условия: 📍 Белград, работа из офиса 5/2 💰 €7 000–10 000 net в месяц 📄 официальное трудоустройство в Сербии/ оформление ВНЖ и полное сопровождение документов ✈️ полный релок пакет 🏋️ компенсация спорта 🇬🇧 занятия английским 📚 бюджет на обучение
DevOps-инженер / DNS Технологии
- Формат
- Удалённо
- Страна
- Не указана
- Город
- Не указан
DevOps-инженер / DNS Технологии Владивосток. Обязанности - Написание Ansible плейбуков и ролей - Автоматизация управления инфраструктурой с помощью Terraform - Администрирование Linux серверов Требования - Опыт работы с Git - Базовое знание любого языка программирования - Опыт работы с Linux, уверенное владение командной строкой