Назад к вакансиям
remotevibecodingjobs16 августа 2026 г.

Senior DevOps-инженер, платформенная инфраструктура

Luxury Presence

ВознаграждениеПо договорённости
Локация
LATAM, Brazil
Формат
Офис
Направления
Вайбкодинг, Веб-разработка, DevOps, Разработка ИИ-агентов, Дизайнер, Автоматизация
Отклик
На remotevibecodingjobs

Luxury Presence — AI-платформа роста для сферы недвижимости. Компания серии C с годовой выручкой $100 млн, поддерживается Bessemer Venture Partners. Более 90 000 специалистов по недвижимости, включая более 30% топ-100 агентов WSJ Real Trends в США, используют платформу.

Ищем Senior DevOps-инженера для создания AI-нативной self-service инфраструктурной платформы, на которой компания поставляет программное обеспечение. Платформа позволяет каждому разработчику, человеку или агенту, проверять изменения за минуты, быстро понимать причины сбоев и уверенно выпускать релизы. Вы присоединитесь к небольшой команде инфраструктуры с высокой отдачей, задача которой — умножить возможности каждого инженера и агента через автоматизацию, self-service и встроенные защитные механизмы. Цель — платформа, где self-service является нормой, а ручное вмешательство — исключением.

Задачи:

  • Строить и эксплуатировать self-service инфраструктурную платформу, делая правильное действие простым, а безопасное — стандартным.
  • Создавать golden paths для инженеров и агентов: в рамках технического направления, заданного Staff-инженерами, строить и эксплуатировать слои, на которые они опираются (единый CI/CD-конвейер, GitOps-доставка на ArgoCD, каталог IaC-модулей, шаблоны для новых сервисов), владея конкретными компонентами от начала до конца. Цель — чтобы инженеры и агенты могли предоставлять инфраструктуру и выпускать изменения в рамках guardrails без ручного написания Terraform/Kustomize и ожидания тикетов.
  • Сделать агентов полноценными разработчиками: обобщить паттерн изоляции агентов в переиспользуемые примитивы платформы — sandboxed runtime, workload identity, audit trails, approval gates. Каждое действие агента должно работать на тех же рельсах идентичности, аудита, владения, распределения затрат и согласования, что и действия человека.
  • Строить и эксплуатировать платформу валидации и quality gates: предоставлять рельсы для проверки изменений перед продакшеном — эфемерные PR-окружения с автоудалением, а также gates безопасности, производительности и нагрузочного тестирования. Внедрять новые gates по мере роста покрытия, поддерживать их скорость и низкий уровень ложных срабатываний, переводить сервисы на эти gates. Делать результаты gates и тестов машиночитаемыми и вызываемыми вне PR-процесса, чтобы агенты и люди могли напрямую реагировать на сбои.
  • Отвечать за надежность и наблюдаемость создаваемого: создавать дашборды и операционные контроли, делающие поверхности, за которые вы отвечаете, наблюдаемыми и улучшаемыми по мере роста пропускной способности: pass rates gates, тренды approval-rate и self-service ratio, типичные сценарии отказов, распределение затрат, метрики DORA. Нести on-call для этих поверхностей, вести инциденты от обнаружения до разбора, превращая повторяющуюся рутину в автоматизацию и runbooks, которые используют другие инженеры.

Требования:

  • Опыт уровня Senior в SRE, DevOps или Platform Engineering: построение и эксплуатация продакшен-инфраструктуры в масштабе, владение значимым направлением работы от начала до конца с ограниченным контролем.
  • Активное и осознанное использование AI-инструментов разработки (Claude Code, Codex и т.п.) в собственном инфраструктурном процессе: изменения Terraform, отладка Kubernetes, автоматизация, операционные расследования. Наличие собственной позиции о том, где эти инструменты полезны, а где нет.
  • Глубокий опыт с Kubernetes (EKS) и AWS (IAM, VPC, ECR, SSM/Secrets Manager, S3, SQS, Lambda, RDS/Aurora).
  • Сильный опыт с IaC (Terraform) и GitOps, включая PR-управляемые apply-процессы (Atlantis или аналоги) и ArgoCD.
  • Глубокие знания CI/CD (GitHub Actions): кэширование/параллелизм, управление артефактами, надежность тестов, наблюдаемость конвейеров.
  • Полный опыт владения инцидентами: on-call для созданных систем, ведение инцидентов от обнаружения до разбора.
  • Отличные кросс-командные коммуникации: умение переводить ограничения платформы в удобные для разработчиков решения и документацию.

Будет плюсом:

  • Опыт с identity, access и policy-as-code: workload/service identity (SPIFFE/SPIRE, OIDC), короткоживущие credentials, управление секретами (Vault), enforcement политик.
  • Опыт построения self-service платформ для разработчиков, эфемерных окружений, CLI, инструментов шаблонизации или внутренних порталов разработчика (Backstage или кастомные). Отношение к инфраструктуре как к продукту.
  • Осознанность в затратах: построение распределения затрат, бюджетов или rightsizing в платформе.

Технологический стек:

  • Инфраструктура: AWS, EKS, Terraform (с Atlantis), Vault, Docker, OPA (Open Policy Agent).
  • CI/CD: GitHub Actions, ArgoCD + Kustomize (GitOps).
  • Обмен сообщениями: Kafka (Confluent Cloud).
  • Наблюдаемость: Datadog, OpenTelemetry.
  • Языки и приложения: Node.js/TypeScript микросервисы, Python, React фронтенды.