Luxury Presence — AI-платформа роста для сферы недвижимости. Компания серии C с годовой выручкой $100 млн, поддерживается Bessemer Venture Partners. Более 90 000 специалистов по недвижимости, включая более 30% топ-100 агентов WSJ Real Trends в США, используют платформу.
Ищем Senior DevOps-инженера для создания AI-нативной self-service инфраструктурной платформы, на которой компания поставляет программное обеспечение. Платформа позволяет каждому разработчику, человеку или агенту, проверять изменения за минуты, быстро понимать причины сбоев и уверенно выпускать релизы. Вы присоединитесь к небольшой команде инфраструктуры с высокой отдачей, задача которой — умножить возможности каждого инженера и агента через автоматизацию, self-service и встроенные защитные механизмы. Цель — платформа, где self-service является нормой, а ручное вмешательство — исключением.
Задачи:
- Строить и эксплуатировать self-service инфраструктурную платформу, делая правильное действие простым, а безопасное — стандартным.
- Создавать golden paths для инженеров и агентов: в рамках технического направления, заданного Staff-инженерами, строить и эксплуатировать слои, на которые они опираются (единый CI/CD-конвейер, GitOps-доставка на ArgoCD, каталог IaC-модулей, шаблоны для новых сервисов), владея конкретными компонентами от начала до конца. Цель — чтобы инженеры и агенты могли предоставлять инфраструктуру и выпускать изменения в рамках guardrails без ручного написания Terraform/Kustomize и ожидания тикетов.
- Сделать агентов полноценными разработчиками: обобщить паттерн изоляции агентов в переиспользуемые примитивы платформы — sandboxed runtime, workload identity, audit trails, approval gates. Каждое действие агента должно работать на тех же рельсах идентичности, аудита, владения, распределения затрат и согласования, что и действия человека.
- Строить и эксплуатировать платформу валидации и quality gates: предоставлять рельсы для проверки изменений перед продакшеном — эфемерные PR-окружения с автоудалением, а также gates безопасности, производительности и нагрузочного тестирования. Внедрять новые gates по мере роста покрытия, поддерживать их скорость и низкий уровень ложных срабатываний, переводить сервисы на эти gates. Делать результаты gates и тестов машиночитаемыми и вызываемыми вне PR-процесса, чтобы агенты и люди могли напрямую реагировать на сбои.
- Отвечать за надежность и наблюдаемость создаваемого: создавать дашборды и операционные контроли, делающие поверхности, за которые вы отвечаете, наблюдаемыми и улучшаемыми по мере роста пропускной способности: pass rates gates, тренды approval-rate и self-service ratio, типичные сценарии отказов, распределение затрат, метрики DORA. Нести on-call для этих поверхностей, вести инциденты от обнаружения до разбора, превращая повторяющуюся рутину в автоматизацию и runbooks, которые используют другие инженеры.
Требования:
- Опыт уровня Senior в SRE, DevOps или Platform Engineering: построение и эксплуатация продакшен-инфраструктуры в масштабе, владение значимым направлением работы от начала до конца с ограниченным контролем.
- Активное и осознанное использование AI-инструментов разработки (Claude Code, Codex и т.п.) в собственном инфраструктурном процессе: изменения Terraform, отладка Kubernetes, автоматизация, операционные расследования. Наличие собственной позиции о том, где эти инструменты полезны, а где нет.
- Глубокий опыт с Kubernetes (EKS) и AWS (IAM, VPC, ECR, SSM/Secrets Manager, S3, SQS, Lambda, RDS/Aurora).
- Сильный опыт с IaC (Terraform) и GitOps, включая PR-управляемые apply-процессы (Atlantis или аналоги) и ArgoCD.
- Глубокие знания CI/CD (GitHub Actions): кэширование/параллелизм, управление артефактами, надежность тестов, наблюдаемость конвейеров.
- Полный опыт владения инцидентами: on-call для созданных систем, ведение инцидентов от обнаружения до разбора.
- Отличные кросс-командные коммуникации: умение переводить ограничения платформы в удобные для разработчиков решения и документацию.
Будет плюсом:
- Опыт с identity, access и policy-as-code: workload/service identity (SPIFFE/SPIRE, OIDC), короткоживущие credentials, управление секретами (Vault), enforcement политик.
- Опыт построения self-service платформ для разработчиков, эфемерных окружений, CLI, инструментов шаблонизации или внутренних порталов разработчика (Backstage или кастомные). Отношение к инфраструктуре как к продукту.
- Осознанность в затратах: построение распределения затрат, бюджетов или rightsizing в платформе.
Технологический стек:
- Инфраструктура: AWS, EKS, Terraform (с Atlantis), Vault, Docker, OPA (Open Policy Agent).
- CI/CD: GitHub Actions, ArgoCD + Kustomize (GitOps).
- Обмен сообщениями: Kafka (Confluent Cloud).
- Наблюдаемость: Datadog, OpenTelemetry.
- Языки и приложения: Node.js/TypeScript микросервисы, Python, React фронтенды.