Компания Twilio ищет Software Engineer в команду Platform Engineering. Это инженерная роль, предполагающая разработку, развертывание и управление высоконагруженными распределенными системами. Системы компании обрабатывают более 12 миллиардов писем во время пиковых событий, таких как Черная пятница, а требования к пропускной способности продолжают быстро расти.
Инженер уровня L3 будет создавать и поддерживать отказоустойчивые бэкенд-сервисы, вносить вклад в проектирование и надежность инфраструктуры, работающей в двух облаках: Amazon Web Services (AWS) и Microsoft Azure. В задачи входит управление Kubernetes за пределами управляемых сервисов, автоматизация инфраструктуры с помощью Terraform и написание production-кода для поддержания работоспособности распределенных систем под реальной нагрузкой с использованием современных AI-инструментов.
Задачи:
- Проектирование, создание и эксплуатация сервисов и автоматизаций для управления кластерами Kubernetes в масштабе. Совместная работа с продакт-менеджментом и техническим руководством для декомпозиции сложных требований на итеративные этапы.
- Проведение тщательных ревью кода, поддержание поддерживаемых паттернов в кодовой базе, обеспечение высоких стандартов тестирования (unit, integration, component) на уровне команды и платформы.
- Управление и улучшение облачных конфигураций в AWS и Azure с использованием Infrastructure as Code (Terraform). Обеспечение глубокого наблюдаемости через стандартизацию метрик, алертов и распределенной трассировки в ключевых пайплайнах данных.
- Выявление технического долга, узких мест системы и единых точек отказа (SPOF), балансируя поставку фич с критическим рефакторингом платформы.
- Наставничество младших инженеров, ведение технического спринт-планирования и обмен экспертизой между распределенными инженерными командами.
Требования:
- Опыт от 4 лет в разработке и эксплуатации отказоустойчивых бэкенд-сервисов в масштабе с использованием Kubernetes. Опыт работы с CAPI, EKS и управлением обновлениями кластеров Kubernetes без даунтайма, включая node draining, API deprecations и PodDisruptionBudgets.
- Практический опыт использования AI-ассистированных инструментов разработки (например, Claude Code) для ускорения генерации кода, автоматизации тестирования и отладки, или сильное желание их освоить.
- Опыт внедрения GitOps-процессов с ArgoCD и автоматизированной оркестрации пайплайнов с Harness (или аналогичной enterprise CI/CD платформой).
- Уверенные навыки работы с Shell, Terraform, YAML и Go (Golang).
- Опыт развертывания и управления production-нагрузками в облачных средах, желательно с глубоким знанием AWS (EKS, EC2, S3) или их аналогов в Microsoft Azure (AKS, Virtual Machines, Blob Storage). Понимание контейнерных сетей (VPC/VNet, pod IPAM, CNI-плагины).
- Владение Terraform для автоматизации провижининга и поддержания паритета окружений.
- Сильное теоретическое и практическое понимание распределенных хранилищ данных, кэширующих слоев и асинхронного стриминга событий (например, Kafka или аналоги).