Grafana Labs — компания, стоящая за открытой облачной платформой наблюдаемости. Grafana Cloud — полностью управляемая платформа наблюдаемости, построенная для масштабирования. Более 35 миллионов пользователей и 7000+ клиентов, включая Anthropic, Bloomberg, NVIDIA, Microsoft и Salesforce, доверяют Grafana Labs обеспечение надёжности своих приложений и систем. Компания полностью удалённая, 1600+ сотрудников в 40+ странах.
Позиция удалённая. Рассматриваются кандидаты только из Великобритании, Испании и Ирландии.
О платформе: Grafana Cloud обрабатывает миллионы метрик, логов и трейсов в секунду из окружений клиентов, обеспечивая высокую доступность и низкую задержку. Внутренняя инженерная платформа (IEP), создаваемая группой Foundations, предоставляет инженерам приложений инструменты, системы и Kubernetes-кластеры для сборки, развёртывания и запуска их нагрузок. Новая команда «Metal» будет отвечать за создание и предоставление ресурсов — хранилищ, сетей и Kubernetes-кластеров — в новых окружениях, начиная с собственного физического оборудования. Команда предоставит Kubernetes control plane и базовые ресурсы вне публичного облака остальной части инженерного отдела.
Задачи:
- Управление физическим окружением «Metal» от bare metal до Kubernetes.
- Управление компонентами кластерной сети: балансировка нагрузки, NAT, DNS, CNI, межкластерная связь, протоколы маршрутизации, архитектура.
- Управление планированием и автоматическим масштабированием.
- Поддержка Crossplane-композиций и Terraform-модулей для общих ресурсов CSP, а также управление версионированием и совместимостью Crossplane и Terraform core и провайдеров.
- Работа с пользователями (командами приложений Grafana Cloud) для понимания их потребностей и инвестирования в нужные возможности.
Требования:
- Опыт работы с распределёнными системами.
- Опыт эксплуатации собственного кода.
- Опыт работы с дата-центрами.
- Участие в дежурствах (on-call rotation).
- Основной стек: Go, Python, Shell.
- Готовность работать в удалённой компании, коммуникабельность, умение работать по консенсусу и следовать командным решениям.
- Целостный подход к разработке: от написания дизайн-документов до интеграционного тестирования.
Бонусы:
- Опыт работы с Cluster-API, Tinkerbell, Talos и/или Ceph.
- Опыт участия в open source или других сообществах.
- Опыт работы с несколькими облачными провайдерами (AWS, GCP, Azure; управляемые Kubernetes-сервисы EKS, GKE, AKS).
- Опыт эксплуатации и управления нагрузками на Kubernetes.