Назад к вакансиям
Дата обнаружения: 27 августа 2026 г.

Инфраструктурный инженер, Kubernetes и bare metal

Aleria LLC

Зарплата5500-6.000$ remote, 8.000-8200$ onsite
Страна
Не указана
Город
Не указан
Формат
Удалённо
Направления
ML-инженер, DevOps
Где отклик
Телеграм

Компания

Aleria LLC из Абу-Даби разрабатывает AI-продукты для клиентов в ОАЭ и по всему миру. Небольшая команда, быстрый рост. Работаем на bare metal, без облака. Нужен инженер, который понимает каждый слой — от NIC до Kubernetes pod — и отвечает за то, чтобы всё это работало стабильно под нагрузкой и не падало посреди ночи.

Условия

  • Удалённо 2 месяца испытательного срока, затем обязательный релокация в Абу-Даби.
  • Занятость: full-time.
  • Зарплата: 5500–6000 $ на удалёнке, 8000–8200 $ после переезда.

Задачи

  • Обеспечивать надёжность и доступность сервисов на bare metal с Kubernetes поверх железа.
  • Строить и поддерживать observability (Prometheus, Grafana, Loki): метрики, дашборды, алерты, SLO/SLI.
  • Реагировать на инциденты, проводить post-mortem и устранять причины, а не симптомы.
  • Тюнить PostgreSQL и другие БД под продакшен-нагрузку, искать бутылочные горлышки.
  • Поддерживать CI/CD (GHES, ArgoCD), снижать время и риск деплоев.
  • Сетевая инфраструктура: маршрутизация, сегментация, балансировка нагрузки, безопасность.
  • On-premise и air-gapped поставки (~10%).
  • Capacity planning и работа над снижением toil.
  • Безопасность, которая не тормозит команду.
  • Взаимодействие с командой разработки и инженерами клиентов.

Требования

  • Глубокий опыт bare metal — без облачных абстракций.
  • Понимание внутреннего устройства Kubernetes, а не только манифестов.
  • Опыт устранения продакшен-инцидентов под давлением, умение быстро находить root cause.
  • Тюнинг БД под нагрузкой (приоритет — PostgreSQL).
  • Опыт построения observability и систем алертинга с нуля.
  • Опыт on-prem и air-gapped развёртываний.
  • Сети: L2/L3, routing, firewall, VPN.
  • Продакшен Linux troubleshooting.
  • Подход security-mindset с балансом на скорость доставки.
  • Высокая автономность при работе с незнакомым стеком.
  • Видение инфраструктуры за пределами текущей задачи.
  • Английский B2+.

Будет плюсом

  • Опыт с GPU-кластерами для AI.
  • Ceph/ZFS/распределённые хранилища.
  • Опыт hardening/compliance для гос. заказчиков.
  • Air-gap CI/CD.

Не ищем

YAML-инженеров, которые только применяют готовые манифесты. Нужен человек, который понимает, что происходит под капотом — и готов первым встать ночью, если что-то упало.