Staff Systems Engineer, IT — старшая инженерная роль для универсального специалиста, готового отвечать за широкий набор платформ. Вы будете владеть системами и интеграциями, обеспечивающими жизненный цикл сотрудника: онбординг, изменение ролей и офбординг. Системы строятся как инфраструктура-как-код с применением SRE-практик, чтобы они были версионированы, наблюдаемы и надежны. Вы станете техническим владельцем ITSM-платформы GitLab и AI-возможностей поверх неё: виртуальные агенты, агентные рабочие процессы и базы знаний, которые решают запросы до превращения их в тикеты. Также вы отвечаете за общую IT-инфраструктуру в облаке. Работая с AI-ориентированной ITSM, вы замените повторяющуюся ручную работу устойчивой автоматизацией и будете партнёром для End User Services, Security, People и Finance при масштабировании решений на всю компанию. Ключевые метрики: покрытие автоматизацией процессов жизненного цикла, доля AI-отклонений (deflection rate) и надёжность создаваемых систем.
Задачи
- Проектировать, строить и владеть сквозной автоматизацией жизненного цикла сотрудника: онбординг, переводы, изменение ролей и офбординг, чтобы предоставление и отзыв доступа происходили точно и с минимальным участием человека.
- Быть техническим владельцем ITSM-платформы GitLab: дизайн каталога услуг, рабочие процессы, процессы запросов, инцидентов и изменений, интеграции и обновления платформы.
- Повышать долю AI-отклонений для всех пользователей ITSM за счёт развёртывания и настройки виртуальных агентов, AI-поиска и агентного разрешения, а также измерения того, что реально решает запросы без участия человека.
- Находить повторяющиеся ручные процессы в IT и партнёрских командах и заменять их автоматизацией, построенной в ITSM и Serval.
- Создавать и поддерживать интеграции между ITSM-платформой и ключевыми системами GitLab: Okta, Google Workspace, Slack, Zoom, JAMF, Fleet, Workday и сам GitLab.
- Управлять IT-инфраструктурой как кодом в облачных средах, чтобы каждое изменение проходило через контроль версий, код-ревью и автоматизированный, аудируемый путь в продакшн.
- Применять SRE-принципы к сервисам IT: значимый мониторинг и алертинг, понятные цели надёжности, учёт ёмкости и стоимости, безобвинительный разбор инцидентов.
- Развивать управление знаниями и self-service-опыт, которые питают AI-отклонения: хорошо структурированные статьи, элементы каталога и диалоговые сценарии, остающиеся точными при изменении систем.
- Инструментировать автоматизацию и производительность AI понятными метриками и дашбордами: доля отклонений, время решения, покрытие автоматизацией, частота отказов — и публично итерировать по результатам.
- Задавать инженерные стандарты для стека IT-автоматизации: контроль версий, тестирование, код-ревью, управление окружениями и контроль изменений, а также наставлять инженеров поддержки в IT-организации.
- Партнёрствовать с Security и Compliance, чтобы автоматизация жизненного цикла и AI-рабочие процессы соответствовали требованиям доступа, аудита и контроля, включая SOX и SOC 2.
- Документировать архитектуру, runbook и проектные решения в handbook, чтобы создаваемые системы были прозрачными, поддерживаемыми и управляемыми всей командой.
Требования
- Широта кругозора как у универсального системного инженера: вы владели широким спектром платформ от начала до конца и достаточно быстро осваиваете незнакомые, чтобы полностью взять их на себя.
- Уверенный опыт работы с инфраструктурой-как-кодом (Terraform или аналоги).