О продукте
В команду ищут эксперта разработки, который возьмёт на себя самые критичные и нагруженные части платформы. Важен не только сильный инженер, но и человек, которому интересно, как индустрия агентов взрослеет: от prompt- к context engineering, от одиночного бота к мульти-агентным системам, MCP и A2A как новые стандарты, память и eval агентов, reasoning-модели, эффективный serving (vLLM / SGLang). Это не просто чтение в ленте, а практическое применение.
Над чем предстоит работать
- Оркестратор диалога на LangGraph: граф сценариев, чекпоинтинг состояния, tool-calling, интеграция с LLM. Это сердце платформы и одна из самых нагруженных её частей.
- Планирование и выполнение многошаговых задач, субагенты и мульти-агентная оркестрация.
- Развитие долговременной памяти агентов, изолированные сэндбоксы для исполнения кода и инструментов, guardrails и контроль действий.
- Парсинг и чанкинг документов, индексация и гибридный / семантический поиск в Milvus.
- Рантайм диалога на Kafka: обработка входящих сообщений, маршрутизация ответов в каналы, поток событий диалога в аналитику.
- Оценка качества агентов, наблюдаемость.
Чем предстоит заниматься
- Реализовывать высоконагруженные бэкенды критичной бизнес-логики.
- Быть владельцем кода одного или нескольких сервисов и отвечать за его качество, производительность, отказоустойчивость и документированность.
- Прототипировать и исследовать подходы (новые модели, фреймворки агентов, способы инференса), чтобы обоснованно выбирать решения, а не следовать хайпу.
- По желанию и в перспективе расти в техлида или тимлида продукта.
Ожидания от кандидата
- Релевантный опыт backend-разработки от 5 лет с Python как основным языком на экспертном уровне (в компании используется Python 3.12): понимание не только как писать, но и как и почему работает под капотом.
- Глубокое понимание async-модели: где asyncio даёт выигрыш, а где только добавляет сложности, как не положить event loop блокирующим вызовом и как дебажить асинхронный код под нагрузкой; опыт с async-фреймворком (в компании используется FastAPI).
- Опыт проектирования и эксплуатации высоконагруженных и отказоустойчивых сервисов: нагрузка, конкурентность, backpressure, деградация, идемпотентность.
- Уверенная работа с микросервисами и брокерами сообщений (в компании используется Kafka).
- Опыт с реляционными БД (в компании используется PostgreSQL); понимание, чем платить за консистентность и как не положить базу под нагрузкой.
- Алгоритмы и структуры данных, ООП, SOLID, чистый читаемый код, code review, юнит-тестирование.
