Тимлид разработки AI платформы (ML-ops/Backend/CV)
Описание
«Детмир Тех» — команда, развивающая цифровую экосистему группы компаний «Детский мир». Делаем продукты для миллионов клиентов и сервисы, которые помогают бизнесу работать быстрее. Кого ищем: ИИ-платформа «Детского Мира» уже работает: LLM-гейтвей с квотами, RAG по корпоративным знаниям, агентные сценарии, собственный GPU-инференс. Основной вектор развития платформы: безопасность данных → прод-контур и наблюдаемость → внешние модели → инструменты для отдела внедрения → измеримое качество → масштабирование на всю компанию. Ищем руководителя отдела ИИ-платформы, который возьмёт техническое развитие платформы и соберёт команду из backend-, MLOps- и CV-инженеров (до 5–7 специалистов; весь Центр AI вырастет до 15 человек). Потребители платформы — все сотрудники компании. Чем предстоит заниматься: Развивать платформу по дорожной карте: Data Governance (права доступа, маскировка ПД), прод-контур и наблюдаемость, внешние модели, гибридный поиск, evals. Сформировать команду: найм backend-, MLOps- и CV-инженеров, стандарты, онбординг, рост людей. Отвечать за эксплуатацию: SLO/uptime, инциденты, бэкапы и восстановление. Управлять экономикой: GPU-мощности (собственные плюс аренда под агентскую платформу), стоимость токенов, квоты по командам и доменам, учёт в рублях. Удовлетворять потребности бизнеса, команд данных и ИТ-инфраструктуры; качественный self-service для потребителей моделей и агентов. Развивать инструменты для отдела внедрения: прод Dify и агентную платформу. Что ожидаем от вас: 4–5+ лет инженерной практики: Python backend (FastAPI, asyncio, БД, брокеры) и/или ML-инженерия (Docker/K8s, CI/CD, мониторинг моделей) — с реальным продом; 1–2 года лидерства: тимлид/техлид — команда, код-ревью, стандарты, наставничество; Архитектурный опыт: проектирование сервисов/платформенных компонентов, API-контракты, интеграции; Эксплуатация: метрики, алертинг, инциденты, SLO; Готовность разбираться в обоих контурах — backend и ML (CV-часть — с поддержкой DS-команды). Будет плюсом: LLM-инференс (vLLM/Triton), LLMOps-практики; GPU-кластеры, очереди, квотирование; CV-контур: инференс, ONNX/TensorRT; Опыт построения платформы с нуля и найма команды. Мы предлагаем: Официальное оформление в соответствии с ТК РФ в IT-аккредитованную компанию; Совокупный доход: оклад + годовой бонус; График работы: 5/2 (гибридный формат работы/ удаленный); Вакансия открыта для кандидатов, проживающих в РФ, удалённый формат работы из других стран не рассматривается; Техника для работы; Полис ДМС; Программа Best Benefits; Внутреннее обучение; Спортивные и развлекательные мероприятия, участие в корпоративной жизни компании. Присоединяйтесь к нам и станьте частью истории бренда с историей!