Инженер по ИИ/AI Agent Engineer (LLM & Agentic Systems)
Описание
Привет! Мы - компания "Градиент" и мы ищем Инженера, который возьмёт ownership над качеством и надёжностью наших AI-агентов и LLM-систем. Это глубоко техническая роль на стыке ML-инженерии и разработки: ты будешь проектировать многошаговые агентские сценарии, строить RAG-пайплайны, выстраивать процессы оценки качества и доводить решения до промышленной эксплуатации. После твоего выхода: Логика работы LLM в наших продуктах становится устойчивой и масштабируемой Многошаговые AI-сценарии корректно работают под нагрузкой и в реальных бизнес-кейсах Появляются воспроизводимые подходы к тестированию, оценке и улучшению качества ответов моделей Команда понимает ограничения решений и может управляемо их развивать Чем тебе предстоит заниматься: Агентские системы: Разрабатывать многошаговые цепочки AI-агентов: orchestration, routing, memory, tool calling Проектировать и внедрять цепочки reasoning, проверок и fallback-механизмов Диагностировать, где и почему ломается логика AI — не «плохой ответ», а почему система даёт такой ответ Ставить guardrails на необратимые действия агентов, определять условия выхода из циклов RAG и данные: Строить end-to-end RAG-пайплайны: ingestion → chunking → embeddings → vector search + hybrid → reranking → prompt orchestration → grounding Экспериментировать с retrieval-стратегиями: гибридный поиск (BM25 + dense), re-ranking, query rewriting Организовывать пайплайн данных: сбор, нормализация, индексация, мониторинг Качество и eval: Разрабатывать и внедрять методики оценки RAG-систем и AI-агентов: offline-метрики, golden datasets, LLM-as-a-Judge, human evaluation, A/B-тесты Выстраивать observability: логи, трейсы, мониторинг качества, версионирование промптов и датасетов Контролировать retrieval-метрики (Hit Rate, MRR, NDCG@K), groundedness, уровень галлюцинаций Что мы от тебя ждем: Обязательно: Опыта создания агентов на современных фреймворках (LangChain, LangGraph, LlamaIndex и тд) Знания стратегий планирования AI-агентов (ReAct, Plan-and-Execute, Reflection и др.) Сильный prompt engineering + chain/tool/function calling Опыта работы с векторными БД (Weaviate, Pinecone, Qdrant, Milvus и др.) Опыта оценки качества LLM-систем (RAGAS, DeepEval, LLM-as-a-Judge или аналоги) Понимания агентских протоколов (MCP, A2A и тд) Linux, Git, Docker, Python Будет плюсом: Понимание атак на LLM (Prompt Injection, Jailbreaks) и защиты от них (Guardrails) Опыт дообучения моделей (LoRA/qLoRA) на специфических доменах Опыт квантизации и оптимизации инференса (ONNX, AWQ) Опыт с графовыми БД (Neo4j) и GraphRAG MLOps-инструменты: MLflow, Kubeflow, DVC Опыт с Kubernetes и высоконагруженными сервисами Что мы предлагаем: Комфортный офис в Бизнес-центре "Алкон", расположенном рядом с метро Сокол График работы с 09:00 до 18:00 для поддержания баланса между работой и личной жизнью, а гибридный формат и ДМС ждет тебя после успешного прохождения испытательного срока Испытательный срок длительностью 3 месяца для взаимной адаптации Работа с современными технологиями и инструментами Сильную и дружную команду профессионалов, готовых расти вместе с вами. Скидки на всю нашу крутую продукцию! Если ты готов к масштабному вызову, хочешь работать работать в команде, которая ценит профессионализм и инновации, — мы ждём тебя! "Градиент" — там, где технологии становятся стратегией.