Старший backend-инженер вычислительной платформы
Описание
Чем предстоит заниматься Разрабатывать backend-сервисы преимущественно на Go. Реализовать API для запуска, управления и мониторинга вычислительных задач. Разрабатывать интеграцию backend со Slurm. Реализовать полный lifecycle задач: submit, queue, run, status, logs, cancel, failure handling, result. Преобразовывать высокоуровневый запрос пользователя в спецификацию вычислительной задачи. Интегрировать платформу с реестром моделей и контейнеров. Работать с S3 и файловыми хранилищами. Разрабатывать проекты, квоты, accounting и политики использования ресурсов. Работать с PostgreSQL. Использовать Kafka или другие механизмы асинхронного взаимодействия там, где они действительно нужны. Разрабатывать CLI и Python SDK. Участвовать в реализации Jupyter и интерактивных вычислительных сценариев. В дальнейшем разрабатывать API для интеграции HPC-вычислений в production-пайплайны компании. Писать интеграционные и end-to-end тесты. Участвовать в code review и архитектурных решениях. Совместно с HPC- и SRE-инженерами разбирать production-проблемы. Что мы ожидаем Сильный опыт backend-разработки от 4 лет. Уверенный Go. PostgreSQL и SQL. Опыт разработки и поддержки production REST API. Хорошее понимание распределенных систем. Понимание транзакций, конкурентности, retries, idempotency и eventual consistency. Опыт построения систем с длительными асинхронными задачами. Опыт интеграции с внешними API и сервисами. Docker/OCI. Базово сильный Linux. Понимание сетевого взаимодействия. Опыт CI/CD и эксплуатации production-сервисов. Способность самостоятельно доводить техническую задачу от идеи до production.