Ведущий инженер DevOps
Описание
Обязанности: •Развёртывание и эксплуатация продуктовых систем компании во всех средах: prod, stage, test, qa, demo. •Настройка, развитие и сопровождение CI/CD-пайплайнов для backend-сервисов (.NET), web-frontend, Node.js-сервисов и мобильных приложений (iOS/Android), включая подпись и публикацию в магазины приложений. •Сопровождение self-hosted GitLab, GitLab Runner и Container Registry: обновления, бэкапы, восстановление, производительность, права доступа. •Эксплуатация контейнерной платформы на Docker Swarm: деплой сервисов, конфигурации и секреты, сетевой слой, обратный прокси (Traefik/nginx), TLS-сертификаты. •Обеспечение воспроизводимости и единообразия окружений, контроль отличий между средами. •Автоматизация инфраструктуры как кода (Ansible, Terraform или аналоги), отказ от ручных правок на серверах. •Построение и сопровождение мониторинга, логирования и алертинга (Grafana, Prometheus, Loki, Alertmanager): SLO/SLI для продуктовых систем, дашборды, дежурные уведомления. Организация резервного копирования и регулярной проверки восстановления для PostgreSQL, MinIO, GitLab и конфигураций. •Эксплуатация инфраструктурных компонентов платформы: PostgreSQL, Kafka, RabbitMQ, MinIO, Keycloak, Redis, включая обновления и миграции. •Работа с облачной инфраструктурой (Yandex Cloud: Cloud Functions, API Gateway, Object Storage, DNS) и GitHub Actions для облачных сервисов. •Внедрение практик безопасности в поставку: SAST/SCA, secret scanning, сканирование образов, управление секретами, ротация ключей, минимизация привилегий. •Подготовка и сопровождение runbook по каждой системе: перезапуск, откат, диагностика, восстановление после сбоя; участие в разборе инцидентов и постмортемах. •Участие в проектировании архитектуры новых цифровых сервисов с точки зрения деплоя, отказоустойчивости, наблюдаемости и стоимости эксплуатации. •Совместная с разработчиками настройка quality gates в CI/CD и стандартов ветвления, релизов и версионирования. Требования: Высшее образование в области информационных технологий, прикладной математики, программной инженерии, автоматизации, вычислительной техники или смежных технических направлений Опыт работы не менее 5 лет в ИТ-инфраструктуре или разработке, из них не менее 3 лет в роли DevOps/SRE-инженера с ответственностью за production Дополнительное профильное обучение по разработке ПО, архитектуре, DevOps, cloud, тестированию или ИБ будет преимуществом Опыт построения DevOps-практик с нуля в небольшой команде: стандарты, пайплайны, мониторинг, runbook, а не только поддержка готового Опыт работы с распределённой по нескольким площадкам инфраструктурой (несколько хостинг-провайдеров плюс публичное облако) Опыт организации дежурства и реагирования на инциденты, проведения постмортемов Опыт проверенного восстановления из бэкапов, а не только их настройки. Опыт эксплуатации .NET-сервисов в Linux-контейнерах: диагностика производительности, память, health checks, graceful shutdown. Готовность работать в компактной команде рядом с разработчиками, участвовать в проектировании и code review инфраструктурной части.Умение документировать системы понятно для коллег и аргументировать технические решения. Будет преимуществом опыт работы в корпоративной среде с повышенными требованиями к ИБ, traceability и релизному контролю. Условия: Субсидирование ипотечного кредитования Льготные путевки в собственный санаторий Ежегодная индексация Расширенная ДМС (после испытательного срока) Корпоративная программа пенсионного обеспечения Дополнительные выплаты: поддержка многодетных родителей, выплата при рождении ребенка Офис в пешей доступности от станции Сколково Корпоративный транспорт от м. Тропарево и от м. Новопеределкино График работы: с 8:30 до 17:00, пятница до 16:00