Старший DevOps-инженер
Описание
Формат работы: full-time (пн-пт), гибрид: 3 дня удаленно, 2 дня в офисе (м. Шоссе Энтузиастов). Приятные моменты: Команда коллег с высоким уровнем компетенций и ориентацией на результат (5 человек в команде). Работа в штате надежного работодателя, все соц. гарантии, слаженная работа в дружеской обстановке. Собственные медицинские центры, скидка 50% на наши услуги для вас и прямых родственников, предоставление оплачиваемых дней по семейным событиям, спортивные тренировки и мероприятия. Что мы ожидаем от вас: Диплом о высшем образовании, опыт работы на аналогичной позиции от 3-х лет. РЕД ОС (RedOS) или аналогичные системы — уверенное владение, развёртывание, настройка, администрирование, работа с подсистемой аудита и средствами защиты информации (соответствие требованиям ФСТЭК, 4 уровень доверия). Debian/Ubuntu, CentOS/Rocky (и аналогичные RPM-based дистрибутивы) — продвинутый уровень, администрирование production-среды; Docker, Docker Compose — уверенное владение, создание и оптимизация собственных образов (multi-stage сборки); Kubernetes, Helm — желательно: понимание компонентов кластера, деплоймент приложений, диагностика; Cilium (CNI/eBPF) — желательно: настройка сетевых политик, балансировка, наблюдаемость (Hubble); Longhorn — желательно: распределённое блочное хранилище, управления PV, снапшоты, репликация, бэкапы. GitLab CI — уверенное владение: проектирование, разработка и сопровождение пайплайнов; ArgoCD — желательно: GitOps-подход; Git — уверенное владение: ветвление, merge-request, code review. Nginx — уверенное владение: reverse-proxy, балансировка, TLS/SSL, проксирование веб-приложений. PostgreSQL — хорошее понимание: развёртывание, конфигурирование, резервное копирование и восстановление, репликация, мониторинг, базовая оптимизация запросов; Redis — уверенное владение: развёртывание, конфигурирование, очереди, мониторинг; RabbitMQ — уверенное владение: развёртывание, конфигурирование, очереди, мониторинг; ELK (Elasticsearch, Logstash, Kibana) — уверенное владение: сбор и анализ логов; Bash — уверенное владение; Python — опыт написания скриптов автоматизации; Jira, системы класса Service Desk — желательно: ведение задач, тикетов, взаимодействие в рамках ITSM-процессов. Vault, Consul, Packer. Чем предстоит заниматься: 1. Написание и оптимизация Dockerfile, сборка собственных Docker-образов (в т.ч. multi-stage сборки, уменьшение размера и повышение безопасности образов). 2. Проектирование, разработка и сопровождение CI/CD-пайплайнов на базе GitLab CI: - Автоматизация сборки, тестирования и доставки приложений в тестовые и production-окружения. - Развёртывание, настройка и сопровождение сервисов с использованием Docker и Docker Compose (Redis, RabbitMQ, MinIO, PostgreSQL, Nginx и др.). - Администрирование Linux-серверов на уровне production: развёртывание и обновление ОС, диагностика (в т.ч. на уровне процессов, памяти, сети), тюнинг производительности, обеспечение безопасности. - Настройка и сопровождение Nginx в качестве веб-сервера и reverse-proxy, работа с DNS (настройка записей и зон, диагностика проблем разрешения имён). - Администрирование PostgreSQL: развёртывание, конфигурирование, резервное копирование и восстановление, контроль производительности и репликации. - Работа с облачными платформами МТС (MTS Cloud / МТС Web Services) и/или Yandex Cloud: развёртывание и сопровождение облачной инфраструктуры, управление ресурсами, сетями, хранилищами и доступом. - Участие в регламентных работах, обновлениях и плановых технических окнах. - Обеспечение бесперебойной работы и отказоустойчивости сервисов: контроль доступности, стабильности и производительности в production-среде. - Проактивное выявление узких мест (bottlenecks), оптимизация производительности и capacity planning: прогнозирование нагрузки и планирование ресурсов. - Снижение рутинного труда (toil reduction) и автоматизация операционных задач (bash, Python, IaC). - Разработка и актуализация runbooks, инструкций и базы знаний для команд поддержки (L1/L2). - Участие в ревью и поддержании актуальности планов аварийного восстановления (DRP). - Взаимодействие с командами разработки: помощь в отладке, оптимизации процессов доставки, консультации по Dockerfile, GitLab CI и лучшим практикам надёжности. - Управление секретами и доступами, поддержка тестовых и production-окружений.