Ведущий DevOps-инженер
Описание
Сейчас мы расширяемся и ищем в команду Ведущего DevOps-инженера. Чем предстоит заниматься: сопровождать и развивать инфраструктуру закреплённого проекта, обеспечивать безопасный перенос изменений между окружениями; находить узкие места в производительности, надёжности и безопасности по всей цепочке сервиса: Linux, виртуальные машины, Kubernetes, Cloudflare, Nginx, PostgreSQL, ClickHouse, Kafka и Redis. Подтверждать выводы метриками и журналами; планировать масштабирование, оптимизировать использование ресурсов и расходы на инфраструктуру. Предлагать развитие текущих технологий и альтернативы, оценивать эффект и риски; значимые решения согласовывать с техническим руководителем; готовить обновления, миграции и другие плановые работы: оценивать сроки, согласовывать окна обслуживания, составлять план выполнения и отката, проверять результат; развивать CI/CD и автоматизацию с помощью GitLab CI/CD, Ansible и Terraform; улучшать мониторинг и оповещения на базе Prometheus, Grafana и Zabbix; улучшать управление доступами, резервное копирование и восстановление; проверять работоспособность механизмов восстановления; диагностировать инциденты, участвовать в восстановлении сервисов и устранять причины повторных сбоев; планировать свои задачи, поддерживать техническую документацию и кратко фиксировать ход работ, результаты и риски; взаимодействовать с разработчиками и подрядчиками. Наши ожидания: от 5 лет практической эксплуатации production-инфраструктуры в роли DevOps или системного инженера; опыт самостоятельной ответственности за проект или крупное направление: планирование изменений, развитие инфраструктуры, инциденты и проверка восстановления; личные примеры масштабирования систем, устранения сложных проблем на стыке компонентов и оптимизации ресурсов и расходов; уверенная диагностика Linux, сети и пути запроса через балансировщик к приложению; практический опыт с Kubernetes и виртуальными машинами; работа с GitLab CI/CD, Ansible, Terraform, мониторингом и журналами; практический опыт эксплуатации PostgreSQL, ClickHouse, Kafka и Redis: диагностика сбоев и ограничений, оценка нагрузки, безопасные изменения и восстановление; понимание Nginx/HAProxy, резервного копирования, управления доступами и секретами; умение самостоятельно оценить технические варианты, составить план масштабирования или изменения, согласовать его и довести до проверенного результата. Будет плюсом: опыт с Cloudflare, Vault, Sealed Secrets, ELK/Loki и применением SLI/SLO. Мы предлагаем: формат работы: гибрид или удаленка; предлагаем атмосферу молодой компании, гибких процессов и прозрачности; оформляем по ТК РФ и всё, что с этим связано; предоставляем ДМС после испытательного срока, а еще у нас есть корпоративный врач; поддерживаем стремление к развитию: корпоративные скидки на обучение от партнеров; доверяем: есть возможность взять 3 дня в квартал по болезни, без официального подтверждения; работаем 5/2, гибкий старт дня с 09:00 до 11:00; находимся в шаговой доступности от м. Василеостровская или м. Спортивная-2, в офисе есть всё необходимое для отличной рабочей жизни.