Senior DevOps
Описание
Мы активно растем и развиваемся, сейчас ищем Senior DevOps, который сможет развивать и поддерживать инфраструктуру и актуальные инженерные практики. Чем предстоит заниматься: сопровождать и развивать инфраструктуру закреплённого проекта, обеспечивать безопасный перенос изменений между окружениями; находить узкие места в производительности, надёжности и безопасности по всей цепочке сервиса: Linux, виртуальные машины, Kubernetes, Cloudflare, Nginx, PostgreSQL, ClickHouse, Kafka и Redis. Подтверждать выводы метриками и журналами; планировать масштабирование, оптимизировать использование ресурсов и расходы на инфраструктуру; предлагать развитие текущих технологий и альтернативы, оценивать эффект и риски; готовить обновления, миграции и другие плановые работы: оценивать сроки, согласовывать окна обслуживания, составлять план выполнения и отката, проверять результат; развивать CI/CD и автоматизацию с помощью GitLab CI/CD, Ansible и Terraform; улучшать мониторинг и оповещения на базе Prometheus, Grafana и Zabbix; улучшать управление доступами, резервное копирование и восстановление, проверять работоспособность механизмов восстановления; диагностировать инциденты, участвовать в восстановлении сервисов и устранять причины повторных сбоев; планировать свои задачи, поддерживать техническую документацию и кратко фиксировать ход работ, результаты и риски. Взаимодействовать с разработчиками и подрядчиками. Наши ожидания: от 5 лет опыта в роли DevOps / Системный инженер; опыт самостоятельной ответственности за проект или крупное направление: планирование изменений, развитие инфраструктуры, инциденты и проверка восстановления; личные примеры масштабирования систем, устранения сложных проблем на стыке компонентов и оптимизации ресурсов и расходов. уверенная диагностика Linux, сети и пути запроса через балансировщик к приложению; практический опыт с Kubernetes и виртуальными машинами; работа с GitLab CI/CD, Ansible, Terraform, мониторингом и журналами; практический опыт эксплуатации PostgreSQL, ClickHouse, Kafka и Redis: диагностика сбоев и ограничений, оценка нагрузки, безопасные изменения и восстановление; понимание Nginx/HAProxy, резервного копирования, управления доступами и секретами; умение самостоятельно оценить технические варианты, составить план масштабирования или изменения, согласовать его и довести до проверенного результата. Будет преимуществом: опыт с Cloudflare, Vault, Sealed Secrets, ELK/Loki и применением SLI/SLO. Что мы предлагаем: формат работы: гибрид или удаленка; предлагаем атмосферу молодой компании, гибких процессов и прозрачности; оформляем по ТК РФ и всё, что с этим связано; предоставляем ДМС после испытательного срока, а еще у нас есть корпоративный врач; поддерживаем стремление к развитию: корпоративные скидки на обучение от партнеров; доверяем: есть возможность взять 3 дня в квартал по болезни, без официального подтверждения; работаем 5/2, гибкий старт дня с 09:00 до 11:00; находимся в шаговой доступности от м. Василеостровская или м. Спортивная-2, в офисе есть всё необходимое для отличной рабочей жизни.