DevOps/SRE инженер
Описание
DevOps/SRE инженер в команду компании — технологическая платформа для управления строительством. Мы создаём автономного координатора строительного проекта, который помогает управлять проектом по факту, а не только по плану, и заменяет собой разрозненныетаблицы, мессенджеры и совещания. Продукт объединяет всех участников строительства в единую цифровую среду, автоматизирует контроль сроков, качества и исполнения работ, помогая управлять проектом в режиме реального времени. Технологический стек: Yandex.Cloud, Kubernetes, Gitlab CI, PostgreSQL, CI/CD для Golang, CI/CD для React Native, Vault, Victoria Metrics, Grafana, OpenSearch, Jira, Confluence Обязанности: Настройка облачных провайдеров, построение Kubernetes кластера, автоматизация, IaC Построение и поддержка Cloud архитектурного решения Оформление технической документации в части системного администрировании Настройка мониторинга, аллертинга, логгирования Построение CI/CD pipeline Прямая поддержка сервиса во время развертывания и общего производства Подготовка документации для процедуры развертывания Решение задач по сборке деплоя Сопровождение и мониторинг процесса развертывания Контроль бесперебойной работы всех инструментов: репозитариев кода, CI/CD-систем, средств для контейнеризации Изучение и сбор новых технологий и связанных с ними инструментов с целью развития в команде среды гибкой разработки Управление политиками доступа Оптимизация работы системного ПО Анализ ошибок возникающих в системном ПО 3 линия поддержки в части системного администрирования Требования Обязательно (продвинутый или профессиональный уровень): Администрирование ОС (навык работы с UNIX-based OS) Создание и администрирование кластеров Kubernetes Опыт работы с helm, terraform CI/CD (навык автоматизации сборки и поставки) Управление конфигурациями (инструмент автоматизации развертывания и управления конфигурациями Ansible, Chef, Puppet) Навык работы с контейнерами Навык написания сценариев для различных средств автоматизации: bash, powershell, shell, python и т.п. Навык работы с инструментами оркестрации Навык работы с хранилищами: Nexus, Artifactory, Harbor Работа с системами контроля версий Понимание принципов и умение обеспечить High Availability и Fault Tolerance Опыт управления инцидентами (мониторинг, алертинг, исправление, постмортем, митигация рисков) Навыки работы с базами данных Желательно: Работа со статическими анализаторами Навыки работы с процессами и инструментами обеспечения безопасности Навыки работы с большими данными (BigData) Навыки тестирования Условия: Официальное трудоустройство с первого дня Конкурентная заработная плата, обсуждаемая индивидуально Испытательный срок — 3 месяца 8-часовой рабочий день, начало в 10:00–11:00 (МСК). Рассматриваем кандидатов с разницей до ±4 часов. Формат работы — удаленный или гибридный ДМС с первого месяца работы Компенсацию профильного обучения Аккредитованная IT-компания (Минцифры РФ). Продукт уже прошел пилоты на крупных строительных проектах Сильную инженерную команду с опытом реализации федеральных проектов Продукт высокого технологического уровня с амбициозной задачей — не MVP, а платформа, способная изменить подход к управлению строительством При отклике, пожалуйста, укажите ваш опыт релевантный вакансии!