Системный администратор SRE
Описание
ПерилаГлавСнаб — производственно-строительная компания полного цикла, которая с 2008 года растёт на высококонкурентном рынке и усиливает позиции в своём сегменте. Мы не просто удержались на рынке — за эти годы мы обогнали десятки конкурентов, масштабировались из 1 филиала в 7 и стали лучшим игроком на рынке в направлении комплектующих, производства и монтажа. Среди наших объектов — «Лужники», парк «Зарядье», ВТБ Арена, Парк Победы, учебно-лабораторный комплекс МИЭМ и другие проекты, где требования к срокам, качеству и исполнению изначально высокие. Сейчас мы усиливаем ИТ-инфраструктуру и ищем не классического системного администратора «починить компьютер», а инфраструктурного инженера уровня Senior / Senior+ с сильным уклоном в SRE, безопасность, сети, backup/restore, Ansible, Terraform, IaC, Git, LLM-инструменты и документацию. Важно: практический опыт Ansible и Terraform обязателен. Без этого опыта кандидата не рассматриваем. Что будет на старте: Доход: оклад 200 000 руб. + KPI до 50 000 руб. Оформление: официальное трудоустройство по ТК РФ с первого рабочего дня. Заработная плата: полностью белая. График: 5/2, понедельник–пятница, с 9:00 до 18:00. Технологические окна: для критичных инфраструктурных работ возможны заранее согласованные работы вне основного графика, включая вечер пятницы или выходные. Инструменты: корпоративная связь, рабочее место, доступ к необходимым системам и инструментам. Уровень задач: инфраструктура, безопасность, автоматизация, AI/LLM-проекты, тестовые контуры, документация и повышение надежности систем. Чем предстоит заниматься: Инфраструктура и автоматизация Работать с Ansible: playbook’и, настройка серверов, сервисов, рабочих мест, типовых операций. Работать с Terraform: описание и сопровождение инфраструктуры как кода. Использовать Git для хранения конфигураций, контроля изменений и откатов. Переводить ручные операции в скрипты, образы, шаблоны, инструкции. Разворачивать и восстанавливать окружения воспроизводимо, а не вручную. Автоматизировать установку и настройку ОС, серверов, сервисов и тестовых контуров. Сети и безопасность Администрировать корпоративные сети. Работать с VLAN, routing, NAT, firewall, DNS, DHCP. Настраивать и сопровождать VPN: WireGuard, OpenVPN. Работать с MikroTik, pfSense или аналогичными решениями. Проверять сетевую сегментацию и доступность сервисов. Находить и закрывать уязвимости на сетевом уровне. Приоритизировать результаты аудита безопасности: что закрывать первым, почему и каким способом. Настраивать мониторинг трафика, алерты, журналирование и базовые защитные инструменты. Backup, restore, rollback, disaster recovery Настраивать и контролировать резервное копирование. Проверять восстановление, а не только наличие копий. Работать с горячими, холодными и офлайн-бэкапами. Участвовать в физической работе с оборудованием: диски, носители, серверы. Готовить сценарии восстановления после сбоя. Описывать процедуры rollback для критичных изменений. Планировать работы в ограниченные технологические окна. Серверы, виртуализация и ОС Администрировать Windows Server и Linux. Работать с физическим серверным оборудованием. Поддерживать и развивать виртуализацию: VMware ESXi, Proxmox VE или аналоги. Переносить, восстанавливать и сопровождать виртуальные машины. Контролировать состояние серверов, дисков, ресурсов, обновлений и жизненного цикла оборудования. Участвовать в подборе серверов, рабочих станций и комплектующих под задачи бизнеса. Корпоративные сервисы Администрировать Active Directory, GPO, пользователей, группы и права доступа. Сопровождать инфраструктурный контур 1С, Bitrix24, Битрикс: Управление сайтом, Confluence. Готовить тестовые копии систем. Проверять обновления до внедрения. Описывать тест-кейсы для проверки изменений: создать объект, изменить, удалить, экспортировать, проверить права, проверить откат. Участвовать в безопасной интеграции внутренних систем через API и коннекторы. AI / LLM / вайб-кодинг Использовать LLM-инструменты в ежедневной инженерной работе. Применять ИИ для анализа логов, конфигов, генерации скриптов, документации и чек-листов. Понимать риски автономных AI-агентов, которые пишут или исполняют код. Проектировать изолированные среды для AI-агентов. Помогать безопасно подключать AI-инструменты к внутренним системам через тестовые контуры, ограниченные права и контролируемые доступы. Участвовать в инфраструктуре под LLM-проекты, Neo4j, PostgreSQL, внутренние интеграции и MCP-коннекторы. Управление доступами и секретами Наводить порядок в доступах, ролях, правах и учетных записях. Настраивать безопасное хранение паролей, токенов, ключей и конфигов. Работать с secret management-подходом. Понимать Kubernetes secrets или аналогичные механизмы управления секретами. Контролировать, чтобы пароли, токены и ключи не хранились в открытом виде в файлах, репозиториях и чатах. Мониторинг и инциденты Работать с Zabbix, Grafana или аналогичными системами мониторинга. Настраивать метрики, алерты и дашборды. Разбирать инциденты до root cause, а не только устранять симптомы. После инцидента внедрять изменения, чтобы проблема не повторялась. Документировать причину, решение, проверку и профилактику. Документация и передача знаний Вести карту инфраструктуры. Описывать серверы, сервисы, зависимости, доступы, конфигурации, backup/restore, rollback. Создавать инструкции, runbook’и, playbook’и, чек-листы. Использовать LLM для ускорения документации, но проверять результат технически. Классический контур системного администратора Учет оборудования. Подбор и жизненный цикл техники. Настройка рабочих мест. Поддержка пользователей. Сопровождение VDI, видеонаблюдения, IP-камер, Ivideon или используемой системы видеонаблюдения. Что мы ожидаем: Опыт работы системным администратором, SRE, DevOps, DevSecOps, инфраструктурным инженером или специалистом по безопасности от 5 лет. Практический опыт Ansible. Практический опыт Terraform. Понимание Infrastructure as Code. Уверенный опыт работы с Git. Глубокое понимание сетей: TCP/IP, VLAN, routing, NAT, firewall, VPN, DNS, DHCP. Опыт работы с firewall, VPN, сегментацией сети и мониторингом трафика. Опыт закрытия инфраструктурных и сетевых уязвимостей. Опыт проведения или сопровождения аудитов безопасности Умение приоритизировать уязвимости и объяснять, почему одни риски закрываются раньше других. Опыт с Windows Server, Linux, Active Directory, GPO и правами доступа. Опыт с VMware ESXi, Proxmox VE или аналогами. Опыт настройки backup / restore / disaster recovery. Опыт проверки восстановления из бэкапов. Понимание offline / cold backup-подхода. Опыт работы с мониторингом: Zabbix, Grafana или аналоги. Умение документировать инфраструктуру и изменения. Готовность использовать LLM / ИИ-инструменты в работе. Самостоятельность: способность взять зону ответственности целиком и довести ее до результата без постоянного контроля.