Ведущий/старший инженер (Linux)
Описание
Группа Rubytech — лидирующий производитель программно-аппаратных комплексов и разработчик технологий для высоконагруженных ИТ-инфраструктур. Мы выпускаем собственную линейку ПАК Скала^р, а также строим и защищаем от киберугроз инфраструктуру, обеспечивая бесперебойную работу крупного бизнеса и государственных организаций. Вам предстоит: ИНФРАСТРУКТУРА И АДМИНИСТРИРОВАНИЕ• Развёртывание и поддержка высоконагруженных Linux инфраструктур (Oracle Linux, РедОС, Альт СП, Astra Linux) в bare metal и виртуализированных средах (KVM, Basis Dynamix, РЕД Виртуализация).• Построение и поддержка отказоустойчивых кластеров: Patroni/etcd, HAProxy/Keepalived, DRBD, Corosync/Pacemaker.• Управление дисковыми подсистемами: LVM, программный и аппаратный RAID, iSCSI, NFS, Raidix.• Настройка и поддержка сетевого стека: VLAN, bonding/teaming, маршрутизация (BGP/OSPF, FRR), iptables/nftables.• Виртуализация и контейнеризация: Docker, Podman, LXC/LXD, Kubernetes. АВТОМАТИЗАЦИЯ• Развёртывание инфраструктуры как код: Ansible, Terraform, Packer.• Создание bash‑скриптов для автоматизации рутинных операций (конфигурация и управление сервисами, сбор метрик, парсинг логов, отправка алертов и др.). МОНИТОРИНГ• Построение систем мониторинга: Prometheus + Grafana, VictoriaMetrics, Zabbix.• Построение дашбордов, алертинга, SLO/SLI, создание runbooks для дежурных инженеров.• Capacity planning: анализ нагрузки, прогнозирование ресурсов, планирование расширения. БЕЗОПАСНОСТЬ• Hardening ОС: SELinux, PAM, контроль привилегий.• Управление доступом и секретами: Keycloak, HashiCorp Vault, KMS.• Сетевая безопасность: сегментация, zero trust, TLS/mTLS. АРХИТЕКТУРА И ЛИДЕРСТВО• Глубокое погружение в архитектуру программно-аппаратных комплексов и инфраструктурных решений, понимание узких мест и точек отказа, разработка планов аварийного восстановления.• Техническое лидерство команды: ревью архитектурных решений, онбординг, менторство Middle и Junior инженеров.• Взаимодействие с командами разработки программно-аппаратных комплексов и командами проектов.• Участие в дежурствах (on call) и разбор инцидентов (postmortem). Требования к нашему кандидату: • Опыт: 5+ лет в Linux администрировании / DevOps / SRE, из которых минимум 2 года в роли Senior или ведущего инженера.• ОС: Глубокое понимание ядра Linux: systemd, cgroups v2, namespaces, eBPF, планировщики I/O и CPU, tuning sysctl, профилирование (perf, strace, bpftrace, flamegraphs).• Сетевой стек: Уверенное понимание TCP/IP, UDP, QUIC, DNS, DHCP, HTTP/2/3, gRPC; умение диагностировать сетевые проблемы на уровне пакетов (tcpdump, wireshark, mtr, ss).• Отказоустойчивость: Практический опыт построения HA кластеров (Patroni, Keepalived, Pacemaker, etcd), понимание split brain, quorum, fencing.• Автоматизация: Свободное владение Ansible (роли, плагины, Molecule тесты) и Terraform (модули, state management, провайдеры).• Контейнеры и оркестрация: Docker/Podman, Kubernetes (deployment, statefulsets, operators, RBAC, network policies), Helm чарты.• Мониторинг: Prometheus, Grafana, VictoriaMetrics, alerting rules, опыт построения систем логирования (Loki/ELK).• Скриптинг: Bash, Python — не только одноразовые скрипты, а поддерживаемые инструменты.• Безопасность: SELinux/AppArmor, аудит, управление доступом, понимание моделей угроз. • Самостоятельность: готовность взять проблему «от интерфейса до ядра» и довести до решения без микроменеджмента.• Системное мышление: видение инфраструктуры как единого целого, а не набора разрозненных компонентов.• Коммуникация: умение объяснить техническое решение нетехническим стейкхолдерам и защитить его перед командой.• Менторство: готовность передавать знания, проводить ревью, растить команду.• Стрессоустойчивость, критическое мышление, способность приоритизировать и распределять задачи в случае возникновения инцидента. Желательно: • Опыт работы с bare metal серверами: IPMI/BMC, PXE boot, UEFI, RAID контроллеры (MegaRAID, HPE Smart Array), прошивки BMC.• Опыт работы с СУБД (PostgreSQL, Picodata, Yandex DB).• Опыт миграции инфраструктуры (физической → виртуальной → контейнерной, или между платформами).• Опыт написания операторов Kubernetes (Go), кастомных Ansible модулей.• Знание FRR, BGP EVPN, VXLAN. Что мы предлагаем: Уютный, комфортный и современный офис в пешей доступности от м. Алексеевская, где есть все необходимое для работы и даже больше: дежурный врач, кафе и столовая, кофе и фрукты, фитнес-центр, коворкинг и многое другое. Стабильный и «белый» конкурентный доход, который мы обсудим при встрече; Удобный график — гибрид или офис (в зависимости от подразделения); Работа в аккредитованной ИТ-компании из реестра Минцифры (отсрочка от мобилизации); Профессиональный рост, обучение и развитие, участие в проекте «Лекторий Rubytech»; Развитые спортивные комьюнити: футбол, волейбол, баскетбол и шахматы; ДМС для вас и вашей семьи на особых условиях; Тимбилдинги, митапы и другие корпоративные мероприятия; Скидки у 500+ партнеров (платформы BestBenefits и Lerna). Ждем вас в нашей команде!