Все вакансии России 0

Младший системный инженер (Ceph)

з/п не указана
Лаборатория Касперского
Москва Постоянная занятость Полный день

Описание

Мы — отдел платформенных сервисов. Отвечаем за приватное облако на базе OpenStack и распределённое хранилище Ceph, которое обслуживает блочный (RBD) и объектный (S3/RadosGW) доступ для сотен виртуальных машин и внутренних сервисов. Наша команда — третья линия поддержки этой инфраструктуры: к нам приходят инциденты, которые не смогли закрыть на первой и второй линиях. Хранилище работает 24/7, поэтому команда несёт дежурство в режиме on-call. Ищем начинающего инженера, который вырастет в сильного специалиста по SDS под менторством команды. Чем предстоит заниматься: Помогать в администрировании действующих кластеров Ceph и участвовать в развёртывании новых нод (OSD/MON/MGR/RGW). Сопровождать сервис хранения с доступом по RBD и S3: заводить пулы, бакеты, пользователей, ключи и политики доступа. Работать в составе третьей линии поддержки: принимать эскалации по инцидентам, связанным с хранилищем, проводить диагностику по рунбукам, локализовать и устранять проблему, при необходимости эскалировать senior-инженерам. Участвовать в дежурствах on-call по графику: быть на связи по телефону, реагировать на алерты и критичные инциденты вне рабочих часов. Настраивать и поддерживать мониторинг кластеров (Prometheus + Grafana), участвовать в разборе инцидентов и пополнении базы рунбуков. Автоматизировать рутинные операции с помощью Ansible/Juju, писать вспомогательные скрипты на Bash/Python. Участвовать в патч-менеджменте, плановых обновлениях и нагрузочном тестировании хранилищ. Вести и актуализировать эксплуатационную документацию. Чего мы ожидаем от кандидата: Уверенное администрирование Linux (Ubuntu/Debian): процессы, systemd, диски и файловые системы, логи, диагностика. Понимание сетевых основ: IP, маршрутизация, VLAN, диагностика связности. Понимание разницы между блочным, файловым и объектным хранением. Базовое понимание архитектуры Ceph и её отказоустойчивости — назначение MON, OSD, MGR, RGW (хотя бы на уровне теории). Навыки скриптинга на Bash и/или Python, умение работать с Git. Готовность участвовать в дежурствах on-call по графику, собранность и хладнокровие при разборе инцидентов, умение действовать по инструкции и вовремя эскалировать. Аккуратность, самостоятельность в поиске решений, готовность быстро учиться. Будет плюсом: Практический опыт с bare-metal или виртуальными серверами. Знакомство с Ceph на практике (домашняя лаба, pet-проект) — cephadm, CRUSH-map, работа с RBD/RGW. Понимание S3-совместимого объектного хранилища: бакеты, объекты, access/secret-ключи, IAM-подобные политики. Базовое знакомство с OpenStack, Kubernetes или подходом IaC (Ansible/Terraform/Juju). Опыт работы на линиях техподдержки или участия в дежурствах on-call. Опыт с observability-стеком (Grafana, Loki, ELK).

Откликнуться
Источник: hh · 13.08.2026

Похожие вакансии в городе Москва

Все вакансии в городе Москва →