Эксплуатировать инженерные системы ЦОД: ИБП, дизель-генераторные установки, прецизионное охлаждение, пожарную сигнализацию и пожаротушение, системы физической безопасности и мониторинга среды (Vutlan, NetBotz).
Организовывать и контролировать плановое техническое обслуживание, вести журналы ТО, управлять подрядчиками по электрике, холодоснабжению, пожарной и физической безопасности площадки.
Планировать ёмкость дата-центра электрическую мощность, охлаждение, стоечное пространство и обеспечивать соответствие критериям Uptime Tier III.
Развивать стек наблюдаемости (Zabbix, Prometheus, Grafana, Loki, Tempo, OpenTelemetry): дашборды, правила сбора и алертинга, сценарии корреляции событий, синтетический мониторинг. Разрабатывать роли и плейбуки Ansible, модули Terraform/OpenTofu, образы Packer; участвовать в пайплайнах CI/CD и GitOps-процессах, автоматизировать рутинные операции.
Расти вместе со старшими инженерами в сетевых задачах: коммутация, VLAN/VRF, QoS, OSPF/BGP, DWDM, межсетевые экраны совместно со службой информационной безопасности; участвовать в расширении региональной телеком-сети.
Подключаться к задачам по виртуализации (zVirt, Proxmox VE, Kubernetes), системам хранения (enterprise-СХД, Ceph) и резервному копированию, включая тестовые восстановления и контроль RPO/RTO.
Требования
Опыт от 2 лет в одной из специализаций: эксплуатация инженерных систем ЦОД, системное или сетевое администрирование, виртуализация, системы хранения данных, мониторинг или DevOps.
Высшее или среднее профессиональное образование по направлениям Информатика и вычислительная техника, Инфокоммуникационные технологии и системы связи, Программная инженерия или Электроэнергетика и электротехника .
Linux на уровне администратора и базовые навыки автоматизации Ansible и скрипты на Python или Bash.
Практический опыт хотя бы с одной системой мониторинга Zabbix, Prometheus или Grafana.
Готовность погружаться в инженерные системы ЦОД (питание, охлаждение, пожарная безопасность) на уровне контроля и координации с подрядчиками технической глубине обучим на месте.
Будет плюсом: Группа по электробезопасности не ниже III или готовность её оформить.
Опыт эксплуатации инженерных систем ЦОД: ИБП, дизель-генераторные установки, прецизионное охлаждение.
Опыт работы по стандарту Uptime Tier III / ГОСТ Р 58811-2020 и планирования ёмкости (capacity planning).
Понимание коммутации и сегментации сетей (VLAN, VRF), протоколов маршрутизации (OSPF, BGP), платформ виртуализации (zVirt, Proxmox VE) и Kubernetes; профильные сертификации (например, CCNA) плюс.
Опыт с enterprise-СХД и Ceph, системами резервного копирования (Кибер Бэкап, Veeam, Exagrid).
Опыт с Terraform/OpenTofu, GitLab CI и GitOps; ведение учёта активов в NetBox.
Работа с системами мониторинга среды (Vutlan, NetBotz) и подсистемами внеполосного управления (iLO, iDRAC).
Базовое понимание требований 187-ФЗ (КИИ), 152-ФЗ и профильных требований регуляторов в сфере ИБ.
Чтение технической документации на английском языке.
Квалификация
Опыт от 2 лет в одной из специализаций: эксплуатация инженерных систем ЦОД, системное или сетевое администрирование, виртуализация, системы хранения данных, мониторинг или DevOps