Главный инженер Центра эксплуатации и развития ИТ-инфраструктуры
Описание
Научно-технологический университет «Сириус» собирает звёздную команду из талантливых и амбициозных ученых. «Сириус» предлагает новую, прогрессивную модель исследовательского университета, в котором создаются все условия для реализации прорывных идей и проектов. Руководство Научно-технологического университета «Сириус» исходит из того, что кадровый потенциал – основополагающая ценность организации, и обеспечивает своих сотрудников передовым оборудованием мирового класса и комфортными условиями для жизни. В качестве приоритетных направлений научно-исследовательской и образовательной деятельности в Университете «Сириус» определены: генетика и науки о жизни искусственный интеллект и информационные технологии когнитивные исследования трансляционные биомедицинские исследования экология и исследования климата Мы приглашаем присоединиться к нашей команде! Требования: Высшее техническое образование Опыт администрирования продакшн сервисов на Linux от 3-х лет Опыт администрирования серверной инфраструктуры от 3-х лет Наличие сертификатов ДПО по операционным системам и сервисам, основанным на Linux будет преимуществом Понимание принципов работы сети передачи данных на уровне администратора Понимание принципов работы систем хранения данных на уровне администратора Понимание принципов работы операционных систем на базе ядра Linux на уровне администратора Уверенные знания: Linux (Debian/Ubuntu/AstraLinux). Уверенное владение командной строкой, понимание работы systemd, управление пакетами, диагностика проблем Понимание TCP/IP, умение настраивать SSH (ключи, ограничение по IP, отключение паролей), базовое понимание работы VPN Опыт настройки Nginx/Apache, понимание работы PHP-FPM, базовые навыки работы с PostgreSQL (бэкапы, восстановление, простые запросы) и Redis Умение читать и писать простые плейбуки Ansible Понимание основ LVM, RAID, умение работать с разметкой дисков и файловыми системами Понимание принципов работы Check Point / IPSec Опыт администрирования SLURM Опыт работы с Ceph (понимание архитектуры, CRUSH map, работа с OSD) будет преимуществом Обязанности: Поддержка пользователей и HPC-кластера: - Мониторинг очередей задач в SLURM, помощь исследователям/студентам с запуском задач - Разработка и актуализация инструкций для администраторов и студентов Поддержка инфраструктуры и сервисов: - Сопровождение production-инстансов (LEMP-стек: Nginx, PHP 8.3, PostgreSQL, Redis, Docker) - Мониторинг состояния кластера Ceph (контроль OSD, дисков, multipath), помощь в миграциях и обслуживании - Написание и поддержка плейбуков Ansible для автоматизации рутины (настройка Zabbix-агентов, развертывание сервисов) Осуществление мониторинга и безопасности: - Отслеживание алертов в Zabbix, реагирование на инциденты (отказ дисков, падение сервисов, спонтанные перезагрузки) - Базовое администрирование сетей и VPN (Check Point SNX, IPSec, SSH) Условия: Официальное оформление Проживание для иногородних, при наличии мест Служебный транспорт Корпоративные спортивные мероприятия Программы дополнительного образования Концерты для работников и их семей