DevOps/SRE-инженер
Описание
ООО "Версус" — высокоэффективная IT компания, разрабатывающая программные и технологические продукты для беспилотной сферы на российском и международном рынке. Мы ищем сильного DevOps/SRE-инженера, который поможет развивать надежную, управляемую и автоматизированную IT-инфраструктуру. Эта роль подойдет специалисту, который умеет системно смотреть на сервисы, снижать ручную нагрузку, повышать стабильность и участвовать в развитии инженерных процессов. Работа только в офисе г.Ижевск, удаленного формата нет. Чем предстоит заниматься: Обеспечивать надежную и стабильную работу критически важных сервисов. Участвовать в развитии инфраструктуры и повышении ее отказоустойчивости. Настраивать и улучшать мониторинг, алертинг и аналитику инцидентов. Работать с метриками доступности и надежности, участвовать в формировании и контроле SLO/SLI. Анализировать инциденты, участвовать в postmortem и внедрять меры по предотвращению повторных сбоев. Автоматизировать рутинные инфраструктурные операции и снижать объем ручной поддержки. Развивать процессы взаимодействия между инфраструктурой и командами разработки. Участвовать в проектировании, сопровождении и улучшении CI/CD и релизных процессов. Вести и поддерживать техническую документацию. Работать с серверной и сетевой инфраструктурой при необходимости, включая Linux, Windows Server и виртуализацию. Участвовать в планировании развития инфраструктуры и технических изменений. Что важно для нас: Опыт работы в инфраструктуре, DevOps или SRE от 5–6 лет. Уверенное понимание принципов DevOps/SRE, надежности сервисов и подходов к incident management. Опыт работы с мониторингом, логированием, алертингом и трассировкой. Знание и практическое применение Git, Terraform и Ansible. Опыт автоматизации инфраструктуры с помощью скриптов или конфигурационного управления. Понимание сетевых основ: DHCP, DNS, VLAN, модель OSI. Опыт администрирования Linux, Windows Server и виртуализационной среды. Практика работы с корпоративной инфраструктурой, AD, SSO и сетевым оборудованием будет плюсом. Умение разбирать инциденты, находить первопричины и доводить улучшения до результата. Готовность работать в офисном формате, а частично удаленно — по согласованию. Будет плюсом: Опыт с Prometheus, Grafana, Loki, ELK/OpenSearch, Jaeger или OpenTelemetry. Практика работы с PagerDuty, Opsgenie или другими системами алертинга и эскалации. Опыт построения runbooks, postmortem-процессов и incident response. Навыки написания скриптов на Bash, Python или PowerShell. Опыт работы с Docker, Hyper-V, Proxmox. Опыт настройки LLM на Bare Metal. Опыт настройки MikroTik, FortiGate, WRT, Unify. Знание VLESS, XRAY; Понимание внутренней инфраструктуры сервисов и подходов к снижению количества рутинных задач. Что предлагаем: Возможность влиять на архитектуру и надежность инфраструктуры. Интересные инженерные задачи без постоянной ручной рутины. Пространство для автоматизации, стандартизации и улучшения процессов. Работу в команде, где ценят системный подход и ответственность за результат. Возможность развивать зрелую SRE-практику внутри компании. Условия: Работа в аккредитованной IT компании над приложениями уровня Enterprise; Команда профессионалов открытая к идеям и обмену опытом; Белая заработная плата, уровень по результатам собеседований; Работа в офисе в г.Ижевск; Комфортный офис: рабочее место с мощным ПК, обеденная зона, кофе, парковка; Испытательный срок 3 месяца; Оплата по результатам собеседования; Напишите последние 3 проекта, компании и роли в комментарий на отклик. Спасибо и успехов в достижении поставленных целей!