ООО "Версус" — высокоэффективная IT компания, разрабатывающая программные и технологические продукты для беспилотной сферы на российском и международном рынке.
Мы ищем сильного DevOps/SRE-инженера, который поможет развивать надежную, управляемую и автоматизированную IT-инфраструктуру. Эта роль подойдет специалисту, который умеет системно смотреть на сервисы, снижать ручную нагрузку, повышать стабильность и участвовать в развитии инженерных процессов.
Работа только в офисе г.Ижевск, удаленного формата нет.
Чем предстоит заниматься:
- Обеспечивать надежную и стабильную работу критически важных сервисов.
- Участвовать в развитии инфраструктуры и повышении ее отказоустойчивости.
- Настраивать и улучшать мониторинг, алертинг и аналитику инцидентов.
- Работать с метриками доступности и надежности, участвовать в формировании и контроле SLO/SLI.
- Анализировать инциденты, участвовать в postmortem и внедрять меры по предотвращению повторных сбоев.
- Автоматизировать рутинные инфраструктурные операции и снижать объем ручной поддержки.
- Развивать процессы взаимодействия между инфраструктурой и командами разработки.
- Участвовать в проектировании, сопровождении и улучшении CI/CD и релизных процессов.
- Вести и поддерживать техническую документацию.
- Работать с серверной и сетевой инфраструктурой при необходимости, включая Linux, Windows Server и виртуализацию.
- Участвовать в планировании развития инфраструктуры и технических изменений.
Что важно для нас:
- Опыт работы в инфраструктуре, DevOps или SRE от 5–6 лет.
- Уверенное понимание принципов DevOps/SRE, надежности сервисов и подходов к incident management.
- Опыт работы с мониторингом, логированием, алертингом и трассировкой.
- Знание и практическое применение Git, Terraform и Ansible.
- Опыт автоматизации инфраструктуры с помощью скриптов или конфигурационного управления.
- Понимание сетевых основ: DHCP, DNS, VLAN, модель OSI.
- Опыт администрирования Linux, Windows Server и виртуализационной среды.
- Практика работы с корпоративной инфраструктурой, AD, SSO и сетевым оборудованием будет плюсом.
- Умение разбирать инциденты, находить первопричины и доводить улучшения до результата.
- Готовность работать в офисном формате, а частично удаленно — по согласованию.
Будет плюсом:
- Опыт с Prometheus, Grafana, Loki, ELK/OpenSearch, Jaeger или OpenTelemetry.
- Практика работы с PagerDuty, Opsgenie или другими системами алертинга и эскалации.
- Опыт построения runbooks, postmortem-процессов и incident response.
- Навыки написания скриптов на Bash, Python или PowerShell.
- Опыт работы с Docker, Hyper-V, Proxmox.
- Опыт настройки LLM на Bare Metal.
- Опыт настройки MikroTik, FortiGate, WRT, Unify.
- Знание VLESS, XRAY;
- Понимание внутренней инфраструктуры сервисов и подходов к снижению количества рутинных задач.
Что предлагаем: - Возможность влиять на архитектуру и надежность инфраструктуры.
- Интересные инженерные задачи без постоянной ручной рутины.
- Пространство для автоматизации, стандартизации и улучшения процессов.
- Работу в команде, где ценят системный подход и ответственность за результат.
- Возможность развивать зрелую SRE-практику внутри компании.
Условия:
- Работа в аккредитованной IT компании над приложениями уровня Enterprise;
- Команда профессионалов открытая к идеям и обмену опытом;
- Белая заработная плата, уровень по результатам собеседований;
- Работа в офисе в г.Ижевск;
- Комфортный офис: рабочее место с мощным ПК, обеденная зона, кофе, парковка;
- Испытательный срок 3 месяца;
- Оплата по результатам собеседования;
Напишите последние 3 проекта, компании и роли в комментарий на отклик.
Спасибо и успехов в достижении поставленных целей!