Обязанности:
- Приём, анализ и обработка обращений в техническую поддержку (L2-уровень);
- Мониторинг состояния сервисов, инфраструктурных контуров и ключевых метрик производительности;o Анализ логов: инфраструктурных, системных и прикладных — с использованием инструментов Grafana Loki и др.;
- Диагностика инцидентов, локализация причин сбоев, взаимодействие с командой развития;o Обновление системного и прикладного программного беспечения в рамках регламентов эксплуатации;
- Проведение обновлений ОС (Linux) и патчей ПО в соответствии с регламентами эксплуатации (релизы, хот фиксы);o Участие в релизном цикле:
- Подготовка к выводу изменений в прод;o Контроль корректности развертывания и проверка работоспособности после релиза;
- Проверка эксплуатационной и технической документации;o Работа над улучшением SLA/SLO: анализ частоты и причин инцидентов, предложение и реализация мер по повышению надёжности.
Требования:
- Владение Linux (консоль, диагностика, базовые компоненты ОС);используемые дистрибутивы: Ubuntu Server, Astra Linux;
- Опыт работы с systemd, journald, tcpdump, strace;
- Понимание сетевых основ (TCP/IP, DNS, TLS);
- Понимание работы микросервисной архитектуры, умение работать и диагностировать Docker, K8s;
- Понимание жизненного цикла инцидента и опыт работы с логами;
- Опыт настройки и работы с системами мониторинга Grafana, Prometheus, Zabbix;
- Базовый опыт работы с СУБД: - просмотр данных и логов; - выполнение точечных SQL-запросов (PostgreSQL, Patroni).
Почему именно Т1?
Мы создадим комфортные условия для работы, предложим интересные и масштабные задачи, а также поможем профессионально расти, развиваться и определять собственную траекторию развития.
Преимущества работы у нас
Приятные бонусы для сотрудников, чтобы работать было легко и интересно.