О роли
Мы ищем высококвалифицированного инженера по контракту с сильным опытом эксплуатации инфраструктуры
для поддержки нашей организации Data and Storage Services. В этой роли предстоит
практическая работа по поддержке и улучшению крупномасштабных систем инфраструктуры данных, обеспечению
операционного совершенства и поддержке внутренних команд, которые зависят от наших платформ в критически важных
бизнес-функциях.
Идеальный кандидат принесёт сильную экспертизу в Python и современной облачной инфраструктуре с
фокусом на надёжность систем, наблюдаемость и кросс-командное сотрудничество.
Чем вы будете заниматься
● Поддержка и эксплуатация крупномасштабных систем инфраструктуры данных для нагрузок OLTP/OLAP,
потоковой обработки и пакетной обработки
● Поддержание и повышение надёжности инфраструктуры за счёт автоматизации, мониторинга и
реагирования на инциденты.
● Разработка и улучшение инструментов и сервисов на Python для оптимизации операционных
рабочих процессов.
● Поддержание и модернизация экосистемы Python, обеспечение актуальности сервисов с
поддерживаемыми версиями и библиотеками.
● Автоматизация процессов разработки для улучшения коммуникации, прозрачности и эффективности
между командами.
● Обработка вопросов и эскалаций от заинтересованных сторон (внутренних партнёров), предоставление ясных, своевременных
и технически обоснованных ответов.
● Создание, ведение и улучшение технической документации, построение дашбордов для мониторинга
для обеспечения ясности, поддерживаемости и плавного онбординга пользователей платформ DSS.
Обязательные требования
● Сильный опыт программирования хотя бы на одном из следующих языков: Python, Java
● Практический опыт эксплуатации инфраструктуры, включая AWS и Kubernetes.
● Подтверждённый опыт поддержки крупномасштабных распределённых систем в production.
● Отличные коммуникативные навыки, способность эффективно сотрудничать с
инженерными и продуктовыми командами.
● Подтверждённые навыки технического письма, создание ясной и эффективной документации,
runbook’ов и руководств для пользователей.
Желательные требования
● Опыт работы с потоковыми системами, такими как Flink, Kafka.
● Знакомство с технологиями платформ данных, такими как Spark, Data Lake, MySQL,
Snowflake
● Знание фреймворков и пайплайнов обработки данных для потоковой обработки данных почти в реальном времени.
● Опыт участия в развитии или управлении общими инфраструктурными сервисами, используемыми несколькими
командами.
● Опыт использования LLM и ИИ для автоматизации и масштабирования поддержки.
Приложение: список проектов:
Этот контрактник может участвовать в нескольких текущих или планируемых инициативах, включая, но не
ограничиваясь:
1. Обновления: Поддержка любых обновлений систем, таких как обновления версий DT, обновления Flink
во всех пайплайнах и системах, поддерживаемых командой Streaming
2. KTLO / Триаж и поддержка: Выполнение рутинных операций, ответы на базовые вопросы
пользователей и эскалация сложных проблем соответствующим инженерным командам.
3. Улучшения документации и наблюдаемости: Расширение и ведение внутренней документации, включая runbook’и, FAQ, материалы для онбординга, дашборды
мониторинга и системные руководства для улучшения обмена знаниями и операционной
эффективности