Мы ищем Data Scientist в команду, которая занимается разработкой ML-решений для бизнес-задач. Основной фокус роли — полный цикл работы с моделями: от исследования данных и проверки гипотез до вывода решений в production и дальнейшего мониторинга.
Формулировать и проверять гипотезы на основе данных, проводить эксперименты (A/B-тесты, multi-armed bandit, sequential testing);
Разрабатывать ML-решения для различных бизнес-задач: от MVP до полноценных production-моделей;
Участвовать в полном цикле разработки моделей: постановка задачи, подготовка данных, построение решения, внедрение и мониторинг;
Работать совместно с аналитиками и data-инженерами над построением признаков, data pipeline и процессами деплоя моделей;
Проводить исследование данных (EDA), очистку, подготовку и визуализацию данных.
Опыт работы с реляционными и колоночными базами данных (PostgreSQL, ClickHouse, Greenplum);
Уверенное владение Python и основными ML-библиотеками (pandas, NumPy, scikit-learn и др.);
Знание классического машинного обучения: задачи классификации и регрессии, алгоритмы, метрики качества, особенности применения;
Понимание математической статистики и теории вероятностей: A/B-тестирование, статистические критерии, p-value, ошибки первого и второго рода, статистическая мощность;
Опыт работы с данными: подготовка выборок, feature engineering, отбор факторов;
Практический опыт работы с LLM (prompt engineering, skills);
Опыт командной разработки с использованием Git и code review;
Умение формулировать бизнес-задачу и переводить её в ML-решение.
Будет плюсом:
Отличное знание SQL: оконные функции, CTE;
Опыт работы с causal inference и uplift-моделированием;
Навыки написания чистого, тестируемого и поддерживаемого кода.
Будьте осторожны: если работодатель просит войти через Google, iCloud или Госуслуги, прислать код или пароль, запустить ПО или перевести деньги — это мошенники.