Требуется Data Scientist (Middle+/Senior).
Условия: Ставка: 1700, с НДС. Локация: РФ. Гражданство: РФ.
Обязательные требования:
- Отличное знание Python, опыт работы с Spark, Pyspark, SQL, работа с S3
- Знание современных алгоритмов машинного обучения и оптимизации
- Математическая статистика и основы машинного обучения: линейные модели, Random Forest, LSTM
- Библиотеки градиентного бустинга: XGBoost, LightGBM, CatBoost
- Глубокое обучение для временных рядов: LSTM, Prophet, DeepAR
- Работа с временными рядами: очистка, прогнозирование, кросс-валидация
- Методы дискретной оптимизации, математическое программирование (LP, MILP, MIP)
- Инструменты оптимизации (Pyomo/OR-Tools/PuLP/COIN-OR), решатели (Gurobi/CPLEX/SCIP/COPT/GLPK)
- Уверенное владение Git
- Опыт разработки продуктового ML решения: анализ данных, создание прототипа, понимание архитектуры ML проектов, настройка пайплайнов данных, умение обернуть модель в базовый backend (FastAPI, Hug и другое), базовые навыки DevOps (Docker, KubeFlow)
- Базовое понимание архитектуры web-приложений и backend-сервисов
- Опыт работы с жизненными циклами разработки вычислительной и программной инфраструктуры
- Высокие навыки коммуникации, стремление к обучению; уровень английского — Intermediate
Дополнительные требования:
- Юнит- и интеграционное тестирование, владение методологией тестирования
- Понимание принципов CI/CD
- ООП и принципы проектирования вычислительных систем
- Опыт в FMCG в Supply Chain, Demand Planning, Forecasting, ERP, APS
- Опыт работы в продуктовых командах (Agile, Scrum)
Этапы отбора:
- Техническое интервью с клиентом
- Техническое интервью с заказчиком
Описание проекта и команды:
Data Scientist создает методологии и эвристики, строит пайплайны машинного обучения для цифровых продуктов компании, проверяет гипотезы и находит закономерности с помощью статистики и ML. Роль предполагает разработку алгоритма, его продуктивизацию и поддержку (мониторинг качества данных и модели, дообучение, документация).