Требуется Data Scientist (Middle+/Senior).

Условия: Ставка: 1700, с НДС. Локация: РФ. Гражданство: РФ.

Обязательные требования:

  • Отличное знание Python, опыт работы с Spark, Pyspark, SQL, работа с S3
  • Знание современных алгоритмов машинного обучения и оптимизации
  • Математическая статистика и основы машинного обучения: линейные модели, Random Forest, LSTM
  • Библиотеки градиентного бустинга: XGBoost, LightGBM, CatBoost
  • Глубокое обучение для временных рядов: LSTM, Prophet, DeepAR
  • Работа с временными рядами: очистка, прогнозирование, кросс-валидация
  • Методы дискретной оптимизации, математическое программирование (LP, MILP, MIP)
  • Инструменты оптимизации (Pyomo/OR-Tools/PuLP/COIN-OR), решатели (Gurobi/CPLEX/SCIP/COPT/GLPK)
  • Уверенное владение Git
  • Опыт разработки продуктового ML решения: анализ данных, создание прототипа, понимание архитектуры ML проектов, настройка пайплайнов данных, умение обернуть модель в базовый backend (FastAPI, Hug и другое), базовые навыки DevOps (Docker, KubeFlow)
  • Базовое понимание архитектуры web-приложений и backend-сервисов
  • Опыт работы с жизненными циклами разработки вычислительной и программной инфраструктуры
  • Высокие навыки коммуникации, стремление к обучению; уровень английского — Intermediate

Дополнительные требования:

  • Юнит- и интеграционное тестирование, владение методологией тестирования
  • Понимание принципов CI/CD
  • ООП и принципы проектирования вычислительных систем
  • Опыт в FMCG в Supply Chain, Demand Planning, Forecasting, ERP, APS
  • Опыт работы в продуктовых командах (Agile, Scrum)

Этапы отбора:

  1. Техническое интервью с клиентом
  2. Техническое интервью с заказчиком

Описание проекта и команды:

Data Scientist создает методологии и эвристики, строит пайплайны машинного обучения для цифровых продуктов компании, проверяет гипотезы и находит закономерности с помощью статистики и ML. Роль предполагает разработку алгоритма, его продуктивизацию и поддержку (мониторинг качества данных и модели, дообучение, документация).