Data Scientist
Описание
Мы ищем Data Scientist в команду, которая занимается разработкой ML-решений для бизнес-задач. Основной фокус роли — полный цикл работы с моделями: от исследования данных и проверки гипотез до вывода решений в production и дальнейшего мониторинга. Чем предстоит заниматься: Формулировать и проверять гипотезы на основе данных, проводить эксперименты (A/B-тесты, multi-armed bandit, sequential testing); Разрабатывать ML-решения для различных бизнес-задач: от MVP до полноценных production-моделей; Участвовать в полном цикле разработки моделей: постановка задачи, подготовка данных, построение решения, внедрение и мониторинг; Работать совместно с аналитиками и data-инженерами над построением признаков, data pipeline и процессами деплоя моделей; Проводить исследование данных (EDA), очистку, подготовку и визуализацию данных. Мы ожидаем: Опыт работы с реляционными и колоночными базами данных (PostgreSQL, ClickHouse, Greenplum); Уверенное владение Python и основными ML-библиотеками (pandas, NumPy, scikit-learn и др.); Знание классического машинного обучения: задачи классификации и регрессии, алгоритмы, метрики качества, особенности применения; Понимание математической статистики и теории вероятностей: A/B-тестирование, статистические критерии, p-value, ошибки первого и второго рода, статистическая мощность; Опыт работы с данными: подготовка выборок, feature engineering, отбор факторов; Практический опыт работы с LLM (prompt engineering, skills); Опыт командной разработки с использованием Git и code review; Умение формулировать бизнес-задачу и переводить её в ML-решение. Будет плюсом: Отличное знание SQL: оконные функции, CTE; Опыт работы с causal inference и uplift-моделированием; Навыки написания чистого, тестируемого и поддерживаемого кода.