ML-Разработчик В Команду Гуманоидных Роботов (Robotics)
Описание
Локация: Офис в МосквеКомпанияYandex — международная технологическая компания, развивающая направление автономного транспорта и робототехники, от исследований до серийного производства.Что делатьРазрабатывать пайплайны дообучения VLA на данных реальных роботов, симуляциях и демонстрациях для повышения success rate.Исследовать и внедрять RL-подходы (offline RL, offline-to-online RL, residual RL) для улучшения политик управления.Развивать методы обучения на корректирующих данных (corrective data) и траекториях восстановления с использованием подходов DAgger и Learning from Human Interventions.Повышать робастность моделей в сложных и нештатных сценариях (OOD robustness) и анализировать failure modes.Формировать и отслеживать метрики качества: success rate, recovery rate и intervention rate.ТребованияУверенное программирование на Python и опыт работы с PyTorch.Сильная база в Deep Learning и Reinforcement Learning (policy optimization, actor-critic, value learning).Понимание принципов Behavior Cloning, Covariate Shift и Dataset Aggregation.Умение проводить абляции, работать с метриками и анализировать причины деградации моделей.Способность читать исследовательские статьи и превращать их в устойчивые ML-пайплайны.Хорошо, если естьОпыт работы с гуманоидными или иными физическими робототехническими платформами.Знакомство с Human-Gated DAgger, Safe RL или Constrained RL.Опыт работы с симуляторами Isaac Lab, Isaac Sim, MuJoCo или ManiSkill.