1、博士及以上学历,计算机科学、人工智能、机器人学等相关专业,具备扎实的机器学习、强化学习、具身模型基础。
2、熟悉VLA(视觉-语言-动作)模型架构,了解RT-2、OpenVLA、pi0.5等主流具身大模型;精通大模型后训练技术,熟练掌握SFT、RLHF、强化学习、模仿学习、偏好对齐等微调范式。
3、熟练使用Python、PyTorch,具备独立搭建大模型训练框架、数据管线的工程能力;熟悉分布式训练、模型性能优化、显存优化、实验管理工具。
4、熟悉仿真训练环境(Isaac Gym/MuJoCo),具备具身场景训练工具、自动化实验链路搭建经验者优先。
Base:北京,其次深圳、上海也可以,特别优秀的也可以base西安、成都