参与下一代具身智能机器人基础模型(Embodied Brain)的研发,构建机器人理解世界、学习技能和执行任务的核心能力。
- 研发 Vision-Language-Action(VLA)等具身基础模型;
- 探索 World Action Model、多模态预训练、Action Tokenization 等前沿方向;
- 研究 Transformer、Diffusion、Mamba、MoE 等先进模型架构在机器人领域的应用;
- 构建大规模机器人预训练与后训练能力,提升模型泛化能力;
- 与机器人平台协同完成模型在真实机器人上的部署、验证与迭代。
- 硕士及以上学历,计算机、人工智能、自动化、机器人等相关专业;
- 扎实的机器学习、深度学习基础,熟悉 Transformer 等主流模型;
- 熟练掌握 Python,熟悉 PyTorch 等深度学习框架;
- 具备良好的编程能力、工程实践能力和团队协作能力。 具有以下经历优先:
- 在 CVPR、ICCV、ECCV、NeurIPS、ICLR、RSS、CoRL 等国际会议发表论文;
- 有 LeRobot、OpenVLA、Isaac Lab、ManiSkill 等开源项目经验;
- 有机器人、生成模型或多模态模型相关科研或实习经历。