"1. 负责面向自动驾驶场景的多模态认知模型,包括但不限于视觉-语言-动作建模、场景理解、意图理解、时序认知,驾驶决策等方向;
- 参与自动驾驶认知模型的数据体系建设,包括训练数据构建、数据清洗、数据挖掘、样本策略设计与效果分析;
- 负责多模态大模型在自动驾驶任务中的训练、微调与优化,包括预训练、监督微调、蒸馏、对齐、评测等工作;
- 结合真实自动驾驶业务场景,探索认知模型在复杂道路环境中的应用,包括长尾场景理解、时空关系建模、动态交互理解等;
- 跟踪多模态大模型、世界模型、具身智能、自动驾驶端到端等前沿技术,结合业务持续推进技术演进。" "1. 自动驾驶感知/预测/规控/场景理解等相关研发经验;
- 多模态大模型、VLM/MLLM、视频理解、时序建模等相关经验;
- 视觉语言理解、具身智能、机器人认知建模等相关经验;
- 扎实的机器学习 / 深度学习基础,熟悉 PyTorch 等主流训练框架;
- 具备较强的代码能力、实验能力和问题定位能力,能够独立推动技术方案迭代;
- 对自动驾驶具身认知方向有兴趣,愿意深入真实业务问题,有较强的学习能力与自驱力。"