拓达教育 Touchdown Education 拓达求职支持办公室Career Support Office touchdown.org.cn ↗
JobFinder为留学生筛选身份匹配的岗位

【理想+】AI 算法工程师-强化学习-北京

理想汽车 · 北京 · 收录于 8月15日
评分
80
发布日期
收录于 8月15日 (2周前)
内推
暂无
公司规模
10k+
行业
汽车出行

岗位描述

“理想+”是理想汽车面向全球顶尖技术人才的校园招聘计划。我们期待你的加入,与理想汽车一起成长、分享收获,通过人工智能技术去改变物理世界的效率和体验,造福我们服务的每一个家庭,以及家庭里的每一位成员。 【本岗位的主要工作内容】

  • 参与强化学习算法的研究与开发,设计并优化适用于复杂任务的强化学习模型;
  • 构建和完善 Agentic AI 系统,实现智能体的自主学习、决策与交互功能;
  • 针对特定应用场景,运用强化学习和 Agent 技术,制定解决方案并推动落地实施;
  • 参与设计和搭建强化学习训练环境,生成高质量训练数据,提升智能体性能;
  • 探索强化学习与其他技术(如大语言模型、多智能体系统等)的融合创新,拓展应用边界。 【技术课题】 强化学习和 Agentic AI​
  • 计算机科学、人工智能、数学等相关专业,硕士及以上学历;
  • 深入理解强化学习原理,熟练掌握 主流强化学习算法;
  • 具备扎实的编程能力,精通 Python 语言,熟悉PyTorch、veRL 等深度学习框架;
  • 有 Agent 系统开发经验,熟悉多智能体协作、任务分配、工具调用等机制;
  • 对大语言模型有一定了解,掌握模型微调、应用等技术;
  • 具备优秀的数学和基础,在计算机视觉、自然语言处理等领域有扎实技术积累;
  • 良好的团队协作与沟通能力,能够高效推动项目进展;
  • ​较强的英文文献阅读与理解能力,及时把握领域前沿动态;
  • 有在相关领域国际会议或期刊发表论文者优先考虑。

加入我的投递 →

理想汽车 的其他岗位

算法研发工程师实习生 · 北京 · 评分 89
Agent架构开发工程师-北京 · 北京 · 评分 86
产品经理实习生(智能眼镜影像) · 北京 · 评分 86
人工智能音乐生成实习生 · 北京 · 评分 86
多模态算法实习生 · 北京 · 上海 · 评分 86
大模型分布式训练系统与网络互联方向实习生 · 上海 · 评分 86

查看全部 →