← 返回岗位列表
27届Stepstar-LLM post train 算法研究员
阶跃星辰
· 北京 · 上海
· 7月24日 · 1个月前
- 评分
- 82
- 发布日期
- 7月24日 (1个月前)
- 内推
- 暂无
- 公司规模
- 201-500
- 行业
- 人工智能
岗位描述
【岗位描述】
- 参与通用推理大模型/多模态大模型对齐(Alignment)方向的研发工作,涵盖数据循环体系的构建,以及在监督微调(SFT)与强化学习(RL)阶段中对数据使用策略的系统性探究;
- 深入探索对齐阶段(Alignment)的数据与算法在大规模训练中的可扩展性与优化路径,覆盖文本、多模态理解以及Agent(Working Agent/Code Agent/Search等)任务场景;
- 参与long-horizon agent任务的大规模数据构建与训练算法的探索,包括但不限于frontier coding task和enterprise working task;
- 参与构建世界领先的高性能通用推理大模型与多模态大模型,在多项客观评测指标中保持行业领先。 【岗位要求】
- 预计毕业时间介于2026年9月至2027年8月的国内外计算机、数学、人工智能等相关专业的优秀应届毕业生;
- 对数据有一定的敏感度,熟知开源社区各数据渠道源,有数据处理的经验和认知;
- 对大模型相关研究前沿进展比较熟悉,如Reasoning RL、Agent RL、多模态理解、Tool/Search Agent等,具有大模型/多模态研发经验者优先;
- 有一定的相关研究经历,发表过顶级会议论文者优先,如ICLR、NeurIPS、ICML、CVPR等;
- 具备扎实的编程基础,有优秀的工程能力,具有NOI、ACM、ICPC等编程竞赛金牌获奖者优先;
- 具备良好的团队协作能力和沟通能力。
加入我的投递 →