拓达教育 Touchdown Education 拓达求职支持办公室Career Support Office touchdown.org.cn ↗
JobFinder为留学生筛选身份匹配的岗位

大模型和分布式推理优化实习生(日常实习)

寒武纪 · 上海 · 收录于 8月15日
评分
84
发布日期
收录于 8月15日 (2周前)
内推
暂无
公司规模
1k-5k
行业
半导体

岗位描述

工作内容: 1、参与分布式推理系统建设,提供行业领先的LLM/多模态模型解决方案; 2、针对大语言模型(LLM)等场景,开展端到端推理性能优化,重点降低推理延迟、提升吞吐量; 3、针对大语言模型(LLM)等场景,开展端到端推理精度分析,提升模型精度; 4、开发和维护大语言模型(LLM)量化工具等; 任职要求 1、计算机、电子工程、自动化、数学等相关专业优先; 2、精通Python/C++; 3、深入理解LLM或者视觉生成模型框架和原理; 4、深入理解量化、kvcache、多机多卡并行等加速技术。 5、实习时间至少为6个月,每周出勤4天。 加分项: 1、有GPU/加速卡调优实践经验; 2、有开源仓库的贡献经验; 3、参与过LLM或者视觉生成端到端推理优化项目,并实际落地; 4、有集群部署经验; 5、了解torch.compile/CUDAGraph/Triton; 6、了解vllm, sglang, megatron, verl等。

加入我的投递 →

寒武纪 的其他岗位

大模型训练系统实习生-27届 · 北京 · 评分 86
大模型训练系统实习生(日常实习) · 北京 · 评分 84
AI编译器研发工程师-27届 · 北京 · 上海 · 评分 80
大模型训练优化工程师-27届 · 北京 · 上海 · 评分 80
AI 智算平台研发工程师-27届 · 上海 · 合肥 · 评分 78

查看全部 →