1、参与快手模型训练推理的深度研发,提升模型训练、推理的框架性能; 2、与算法部门合作,为快手大模型定制训练方案,探索大模型的RLHF、MoE、多模态、longcontext等前沿方向,提升训练性能; 3、分析服务器、手机端模型的推理特点,对计算、访存和通讯做出针对性优化; 4、关注前沿技术,跟进业内最新研究进展和应用趋势,提出创新思路和方向。 1、硕士及以上学历,专业不限,计算机相关专业优先; 2、掌握Python/C++编程语言,熟练使用Pytorch框架或者有vllm/tensorrt等推理框架使用经验; 3、具备分布式训练或HPC基础知识,了解集合通信和CUDA编程或者arm/x86 SIMD指令更佳; 4、有机器学习平台开发和深度学习框架开发等领域开发经验; 5、有模型训练推理调优相关工作经历,包括搜广推模型或CV/NLP模型,熟悉Transformer/Bert/GPT等模型结构更佳。