【部门介绍】引擎架构部提供小红书搜广推,CV和NLP业务的深度学习模型高性能AI Infra服务。主导SOTA AI Infra架构设计与核心模块开发,支撑AI业务在大规模多模态生成式搜广推等前沿场景上规模落地。 1、参与开发支持下一代语言/多模态超大规模(百亿-万亿级)模型的GPU千卡互联分布式训练和推理框架。 2、与公司算法同学深度合作,为重点项目进行算法与训练/推理框架的联合优化。 3、支撑业界领先的多模态模型在国内最大的生活兴趣社区上落地。 【岗位要求】
- 有扎实的工程算法基础,精通数据结构和常用算法,熟练掌握各种编译、调试、性能分析工具。
- 熟悉C/C++/CUDA,具备扎实的系统底层能力(内存、并发、网络)。
- 有大规模分布式系统开发和优化经验;有大模型分布式训练或推理经验者优先。
- 接触过vLLM/SGLang/Megatron/DeepSpeed/veRL/OpenRLHF/LLaMA-Factory/MLIR/TVM/Triton/TileLang等分布式异构计算框架中的一个。
- 熟悉常见深度学习模型结构。 【加分项】 • 在vLLM/SGLang、Megatron、DeepSpeed、veRL、TVM、LLVM等社区有持续代码贡献。