欢迎访问上海招聘网!本站为上海找工作求职者提供上海人才招聘、上海人才市场、上海人才网等岗位信息!


职位月薪: 面议
1、具备扎实的计算机系统基础,在分布式系统、高性能计算、机器学习系统或计算机体系结构等方向有深入积累; 2、精通 Python、C++ 中至少一种语言,具备复杂系统架构设计和核心模块研发能力; 3、深入理解 PyTorch 运行机制,对自动微分、计算图、分布式通信、并行训练和显存管理有系统认识; 4、深入理解 Megatron-LM、FSDP、DeepSpeed、verl 等训练框架中的一种或多种,能够分析其核心架构与性能边界; 5、熟悉大规模分布式训练中的通信、计算、显存和存储瓶颈,能够完成跨层性能分析与优化; 6、熟悉 NCCL/HCCL、RDMA、集合通信算法、通信计算重叠或大规模网络拓扑; 7、具备复杂技术问题的抽象能力,能够从局部现象识别系统性根因,并形成可演进的解决方案; 8、具备较强的技术判断力和推动力,能够主导关键技术方向并协调多团队完成复杂系统建设。加分项: 1、主导或深度参与过百亿、千亿参数模型的预训练、后训练或强化学习训练系统建设; 2、具备数百卡、千卡及以上规模的分布式训练实践; 3、在 MoE、长上下文、多模态、Agentic RL 或新型模型架构方向有系统经验; 4、具备 CUDA、Triton、CANN、算子开发、编译优化或性能建模经验; 5、具备异构芯片适配、跨硬件精度对齐或大规模训练稳定性建设经验; 6、在训练框架、分布式系统、高性能计算相关开源项目中有核心贡献; 7、有从技术方向规划、核心架构设计到规模化生产落地的完整经验。
微信扫一扫,及时了解投递状态
您目前还没有登录:立即登录1、具备扎实的计算机系统基础,在分布式系统、高性能计算、机器学习系统或计算机体系结构等方向有深入积累; 2、精通 Python、C++ 中至少一种语言,具备复杂系统架构设计和核心模块研发能力; 3、深入理解 PyTorch 运行机制,对自动微分、计算图、分布式通信、并行训练和显存管理有系统认识; 4、深入理解 Megatron-LM、FSDP、DeepSpeed、verl 等训练框架中的一种或多种,能够分析其核心架构与性能边界; 5、熟悉大规模分布式训练中的通信、计算、显存和存储瓶颈,能够完成跨层性能分析与优化; 6、熟悉 NCCL/HCCL、RDMA、集合通信算法、通信计算重叠或大规模网络拓扑; 7、具备复杂技术问题的抽象能力,能够从局部现象识别系统性根因,并形成可演进的解决方案; 8、具备较强的技术判断力和推动力,能够主导关键技术方向并协调多团队完成复杂系统建设。加分项: 1、主导或深度参与过百亿、千亿参数模型的预训练、后训练或强化学习训练系统建设; 2、具备数百卡、千卡及以上规模的分布式训练实践; 3、在 MoE、长上下文、多模态、Agentic RL 或新型模型架构方向有系统经验; 4、具备 CUDA、Triton、CANN、算子开发、编译优化或性能建模经验; 5、具备异构芯片适配、跨硬件精度对齐或大规模训练稳定性建设经验; 6、在训练框架、分布式系统、高性能计算相关开源项目中有核心贡献; 7、有从技术方向规划、核心架构设计到规模化生产落地的完整经验。
企业尚未更新
上海市
扫描二维码及时订阅职位
最新职位信息第一时间知晓
上海兼职招聘
360行任你挑选
分秒必争直达HR
谁看我简历早知道
请使用微信【扫一扫】
关注「上海易职邦招聘」公众号完成登录
客服电话:400-765-0056
竭诚为您服务
服务时间08:00-24:00
微信小程序
面试通知
收藏
简历
足迹
微信求职
关注公众号
掌握最新求职动态
小程序
进入小程序
随时随地找工作