欢迎访问上海招聘网!本站为上海找工作求职者提供上海人才招聘、上海人才市场、上海人才网等岗位信息!


职位月薪: 面议
任职要求:1. 2027届本科及以上毕业生,计算机科学与技术、软件工程、电子信息、通信工程、自动化等相关专业。2. 具备扎实的计算机基础,熟悉 C/C++、数据结构与算法,具备良好的系统编程、代码调试和问题分析能力。3. 熟悉 Linux 开发环境,对多线程、异步编程、内存管理、网络通信和并发控制有一定理解。4. 具备系统软件、并行计算、计算机网络、计算机体系结构或分布式系统相关项目经验。5. 对硬件体系结构和系统性能优化有兴趣,能够从计算、通信、存储和内存访问等维度分析性能瓶颈。加分项:1. 参与过 GPU 通信库、分布式推理、MoE 专家并行、Prefill/Decode 分离或分布式 KV Cache 相关项目。2. 熟悉 NCCL、RCCL、DeepEP、UCX、Mooncake 等项目,具备相关源码阅读或开源贡献经验。3. 熟悉 RDMA Verbs、RoCE/InfiniBand、GPUDirect RDMA、PCIe、CXL或超节点 Scale-up 互联技术。4. 熟悉 GPU 体系结构、DMA、NoC、片间互联、硬件队列或一致性与内存访问机制。5. 具备 CUDA/ROCm、GPU Kernel、通信 Kernel 或通信计算重叠优化经验。6. 熟悉 Tensor Parallel、Expert Parallel 和推理调度机制。7. 在 ACM/ICPC、CCPC、ASC、ISC、HPC-AI 等相关竞赛中获奖。8. 在并行计算、分布式系统、计算机网络或计算机体系结构领域具有高质量论文、专利或项目成果。加入曦望,你将获得什么?- 难得的创造机会:参与 AI 推理 GPU 和算力基础设施从 0 到 1 到 N 的真实建设。- 真问题、真战场、大空间:解决成本、稳定性、规模化落地中的关键问题,在核心岗位承担真实责任。- 顶级人才共事:和行业优秀的工程、架构、产品与业务团队一起做复杂系统。- 简单坦诚的文化:被信任、讲事实、少内耗,专业高效地把事做成。- 长期回报与保障:有竞争力的薪酬激励、token 补贴、补充商保、员工及家人体检、晚餐与夜间出行支持等。你将面向分布式推理基础设施(AI Infra),参与GPU高性能通信、分布式 KVCache 及超节点系统的研发。岗位职责:1. 参与自研 GPU 高性能通信库的研发,包括集合通信、DeepEP 类专家并行通信及 RDMA 高速传输。2. 参与 GPU 超节点系统研发,围绕 GPU、片间互联、PCIe、NIC、交换网络等硬件资源,优化数据通路、任务调度和资源协同。3. 参与大规模推理集群的 Scale-up/Scale-out 通信架构与组网优化。4. 参与分布式 KV Cache 系统研发,包括跨节点传输、缓存管理、分层存储、节点间共享以及 Prefill/Decode 分离场景下的数据通路优化。5. 参与超节点互联协议、内存池化、存储池化、网络仿真的研究及工程落地。
微信扫一扫,及时了解投递状态
您目前还没有登录:立即登录任职要求:1. 2027届本科及以上毕业生,计算机科学与技术、软件工程、电子信息、通信工程、自动化等相关专业。2. 具备扎实的计算机基础,熟悉 C/C++、数据结构与算法,具备良好的系统编程、代码调试和问题分析能力。3. 熟悉 Linux 开发环境,对多线程、异步编程、内存管理、网络通信和并发控制有一定理解。4. 具备系统软件、并行计算、计算机网络、计算机体系结构或分布式系统相关项目经验。5. 对硬件体系结构和系统性能优化有兴趣,能够从计算、通信、存储和内存访问等维度分析性能瓶颈。加分项:1. 参与过 GPU 通信库、分布式推理、MoE 专家并行、Prefill/Decode 分离或分布式 KV Cache 相关项目。2. 熟悉 NCCL、RCCL、DeepEP、UCX、Mooncake 等项目,具备相关源码阅读或开源贡献经验。3. 熟悉 RDMA Verbs、RoCE/InfiniBand、GPUDirect RDMA、PCIe、CXL或超节点 Scale-up 互联技术。4. 熟悉 GPU 体系结构、DMA、NoC、片间互联、硬件队列或一致性与内存访问机制。5. 具备 CUDA/ROCm、GPU Kernel、通信 Kernel 或通信计算重叠优化经验。6. 熟悉 Tensor Parallel、Expert Parallel 和推理调度机制。7. 在 ACM/ICPC、CCPC、ASC、ISC、HPC-AI 等相关竞赛中获奖。8. 在并行计算、分布式系统、计算机网络或计算机体系结构领域具有高质量论文、专利或项目成果。加入曦望,你将获得什么?- 难得的创造机会:参与 AI 推理 GPU 和算力基础设施从 0 到 1 到 N 的真实建设。- 真问题、真战场、大空间:解决成本、稳定性、规模化落地中的关键问题,在核心岗位承担真实责任。- 顶级人才共事:和行业优秀的工程、架构、产品与业务团队一起做复杂系统。- 简单坦诚的文化:被信任、讲事实、少内耗,专业高效地把事做成。- 长期回报与保障:有竞争力的薪酬激励、token 补贴、补充商保、员工及家人体检、晚餐与夜间出行支持等。你将面向分布式推理基础设施(AI Infra),参与GPU高性能通信、分布式 KVCache 及超节点系统的研发。岗位职责:1. 参与自研 GPU 高性能通信库的研发,包括集合通信、DeepEP 类专家并行通信及 RDMA 高速传输。2. 参与 GPU 超节点系统研发,围绕 GPU、片间互联、PCIe、NIC、交换网络等硬件资源,优化数据通路、任务调度和资源协同。3. 参与大规模推理集群的 Scale-up/Scale-out 通信架构与组网优化。4. 参与分布式 KV Cache 系统研发,包括跨节点传输、缓存管理、分层存储、节点间共享以及 Prefill/Decode 分离场景下的数据通路优化。5. 参与超节点互联协议、内存池化、存储池化、网络仿真的研究及工程落地。
企业尚未更新
上海市
扫描二维码及时订阅职位
最新职位信息第一时间知晓
上海兼职招聘
360行任你挑选
分秒必争直达HR
谁看我简历早知道
请使用微信【扫一扫】
关注「上海易职邦招聘」公众号完成登录
客服电话:400-765-0056
竭诚为您服务
服务时间08:00-24:00
微信小程序
面试通知
收藏
简历
足迹
微信求职
关注公众号
掌握最新求职动态
小程序
进入小程序
随时随地找工作