欢迎访问上海招聘网!本站为上海找工作求职者提供上海人才招聘、上海人才市场、上海人才网等岗位信息!


职位月薪: 面议
任职要求:- 2027届本科及以上毕业生,计算机、软件工程、电子工程等相关专业,专业基础扎实。- 熟练掌握 C/C++ 与 Python,具备良好的编程开发习惯。- 熟悉计算机体系结构与并行计算原理,理解 GPGPU/NPU 的 SIMT、存储与通信模型及内存层次、并发同步机制。- 了解 GEMM/CONV/ATTN/MOE 等核心算子的计算访存特征。- 熟悉编译原理基本概念,了解传统编译器(LLVM)或 AI 编译器(MLIR/TVM/Triton/TileLang 等)架构。加分项:- 有 CUDA/Triton/CUTLASS/ComposableKernel 等计算库的开发与深入调优经验,对 CuTe Layout Algebra 有理解和研究者优先。- 熟悉 NVIDIA、AMD或国产芯片的 ISA 与微架构,能借助 NCU/ROCprof 等工具定位性能瓶颈者优先。- 有大模型/多模态/文生图/视频/3D 生成等前沿模型的推理加速与端到端调优经验,熟悉 vLLM/SGLang/FlashInfer 者优先。- 参与过 LLVM/AI 编译器开发(中后端指令选择/调度/寄存器分配相关),或在强化学习、Auto-Tuning、LLM Agent 用于系统/编译自动化方向有科研/实习经历者优先。- 知名高校实验室硕博,在 PLDI、ASPLOS、MICRO、ISCA、NeurIPS 等顶会发表论文,为知名 LLM 推理/AI 编译器/HPC 开源项目核心贡献者,或有程序设计/超算竞赛优异成绩者优先。加入曦望,你将获得什么?- 难得的创造机会:参与 AI 推理 GPU 和算力基础设施从 0 到 1 到 N 的真实建设。- 真问题、真战场、大空间:解决成本、稳定性、规模化落地中的关键问题,在核心岗位承担真实责任。- 顶级人才共事:和行业优秀的工程、架构、产品与业务团队一起做复杂系统。- 简单坦诚的文化:被信任、讲事实、少内耗,专业高效地把事做成。- 长期回报与保障:有竞争力的薪酬激励、token 补贴、补充商保、员工及家人体检、晚餐与夜间出行支持等。你将参与曦望AI推理芯片及软硬件系统的核心研发工作,把底层技术能力推进到可验证、可交付、可规模化应用的真实场景。岗位职责:- 参与大算力异构芯片(GPU/NPU)高性能软件栈研发、编译优化与性能调优。- 参与先进 GPGPU 体系结构研究,深入调研分析 NV/AMD/国产芯片前沿架构,推动硬件演进,打造易用、高性能的软硬件平台。- 面向前沿 LLM 推理场景,从汇编层(指令选择/调度/Scoreboard 等)定位算子性能瓶颈,设计极致利用硬件的 SOTA Kernel 策略,打造核心高性能算子库(GEMM/CONV/ATTN/MOE);以算子为视角协同硬件、编译器团队全链路参与国产加速计算平台设计。- 参与面向大模型场景的整网编译与 MegaKernel 粒度算子融合优化,提升算力与带宽利用率,实现端到端推理性能突破。- 参与自动调优(Auto-Tuning)、强化学习与 Agent/Code-LLM 结合的智能化优化策略与测试体系建设,并推动 AI 编译器在推理/训练业务侧落地。
微信扫一扫,及时了解投递状态
您目前还没有登录:立即登录任职要求:- 2027届本科及以上毕业生,计算机、软件工程、电子工程等相关专业,专业基础扎实。- 熟练掌握 C/C++ 与 Python,具备良好的编程开发习惯。- 熟悉计算机体系结构与并行计算原理,理解 GPGPU/NPU 的 SIMT、存储与通信模型及内存层次、并发同步机制。- 了解 GEMM/CONV/ATTN/MOE 等核心算子的计算访存特征。- 熟悉编译原理基本概念,了解传统编译器(LLVM)或 AI 编译器(MLIR/TVM/Triton/TileLang 等)架构。加分项:- 有 CUDA/Triton/CUTLASS/ComposableKernel 等计算库的开发与深入调优经验,对 CuTe Layout Algebra 有理解和研究者优先。- 熟悉 NVIDIA、AMD或国产芯片的 ISA 与微架构,能借助 NCU/ROCprof 等工具定位性能瓶颈者优先。- 有大模型/多模态/文生图/视频/3D 生成等前沿模型的推理加速与端到端调优经验,熟悉 vLLM/SGLang/FlashInfer 者优先。- 参与过 LLVM/AI 编译器开发(中后端指令选择/调度/寄存器分配相关),或在强化学习、Auto-Tuning、LLM Agent 用于系统/编译自动化方向有科研/实习经历者优先。- 知名高校实验室硕博,在 PLDI、ASPLOS、MICRO、ISCA、NeurIPS 等顶会发表论文,为知名 LLM 推理/AI 编译器/HPC 开源项目核心贡献者,或有程序设计/超算竞赛优异成绩者优先。加入曦望,你将获得什么?- 难得的创造机会:参与 AI 推理 GPU 和算力基础设施从 0 到 1 到 N 的真实建设。- 真问题、真战场、大空间:解决成本、稳定性、规模化落地中的关键问题,在核心岗位承担真实责任。- 顶级人才共事:和行业优秀的工程、架构、产品与业务团队一起做复杂系统。- 简单坦诚的文化:被信任、讲事实、少内耗,专业高效地把事做成。- 长期回报与保障:有竞争力的薪酬激励、token 补贴、补充商保、员工及家人体检、晚餐与夜间出行支持等。你将参与曦望AI推理芯片及软硬件系统的核心研发工作,把底层技术能力推进到可验证、可交付、可规模化应用的真实场景。岗位职责:- 参与大算力异构芯片(GPU/NPU)高性能软件栈研发、编译优化与性能调优。- 参与先进 GPGPU 体系结构研究,深入调研分析 NV/AMD/国产芯片前沿架构,推动硬件演进,打造易用、高性能的软硬件平台。- 面向前沿 LLM 推理场景,从汇编层(指令选择/调度/Scoreboard 等)定位算子性能瓶颈,设计极致利用硬件的 SOTA Kernel 策略,打造核心高性能算子库(GEMM/CONV/ATTN/MOE);以算子为视角协同硬件、编译器团队全链路参与国产加速计算平台设计。- 参与面向大模型场景的整网编译与 MegaKernel 粒度算子融合优化,提升算力与带宽利用率,实现端到端推理性能突破。- 参与自动调优(Auto-Tuning)、强化学习与 Agent/Code-LLM 结合的智能化优化策略与测试体系建设,并推动 AI 编译器在推理/训练业务侧落地。
企业尚未更新
上海市
扫描二维码及时订阅职位
最新职位信息第一时间知晓
上海兼职招聘
360行任你挑选
分秒必争直达HR
谁看我简历早知道
请使用微信【扫一扫】
关注「上海易职邦招聘」公众号完成登录
客服电话:400-765-0056
竭诚为您服务
服务时间08:00-24:00
微信小程序
面试通知
收藏
简历
足迹
微信求职
关注公众号
掌握最新求职动态
小程序
进入小程序
随时随地找工作