欢迎访问上海招聘网!本站为上海找工作求职者提供上海人才招聘、上海人才市场、上海人才网等岗位信息!

网站地图
上海招聘网

上海站[切换城市]
  • 职位
    • 公司
    • 职位
  • 上海招聘网 www.shrszp.net 提示:

    确认
    上海招聘网 上海招聘网 > 招聘列表 > 招聘详情 >

    【英才2027】智驾大模型量化与部署-造父Robotaxi(J21705)

    【英才2027】智驾大模型量化与部署-造父Robotaxi(J21705)

    职位月薪:面议

    【英才2027】智驾大模型量化与部署-造父Robotaxi(J21705)

    职位月薪: 面议

    • 岗位类别:
    • 招聘类型: 全职
    • 工作经验: 10年以上
    • 工作地点: 上海市
    • 学历要求: 硕士研究生
    • 招聘人数: 1人
      福利待遇:
    • 五险一金
    • 优质平台
    • 法定节假日休息
    • 年终奖

    收藏 收藏 小程序 小程序 岗位分享 微信分享

    聊一聊 和TA聊一聊  投递简历 投个简历

    联系方式

    联系人:上海哈啰普惠科技有限公司

    联系电话:152****5633

    点击查看
    打电话联系前先投递一份简历,面试成功率提高60%!

    (联系我时,请说是在上海易职邦上看到的)

    职位描述

    岗位职责: 随着自动驾驶进入“大模型时代”,从传统的规则驱动转向数据驱动的端到端(End-to-End)感知决策规划一体化模型成为行业趋势。然而,将参数量巨大、计算密集的 Transformer 类大模型高效、安全地部署在算力受限的车规级芯片上,是量产落地的核心瓶颈。 我们需要你加入我们的核心基础架构团队,通过极致的模型压缩、量化加速与推理引擎优化,让智驾大模型在车轮上跑得更快、更稳、更省电。 岗位职责 1. 大模型量化研究与应用:负责智驾大模型(如 VAD, VLA, QwenVL 等)的低比特量化(PTQ/QAT),探索混合精度量化、稀疏化及结构化剪枝技术,在保证精度的前提下大幅降低显存占用与计算量。 2. 高性能推理引擎开发:基于 NVIDIA TensorRT、TVM 或自研推理框架,针对车规级芯片(NVIDIA Thor/Orin, Horizon J5/J6, Qualcomm Snapdragon Ride 等)进行算子开发与性能调优。 3. 端到端部署链路构建:打通从 PyTorch 训练框架到车载嵌入式环境的部署全流程,解决动态 Shape、多模态输入对齐、内存管理、运行时调度等工程难题。 4. 软硬协同优化:深入理解 GPU/NPU 硬件架构,利用 CUDA/C++ 进行底层算子优化,挖掘硬件极致性能,降低推理延迟(Latency)并提升吞吐量(Throughput)。 任职要求: 1. 2027 届海内外高校应届毕业生,计算机、电子工程、自动化、数学等相关专业,硕士及以上学历优先。 2. 具备扎实的 C/C++ 编程基础,熟悉 Python,具有良好的代码规范和调试能力。 3. 熟悉 Linux 开发环境,了解计算机体系结构、操作系统及编译原理。 专业技能(满足以下任意 2-3 项即可) 1. 深度学习框架:熟练掌握 PyTorch 或 TensorFlow,深入理解常见神经网络结构(CNN, Transformer, ViT),有实际的大模型训练或微调经验。 2. 模型压缩技术:熟悉模型量化原理(INT8/FP16/BF16),了解 PTQ(训练后量化)和 QAT(量化感知训练)流程,有 TensorRT、ONNX Runtime 使用经验者优先。 3. 高性能计算:熟悉 CUDA 编程,了解 GPU 内存层级、并行计算原理;或有 TVM、MLIR 等编译器栈开发经验。 4. 部署实战经验:有过将深度学习模型部署到嵌入式设备的实际项目经历; 加分项 端到端大模型自动驾驶量产经验,熟悉VLA、ViT、Transformer; 学术新星、技术能手:有MLSys、Efficient AI前沿方向工作产出;

    二维码微信扫一扫,及时了解投递状态
    头像您目前还没有登录:立即登录

    岗位职责: 随着自动驾驶进入“大模型时代”,从传统的规则驱动转向数据驱动的端到端(End-to-End)感知决策规划一体化模型成为行业趋势。然而,将参数量巨大、计算密集的 Transformer 类大模型高效、安全地部署在算力受限的车规级芯片上,是量产落地的核心瓶颈。 我们需要你加入我们的核心基础架构团队,通过极致的模型压缩、量化加速与推理引擎优化,让智驾大模型在车轮上跑得更快、更稳、更省电。 岗位职责 1. 大模型量化研究与应用:负责智驾大模型(如 VAD, VLA, QwenVL 等)的低比特量化(PTQ/QAT),探索混合精度量化、稀疏化及结构化剪枝技术,在保证精度的前提下大幅降低显存占用与计算量。 2. 高性能推理引擎开发:基于 NVIDIA TensorRT、TVM 或自研推理框架,针对车规级芯片(NVIDIA Thor/Orin, Horizon J5/J6, Qualcomm Snapdragon Ride 等)进行算子开发与性能调优。 3. 端到端部署链路构建:打通从 PyTorch 训练框架到车载嵌入式环境的部署全流程,解决动态 Shape、多模态输入对齐、内存管理、运行时调度等工程难题。 4. 软硬协同优化:深入理解 GPU/NPU 硬件架构,利用 CUDA/C++ 进行底层算子优化,挖掘硬件极致性能,降低推理延迟(Latency)并提升吞吐量(Throughput)。 任职要求: 1. 2027 届海内外高校应届毕业生,计算机、电子工程、自动化、数学等相关专业,硕士及以上学历优先。 2. 具备扎实的 C/C++ 编程基础,熟悉 Python,具有良好的代码规范和调试能力。 3. 熟悉 Linux 开发环境,了解计算机体系结构、操作系统及编译原理。 专业技能(满足以下任意 2-3 项即可) 1. 深度学习框架:熟练掌握 PyTorch 或 TensorFlow,深入理解常见神经网络结构(CNN, Transformer, ViT),有实际的大模型训练或微调经验。 2. 模型压缩技术:熟悉模型量化原理(INT8/FP16/BF16),了解 PTQ(训练后量化)和 QAT(量化感知训练)流程,有 TensorRT、ONNX Runtime 使用经验者优先。 3. 高性能计算:熟悉 CUDA 编程,了解 GPU 内存层级、并行计算原理;或有 TVM、MLIR 等编译器栈开发经验。 4. 部署实战经验:有过将深度学习模型部署到嵌入式设备的实际项目经历; 加分项 端到端大模型自动驾驶量产经验,熟悉VLA、ViT、Transformer; 学术新星、技术能手:有MLSys、Efficient AI前沿方向工作产出;

    二维码微信扫一扫,及时了解投递状态
    头像您已有可投递的在线简历:点击投递
    简历完成度50%,完善简历才能找到好工作:完善简历

    公司介绍

    企业尚未更新

    工作地点

    地址上海市

    查看地图

    看了此职位的人还会看
    查看更多相似的职位 >>

    公司信息 给我留言

    推荐职位 相关公司推荐

    • 头像

      上海砺墨信息咨询有限公司

      热招1个职位
      查看
    • 头像

      上海乔安贝恩家政服务有限公司

      热招3个职位
      查看
    • 头像

      上海龙攀网络科技有限公司

      热招3个职位
      查看
    • 头像

      凯莫(上海)教育科技有限公司

      热招2个职位
      查看
    • 头像

      上海欧伦森塑胶科技有限公司

      热招5个职位
      查看
    二维码

    扫描二维码及时订阅职位

    最新职位信息第一时间知晓

    上海兼职招聘

    • 扫码下载APP

      上海招聘网APP
    • 扫码进小程序

      上海招聘网小程序

    服务信息

    联系电话: 13916151478 杨老师

    服务时间:08:00-18:00

    上海人才招聘 | 上海招聘网 | 上海找工作 | 上海招聘 | 上海人才招聘网

    Copyright 2012-2022 上海招聘网 All Rights Reserved

    详细地址:江西省南昌市青山湖区高新大道万象汇9号楼7楼

    版权所有:江西易职邦网络科技有限公司

    ICP证:赣ICP备2021008707号-3 赣公网安备 36010202000584号

    技术支持:南昌传爱网络科技有限公司

    关注公众号

    服务时间08:00-24:00

    微信公众号

    微信公众号

    招聘交流群

    招聘交流群

    微信小程序

    微信小程序

    微信扫一扫

    面试通知

    收藏

    简历

    足迹

    微信求职

    关注公众号

    掌握最新求职动态

    微信公众号

    小程序

    进入小程序

    随时随地找工作

    小程序