欢迎访问上海招聘网!本站为上海找工作求职者提供上海人才招聘、上海人才市场、上海人才网等岗位信息!

网站地图
上海招聘网

上海站[切换城市]
  • 职位
    • 公司
    • 职位
  • 上海招聘网 www.shrszp.net 提示:

    确认
    上海招聘网 上海招聘网 > 招聘列表 > 招聘详情 >

    多模态大模型高精度蒸馏加速研究

    多模态大模型高精度蒸馏加速研究

    职位月薪:面议

    多模态大模型高精度蒸馏加速研究

    职位月薪: 面议

    • 岗位类别:
    • 招聘类型: 全职
    • 工作经验: 10年以上
    • 工作地点: 上海市
    • 学历要求: 本科
    • 招聘人数: 1人
      福利待遇:
    • 五险一金
    • 优质平台
    • 法定节假日休息
    • 年终奖

    收藏 收藏 小程序 小程序 岗位分享 微信分享

    聊一聊 和TA聊一聊  投递简历 投个简历

    联系方式

    联系人:深圳市腾讯计算机系统有限公司

    联系电话:152****5633

    点击查看
    打电话联系前先投递一份简历,面试成功率提高60%!

    (联系我时,请说是在上海易职邦上看到的)

    职位描述

    课题背景随着大语言模型(LLM)、扩散模型在生成式AI领域的广泛应用,模型规模持续扩大,带来了高算力消耗、高显存占用、推理延迟高的问题,严重制约其在端侧、边缘设备及低算力场景的落地。本课题聚焦模型蒸馏压缩技术,重点针对扩散模型与大语言模型,通过蒸馏、量化、剪枝等技术手段,在尽可能保留原模型精度与生成效果的前提下,实现模型轻量化,降低部署成本,推动生成式AI技术的规模化、低成本应用。课题挑战 1. 精度与轻量化平衡的核心挑战:扩散模型的生成质量、大语言模型的语义理解与生成连贯性,对模型结构和参数依赖性极强,蒸馏过程中难以在大幅压缩模型体积(参数量、计算量)的同时,完全保留原模型的性能,易出现生成模糊、语义偏差、推理精度下降等问题。 2. 针对性蒸馏策略设计难度:扩散模型与大语言模型的模型结构、训练逻辑差异显著,需设计差异化蒸馏方案,适配两类模型的核心特性,避免通用蒸馏方法导致的性能损耗,同时优化蒸馏效率。 3. 工程化落地的技术瓶颈:蒸馏后的轻量化模型需适配不同部署场景(端侧、边缘、云端),需解决蒸馏过程中的训练稳定性、量化噪声、剪枝稀疏性带来的推理效率瓶颈;同时需兼顾蒸馏速度与模型泛化能力,避免过拟合,确保轻量化模型在复杂场景下的可靠运行。具体工作 1. 负责扩散模型、大语言模型的蒸馏压缩方案设计与实现,结合两类模型特性,选用合适的蒸馏策略(如知识蒸馏、自蒸馏、量化蒸馏),制定模型压缩目标(参数量、计算量、推理延迟)。 2. 开展蒸馏模型的训练与优化,调试蒸馏温度、损失函数、蒸馏节奏等关键参数,解决蒸馏过程中精度下降、训练不稳定等问题,确保轻量化模型与原模型性能差距控制在可接受范围。 3. 配合工程团队,完成蒸馏后模型的量化、剪枝等后续优化,适配不同部署场景的需求,测试模型推理速度、显存占用情况,输出工程化落地方案;跟进模型蒸馏领域前沿技术,迭代优化蒸馏策略,提升压缩效率与模型性能。 1. 熟悉深度学习基础理论,掌握模型蒸馏核心原理,了解扩散模型(如Stable Diffusion)、主流开源大语言模型的基本结构 2. 熟练使用Python编程语言,掌握PyTorch/FSDP等深度学习框架,能独立完成模型训练与调试 3. 具备良好的逻辑思维能力、问题解决能力,对模型加速、蒸馏方向有浓厚兴趣,愿意主动学习前沿技术 4. 熟悉模型蒸馏、量化(INT8/INT4)、剪枝等常用模型压缩技术,有落地经验

    二维码微信扫一扫,及时了解投递状态
    头像您目前还没有登录:立即登录

    课题背景随着大语言模型(LLM)、扩散模型在生成式AI领域的广泛应用,模型规模持续扩大,带来了高算力消耗、高显存占用、推理延迟高的问题,严重制约其在端侧、边缘设备及低算力场景的落地。本课题聚焦模型蒸馏压缩技术,重点针对扩散模型与大语言模型,通过蒸馏、量化、剪枝等技术手段,在尽可能保留原模型精度与生成效果的前提下,实现模型轻量化,降低部署成本,推动生成式AI技术的规模化、低成本应用。课题挑战 1. 精度与轻量化平衡的核心挑战:扩散模型的生成质量、大语言模型的语义理解与生成连贯性,对模型结构和参数依赖性极强,蒸馏过程中难以在大幅压缩模型体积(参数量、计算量)的同时,完全保留原模型的性能,易出现生成模糊、语义偏差、推理精度下降等问题。 2. 针对性蒸馏策略设计难度:扩散模型与大语言模型的模型结构、训练逻辑差异显著,需设计差异化蒸馏方案,适配两类模型的核心特性,避免通用蒸馏方法导致的性能损耗,同时优化蒸馏效率。 3. 工程化落地的技术瓶颈:蒸馏后的轻量化模型需适配不同部署场景(端侧、边缘、云端),需解决蒸馏过程中的训练稳定性、量化噪声、剪枝稀疏性带来的推理效率瓶颈;同时需兼顾蒸馏速度与模型泛化能力,避免过拟合,确保轻量化模型在复杂场景下的可靠运行。具体工作 1. 负责扩散模型、大语言模型的蒸馏压缩方案设计与实现,结合两类模型特性,选用合适的蒸馏策略(如知识蒸馏、自蒸馏、量化蒸馏),制定模型压缩目标(参数量、计算量、推理延迟)。 2. 开展蒸馏模型的训练与优化,调试蒸馏温度、损失函数、蒸馏节奏等关键参数,解决蒸馏过程中精度下降、训练不稳定等问题,确保轻量化模型与原模型性能差距控制在可接受范围。 3. 配合工程团队,完成蒸馏后模型的量化、剪枝等后续优化,适配不同部署场景的需求,测试模型推理速度、显存占用情况,输出工程化落地方案;跟进模型蒸馏领域前沿技术,迭代优化蒸馏策略,提升压缩效率与模型性能。 1. 熟悉深度学习基础理论,掌握模型蒸馏核心原理,了解扩散模型(如Stable Diffusion)、主流开源大语言模型的基本结构 2. 熟练使用Python编程语言,掌握PyTorch/FSDP等深度学习框架,能独立完成模型训练与调试 3. 具备良好的逻辑思维能力、问题解决能力,对模型加速、蒸馏方向有浓厚兴趣,愿意主动学习前沿技术 4. 熟悉模型蒸馏、量化(INT8/INT4)、剪枝等常用模型压缩技术,有落地经验

    二维码微信扫一扫,及时了解投递状态
    头像您已有可投递的在线简历:点击投递
    简历完成度50%,完善简历才能找到好工作:完善简历

    公司介绍

    企业尚未更新

    工作地点

    地址上海市

    查看地图

    看了此职位的人还会看
    查看更多相似的职位 >>

    公司信息 公司信息

    头像

    深圳市腾讯计算机系统有限公司

    ecruit_type} 全职

    人力资源服务 人力资源服务

    500-999 500-999人

    广东省,深圳市;北京市;上海市;浙江省,杭州市 广东省,深圳市;北京市;上海市;浙江省,杭州市

    查看所有职位

    公司信息 给我留言

    推荐职位 相关公司推荐

    • 头像

      上海勤博集装箱服务有限公司

      热招2个职位
      查看
    • 头像

      上海砺墨信息咨询有限公司

      热招1个职位
      查看
    • 头像

      凯莫(上海)教育科技有限公司

      热招2个职位
      查看
    • 头像

      上海若济生物医药科技有限公司

      热招1个职位
      查看
    • 头像

      上海龙攀网络科技有限公司

      热招3个职位
      查看
    二维码

    扫描二维码及时订阅职位

    最新职位信息第一时间知晓

    上海兼职招聘

    • 扫码下载APP

      上海招聘网APP
    • 扫码进小程序

      上海招聘网小程序

    服务信息

    联系电话: 13916151478 杨老师

    服务时间:08:00-18:00

    上海人才招聘 | 上海招聘网 | 上海找工作 | 上海招聘 | 上海人才招聘网

    Copyright 2012-2022 上海招聘网 All Rights Reserved

    详细地址:江西省南昌市青山湖区高新大道万象汇9号楼7楼

    版权所有:江西易职邦网络科技有限公司

    ICP证:赣ICP备2021008707号-3 赣公网安备 36010202000584号

    技术支持:南昌传爱网络科技有限公司

    关注公众号

    服务时间08:00-24:00

    微信公众号

    微信公众号

    招聘交流群

    招聘交流群

    微信小程序

    微信小程序

    微信扫一扫

    面试通知

    收藏

    简历

    足迹

    微信求职

    关注公众号

    掌握最新求职动态

    微信公众号

    小程序

    进入小程序

    随时随地找工作

    小程序