欢迎访问上海招聘网!本站为上海找工作求职者提供上海人才招聘、上海人才市场、上海人才网等岗位信息!

网站地图
上海招聘网

上海站[切换城市]
  • 职位
    • 公司
    • 职位
  • 上海招聘网 www.shrszp.net 提示:

    确认
    上海招聘网 上海招聘网 > 招聘列表 > 招聘详情 >

    【REDstar】多模态基础模型算法工程师

    【REDstar】多模态基础模型算法工程师

    职位月薪:面议

    【REDstar】多模态基础模型算法工程师

    职位月薪: 面议

    • 岗位类别:
    • 招聘类型: 全职
    • 工作经验: 10年以上
    • 工作地点: 上海市
    • 学历要求: 本科
    • 招聘人数: 1人
      福利待遇:
    • 五险一金
    • 优质平台
    • 法定节假日休息
    • 年终奖

    收藏 收藏 小程序 小程序 岗位分享 微信分享

    聊一聊 和TA聊一聊  投递简历 投个简历

    联系方式

    联系人:行吟信息科技(上海)有限公司

    联系电话:152****5633

    点击查看
    打电话联系前先投递一份简历,面试成功率提高60%!

    (联系我时,请说是在上海易职邦上看到的)

    职位描述

    岗位职责: 构建多模态大模型“感知-推理-交互”的全链路能力,定义小红书下一代多模态智能基座。你将主导多模态大模型从持续预训练(CPT)、中期训练(Mid-training)、监督微调(SFT)、强化学习(RL)到在线策略蒸馏(OPD / MOPD)的全流程训练与架构演进,并赋能点点、搜索、广告、推荐、电商、智能创作等业务场景。1、CPT & Mid-training:负责 VLM 的持续预训练与中期训练,注入垂域知识、缓解灾难性遗忘,通过原生分辨率、长上下文扩展与数据配比(Data Mixing)夯实模型基础能力;2、SFT & Alignment:负责 VLM 的 SFT 与高质量多模态指令数据构建,治理模型幻觉,提升指令遵循鲁棒性;3、Reasoning & RL:主导 VLM 的强化学习流程,并构建多模态 Reward Model,探索 Long-thought 推理范式,提升复杂视觉、数学、逻辑及长视频序列下的深度推理能力;4、OPD & MOPD:在 RL 之后引入在线策略蒸馏,与多专家在线策略蒸馏,将多个专家模型能力高效融合蒸馏至统一基座,兼顾多任务能力与推理效率; 5、超长视频理解:研发高效的长视频编码、视觉 Token 压缩与时空注意力机制,优化多帧推理效率,挖掘视频与直播流的时序及交互语义; 6、多模态 Agent:研发具备视觉反馈与自我修正能力的智能体,构建 VLM 工具调用与任务规划、执行、验证闭环。 任职要求: 1、本科及以上学历,计算机、人工智能、数学等相关专业; 2、深入理解 Transformer 架构与大模型训练全流程(CPT / Mid-train / SFT / RL / OPD),熟悉主流 VLM 架构(如 LLaVA、Qwen-VL、InternVL 等); 3、在大规模预训练、CPT、Mid-training、SFT、RL、在线策略蒸馏(OPD / MOPD)、MLLM 推理优化、视觉对齐或视频理解等方向有深入研究或落地经验; 4、精通 PyTorch,熟悉 Megatron-LM、DeepSpeed 等分布式训练框架,具备百亿/千亿级参数模型的大规模训练经验,熟悉 veRL、OpenRLHF 者优先; 5、对多模态数据的构建、清洗及 Data Mixing 策略有独特见解,理解各训练阶段的数据需求差异; 6、熟悉主流多模态评测集,能构建垂直领域 Benchmark,并以评测结果反向驱动数据与算法迭代。【加分项】: 1、在 CVPR、ICCV、ECCV、NeurIPS、ICML、ICLR、ACL 等顶会发表过高影响力论文,或在知名开源多模态项目中有核心贡献。

    二维码微信扫一扫,及时了解投递状态
    头像您目前还没有登录:立即登录

    岗位职责: 构建多模态大模型“感知-推理-交互”的全链路能力,定义小红书下一代多模态智能基座。你将主导多模态大模型从持续预训练(CPT)、中期训练(Mid-training)、监督微调(SFT)、强化学习(RL)到在线策略蒸馏(OPD / MOPD)的全流程训练与架构演进,并赋能点点、搜索、广告、推荐、电商、智能创作等业务场景。1、CPT & Mid-training:负责 VLM 的持续预训练与中期训练,注入垂域知识、缓解灾难性遗忘,通过原生分辨率、长上下文扩展与数据配比(Data Mixing)夯实模型基础能力;2、SFT & Alignment:负责 VLM 的 SFT 与高质量多模态指令数据构建,治理模型幻觉,提升指令遵循鲁棒性;3、Reasoning & RL:主导 VLM 的强化学习流程,并构建多模态 Reward Model,探索 Long-thought 推理范式,提升复杂视觉、数学、逻辑及长视频序列下的深度推理能力;4、OPD & MOPD:在 RL 之后引入在线策略蒸馏,与多专家在线策略蒸馏,将多个专家模型能力高效融合蒸馏至统一基座,兼顾多任务能力与推理效率; 5、超长视频理解:研发高效的长视频编码、视觉 Token 压缩与时空注意力机制,优化多帧推理效率,挖掘视频与直播流的时序及交互语义; 6、多模态 Agent:研发具备视觉反馈与自我修正能力的智能体,构建 VLM 工具调用与任务规划、执行、验证闭环。 任职要求: 1、本科及以上学历,计算机、人工智能、数学等相关专业; 2、深入理解 Transformer 架构与大模型训练全流程(CPT / Mid-train / SFT / RL / OPD),熟悉主流 VLM 架构(如 LLaVA、Qwen-VL、InternVL 等); 3、在大规模预训练、CPT、Mid-training、SFT、RL、在线策略蒸馏(OPD / MOPD)、MLLM 推理优化、视觉对齐或视频理解等方向有深入研究或落地经验; 4、精通 PyTorch,熟悉 Megatron-LM、DeepSpeed 等分布式训练框架,具备百亿/千亿级参数模型的大规模训练经验,熟悉 veRL、OpenRLHF 者优先; 5、对多模态数据的构建、清洗及 Data Mixing 策略有独特见解,理解各训练阶段的数据需求差异; 6、熟悉主流多模态评测集,能构建垂直领域 Benchmark,并以评测结果反向驱动数据与算法迭代。【加分项】: 1、在 CVPR、ICCV、ECCV、NeurIPS、ICML、ICLR、ACL 等顶会发表过高影响力论文,或在知名开源多模态项目中有核心贡献。

    二维码微信扫一扫,及时了解投递状态
    头像您已有可投递的在线简历:点击投递
    简历完成度50%,完善简历才能找到好工作:完善简历

    公司介绍

    企业尚未更新

    工作地点

    地址上海市

    查看地图

    看了此职位的人还会看
    查看更多相似的职位 >>

    公司信息 给我留言

    推荐职位 相关公司推荐

    • 头像

      自由鸟健身工作室

      热招1个职位
      查看
    • 头像

      上海市复旦求是进修学院

      热招6个职位
      查看
    • 头像

      上海视妙文化传播有限公司

      热招1个职位
      查看
    • 头像

      凯莫(上海)教育科技有限公司

      热招2个职位
      查看
    • 头像

      上海若济生物医药科技有限公司

      热招1个职位
      查看
    二维码

    扫描二维码及时订阅职位

    最新职位信息第一时间知晓

    上海兼职招聘

    • 扫码下载APP

      上海招聘网APP
    • 扫码进小程序

      上海招聘网小程序

    服务信息

    联系电话: 13916151478 杨老师

    服务时间:08:00-18:00

    上海人才招聘 | 上海招聘网 | 上海找工作 | 上海招聘 | 上海人才招聘网

    Copyright 2012-2022 上海招聘网 All Rights Reserved

    详细地址:江西省南昌市青山湖区高新大道万象汇9号楼7楼

    版权所有:江西易职邦网络科技有限公司

    ICP证:赣ICP备2021008707号-3 赣公网安备 36010202000584号

    技术支持:南昌传爱网络科技有限公司

    关注公众号

    服务时间08:00-24:00

    微信公众号

    微信公众号

    招聘交流群

    招聘交流群

    微信小程序

    微信小程序

    微信扫一扫

    面试通知

    收藏

    简历

    足迹

    微信求职

    关注公众号

    掌握最新求职动态

    微信公众号

    小程序

    进入小程序

    随时随地找工作

    小程序