岗位职责与要求:
1、探索应用多模态理解、生成式大模型、环境动力学、强化学习等前沿技术;
2、探索世界模型以及水下世界模型(含WAM、AC-WM),构建可编辑、可交互的世界模型,支持实时交互,并进行极致系统优化;探索数据合成、指令微调、偏好对齐、模型优化;提升 Scalable Oversight、模型推理与规划能力,构建全面客观准确的评测体系,持续探索提升大模型能力;
3、探索可交互模拟范式下的特定世界模型(PixelVerse-R1、Genie 3等),研究文本/参考图像到视频动作场景的转换,聚焦解决无限流视频生成的物理演化(out of screen dynamic)和长期记忆(long-term memory)难题;
4、利用预训练、仿真等技术对虚拟/现实世界的各类环境进行建模,提供多模态交互与物理演绎的基本能力,推动生成式基础模型在决策领域的应用落地,研发以大模型为核心的新范式、新技术。1、硕士及以上学历在读,计算机、人工智能、自动化、数学等相关专业优先;
2、在计算机视觉、多模态、生成式模型(AIGC)、强化学习(RL)、环境模拟等一个或多个领域有较深入研究者,具备前沿论文解读能力和实际落地能力;
3、熟练使用水下视频处理、3D重建及物理渲染技术等,对水下环境进行建模,为决策与规划水下世界模型提供高保真的多模态交互与物理演绎基础加分;
4、具有良好的沟通协作能力,工作积极主动,能够与团队融洽合作。
加分项:
在ACM/ICPC、Top Coder、Kaggle等比赛中取得过良好成绩是加分项;
在大模型领域,发表过相关论文是加分项;
在世界模型、具身智能、决策大模型或大规模多模态项目中有实际研发经验者优先。

微信扫一扫,及时了解投递状态
岗位职责与要求:
1、探索应用多模态理解、生成式大模型、环境动力学、强化学习等前沿技术;
2、探索世界模型以及水下世界模型(含WAM、AC-WM),构建可编辑、可交互的世界模型,支持实时交互,并进行极致系统优化;探索数据合成、指令微调、偏好对齐、模型优化;提升 Scalable Oversight、模型推理与规划能力,构建全面客观准确的评测体系,持续探索提升大模型能力;
3、探索可交互模拟范式下的特定世界模型(PixelVerse-R1、Genie 3等),研究文本/参考图像到视频动作场景的转换,聚焦解决无限流视频生成的物理演化(out of screen dynamic)和长期记忆(long-term memory)难题;
4、利用预训练、仿真等技术对虚拟/现实世界的各类环境进行建模,提供多模态交互与物理演绎的基本能力,推动生成式基础模型在决策领域的应用落地,研发以大模型为核心的新范式、新技术。1、硕士及以上学历在读,计算机、人工智能、自动化、数学等相关专业优先;
2、在计算机视觉、多模态、生成式模型(AIGC)、强化学习(RL)、环境模拟等一个或多个领域有较深入研究者,具备前沿论文解读能力和实际落地能力;
3、熟练使用水下视频处理、3D重建及物理渲染技术等,对水下环境进行建模,为决策与规划水下世界模型提供高保真的多模态交互与物理演绎基础加分;
4、具有良好的沟通协作能力,工作积极主动,能够与团队融洽合作。
加分项:
在ACM/ICPC、Top Coder、Kaggle等比赛中取得过良好成绩是加分项;
在大模型领域,发表过相关论文是加分项;
在世界模型、具身智能、决策大模型或大规模多模态项目中有实际研发经验者优先。

微信扫一扫,及时了解投递状态
简历完成度50%,完善简历才能找到好工作:
完善简历