欢迎访问上海招聘网!本站为上海找工作求职者提供上海人才招聘、上海人才市场、上海人才网等岗位信息!


职位月薪: 面议
解决语音合成中音色的可控设计、精细编辑与情感表达难题,构建"设定形象→生成对味声音"的全链路音色合成系统。1. 从自然语言描述精准生成目标音色(Voice Design),支持年龄、性格、质感等属性的可控刻画,并支持对已有音色的指令驱动修改(Voice Edit)。2. 实现同一音色在多情绪(喜怒哀惧)下的高保真自然表达,解决音色与情绪的耦合问题。3. 通过基座 TTS 模型的角色化微调,在克隆音色的同时学习特定说话人的表演韵律与语言风格,并构建 VC 驱动的自动化训练数据管线。1、有语音合成(TTS)、音色克隆或语音转换相关研究经验,熟悉主流 TTS 框架与音频生成模型架构;2、有 Diffusion / Flow Matching / 自回归模型在语音领域的实践经验,能独立完成从数据构建、模型训练到评估的全链路工作;3、有大规模音频数据处理与自动化 pipeline 搭建经验,有模型微调与工程化落地能力;4、在 ICASSP、INTERSPEECH、NeurIPS 等顶会发表过高质量论文,或有 CosyVoice、GPT-SoVITS 等开源项目贡献经验。
微信扫一扫,及时了解投递状态
您目前还没有登录:立即登录解决语音合成中音色的可控设计、精细编辑与情感表达难题,构建"设定形象→生成对味声音"的全链路音色合成系统。1. 从自然语言描述精准生成目标音色(Voice Design),支持年龄、性格、质感等属性的可控刻画,并支持对已有音色的指令驱动修改(Voice Edit)。2. 实现同一音色在多情绪(喜怒哀惧)下的高保真自然表达,解决音色与情绪的耦合问题。3. 通过基座 TTS 模型的角色化微调,在克隆音色的同时学习特定说话人的表演韵律与语言风格,并构建 VC 驱动的自动化训练数据管线。1、有语音合成(TTS)、音色克隆或语音转换相关研究经验,熟悉主流 TTS 框架与音频生成模型架构;2、有 Diffusion / Flow Matching / 自回归模型在语音领域的实践经验,能独立完成从数据构建、模型训练到评估的全链路工作;3、有大规模音频数据处理与自动化 pipeline 搭建经验,有模型微调与工程化落地能力;4、在 ICASSP、INTERSPEECH、NeurIPS 等顶会发表过高质量论文,或有 CosyVoice、GPT-SoVITS 等开源项目贡献经验。
企业尚未更新
上海市
扫描二维码及时订阅职位
最新职位信息第一时间知晓
上海兼职招聘
360行任你挑选
分秒必争直达HR
谁看我简历早知道
请使用微信【扫一扫】
关注「上海易职邦招聘」公众号完成登录
客服电话:400-765-0056
竭诚为您服务
服务时间08:00-24:00
微信小程序
面试通知
收藏
简历
足迹
微信求职
关注公众号
掌握最新求职动态
小程序
进入小程序
随时随地找工作