招聘信息分享 招聘信息分享 ← 返回岗位列表

语音生成算法工程师

小米📍北京生态链
发布时间:

岗位职责

1.聚焦语音生成大模型技术研究,涵盖多模态融合,提升长序列建模能力与实时时性; 2.研发风格与情感可控技术,构建语义-时序-声学等多级可控接口,支持音色迁移与交互式编辑; 3.提升instruct tts的泛华,完成context-awaretts在小米业务场景上的落地。

任职要求

1.精通传统端到端和最新大语言模型TTS框架、熟悉声学模型与声码器,具备TTS大模型或语音克隆项目经验 2.对各个模块的原理、问题、改进点能有自己的深入理解; 3.具备较强的工程实现能力,有开源项目开发经验优先,沟通能力强; 4.在顶级学术会议或期刊发表过相关方向论文者优先; 5.硕士及以上学历。
前往官网申请 →