招聘信息分享 招聘信息分享 ← 返回岗位列表

千问事业部-音频多模态生成算法专家-杭州/北京/上海

阿里巴巴📍北京/杭州/上海技术类技术类-算法2年以上硕士
发布时间:

岗位职责

1. 负责音频多模态生成大模型的研发,包含语音合成、音乐生成、音效生成和歌曲生成等任务的基础研究和应用落地; 2. 研发基于扩散模型(Diffusion Models)或自回归模型(AR)的音频生成算法; 3. 研究音频表征、强化学习或语音端到端等技术方向。

任职要求

1. 计算机、信号处理、数学等相关专业硕士/博士学位,3 年以上相关工作经验; 2. 在语音合成、音乐生成、音效生成或语音端到端等领域有深入研究,具备大规模数据训练经验; 3. 熟练掌握 PyTorch/DeepSpeed/Megatron等框架,有高性能推理优化经验者优先; 4. 发表过领域顶级会议文章(NeurIPS、ICML、ICLR、ACL、ICASSP、Interspeech等)、相关实习经验或者ACM竞赛获奖者优先。
前往官网申请 →