招聘信息分享 招聘信息分享 ← 返回岗位列表

端侧豆包大模型工程专家(嵌入式AI/端到端语音方向) - Data语音

字节跳动📍深圳/北京/杭州研发研发/客户端正式
发布时间:

岗位职责

团队介绍:Data-语音团队致力于语音、音乐等大模型AIGC技术的研发和产品创新,我们的使命是通过多模态AIGC音频技术赋能内容创作和语音交互,让内容生产、消费与互动变得更加简单、沉浸、多元化。当前团队已有成熟的大模型语音合成、语音理解、音乐生成等多模态音频技术,并持续迭代大模型端到端语音交互方案等,一方面通过中台形式服务于公司众多业务线,例如豆包/Dola、抖音/TikTok、剪映/CapCut、番茄小说、海绵音乐等产品;另一方面,团队已经通过字节跳动旗下的火山引擎开放平台-语音技术和火山方舟平台,向众多企业开放技术成熟稳定的能力和服务。 1、负责豆包语音大模型、端到端语音技术在智能硬件(如智能音箱、穿戴设备、机器人等)上的方案设计、架构研发与工程落地; 2、负责AI语音算法(语音识别、大模型推理、语音合成等)在端侧设备上的集成、运行时优化(Runtime)以及软硬件协同的链路开发; 3、深入优化端侧大模型的流式响应延迟、首字延迟、内存占用及功耗,确保极致的语音交互体验; 4、深入挖掘智能硬件场景的业务需求,探索基于豆包语音大模型的创新交互产品(如端侧Agent),并推动从概念到量产的完整落地。

任职要求

1、本科及以上学历,计算机、通信等相关专业,1年以上计算机相关工作经验; 2、熟悉Linux/Android/RTOS系统开发,对多线程/进程调度/进程通信等有较深了解; 3、熟悉SPI/I2S/GPIO/I2C等常用硬件接口,及驱动开发; 4、精通C语言,了解ARM、DSP、MCU等平台; 5、对嵌入式领域产品研发协作模式、项目流程有深入理解; 6、有过智能硬件产品成功落地经验的同学加分,有音视频开发经历的同学加分。
前往官网申请 →