视觉多模态应用算法工程师/专家(视频通话方向) - Seed Model
发布时间:
岗位职责
团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。
Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。
1、负责视频通话模型Post-training的优化和研发,包括通话长多轮对话体验的优化、视觉感知能力、联网搜索能力、记忆、Agent调用能力等;
2、研发视频通话的新特性,包括主动响应、音视频双工等特性;
3、参与智能硬件相关能力的优化,提升端到端用户体验;
4、探索各种前沿创新性技术,并转化为应用侧效果。
任职要求
1、硕士学位及以上,人工智能、计算机、自动化、数学相关专业优先;
2、有视频大模型训练、智能硬件相关研究经验者优先,在顶级学术会议上发表过多模态大模型相关研究论文者优先;
3、责任心强,积极主动,有良好的沟通能力和团队合作能力,对视频通话、智能硬件应用有强烈兴趣者优先。