招聘信息分享 招聘信息分享 ← 返回岗位列表

多模态基础模型算法工程师 - Data

字节跳动📍北京/上海/杭州研发研发/算法正式
发布时间:

岗位职责

团队介绍:Data作为公司的技术中台,支撑字节跳动旗下抖音、剪映、番茄等产品与火山引擎业务的高速发展。 加入Data,你将有充足的空间进行技术探索,覆盖C端、B端、AI应用等不同业务: 算法业务:依托亿级 DAU 的超大规模真实业务场景,全面覆盖推荐、搜索、广告、电商与生活服务,持续探索 AI 应用与 AI Infra 前沿领域。 火山引擎:业界领先的AI云,涵盖从销售、解决方案到客户落地支持的全链路,为企业的数字化转型与智能化升级提供全周期技术支持。 技术中台:覆盖存储、计算、网络、数据库、大数据、视频编解码、基础设施等全领域基础技术,为产品服务与AI研发提供底层保障。 1、负责业务基模的预训练体系建设,覆盖Pretrain与Midtrain全流程,围绕多模态模型训练,开展模型架构优化、训练目标设计、世界知识体系构建与注入、训练策略优化、千卡训练效率提升等探索,持续提升模型在视频与图文场景下的世界知识能力、多实体与细粒度识别能力,以及通用感知与理解能力; 2、负责业务基模的后训练体系建设,围绕SFT、RL、OPD等方向开展方法探索与落地,建设包含指令数据、偏好数据及业务推理数据在内的后训练数据体系,持续提升模型在业务场景下的指令跟随能力、通用推理能力与抗幻觉能力,实现模型效果与业务目标的持续对齐; 3、负责基模训练全阶段的数据与评估体系建设,覆盖预训练数据、后训练数据的数据清洗、标注、配比、合成与迭代,搭建全面的评估体系与质量监控机制,建立基模评估体系与业务表现之间的桥梁,提升离线评估对线上效果的预测能力; 4、跟踪基础模型领域最新技术进展,探索模型架构、训练范式、数据构建、知识强化和模型对齐等方向的前沿方法,并推动其在业务基模中的落地应用。

任职要求

1、基础扎实,有良好的代码、机器学习算法功底和经验; 2、熟悉CV、VLM、Omni Model、LLM、Agent、DeepResearch、视觉搜索/AI问答等相关的算法和技术; 3、出色的问题解决能力,善于分析,历史上解决过难题,遇到难题时能静下心,没有畏难情绪,能查到底层; 4、由衷热爱技术,可以一线写代码,查问题,有强烈的工作责任心,较好的学习能力、沟通能力和自驱力。
前往官网申请 →