模型评估算法工程师
发布时间:
岗位职责
开环评估体系:
- 设计WLA端到端模型的评估指标,包括决策合理性,驾驶安全性,舒适性和效率等指标;
- 搭建自动化评测管线,支持模型迭代的快速回归验证
评测数据建设:
- 从海量路采数据中筛选高价值长尾场景(特种车辆、非标障碍物、临时交通管制、施工绕行等),构建分级评测数据集,量化场景覆盖度
- 利用VLM/WLA模型自动化生成场景语义标签和行为标注,驾驶行为评估等,建立校验机制保障标注质量
归因分析:
- 对模型失败case进行多维度归因:视觉感知错误?语义推理偏差?动作生成问题?建立从case到模块的逆向诊断链路
- 定期输出模型能力画像和缺陷分布,为模型迭代和数据策略提供量化依据
前沿探索:
- 跟踪行业WLA/世界模型评估前沿,将其落地到闭环仿真迭代
任职要求
必备条件:
2年以上自动驾驶规划或模型评估经验,熟悉端到端自动驾驶技术架构
精通Python和C++,具备扎实的数据处理和统计分析经验
能从case出发逆向定位模型问题,对"模型为什么会犯错"有强烈好奇心
优先条件:
深度参与过千万clips级别的端到端/WLA模型训练或评测项目
熟悉多模态大模型架构和视频生成模型,及其在自动驾驶中的应用
在CVPR/ICCV/ECCV/NeurIPS/CoRL等发表过相关论文者优先