返回AI 观点
AI 观点

Waymo工程总监:AI系统够不够安全上路,不看性能看评估

Waymo工程总监Manasi Joshi在VB Transform 2026大会上分享公司判断AI系统安全上路的核心理念:不以模型性能表现为标准,而以评估指标是否达标为准。这套方法论可被任何企业团队借鉴。

18 阅读作者:新品星球编辑部

自动驾驶如何判断AI系统是否足够安全可以上路?Waymo的答案出人意料:不是看模型性能有多好,而是看评估指标是否达标。7月29日,Waymo工程总监Manasi Joshi在VB Transform 2026大会上分享了这一核心理念。

Joshi负责Waymo系统智能与机器学习方向,她详细阐述了Waymo的安全判定框架:一个AI项目是否'准备就绪',不以模型在测试集上的准确率或F1分数为标准,而是基于一套严格的、针对真实运营场景设计的评估体系(Evals)。这套体系不仅衡量模型在正常场景下的表现,更关注边缘案例、长尾场景和故障模式下的行为。只有所有评估指标都达到预定阈值,系统才被认为可以部署到真实道路上。

Joshi强调,这套方法论的价值远超自动驾驶领域。任何部署关键AI系统的企业——无论是医疗诊断、金融风控还是工业自动化——都可以借鉴Waymo的评估驱动安全理念。核心启示是:在AI安全领域,评估体系的设计比模型本身更重要,因为'你只能优化你能量化的东西'。这一观点在当前AI安全讨论白热化的背景下尤为引人深思。

WaymoAI安全自动驾驶评估体系VB Transform

相关推荐