返回列表
VLA / Vision-Language-Action 每日论文卡
Output Type Before Quality: A Standards-Derived XAI Admissibility Rubric for Autonomous-Driving Safety
论文聚焦于自动驾驶安全领域,识别并形式化了安全标准对可解释性证据的类型要求与当前主流XAI方法输出类型之间的结构性不匹配(即“证据类型鸿沟”)

论文详情

Output Type Before Quality: A Standards-Derived XAI Admissibility Rubric for Autonomous-Driving Safety

2026-06-03 · 原文 · 翻译 · 2606.05461

论文聚焦于自动驾驶安全领域,识别并形式化了安全标准对可解释性证据的类型要求与当前主流XAI方法输出类型之间的结构性不匹配(即“证据类型鸿沟”) 研究发现,安全标准(如ISO/PAS 8800)要求有向因果链、量化干预效应等证据,而最流行的XAI方法(如SHAP)只能返回特征排序列表,无法在结构上满足这些要求 论文旨在通过构建一个基于标准的评估量规,系统性地识别哪些生命周期阶段必须使用因果XAI方法才能满足安全证据要求,并指导XAI方法的选择

6 分钟读完 6 张阅读卡 NVIDIA Corporation, Santa Clara, CA, USA
一眼看懂 封面预览

论文聚焦于自动驾驶安全领域,识别并形式化了安全标准对可解释性证据的类型要求与当前主流XAI方法输出类型之间的结构性不匹配(即“证据类型鸿沟”)

  • 论文聚焦于自动驾驶安全领域,识别并形式化了安全标准对可解释性证据的类型要求与当前主流XAI方法输出类型之间的结构性不匹配(即“证据类型鸿沟”)
  • 研究发现,安全标准(如ISO/PAS 8800)要求有向因果链、量化干预效应等证据,而最流行的XAI方法(如SHAP)只能返回特征排序列表,无法在结构上满足这些要求
  • 论文旨在通过构建一个基于标准的评估量规,系统性地识别哪些生命周期阶段必须使用因果XAI方法才能满足安全证据要求,并指导XAI方法的选择
Card 01 研究单位

研究单位

  • NVIDIA Corporation, Santa Clara, CA, USA
  • NVIDIA GmbH, Munich, Germany
Card 02 论文概述

论文概述

  • 论文聚焦于自动驾驶安全领域,识别并形式化了安全标准对可解释性证据的类型要求与当前主流XAI方法输出类型之间的结构性不匹配(即“证据类型鸿沟”)
  • 研究发现,安全标准(如ISO/PAS 8800)要求有向因果链、量化干预效应等证据,而最流行的XAI方法(如SHAP)只能返回特征排序列表,无法在结构上满足这些要求
  • 论文旨在通过构建一个基于标准的评估量规,系统性地识别哪些生命周期阶段必须使用因果XAI方法才能满足安全证据要求,并指导XAI方法的选择
Card 03 核心贡献

核心贡献

  • 提出了一个从安全标准条款中推导出的、包含19个可测试证据标准的评估量规,覆盖了自动驾驶系统的7个生命周期阶段,并配有可复现的S/P/F评分规则
  • 通过结构评分分析,明确识别出危害识别、事故调查和数据管理三个生命周期阶段,因果XAI在结构上对于满足证据要求是唯一必要的,且这一结论具有鲁棒性
  • 在一个包含1,996个真实驾驶片段的VLA模型上进行了概念验证实验,验证了所测试的XAI方法观察到的输出类型与量规预测相匹配,并揭示了SHAP的静默故障案例
Card 04 方法描述

方法描述

  • 理论基础:基于Pearl的因果层次理论,论证了关联层级(rung-1)的方法无法回答干预(rung-2)或反事实(rung-3)问题,这是结构不匹配的根源
  • 量规构建:系统性地从AMLAS, ISO 21448, ISO/PAS 8800, ISO 26262四个出版物中提取了19个可解释性相关的证据需求,并将其分类到7个安全生命周期阶段,制定S/P/F评分规则
  • 结构评估:对SHAP, GradCAM, Counterfactual, SCM, Causal Trace, CoC六类XAI方法,根据其输出类型(而非输出质量)在结构上能否满足每个证据标准进行评分,并计算各阶段最佳因果方法与非因果方法的得分差距
  • 实证验证:在NVIDIA PhysicalAI-AV数据集上,对单个VLA模型施加7种扰动,运行SHAP、SCM和CoC轨迹,检验其实际输出类型是否与量规预测一致
Card 05 数据集与资源

数据集与资源

  • 使用的数据集:NVIDIA PhysicalAI-AV 数据集,包含 1,996 个真实世界驾驶片段
  • 模型规模和参数量:论文中未明确提及所测试的VLA模型的具体参数量
  • 训练资源:论文中未明确提及训练所用的 GPU/TPU 等具体资源,但研究单位为NVIDIA,可推断使用了NVIDIA的GPU资源
Card 06 评估与结果

评估与结果

  • 评估环境和基准:在1,996个片段上,施加7种不同严重程度的扰动,生成79,840行数据,使用10次随机种子进行训练/测试分割
  • 主要评估指标:量规的S/P/F评分、因果必要性的阈值差距(≥30%)、单细胞翻转鲁棒性、SHAP的、SCM的有向边数量、CoC的动作变化率
  • 关键实验结果:

- 结构分析:在危害识别(+62%)、事故调查(+50%)和数据管理(+50%)阶段,因果XAI得分显著优于非因果方法,且该结论对阈值和单细胞评分扰动具有鲁棒性

- 实证验证:SHAP返回了特征排序列表(无有向边),SCM生成了有向无环图(DAG),CoC轨迹返回了自然语言因果候选,与量规的结构预测完全一致

- 静默故障案例:在一个亮度扰动导致严重轨迹偏差的案例中,SHAP将实际扰动原因排在第8位,而SCM和CoC也未能成功定位故障,突显了验证因果解释保真度的挑战