摘要

Agent Failure Localization 是从智能体执行证据中定位最早未恢复的关键失败,确定其发生在哪两个组件的交互边上,并判断修复责任属于哪一侧的过程。(来源:Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures

核心内容

定义

当前交互中心方法使用“interaction edge + fault side + failure mode”三部分标签,把表面行为、发生边界和修复归属分开。(来源:Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures

关键要点

适用范围与边界

适用于编码智能体、长时个人助手和多智能体系统的事后诊断。可靠归因要求足够完整的轨迹、组件边界和环境证据;信息缺失时应保留多种解释或拒绝强行分类。(来源:Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures

分歧与演变

该方法强调跨架构共享的组件交互,而许多既有分类更侧重特定 benchmark、内部模块或终局错误类型。两者可以互补:先定位关键事件与责任组件,再使用领域分类描述具体机制。(来源:Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures

相关页面

来源

待核实问题