ProvenanceGuard: Source-Aware Factuality Verification for MCP-Based LLM Agents
arxiv.org原文 ↗
ProvenanceGuard 处理的是 source-aware factuality:一个 claim 即使被 pooled evidence 支持,只要归因给了错误来源,在 MCP 场景里仍然是事实性风险。系统读取带稳定 tool ID、source ID、raw output 的 MCP trace,把回答拆成 atomic claims,路由到 source-specific evidence,再用 NLI 和 token-alignment proxy 判断支持关系与归因一致性。论文在 281 条医学域 MCP-agent traces 上构造 2,325 个 claim labels,40-trace held-out split 的 block F1 为 0.802、source accuracy 为 0.858;更难的 multi-source benchmark 上 block F1 到 0.846,但 source-plus-relation accuracy 只有 0.229,说明精确来源归属仍是硬点。
–浏览
评论 · Comments