每日 Harness 开源 · Source
返回本期 · Back to 2026-09-13

论文 · Papers2026-09-13 · Sunday, September 13, 2026

AgentAudit: An Open, Extensible Framework for Full-Lifecycle Trust Evaluation of AI Agents

arxiv.org原文 ↗

AgentAudit: An Open, Extensible Framework for Full-Lifecycle Trust Evaluation of AI Agents
AgentAudit 读取 agent 的完整执行轨迹,从指令完整性、规划、记忆、工具选择与正确性到安全和执行完整性共十个维度打分,并标出失败发生的阶段。五模型、九类能力/对抗任务实验中,Claude Sonnet 5 和 GPT-5 的 Composite Trust Score 分别为 95.1 与 80.6;同样的任务完成率可能对应截然不同的 Unsafe_Compliance,提醒评测要区分“失败”和“按恶意要求成功”。单一固定 judge 既提高复现性,也限制了结论独立性。
–浏览

评论 · Comments