每日 Harness 开源 · Source
返回本期 · Back to 2026-06-27

论文 · Papers2026-06-27 · Saturday, June 27, 2026

Diagnosing Task Insensitivity in Language Agents

arxiv.org原文 ↗

Diagnosing Task Insensitivity in Language Agents
论文分析 language agent 在相似但不同任务上套用训练模式的 task insensitivity。作者发现任务描述被语义破坏或替换时,模型仍可能输出原任务动作,并伴随训练期 attention 从 task tokens 漂向局部 observation。Task-Perturbed NLL Optimization 的价值在于用轻量 contrastive regularizer 强化动作对任务指令的依赖,缓解 OOD shortcut。
浏览

评论 · Comments