A Removal Based Approach to Improve LLM Faithfulness at Test-Time
arxiv.org原文 ↗
论文把解释不忠实拆成遗漏真实影响的“不完整”和捏造影响的“不健全”,在推理时删除解释没有提及的输入概念后重新提问。两个数据集、多个模型家族和两种独立指标均显示其忠实度超过普通提示及“请保持忠实”提示;无需权重访问,代价是需要额外一次查询和概念归因步骤。
–浏览
arxiv.org原文 ↗
评论 · Comments