Towards Reliable and Robust LLM Planning
arxiv.org原文 ↗
这项工作用符号反馈驱动 LLM planning 的迭代自修正,目标是减少长程决策中的不可行计划和错误解。摘要把 planning 明确放在 security、robustness 和 reliability 的语境中,而不是单纯作为推理 benchmark。可检查的 symbolic feedback 是重点,因为它给语言计划提供了比自我反思更硬的约束。
–浏览
评论 · Comments