每日 Harness 开源 · Source
返回本期 · Back to 2026-08-06

论文 · Papers2026-08-06 · Thursday, August 6, 2026

Test-Time Scaling in Reasoning LLMs

arxiv.org原文 ↗

Test-Time Scaling in Reasoning LLMs
这篇综述把推理模型的测试时扩展归纳为单轨迹延长、叶节点终态规约和前缀搜索三类,并区分精确复现与分布式结果复现。作者同时发布约 20 亿 token 的完整推理轨迹,试图让采样、验证与搜索策略可以在统一材料上比较。它的价值主要是清理术语和复现实验边界;作为综述,并没有提出一个能跨任务取胜的新缩放算法。
浏览

评论 · Comments