返回本期 · Back to 2026-08-06 论文 · Papers2026-08-06 · Thursday, August 6, 2026 Test-Time Scaling in Reasoning LLMs arxiv.org原文 ↗ 测试时计算评测方法其他垂直 这篇综述把推理模型的测试时扩展归纳为单轨迹延长、叶节点终态规约和前缀搜索三类,并区分精确复现与分布式结果复现。作者同时发布约 20 亿 token 的完整推理轨迹,试图让采样、验证与搜索策略可以在统一材料上比较。它的价值主要是清理术语和复现实验边界;作为综述,并没有提出一个能跨任务取胜的新缩放算法。 –浏览 –点赞 复制链接 评论 · Comments
评论 · Comments