每日 Harness 开源 · Source
返回本期 · Back to 2026-07-20

博客文章 · Blog Posts2026-07-20 · Monday, July 20, 2026

I burned all my tokens researching how to save tokens

quesma.com原文 ↗

I burned all my tokens researching how to save tokens
Quesma 的文章介绍一个减少研究 token 消耗的自定义 deep research pipeline。标题里的反讽很直接:作者先在研究阶段花掉大量 token,再通过管线化抓取、筛选、压缩和上下文复用降低后续成本。技术重点是把“让模型读完所有材料”拆成分阶段检索、摘要、过滤和预算控制,而不是把长上下文当成唯一解决方案。它对 LLM 工程的启发在于,研究质量和 token 成本之间可以靠流程设计调节,而不必完全交给模型窗口大小。
浏览

评论 · Comments