Tokenomics: Quantifying Where Tokens Are Used in Agentic Software Engineering
arxiv.org原文 ↗
论文分析 LLM 多智能体软件工程系统在 SDLC 各阶段的 token 消耗,而不是只看一次代码生成的开销。作者用 ChatDev 在 GPT-5 reasoning model 上执行 30 个软件开发任务,把内部阶段映射到设计、编码、补全、代码评审、测试和文档;初步结果显示迭代式 Code Review 平均占 59.4% token,输入 token 平均占 53.9%。这使 agentic coding 的成本瓶颈更具体地落在协作与验证协议上,而非模型输出本身。
–浏览
评论 · Comments