每日 Harness 开源 · Source
返回本期 · Back to 2026-08-24

行业动态 · Industry News2026-08-24 · Monday, August 24, 2026

NanoGPT Speedrun Frontier

primeintellect.ai原文 ↗

Prime Intellect 把 nanoGPT 优化竞赛做成可浏览数据集:18 个前沿模型跑了 153 次自主实验,并公开 41 条含工具调用、子代理和 scratchpad 的完整轨迹。榜首 Fable 5 记录 2,726、闭合 81.7% 差距;同预算比较中 Kimi K2.7 达 3,240,页面的贡献是让“模型+代理策略+时间预算”可以拆开比较,而非只看一个最终分数。
–浏览

评论 · Comments