NanoGPT Speedrun Frontier
primeintellect.ai原文 ↗
Prime Intellect 把 nanoGPT 优化竞赛做成可浏览数据集:18 个前沿模型跑了 153 次自主实验,并公开 41 条含工具调用、子代理和 scratchpad 的完整轨迹。榜首 Fable 5 记录 2,726、闭合 81.7% 差距;同预算比较中 Kimi K2.7 达 3,240,页面的贡献是让“模型+代理策略+时间预算”可以拆开比较,而非只看一个最终分数。
–浏览
评论 · Comments