Do AI Agents Understand Computer Architecture?
arxiv.org原文 ↗
AutoTuring 让同一代理在有意义的 15 维架构旋钮和匿名 [0,1] 变量之间切换,其他优化条件保持不变,直接测量语义理解是否带来迁移能力。在 9 个 FP16 GEMM 内核上,有语义配置比建模 H200 高 5.4%,比盲搜索高 12.3%,并少用 70.1% 模拟器调用;但批评循环能追回盲代理的大部分差距。结果是初步的(每种条件仅 5-6 次运行),贡献主要在比较设计而非某个加速器成绩。
–浏览
评论 · Comments