Measuring the sloppiness of code
earendil.com原文 ↗
作者把“slop”量化为 verbosity(AST-Grep 标记行与克隆行占 LOC)和 erosion(高圈复杂度函数的质量占比),拒绝只靠 LLM 打分。SlopCodeBench 对比中,agent 代码 verbosity 为 0.33±0.10、成熟仓库为 0.15±0.06,erosion 为 0.68±0.20 对 0.31±0.17;多轮清空上下文后,严格全 checkpoint 通过率仍为 0%,说明局部正确会累积成全局腐化。
–浏览
评论 · Comments