Which Models Are Our Models Built On? Auditing Invisible Dependencies in Modern LLMs
arxiv.org原文 ↗
这篇论文提出 ModSleuth,用 agentic 系统从模型卡、论文、README、数据说明等公开材料里递归重建 LLM 依赖图,而不是只抽取单层引用。作者在 4 个公开材料丰富的 LLM release 上恢复了 1,060 个带 source-grounded evidence 的依赖,并把依赖关系区分为直接、间接以及不同 pipeline operation。它值得读的地方在于把“模型训练用了谁的输出”从模糊伦理问题落成可审计图结构,同时也承认难点已经从信息抽取转向依赖定义和 artifact identity 对齐。
–浏览
评论 · Comments