每日 Harness 开源 · Source
返回本期 · Back to 2026-08-12

论文 · Papers2026-08-12 · Wednesday, August 12, 2026

Stealing Reasoning Traces from Proprietary LLM APIs

arxiv.org原文 ↗

安全与攻防上下文工程系统·基础设施
Stealing Reasoning Traces from Proprietary LLM APIs
论文抓住闭源 API 的架构缺口:服务端把加密推理块交给客户端保存并在后续请求回传,但同一厂商内这些块能跨会话、用户乃至模型互换。攻击者可把强模型的块送给防护较弱的模型,诱使后者逐字吐出明文;作者在 Anthropic、OpenAI 和 Google 上演示了反蒸馏、隐私提取、危险信息泄漏与隐形提示注入四类路径。对公共仓库中 315,320 个 reasoning block 的解码找到 367 项 PII 和 182 份凭据,说明“内容加密”若不绑定主体、模型与会话,仍无法提供隔离。
浏览

评论 · Comments