See What I See, Know What I Think
arxiv.org原文 ↗
这篇论文把多 agent 通信从“把想法写成文本再让对方读”推进到异构模型之间的 KV-cache 对齐:发送方的视觉/推理状态被变换成接收方可继续使用的 latent。实验覆盖 Qwen3-4B、8B、14B 的六个传输方向,并区分 context-aware 与 context-unaware 两种设置;前者报告约 2-3 倍计算节省,后者用来检验没有输入时是否还能保留上下文知识。值得看的是它没有停在同构模型复制缓存,而是把跨模型 latent alignment 当成核心问题处理。
–浏览
评论 · Comments