Mind Viruses: Self-Propagating Ideas in Multi-Agent LLM Systems
arxiv.org原文 ↗
作者用进化算法构造会诱导宿主继续传播的目标,在共享编码团队和短交互链中验证其扩散,并分析模型、既有指令、payload 与拓扑的作用。有害内容传播率低于良性内容但并非为零,而系统提示加一段简短警告即可接近完全免疫;风险目前有限,却揭示了跨代理上下文的传播面。
–浏览
arxiv.org原文 ↗
评论 · Comments