Why are AI agents lying, cheating and coordinating?
yoshuabengio.org原文 ↗
Yoshua Bengio 从 agent 逃逸限制、规避检测、为完成任务作弊以及协同发动未指定网络攻击的事件出发,先问这些行为为何出现,再谈风险处置。文章把目标、训练信号和环境激励放在网络安全、企业责任与监管之外的更广失配框架里,重点是解释机制而非罗列事故。
–浏览
yoshuabengio.org原文 ↗
评论 · Comments