An Alien Mind
openai.com原文 ↗
OpenAI 将对齐从“模型是否遵守指令”扩展到能力增强后的人类价值与治理问题,特别强调工具调用、社交交互和非语言推理会削弱仅监控 chain-of-thought 的策略。文章称 GPT-6 Astra 比 GPT-5.6 Sol 更符合当前对齐目标,但仍需要激活监测、纵深防御和国际协作来处理递归自我改进风险。
–浏览
openai.com原文 ↗
评论 · Comments