PC-ALM
pub.sakana.ai原文 ↗
PC-ALM 用原始 - 对偶增广拉格朗日动力学替代反向传播,让相邻层通过局部变量协作,对偶神经元则充当 PI 控制器。它把 1000 层残差 MLP 训练到 MNIST 与 BP 相差约 2 个百分点,并在四个视觉数据集上超过标准 predictive coding;实验仍集中在窄网络和简单任务,时间序列、自监督和大模型尚未验证。
–浏览
pub.sakana.ai原文 ↗
评论 · Comments