← Demo

神经元激活冻结:模型陷入 trap 的过程

载入中…

2026-08-27 更正:冻结是真的,但成因是平凡的

本页展示的 activation churn 下降确实存在(深层 L12–15 差 −0.21 ~ −0.23, 浅层只有 −0.04 ~ −0.06),图和数都没问题。但当时缺一个对照: 机器人卡住 → 观测不变 → 模型输入不变 → 神经元激活当然不变

补上之后:激活粘滞与「输入自身稳定度」相关 r = +0.934, 把输入回归掉后 AUC 从 0.836 掉到 0.419; 输入稳定度单独就有 0.878,比激活指标还高。所以这不是激活层面的机制。

本页核心分析保留作为记录;开场已补充多 case、多 rollout 的真实分布。经受住全部对照的结论见 signal-explainer · case-spread。