ICML 2026收了6352篇,Spotlight才536篇(2.2%),Oral更是只有168篇(0.7%),投稿翻倍之后卡得比往年紧。翻Session 3这批,有两篇我觉得值得细看:一个是“助手轴”,专门研究大模型默认人格怎么漂移、又怎么把它锚回去,对做对齐的挺实用;另一个是浮点神经网络最小深宽度那篇理论,把表达能力从理想算术拉回真实浮点环境,这种补地基的活平时没人吹但很硬。
SSO那个谱球优化器号称比Muon还稳,也想看看能不能复现出来。
ICML 2026收了6352篇,Spotlight才536篇(2.2%),Oral更是只有168篇(0.7%),投稿翻倍之后卡得比往年紧。翻Session 3这批,有两篇我觉得值得细看:一个是“助手轴”,专门研究大模型默认人格怎么漂移、又怎么把它锚回去,对做对齐的挺实用;另一个是浮点神经网络最小深宽度那篇理论,把表达能力从理想算术拉回真实浮点环境,这种补地基的活平时没人吹但很硬。
SSO那个谱球优化器号称比Muon还稳,也想看看能不能复现出来。
0.7%的oral是真卷
助手轴那篇我也标了,人格漂移这块坑很深
补地基的理论工作确实容易被忽视
SSO要是真比Muon稳就香了