读论文

不是意识证明,而是可检验的内部工作台
Wes Gurnee、Nicholas Sofroniew、Jack Lindsey 等 · Anthropic · Transformer Circuits Thread · 2026

Jacobian Lens 把模型中间层里可被语言化的表示读出来。真正的发现不是它们存在,而是它们只占激活方差的不到 10%,并且只支撑显式报告与灵活推理、不支撑自动化处理。

阅读原文 → #interpretability #LLM #mechanistic-interpretability
做事的脑,记事的脑
Siru Ouyang 等 · Google Cloud AI Research · UIUC · MIT · 2026

SkillOS 把智能体拆成冻结的「执行者」和可训练的「策展人」,后者用纯文本管理一座技能库——而一个 RL 训出的 8B 策展人,在这件事上赢过 Gemini-2.5-Pro。

阅读原文 → #agents #memory #self-evolution