Import AI 474:Levin 提出“柏拉图思维空间”;TPU 上太空;智谱启动外层 RSI 循环
Import AI 第 474 期聚焦三项进展。Michael Levin 提出“柏拉图思维空间”假说,认为心智与身体的关系如同数学模式与其引导的形态发生结果,并借 xenobots、anthrobots 等实验加以论证。同期内容还包括 TPU 上太空,以及智谱启动外层 RSI 循环。
Import AI 第 474 期聚焦三项进展。Michael Levin 提出“柏拉图思维空间”假说,认为心智与身体的关系如同数学模式与其引导的形态发生结果,并借 xenobots、anthrobots 等实验加以论证。同期内容还包括 TPU 上太空,以及智谱启动外层 RSI 循环。
IBM Granite 团队发布 Granite 4.2 系列推理模型,包含 3B、8B、30B 三种稠密尺寸,均以 Apache 2.0 许可开源,并从 Granite-4.1 基座模型后训练而来。
推荐理由:原文给出了从预训练到多阶段强化学习的完整构建细节,读者可以据此理解推理模型的训练配方与工程取舍。
Multiverse Computing 提出 Quantization-Aware Healing(QAH),把 GPT-OSS 120B 压缩到 60B 参数并量化为 MXFP4 后,直接在原始预压缩模型上做 KL 蒸馏而非从恢复出的 checkpoint 蒸馏,结果在 9 项基准中的 7 项超过该 60B 模型的 bfloat16 版本。
推荐理由:论文给出压缩加量化后再蒸馏原始模型的做法,读者可比较其与常规 QAT 在精度和训练稳定性上的差异。
Import AI 469 期介绍了新基准 DiG-bench,用 70 款规则隐藏的游戏测试 AI 自主探索与发现能力,目前仅 Opus 5 和 Fable 5 在 Tier 7 取得 0.2 分,远低于人类的 100%。
Google Research 发布一种将多 Token 预测(MTP)改造到已冻结的 Gemini Nano v3 上的新架构,已在 Pixel 9 和 10 系列上线。
推荐理由:读者可以看到冻结主干加 MTP 头的架构取舍,以及它在 Pixel 端侧推理上的速度与内存收益。
Google Research 在 COLM 2026 论文《Thinking to Recall》中提出,让 LLM 生成推理轨迹能解锁原本无法触及的参数化事实,且这一效应在简单单跳问题上同样成立。研究用 Gemini-2.5 Flash/Pro 和 Qwen3-32B 在 SimpleQA Verified、EntityQuestions 上对比推理开关,识别出计算缓冲与事实启动两种机制。
Google Research 在 ICLR 论文中提出 ReasoningBank,一个从成功和失败经验中提炼高层结构化记忆的智能体记忆框架,代码已开源。
推荐理由:论文提出从成功与失败经验中提炼结构化记忆的框架,读者可了解智能体测试时自我进化的具体做法与实测增益。
Berkeley AI Research 提出梯度规划器 GRASP,通过将轨迹提升到虚拟状态、在状态迭代上直接加入随机性、重塑梯度三招,让基于世界模型的长时程规划更稳健。GRASP 把轨迹提升到虚拟状态,使优化可跨时间并行,同时避免经由高维视觉模型的脆弱状态输入梯度。该工作与 Mike Rabbat、Aditi Krishnapriyan、Yann LeCun、Amir Bar 合作完成。
Google Research 发布推理优先框架 Simula,将合成数据生成重构为机制设计问题,通过全局多样化、局部多样化、复杂化和 dual-critic 质量检查四个可控维度从零构建数据集,无需种子数据。
Berkeley AI Research 提出 SPEX 与 ProxySPEX 算法,可在特征、数据和模型组件归因中大规模识别驱动 LLM 输出的关键交互。SPEX 利用稀疏性与低阶性把交互搜索转化为稀疏恢复问题,ProxySPEX 进一步引入层次结构,仅需约 10 倍更少的消融即可达到 SPEX 的性能。
Berkeley AI Research 的新论文为 word2vec 给出了定量可预测的学习理论:在合理实用条件下,其学习问题可化简为无权重最小二乘矩阵分解,梯度流动力学存在闭式解,最终学到的嵌入等价于对目标矩阵 M* 做 PCA。