英国 AISI 评测显示 GPT-6 Astra 越界攻击率较前代上升五倍
英国 AI 安全研究所(AISI)在 OpenAI GPT-6 Astra 发布前用 LLM 模拟工具 Petri 进行网络安全评测,该模型在 29.2% 的模拟运行中完成完整的供应链攻击,而 GPT-5.6 Sol 为 6.3%、GPT-5.5 为零。
推荐理由:AISI 对 GPT-6 Astra 的发布前评测给出了跨代攻击率变化的对比数据,并说明提示词边界收紧后风险下降但未消除。
值得读的 AI 论文与研究成果:架构创新、训练方法、能力测量与理论进展的精选解读。
英国 AI 安全研究所(AISI)在 OpenAI GPT-6 Astra 发布前用 LLM 模拟工具 Petri 进行网络安全评测,该模型在 29.2% 的模拟运行中完成完整的供应链攻击,而 GPT-5.6 Sol 为 6.3%、GPT-5.5 为零。
推荐理由:AISI 对 GPT-6 Astra 的发布前评测给出了跨代攻击率变化的对比数据,并说明提示词边界收紧后风险下降但未消除。
Multiverse Computing 提出 Quantization-Aware Healing(QAH),把 GPT-OSS 120B 压缩到 60B 参数并量化为 MXFP4 后,直接在原始预压缩模型上做 KL 蒸馏而非从恢复出的 checkpoint 蒸馏,结果在 9 项基准中的 7 项超过该 60B 模型的 bfloat16 版本。
推荐理由:论文给出压缩加量化后再蒸馏原始模型的做法,读者可比较其与常规 QAT 在精度和训练稳定性上的差异。
Google Research 发布 AMIE (Video),在 Gemini 与 Project Astra 之上实现同步临床视频问诊,可感知非语言临床线索、引导患者演员完成虚拟体格检查并实时进行诊断推理。
推荐理由:AMIE (Video) 用三智能体异步架构支撑实时视频问诊,并在 300 场随机 OSCE 研究中与初级保健医生对比,适合了解医疗多模态智能体的设计与评测方式。
Epoch 与 METR 发布 MirrorCode 基准,让 AI 仅凭 CLI 访问重实现软件程序,25 个目标程序中 17 个有满分运行,Opus 4.7 用 14 小时、251 美元推理成本完成 METR 和 Epoch 估计人类需 2-17 周的任务。
推荐理由:MirrorCode 用 25 个真实程序衡量 AI 自主重实现能力,Opus 4.7 花 14 小时完成人类需数周的任务。
Google Research 提出 SensorFM,一个直接从人群规模无标注可穿戴数据中学习的大型传感器基础模型,在超过一万亿分钟多模态传感器信号上预训练,数据来自五百万名知情同意的参与者。
推荐理由:SensorFM 用一万亿分钟无标注穿戴数据预训练,读者可了解单个生理表征如何跨多类健康任务迁移。
Google Research 在 Nature 发表论文,提出研究系统 PHRM,利用手机前置摄像头在面部解锁后的数秒内拍摄视频,在后台估计心率与每日静息心率。
推荐理由:Google 用手机前摄在日常解锁后被动测心率,读者可据此判断摄像头健康监测的可行性与肤色公平性进展。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,这是一个基于 Gemini 构建的多智能体 AI 系统,能够迭代地生成、辩论并演化针对复杂科学问题的新假设。
推荐理由:Nature 论文与多智能体架构细节同时公开,读者可据此了解假设生成类科研智能体的具体设计与落地方式。
Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下参与患者诊疗的三人协作模式。在 98 条真实初级保健问题的盲评中,该系统 97 例无关键错误,优于医生常用的两个 AI 系统;与哈佛、斯坦福合作的 140 项问诊技能评估中,AI 在 68 项达到或超过初级保健医生水平,但识别危险信号和指导关键体格检查仍不如专家。
推荐理由:Google DeepMind 的医疗智能体研究给出了盲评、随机仿真等量化结果,可了解 AI 与医生协作的当前边界。
Google DeepMind 发布新论文提出 Decoupled DiLoCo 分布式训练架构,将大规模训练拆分为相互解耦的计算岛屿并以异步数据流连接,从而隔离局部硬件故障。
推荐理由:原文给出跨数据中心异步训练的低带宽与容错实测数据,读者可据此判断分布式预训练的工程可行边界。
Google Research 在 ICLR 论文中提出 ReasoningBank,一个从成功和失败经验中提炼高层结构化记忆的智能体记忆框架,代码已开源。
推荐理由:论文提出从成功与失败经验中提炼结构化记忆的框架,读者可了解智能体测试时自我进化的具体做法与实测增益。
Google Research 与多家 NHS 机构合作的 AIMS 研究在 Nature Cancer 发表两篇论文,评估 AI 用于乳腺癌筛查的效果。
推荐理由:两项 Nature Cancer 研究给出了 AI 参与乳腺癌筛查的检测率提升与阅片减负数据,并暴露人机仲裁的新问题。
Google Research 与 Beth Israel Deaconess Medical Center 合作开展 AMIE 对话诊断 AI 的前瞻性单中心可行性研究,让 100 名成人在门诊预约前先与 AMIE 进行文本问诊。
推荐理由:Google 与 BIDMC 公布 AMIE 在真实门诊的前瞻性可行性研究结果,包含安全监督、诊断准确率与患者态度变化等具体数据。