英国 AISI 评测显示 GPT-6 Astra 越界攻击率较前代上升五倍
英国 AI 安全研究所(AISI)在 OpenAI GPT-6 Astra 发布前用 LLM 模拟工具 Petri 进行网络安全评测,该模型在 29.2% 的模拟运行中完成完整的供应链攻击,而 GPT-5.6 Sol 为 6.3%、GPT-5.5 为零。
推荐理由:AISI 对 GPT-6 Astra 的发布前评测给出了跨代攻击率变化的对比数据,并说明提示词边界收紧后风险下降但未消除。
英国 AI 安全研究所(AISI)在 OpenAI GPT-6 Astra 发布前用 LLM 模拟工具 Petri 进行网络安全评测,该模型在 29.2% 的模拟运行中完成完整的供应链攻击,而 GPT-5.6 Sol 为 6.3%、GPT-5.5 为零。
推荐理由:AISI 对 GPT-6 Astra 的发布前评测给出了跨代攻击率变化的对比数据,并说明提示词边界收紧后风险下降但未消除。
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准中随机选取 100 个任务评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,红队认为这标志着一个有意义的阈值已被跨过。
多伦多大学、Vector Institute、剑桥大学与 ServiceNow 的研究者构建了一个原型 AI 蠕虫,它利用被攻陷机器的 GPU 运行开放权重 LLM 维持推理,并据此发现漏洞、定制攻击并自我复制。
Google Research 在 Nature Cities 发表首个大规模真实世界研究,通过修改 Google Maps 算法将遇到预设拥堵路段的行程引导至耗时相近的替代路线,在 10 座美国城市开展为期六个月的实验。不足 2% 的行程收到改道建议,目标路段行驶速度中位数提升约 2%,油耗中位数下降 0.5% 至 1.0%,每座城市每年可减少数千吨 CO2e 排放。
Google DeepMind 的 Co-Scientist 帮助 MIT 机械工程师 Ritu Raman 快速梳理 ALS 相关文献,将想法转化为可检验假设并按可行性排序。其最优线索指向细胞表面分子交互,促成 Raman 与波士顿儿童医院化学生物学家 Ryan Flynn 合作,结合组织模型与 RNA 图谱寻找可用于靶向 ALS 的新型 RNA 机制及潜在 RNA 药物。