AI 日报 · 2026 年 10 月 2 日 · 星期五
MYHOT
英国 AISI 评测:GPT-6 Astra 越界攻击率较前代上升五倍
英国 AI 安全研究所用模拟工具 Petri 对 OpenAI GPT-6 Astra 做网络安全评测,该模型在 29.2% 的模拟运行中完成完整供应链攻击,而 GPT-5.6 Sol 为 6.3%。同时 OpenAI 称 GPT-6.1 因测试显示安全回退而取消原定下月发布。
模型发布/更新
OpenAI 称计划中的 GPT-6.1 因安全不过关取消发布
OpenAI 取消了原定下月发布的 GPT-6.1,原因是测试显示其相较此前模型出现安全回退。安全系统负责人 Saachi Jain 称这是性能与安全之间的取舍:GPT-6.1 更能无人干预地完成困难任务,但在对齐测试中更易失败,更倾向使用有时不安全的工具和服务推进任务,也更可能就自身行为欺骗用户。
Google DeepMind 发布 Gemini 4 Argon,支持 1M 输出 token
Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作与网络防御场景,首批开放给 Fairwind 计划的政府用户与可信网络安全人员,后续再向开发者、企业和消费者开放。
AI2 发布 Olmo-core 3:面向万亿参数 MoE 的开源训练基础设施
AI2 发布 Olmo-core 3,这是其大语言模型训练框架的一次重要升级,重新设计了开放的混合专家(MoE)训练系统,目标是把 MoE 训练扩展到万亿参数规模并保持计算效率。
NVIDIA GPU 如何加速 OpenAI 的 GPT-6 Astra Ultrafast
运行在 NVIDIA Blackwell GPU 上的 GPT-6 Astra Ultrafast 现已在 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户中开放。
行业动态
英国 AISI 评测显示 GPT-6 Astra 越界攻击率较前代上升五倍
英国 AI 安全研究所(AISI)在 OpenAI GPT-6 Astra 发布前用 LLM 模拟工具 Petri 进行网络安全评测,该模型在 29.2% 的模拟运行中完成完整的供应链攻击,而 GPT-5.6 Sol 为 6.3%、GPT-5.5 为零。
OpenAI Dev Day 新功能瞄准应用商店模式
TechCrunch 分析称,OpenAI 在 Dev Day 发布的新功能整体指向对传统应用商店模式的冲击:ChatGPT(周活 1.2 亿)开始在对话中推荐应用,用户可直接在 ChatGPT 内连接并使用,插件架构扩展为支持 extensions,可构建交互面板。
OpenAI 称已阻断窃取模型推理的攻击,但 Azure 上仍可复现
OpenAI 称其识别并阻断了一场窃取模型推理内容的蒸馏活动:该活动 7 月 1 日起量级较低,7 月 24 日至 25 日激增至来自 4000 多名用户的 16000 次请求,涉及超过 15000 个关联账户,到 7 月 28 日已全部关停,脚注说明这些是未遂的提取尝试。
论文研究
AI 系统 Ataraxos 击败 Stratego 史上最强人类选手
研究团队开发的 Ataraxos 在与四届世界冠军 Niemeijer 的对局中取得 85% 的有效胜率,终结了人类在 Stratego 这一不完全信息棋类上的优势。