Anthropic 的 IPO 招股书纳入人类灭绝风险警告
Anthropic 在 IPO 招股书中警告失控 AI 可能在一代人时间内终结人类,公司现任与前任员工也公开发出类似警示。Amodei 上周在联合国安理会称 AI 是当今世界最重要的全球安全问题,本月还主导呼吁为 AI 前沿发展设定节奏;OpenAI 的 Sam Altman 与马斯克均支持其放缓开发、加强安全的行业合作提议。
Anthropic 在 IPO 招股书中警告失控 AI 可能在一代人时间内终结人类,公司现任与前任员工也公开发出类似警示。Amodei 上周在联合国安理会称 AI 是当今世界最重要的全球安全问题,本月还主导呼吁为 AI 前沿发展设定节奏;OpenAI 的 Sam Altman 与马斯克均支持其放缓开发、加强安全的行业合作提议。
英伟达宣布成立由100多家公司组成的联盟,推动其 Open Agent Safety Platform 智能体安全技术,OpenAI、Amazon、Google、Apple 均未加入,而 Anthropic 是支持方。
据 Bloomberg 报道,OpenAI 正与投资者洽谈一笔至少 300 亿美元的 pre-IPO 融资,估值约 1.4 万亿美元,投资者希望在 OpenAI 明年上市前继续加注。
Sam Altman 在 DevDay 主题演讲后表示,OpenAI 只有在能对模型安全作出可靠承诺后才会启动 IPO,目前没有明确时间表。他称“pacing the frontier”是把安全与对齐置于能力之前,现在推进 IPO 会带来额外压力。Anthropic 已于 6 月正式提交上市申请,SpaceX 也在 6 月完成上市。
Google 发布新一代前沿模型 Gemini 4 Argon,在部分关键基准上超过 OpenAI 和 Anthropic 的竞品,但并未取得明显领先。
Google 发布新一代前沿模型 Gemini 4 Argon,称其在软件工程、法律金融等企业知识工作以及网络安全防御等复杂工作流中具备前沿性能。该模型初期只开放给一批可信网络安全防御者,Google 表示正参与美国政府的前置发布模型访问自愿流程,并将逐步扩大开放,同时强化防滥用、防提示词注入和失准监测等前沿保障措施。
特朗普周二与二十余家科技公司达成自愿协议,企业承诺实施白宫建议的管控措施,包括接受独立安全审计,审查重点涵盖网络安全、生物安全、化学威胁以及 AI 模型意外行为等风险。
Google 在 Gemini 聊天中全球上线 Skills,用详细提示词承载特定任务,用户以“/”加名称调用,并可由历史对话生成、检测到匹配提示时自动运行。Skills 格式源自 Anthropic 并以开放标准提供,支持文本文档、PDF 和图片作为参考材料,还可将多个 Skill 串联完成任务。
谷歌的 Sundar Pichai、Anthropic 的 Dario Amodei、Meta 的 Mark Zuckerberg、OpenAI 的 Greg Brockman。
美国联邦贸易委员会正就潜在消费者保护违规行为调查 OpenAI、Anthropic 等领先 AI 实验室。FTC 主席 Andrew Ferguson 计划通过具有法律约束力的“民事调查令”强制相关方移交文件并问询高管,命令预计数周内发出,调查在 Hugging Face 遭攻击事件之前就已启动。
推荐理由:从监管动作切入,可看到 AI 实验室在消费者保护与智能体责任上的合规压力如何升级。
特朗普昨日宣布的“有道德约束力”AI 安全协议全文公开,正式名称为《前沿责任联合承诺》(Joint Commitment on Frontier Responsibilities)。
Anthropic 公布评测结果,称智谱开源权重模型 GLM-5.3 在漏洞利用开发上接近其 Claude Mythos Preview。
Amazon Bedrock 在印度区域上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过 geographic cross-Region inference 让推理请求仅在 ap-south-1 与 ap-south-2 之间路由,实现数据留在印度境内。
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5,通过 bedrock-runtime 端点实现区域内推理,请求与数据全程不离开所调用区域。
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准中随机选取 100 个任务评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。此前模型如 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,红队认为这标志着一个有意义的阈值已被跨过。
AWS 展示了一套合同智能平台架构:AI 智能体从合同 PDF 中提取八个关键字段并给出置信度,由较轻量的 Claude Haiku 智能体独立复核,签名识别分歧时交由 Amazon Textract 用计算机视觉确定。核验结果写入 Amazon Aurora PostgreSQL,用户可通过嵌入仪表板和自然语言对话查询合同组合级聚合数据与单份合同细节,典型条件下单份合同处理只需数秒。
AMD 以 82 亿美元收购 World Labs,后者由李飞飞创立,专注空间智能。World Labs 近期发布 Atlas,这是一种从零训练的 omni 模型架构,能从 2D 图像输入预测新视角,性能超过专用模型,解决了计算机视觉中长期存在的稀疏重建问题,潜在应用覆盖机器人仿真、设计工程、科学等领域。
AINews 汇总 9/24-9/25 动态,Claude Opus 5.5 本周发布后反响积极,以 88.4% 领跑 SimpleBench,并被指在生成讲解视频上表现突出。
推荐理由:汇总一周内多个模型与工具的动态,便于快速了解前沿模型在基准、成本和视频生成上的位置。
Latent Space 播客邀请 Anthropic 的 Thariq Shihipar,讨论 Claude Code 的演进方向,包括 Ask User Question 与 artifacts 作为人机交互界面、Claude Tag 与 Projects 支持多人协作、Claude Mods 让用户自定义执行循环与 UI。
中国工信部据报要求字节跳动和阿里巴巴提交购买 Nvidia RTX Pro 5500 芯片的计划,其中字节跳动计划订购 100 万颗,Nvidia 准备今年 12 月发出首批订单。
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,定位为更高效、多数任务单任务成本更低的 Sonnet 模型,适合范围明确的编码与知识工作,如告警首响应、智能体常驻监控、SQL 生成、UI/UX 测试和 IDE 内快速编码。
推荐理由:官方给出 Sonnet 5.5 的定位、适用任务和与 Opus 5.5 的分工,可据此判断该把哪些工作交给它。
Simon Willison 在 WeAreDevelopers World Congress 北美站闭幕演讲中,按时间线梳理了 2026 年 LLM 领域的关键进展。
Simon Willison 把三张 kākāpō 鹦鹉照片交给 Claude Opus 5.5,生成 HTML 5 canvas 像素动画 Kākāpō Party,画面中至少 20 只鹦鹉随音乐跳跃、点击触发彩带与气球。
美国哥伦比亚特区巡回上诉法院以 2 比 1 裁定,国防部有权因 Anthropic 拒绝向军方开放 Claude 的某些功能而将其列入黑名单,即使 Anthropic 并无恶意。
Latent Space 宣布将合并 AINews 与 Discord 的职能、推出 AINews v3,并探索迁移至 Beehiiv 和新首页,同时重新开放赞助与 PR 投稿。
Radical Numerics 联合创始人兼 CEO Eric Nguyen 认为生物安全正演变为 AI 军备竞赛,防御方目前处于下风,主张更激进地推进前沿模型能力。
Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 家族首个模型,官方称多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度约快 30%,并成为 Claude Code 与 Claude 应用的默认模型。
推荐理由:同日两家发布新模型并同步降价,材料给出第三方评测与按任务成本拆解,可对照能力与价格的实际取捨。
Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna,Simon Willison 记录了初步体验。
Simon Willison 发布 llm-anthropic 0.29,为其 LLM 工具集接入 Anthropic 模型的插件更新。正文未披露该版本的模型、参数或功能变更细节。
MIT Technology Review 与 Times of San Diego 用 15 个月调查,绘制出首张边境监控塔附近死亡案例的全面地图与分析。团队汇总 2015 年以来的记录,向得州 17 县警长办公室申请档案,获 14 县超 4000 页报告,并用 Anthropic 的 Claude 通过 API 提取遗骸坐标后人工核验。
一名新入职大公司的工程师称,团队里的规格、代码、测试、PRD、工单及其处理、报告等全部由 Claude Code 生成,从 L1 到 L7 的工程师都在做同一件事——和 Claude 对话。没人喜欢这种状态,管理层多次表示推送代码不是瓶颈,员工每天工作 12 到 13 个小时只是为了按回车。
Jev 发布两天内出现至少 6 个复现方案,包括基于 ModernBERT 的 Laya、基于扩散模型的 DiffusionGemmaJev,以及 Qwen3.5-9B LoRA 微调的 Bespoke Nimble 等,其数据被承认 100% 为合成数据。
Anthropic 为 Claude Code 推出 Projects,单次对话可派生多个并行云端会话、在线程间传递上下文,用户离开后仍继续运行,本地工作流后续支持。
Steve Yegge 关停了 Gas Town,并承认每月花费数千美元订阅编码智能体,却只做出这一个项目。Databricks 向约 3500 名工程师铺开 GPT-6 Astra,表示其在复杂长周期任务上"明确"优于 Opus 5 / Sol 5.6,但整体编码支出增加约 60%。OpenAI 发布模型失准事件追踪与披露框架,并附上过去六个月的六份案例报告。
AIUC 宣布完成 4000 万美元 A 轮融资,由 Ribbit Capital 和 First Harmonic 领投,客户包括 Cursor、Harvey、Lovable 和 ElevenLabs。
多伦多大学、Vector Institute、剑桥大学与 ServiceNow 的研究者构建了一个原型 AI 蠕虫,它利用被攻陷机器的 GPU 运行开放权重 LLM 维持推理,并据此发现漏洞、定制攻击并自我复制。
Epoch 与 METR 发布 MirrorCode 基准,让 AI 仅凭 CLI 访问重实现软件程序,25 个目标程序中 17 个有满分运行,Opus 4.7 用 14 小时、251 美元推理成本完成 METR 和 Epoch 估计人类需 2-17 周的任务。
推荐理由:MirrorCode 用 25 个真实程序衡量 AI 自主重实现能力,Opus 4.7 花 14 小时完成人类需数周的任务。
英国 AI Security Institute 首次公开分析领先开源权重模型与闭源前沿模型的网络安全能力差距,发现这一差距正在缩小:GLM-5.2 与 DeepSeek V4-Pro 的性能大致相当于比它们早 4 到 7 个月发布的闭源前沿模型,而 2025 年大部分时间测得的差距是 6 到 10 个月。
Fable 在 KernelBench-Mega 上写出被认为首个真正的 megakernel,用 CUDA 在 RTX PRO 6000 Blackwell 上相对优化 PyTorch 基线取得 18.71X 加速,超过 Claude Opus 4.8 的 14.4X、GLM-5.2 的 11.14X 和 GPT 5.5 的 4.34X。
牛津大学、英国 AI 安全研究所、斯坦福大学和伦敦政治经济学院的研究者对 AI 说服人类的能力做了四组实验,涉及 6923 人的 18978 场对话,发现 AI 系统在文本说服上稳定优于人类专家,即使专家提前研究、接受数小时结构化训练并获得 1000 英镑现金奖励。