Simon Willison 发布 commit-rewriter 0.2
Simon Willison 发布 commit-rewriter 0.2,该工具用于重写 git 提交记录。他同时在推广每月 10 美元的赞助订阅,提供当月最重要 LLM 进展的精选邮件摘要。
Simon Willison 发布 commit-rewriter 0.2,该工具用于重写 git 提交记录。他同时在推广每月 10 美元的赞助订阅,提供当月最重要 LLM 进展的精选邮件摘要。
Datasette 1.0a41 发布,Alec Garcia 为该版本加入了 OpenTelemetry 支持。此版本还将 Datasette 的所有模态对话框重构为单个 Web Component,并已编写文档供其他插件使用。
AI 让思考变得廉价但实验本身并未加速,生物科技行业由此分化出两种路径:Foundries 用下一代测序、高通量显微和物理自动化把实验数据生成速度提升一个数量级,Navigators 则把模型嵌入公司日常流程以加快决策。Navigators 虽不显眼却适用于所有公司,早期的 Endura Therapeutics 已用几小时搭建内部仪表盘,使实验分析从一周缩短到一小时。
Meta 在 Connect 2026 上把个人智能体 Muse 作为硬件加智能体战略的核心,发布相关智能体功能与新眼镜,仅预告而未发布新前沿模型。Muse 现已支持语音与实时视频,可后台持续处理任务,并将在所有 Meta 眼镜上以唤醒词激活;每台 Muse 拥有独立邮箱地址,Mac 版 Muse 支持计算机使用。
Simon Willison 用 GPT-6 Astra 开发了一个 Gemini 3.8 TTS Playground,可组合单人旁白或多说话人对话、预览音频并查看请求响应细节,设置可保存为可分享的 URL。
一份可交互的讲解 artifact,通过实时示例演示 shadow DOM 的样式封装、继承、slots、parts 与 JavaScript 访问,展示 shadow root 如何创建带私有样式表和元素的隔离 DOM 树,并以特定受控方式与页面 DOM 交互。内容以 Fable 5.1 Medium 生成。
OpenAI Academy 迎来成立两周年,目标是把 AI 技能带给更多社区。
Radical Numerics 联合创始人兼 CEO Eric Nguyen 认为生物安全正演变为 AI 军备竞赛,防御方目前处于下风,主张更激进地推进前沿模型能力。
OpenAI 将 Daybreak 计划的使用权限扩展至乌克兰政府,用于支持民用基础设施的网络防御。
invideo 借助 GPT‑6 Astra 让剪辑规划更精准,色彩校正与调色效率提升 3 倍,并在一天内生成 50 个自定义效果。
Harvey 借助 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文书,让律师能将精力集中在策略上。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,讨论 AI 安全、人类控制与国际合作。
Ringg 借助 GPT-5.6 让 AI 智能体处理最多 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页等多语言场景。相比 GPT-4.1,其成本降低 90%。
OpenAI 发布 MentalHealthBench,一个由专家参与构建的基准,用于评估 AI 在真实心理健康对话中回答是否有帮助且安全。该基准覆盖多种现实心理健康对话场景,衡量模型回复的助益性与安全性。
Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 家族首个模型,官方称多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度约快 30%,并成为 Claude Code 与 Claude 应用的默认模型。
推荐理由:同日两家发布新模型并同步降价,材料给出第三方评测与按任务成本拆解,可对照能力与价格的实际取捨。
Simon Willison 与 Jesse Vincent 将于 10 月 14 日(周三)在旧金山举办一场面向 coding agent 构建者的晚间 Birds of a Feather 交流会,主题是用 coding agent 及其之上做各种奇怪有趣的尝试。
ChatGPT Ads 扩展至东南亚和台湾,覆盖超过 60 个国家和地区,符合条件的企业可借此触达更多用户。
Airbnb 正在扩大工程团队对 GPT-6 Astra 及 OpenAI 前沿模型的接入,用于排查 bug、设计系统和加快交付。该举措旨在让更多工程团队借助这些模型提升开发效率。
Grab 与 OpenAI 联合推出区域项目 GO Forward with AI,计划帮助东南亚 3 万名合作伙伴掌握实用 AI 技能。
Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna,Simon Willison 记录了初步体验。
John Platt 在 Latent Space 播客介绍了 Google 的 Empirical Research Assistance(ERA):它用 Gemini 维护一张实验 notebook 树,并用类似蒙特卡洛树搜索的 UCB 规则挑选 notebook 进行变异,把可写成打分函数的科学问题自动化求解。
GPT-6 改进了提示词缓存,带来更高的缓存命中率,并新增诊断能力、显式断点以及可降低延迟与成本的控制项。
Simon Willison 发布 llm 0.36,这是其 LLM 命令行工具的新版本。原文未披露该版本的具体功能、模型支持或数字细节。
用户 @therealcornpop 在 TikTok 上指出,用 AI 写 TikTok 和 YouTube 脚本会非常明显:不只是「不是 X,而是 Y」这类 AI 腔、三段式结构,或靠大量标点堆出的断奏式文风——听起来很深,其实不是。真正暴露的是内容的空洞、个人声音的缺失,以及能看出你对所谈话题并没有自己的观点。
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,均面向日常工作任务。两者在能力与成本之间采用不同的平衡方案,官方称其将前沿智能带入日常工作。
推荐理由:OpenAI 同时推出两款定位不同的 GPT-6 模型,读者可据此了解其能力与成本的分档思路。
Simon Willison 发布 llm-anthropic 0.29,为其 LLM 工具集接入 Anthropic 模型的插件更新。正文未披露该版本的模型、参数或功能变更细节。
Simon Willison 发布 LLM 插件 llm-typesafe 0.1a0,为其 LLM 工具接入 TypeSafe AI 的新模型 Jev,可通过 `llm install llm-typesafe` 安装并设置 API key 使用。
Parallel 的智能体借助 GPT-6 Astra 完成劳动力市场数据的检索与综合,相比此前模型将时间和成本各降低一半。
小米发布 MiMo-V2.6 系列,包含原生全模态的 MiMo-V2.6-Pro(1.02T 总参数、42B 激活)和 MiMo-V2.6-Flash,并推出输出速度最高快 20 倍的 UltraSpeed 版本。
推荐理由:小米 MiMo-V2.6-Pro 以约 300 万美元训练成本登顶开放权重模型,其 RL 环境与训练配方同步开源值得关注。
OpenAI 提出针对前沿模型与防护措施的第三方 AI 安全评估优先事项与原则,强调评估需严格、安全且独立。
TypeSafe AI 发布 Jev,这是其称为 System One 模型的新类别,仍接受文本输入,但输出的是对应分类、是/否问题和评分的浮点数字及置信度,输入定价 $0.042/百万 token,输出免费。
Cloudflare 在历经两年预览后,正式 GA Python Workers,Python 成为 Cloudflare Developer Platform 上一等且完整支持的语言。
InstructGPT 论文作者之一、TypeSafe AI CEO Diogo Almeida 在播客中介绍新模型 Jev,定位为机器原生、面向代码消费的 System One 大模型,按每美元智能而非聊天体验优化,用于编程中不追求确定性而强调可靠性。
NVIDIA 推出 Halos,称其为首个也是唯一的物理 AI 全栈安全系统,覆盖设计、验证与部署各层。
NVIDIA 在开罗举办埃及 AI 生态活动,其 Deep Learning Institute 在埃及的学员规模一年内增长超十倍。埃及已有超 85,000 名开发者接受 NVIDIA 培训,尼日利亚成为该机构全球第二大市场;Cassava 与 Vodafone 埃及宣布共建 AI 工厂,通过 GPU-as-a-service 提供本地托管 AI 基础设施。
NVIDIA 提出把 AI 安全当作工程问题来对待:Agent 栈从模型、harness 到运行时环境每一层都需有可执行的边界、明确责任人和验证证据。其开源的 NVIDIA OpenShell 提供策略在 Agent 触及范围之外强制生效的安全运行时,并支持沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。
Import AI 第 473 期介绍了 RAND 关于美国超级智能战略的长篇报告,其核心建议是采取“行动自由”战略,通过投资 AI 安全、维持人类能动性并保留多种战略选项来应对不确定性。研究还展示了在脑组织被刻意清除的幼鼠体内培育人类脑组织的实验,以及机器诠释学相关进展。
Higgsfield AI 借助 GPT-6 Astra,一天内就将新的视频创作功能推向市场,让小型企业更轻松地制作视频广告。该功能面向小企业的视频广告创作场景,缩短了创意工具从开发到上线的周期。
MIT Technology Review 与 Times of San Diego 用 15 个月调查,绘制出首张边境监控塔附近死亡案例的全面地图与分析。团队汇总 2015 年以来的记录,向得州 17 县警长办公室申请档案,获 14 县超 4000 页报告,并用 Anthropic 的 Claude 通过 API 提取遗骸坐标后人工核验。
OpenAI 正与一个独立的数学与人工智能顾问组合作,为该领域新兴 AI 成果的评审与对外沟通提供指导。