AINews:Opus 5.5 擅长做讲解视频
AINews 汇总 9/24-9/25 动态,Claude Opus 5.5 本周发布后反响积极,以 88.4% 领跑 SimpleBench,并被指在生成讲解视频上表现突出。
推荐理由:汇总一周内多个模型与工具的动态,便于快速了解前沿模型在基准、成本和视频生成上的位置。
AINews 汇总 9/24-9/25 动态,Claude Opus 5.5 本周发布后反响积极,以 88.4% 领跑 SimpleBench,并被指在生成讲解视频上表现突出。
推荐理由:汇总一周内多个模型与工具的动态,便于快速了解前沿模型在基准、成本和视频生成上的位置。
在 Amazon SageMaker AI 上,用同一个 AWS vLLM-Omni DLC 镜像部署两个端点:实时端点跑 FLUX.2-klein-4B 图像生成,异步端点跑 Wan2.1-VACE-1.3B 图生视频。
Runway 推出 GWM Worlds 2 研究预览,将高保真视频与音频生成变为实时交互式模拟,并提出 WorldPrompt 输入格式,可固定环境的部分要素(包括首帧)再生成带时间戳的事件,事件可在实时中提示。
invideo 借助 GPT‑6 Astra 让剪辑规划更精准,色彩校正与调色效率提升 3 倍,并在一天内生成 50 个自定义效果。
Higgsfield AI 借助 GPT-6 Astra,一天内就将新的视频创作功能推向市场,让小型企业更轻松地制作视频广告。该功能面向小企业的视频广告创作场景,缩短了创意工具从开发到上线的周期。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 stable-diffusion-webui 的大部分功能重建为单张工作流画布。
推荐理由:用 73 个节点复刻 A1111 的十一类图像与视频管线,可直观看到节点式工作流的组织方式与复用边界。
Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出智能体视频理解功能,视频分析 token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。
推荐理由:官方给出视频分析在 token、成本与准确率上的量化变化,并说明可用入口和启用方式,便于开发者评估是否迁移现有视频处理流程。
Google DeepMind 发布 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供给开发者,新增场景延长、首尾帧插值、360p 快速草稿和 4K 放大等能力。
推荐理由:原文列出场景延长、首尾帧插值和 4K 放大等具体能力与价格入口,可据此判断生成视频工作流的变化。
Google DeepMind 与 A24 宣布达成首个聚焦研究的合作伙伴关系,双方将围绕多个项目展开长期研发协作,让 A24 的导演直接在创作流程中参与塑造新技术。Google 同时宣布对 A24 进行投资。该合作初期目标是连接前沿技术与下一代娱乐,具体目标、技术产出和创作里程碑将随时间演变。
Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)与 Gemini Omni Flash(gemini-omni-flash-preview)。
推荐理由:同属 Nano Banana 家族的三档模型首次给出速度、成本与质量的分工定位,可作为选型参照。
Google DeepMind 推出 Gemini Omni 系列,首个模型 Gemini Omni Flash 可组合图像、音频、视频和文本输入,生成并对话式编辑高质量视频。
推荐理由:Gemini Omni Flash 把视频生成与对话式编辑合并到同一模型,读者可据此判断多模态创作入口的变化。