Condé Nast 如何用 Amazon Bedrock 构建多模态视频检索
Condé Nast 与 AWS 生成式 AI 创新中心基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,采用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与字幕信号,将单次内容检索耗时从 250 分钟降到 2 分钟以内。
Condé Nast 与 AWS 生成式 AI 创新中心基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,采用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与字幕信号,将单次内容检索耗时从 250 分钟降到 2 分钟以内。
Google DeepMind 推出 SynthID Bio,把水印技术带入合成生物学,在生物代码中嵌入不可感知的签名,使其不只在数字模型上、也能在合成出的实体蛋白质上被验证,同时保留其生物功能。
推荐理由:Google DeepMind 把水印技术从图像扩展到蛋白质与 3D 结构,读者可看到生物安全筛查的一层新验证思路。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统在 CoreWeave Cloud 上线,并搭配 Spectrum-X 102.4T 以太网,Cognition 成为首个在生产环境运行该平台、支撑 Devin 的客户。
Amazon Bedrock 在印度区域上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过 geographic cross-Region inference 让推理请求仅在 ap-south-1 与 ap-south-2 之间路由,实现数据留在印度境内。
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5,通过 bedrock-runtime 端点实现区域内推理,请求与数据全程不离开所调用区域。
Microsoft Research 发布 Quine,一个面向生物学复杂性的 AI 研究系统,由生物学世界模型和连接模型、科学工具、文献与科研人员的交互式 harness 两部分组成。
推荐理由:微软研究院公开了面向生物学的多模态世界模型 Quine 及其与 Broad Institute 合作的湿实验验证结果。
OpenAI 发布 DevDay 2026 回顾,汇总了 20 多项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者构建者的新工具。
OpenAI 发布 dots,一种可跨复杂项目和日常任务持续推进工作的主动式助手。官方称 dots 让用户在工作推进过程中仍保持掌控。
xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,支持 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过 bedrock-runtime 的跨区域推理配置提供,并支持 Responses、Chat Completions 和 Converse API。
推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度成本权衡,可供工程选型参考。
OpenAI 启动 Codex Originals 计划征集,寻找使用 Codex 的开发者、研究者与创作者分享真实项目故事。有意者可在下方提交自己的故事与项目介绍,参与该计划下一阶段。
Proaction 借助 Codex、GPT-Live-1 和 GPT-6 Astra,更快地构建、运营并销售现代车队管理方案,销售提升 60%,节省 75+ 小时。
Datacor 将 Amazon Quick Sight 嵌入 TrackAbout,为工业气体与焊接分销商提供交互式仪表盘和自然语言问答,用户无需提交 IT 工单即可查询租赁数据。
invideo 借助 GPT‑6 Astra 让剪辑规划更精准,色彩校正与调色效率提升 3 倍,并在一天内生成 50 个自定义效果。
Harvey 借助 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文书,让律师能将精力集中在策略上。
Ringg 借助 GPT-5.6 让 AI 智能体处理最多 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页等多语言场景。相比 GPT-4.1,其成本降低 90%。
ChatGPT Ads 扩展至东南亚和台湾,覆盖超过 60 个国家和地区,符合条件的企业可借此触达更多用户。
Airbnb 正在扩大工程团队对 GPT-6 Astra 及 OpenAI 前沿模型的接入,用于排查 bug、设计系统和加快交付。该举措旨在让更多工程团队借助这些模型提升开发效率。
GPT-6 改进了提示词缓存,带来更高的缓存命中率,并新增诊断能力、显式断点以及可降低延迟与成本的控制项。
Higgsfield AI 借助 GPT-6 Astra,一天内就将新的视频创作功能推向市场,让小型企业更轻松地制作视频广告。该功能面向小企业的视频广告创作场景,缩短了创意工具从开发到上线的周期。
OpenAI Academy 新增多条学习路径,覆盖员工、开发者、领导者、教育工作者和学生,帮助他们建立并展示实用的 AI 技能。
V7 使用 GPT-5.6 处理分散的公司文件,将其转化为智能体可用的上下文,以完成复杂的、可溯源到来源的工作,同时成本降低 78%、准确率提升。
Pawprint Studio 的开放世界捉宠 RPG《Aniimo》本周首发上线 GeForce NOW,玩家可免去 45GB 下载直接串流游玩。
Cooley 基于 ChatGPT Work 打造 GO Public,把智能引入 IPO 流程,帮助律师更早发现问题,并将判断力集中在最关键之处。
OpenAI 发布 Astra for Law,为法律行业提供前沿智能,支持律所自定义工作流、连接法律数据源,并针对保密客户工作提供法律级管控。该产品名为 OpenAI for Law。
NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高为 2.5 倍。
推荐理由:NVIDIA 官方首次公布 Vera Rubin NVL72 的 MLPerf 推理成绩,并给出跨机架扩展与软件迭代的量化对比,可供判断推理经济学走向。
OpenAI 推出 AI 驱动的广告体验,其中包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
Hex 的数据智能体借助 GPT-6 Astra,把分析答案转化为可交互的可视化报告,让员工愿意主动分享。
OpenAI 介绍如何用 ChatGPT Work 和 Codex analytics 把 AI 使用情况与业务价值对应起来。团队可借此了解 AI 的使用量与支出,识别培训需求,并将采用情况与业务成果关联。
Salesforce 在 Dreamforce 上发布首个 CRM 推理模型 Koa,由 NVIDIA Nemotron 3 Super 在后训练阶段基于近三十年企业 CRM 部署的专有合成数据集构建,采用监督微调与 NVIDIA NeMo RL、NeMo Gym、NeMo AutoModel 的强化学习。
NVIDIA 在 AI Infra Summit 上介绍 DSX 平台,涵盖功率优化软件 DSX MaxLPS、电网响应组件 DSX Flex、开源管理软件 DSX OS、仿真工具 DSX Sim 和参考设计。
Fyxer 基于 OpenAI 模型构建 AI 行政助理,结合微调、记忆能力与真实用户反馈,帮助用户整理收件箱并按每位用户的语言风格起草邮件。
Perplexity 用 GPT-6 Astra 撰写沟通内容、修改软件并监控生产系统,对模型的检查频率远低于早期模型。
Cognition 借助 GPT‑6 Astra 提升 Devin 测试软件并验证其可用的能力,目标是让工程师减少代码审查、交付更多。
OpenAI 把内部 Python 库 Habitat 演进为支撑 10 亿 ChatGPT 用户、每秒 2200 万请求的全球分布式存储平台。
César de la Fuente 的实验室正用 Codex 和 ChatGPT 在现存与已灭绝生物的基因组中搜寻抗菌候选分子,以对抗耐药性感染。
OpenAI 在 ChatGPT Work 中推出 Data agent,用户可用自然语言连接公司数据、挖掘洞察并构建交互式仪表盘。该功能面向所有用户开放,让数据分析和可视化不再依赖专业工具或技能。
OpenAI 发布 ChatGPT for Financial Services,内置金融数据并整合 GPT-6 Astra,用于研究、建模和生成面向客户的材料。原文仅给出这一句产品说明,未披露定价、上线时间或具体数据来源。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 stable-diffusion-webui 的大部分功能重建为单张工作流画布。
推荐理由:用 73 个节点复刻 A1111 的十一类图像与视频管线,可直观看到节点式工作流的组织方式与复用边界。
OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于编排、长时间运行的会话和工具调用,让开发者构建并上线云端智能体。
推荐理由:原文给出了 Agents API 的托管定位与 Codex harness 支撑,读者可据此判断云端智能体的构建方式。
OpenAI 在 API 中推出 GPT-Live-1,为开发者带来自然的全双工语音对话能力。该模型在指令遵循上有提升,同时支持自定义音色和电话语音(telephony)接入。
推荐理由:OpenAI 把全双工语音对话开放到 API,开发者可据此评估实时语音应用的改造路径。