跳到正文

全部动态

今日 4 条
今天10月1日周四
  1. Microsoft Research26

    微软研究院利用机器学习预测电网空间天气风险

    微软研究院开发了一套机器学习系统,为美国本土 66,935 座变电站生成空间天气风险预测,可提前 30 至 60 分钟预警。该系统结合太阳风观测、AE 与 Dst 指数预报、地质电导率及电网数据,在 2020-2026 年评估期内检测到近 80% 的重大空间天气事件,其中 AE 预测 RMSE 为 410.2 nT,Dst 预测 RMSE 为 7.2 nT。

9月30日周三
  1. AWS Machine Learning Blog67

    在 Amazon Bedrock AgentCore Runtime Instances 上构建多智能体音乐制作流水线

    AWS 官方博客演示如何在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线:作曲智能体用 Claude Sonnet 4.6 生成音乐简报并在实例自带的 NVIDIA L4 上运行开源音乐生成模型 ACE-Step,20 秒 48kHz 立体声渲染约 9 秒。

    推荐理由:文章给出三智能体共享 GPU 实例视频/音频流水线的完整代码与踩坑点,可迁移到其他长时任务编排。

  2. Google DeepMind65

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质与结构加水印

    Google DeepMind 推出 SynthID Bio,把水印技术带入合成生物学,在生物代码中嵌入不可感知的签名,使其不只在数字模型上、也能在合成出的实体蛋白质上被验证,同时保留其生物功能。

    推荐理由:Google DeepMind 把水印技术从图像扩展到蛋白质与 3D 结构,读者可看到生物安全筛查的一层新验证思路。

  3. AWS Machine Learning Blog67

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,定位为 GPT-6 Sol 的升级版,面向智能体编码、computer use 与专业工作负载提供更强推理能力。

    推荐理由:材料给出 GPT-6.1 Sol 在 Bedrock 上线后的能力定位与成本对比,读者可据此判断强推理模型的落点。

  4. Google Research39

    Google Research 提出 Diffusion Controller,统一并简化 AI 图像生成控制

    Google Research 发布 Diffusion Controller 框架,把扩散模型的去噪过程重新定义为连续控制问题,主模型完全冻结,仅用轻量"转向阻尼"网络注入微调修正。该框架在 Stable Diffusion v1.4 上用 HPS-v2 评测,其完全解锁版本对基线模型取得 90% 胜率,并支持 PPO 策略梯度与奖励加权损失两种微调方式,可在不接触底层代码的情况下定制闭源模型。

  5. AWS Machine Learning Blog24

    Amazon Quick 提示词工程基础指南

    亚马逊 AWS 发布 Amazon Quick 提示词工程基础指南(Part 1),给出跨组件通用的提示词设计原则与可复用框架。文章涵盖清晰具体、业务上下文和示例教学等核心原则,以及用于复杂请求的 CRISPE 框架,Part 2 将讲解 Research、Flows、Sight、Chat Agents 和 Action Integrations 的组件专属技巧。

  6. AWS Machine Learning Blog31

    Amazon Quick 提示词工程:各组件模式与常见陷阱

    AWS 发文拆解 Amazon Quick 各组件如何解读提示词,并给出对应写法。Quick Research 需明确目标、受众与范围,自行拆解子问题并收窄数据源;Quick Flows 要写清时间、数据源与输出格式,复杂逻辑用编号步骤,并可在 agentic runtime 中对话式微调;Quick Sight 的查询需含业务问题、指标、维度和可视化偏好。

  7. AWS Machine Learning Blog27

    用 Amazon Quick 和 Amazon Bedrock AgentCore 构建 AI 合同智能平台

    AWS 展示了一套合同智能平台架构:AI 智能体从合同 PDF 中提取八个关键字段并给出置信度,由较轻量的 Claude Haiku 智能体独立复核,签名识别分歧时交由 Amazon Textract 用计算机视觉确定。核验结果写入 Amazon Aurora PostgreSQL,用户可通过嵌入仪表板和自然语言对话查询合同组合级聚合数据与单份合同细节,典型条件下单份合同处理只需数秒。

9月29日周二
  1. Hugging Face Blog69

    NVIDIA 发布表格基础模型 Kumo Tabular,在四个基准排名第一

    NVIDIA 发布开源表格基础模型 Kumo Tabular,属于 Kumo Structured 模型系列,在 Hugging Face 上提供权重。给定带标签行的表格,它在单次前向传播中预测新行标签,无需训练、调参和特征工程,支持分类与回归,提供 28M 至 215M 三档参数规模,采用 OpenMDW-1.1 许可可商用。

    推荐理由:原文公开了表格基础模型的三档规模、单次前向推理方式和四个基准排名,可据此判断无训练微调的表格预测路径。

  2. OpenAI News68

    OpenAI 发布 GPT-6.1 Sol

    OpenAI 发布 GPT-6.1 Sol,官方称其面向编码、电脑操作和专业工作,接近 Astra 的智能水平。其标准 API 输入和输出 token 价格为 Astra 的五分之一。

    推荐理由:官方公布 GPT-6.1 Sol 的定位与定价,读者可据此判断它在编码和电脑操作上的价格取舍。

  3. AWS Machine Learning Blog60

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,支持 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过 bedrock-runtime 的跨区域推理配置提供,并支持 Responses、Chat Completions 和 Converse API。

    推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度成本权衡,可供工程选型参考。

  4. AWS Machine Learning Blog60

    AWS 上线 Claude Sonnet 5.5

    AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,定位为更高效、多数任务单任务成本更低的 Sonnet 模型,适合范围明确的编码与知识工作,如告警首响应、智能体常驻监控、SQL 生成、UI/UX 测试和 IDE 内快速编码。

    推荐理由:官方给出 Sonnet 5.5 的定位、适用任务和与 Opus 5.5 的分工,可据此判断该把哪些工作交给它。

9月28日周一
9月26日周六
  1. AWS Machine Learning Blog35

    在 Amazon EKS 上用 EFA 和 DeepEP 扩展 MoE 强化学习,吞吐量提升 40%

    AWS 博客介绍在 Amazon EKS 上结合 EFA 与 DeepEP 扩展 MoE 模型强化学习训练的架构,吞吐量提升 40%。该方案针对 rollout 生成与策略训练并行、数百加速器间高吞吐通信,以及 MoE 专家并行(EP)带来的跨节点动态 all-to-all 通信开销。文中覆盖 RLHF、GRPO 等大规模 RL 负载在计算、内存和网络带宽上的资源平衡问题。

  2. AWS Machine Learning Blog31

    NarrateAI:在 Amazon Bedrock 上实现生产级 LLM 质量保障

    NarrateAI 在 Amazon Bedrock 上落地五项质量保障技术,为 4,000 多名 AWS 高管提供实时数据问答,数值准确率约 99%。这五项技术分别是自适应流水线编排、跨账号多模型故障转移、实时流式评估、复合评估框架和数据准确性校验;其中约 90% 的查询走单次快速路径,仅约 10% 超出上下文窗口的复杂查询触发并行批处理。