跳到正文

#部署/工程

今日 2 条
今天10月1日周四
  1. Microsoft Research26

    微软研究院利用机器学习预测电网空间天气风险

    微软研究院开发了一套机器学习系统,为美国本土 66,935 座变电站生成空间天气风险预测,可提前 30 至 60 分钟预警。该系统结合太阳风观测、AE 与 Dst 指数预报、地质电导率及电网数据,在 2020-2026 年评估期内检测到近 80% 的重大空间天气事件,其中 AE 预测 RMSE 为 410.2 nT,Dst 预测 RMSE 为 7.2 nT。

9月30日周三
  1. AWS Machine Learning Blog67

    在 Amazon Bedrock AgentCore Runtime Instances 上构建多智能体音乐制作流水线

    AWS 官方博客演示如何在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线:作曲智能体用 Claude Sonnet 4.6 生成音乐简报并在实例自带的 NVIDIA L4 上运行开源音乐生成模型 ACE-Step,20 秒 48kHz 立体声渲染约 9 秒。

    推荐理由:文章给出三智能体共享 GPU 实例视频/音频流水线的完整代码与踩坑点,可迁移到其他长时任务编排。

  2. AWS Machine Learning Blog27

    用 Amazon Quick 和 Amazon Bedrock AgentCore 构建 AI 合同智能平台

    AWS 展示了一套合同智能平台架构:AI 智能体从合同 PDF 中提取八个关键字段并给出置信度,由较轻量的 Claude Haiku 智能体独立复核,签名识别分歧时交由 Amazon Textract 用计算机视觉确定。核验结果写入 Amazon Aurora PostgreSQL,用户可通过嵌入仪表板和自然语言对话查询合同组合级聚合数据与单份合同细节,典型条件下单份合同处理只需数秒。

9月29日周二
  1. AWS Machine Learning Blog60

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,支持 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过 bedrock-runtime 的跨区域推理配置提供,并支持 Responses、Chat Completions 和 Converse API。

    推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度成本权衡,可供工程选型参考。

9月28日周一
9月26日周六
  1. AWS Machine Learning Blog35

    在 Amazon EKS 上用 EFA 和 DeepEP 扩展 MoE 强化学习,吞吐量提升 40%

    AWS 博客介绍在 Amazon EKS 上结合 EFA 与 DeepEP 扩展 MoE 模型强化学习训练的架构,吞吐量提升 40%。该方案针对 rollout 生成与策略训练并行、数百加速器间高吞吐通信,以及 MoE 专家并行(EP)带来的跨节点动态 all-to-all 通信开销。文中覆盖 RLHF、GRPO 等大规模 RL 负载在计算、内存和网络带宽上的资源平衡问题。

  2. AWS Machine Learning Blog31

    NarrateAI:在 Amazon Bedrock 上实现生产级 LLM 质量保障

    NarrateAI 在 Amazon Bedrock 上落地五项质量保障技术,为 4,000 多名 AWS 高管提供实时数据问答,数值准确率约 99%。这五项技术分别是自适应流水线编排、跨账号多模型故障转移、实时流式评估、复合评估框架和数据准确性校验;其中约 90% 的查询走单次快速路径,仅约 10% 超出上下文窗口的复杂查询触发并行批处理。

9月23日周三
9月22日周二
9月21日周一
  1. NVIDIA Blog37

    AI 安全是一个工程问题:如何在 Agent 栈的每一层解决它

    NVIDIA 提出把 AI 安全当作工程问题来对待:Agent 栈从模型、harness 到运行时环境每一层都需有可执行的边界、明确责任人和验证证据。其开源的 NVIDIA OpenShell 提供策略在 Agent 触及范围之外强制生效的安全运行时,并支持沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。

  2. NVIDIA Blog17

    NVIDIA 盘点 5 家用 AI 推动清洁能源的公司

    NVIDIA 在纽约气候周期间介绍了 5 家用 AI 加速清洁能源落地的公司。ThinkLabs AI 用 NVIDIA CUDA 平台构建数字孪生与智能体,帮助南加州爱迪生将电网并网申请评估时间从 30-45 天缩短到 2 分钟;Redwood Materials 用 100% 回收的电动车电池为 AI 工厂提供离网供电,系统基于 NVIDIA Blackwell 平台运行。

9月16日周三
  1. NVIDIA Blog62

    NVIDIA Vera Rubin NVL72 首登 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7 倍

    NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高为 2.5 倍。

    推荐理由:NVIDIA 官方首次公布 Vera Rubin NVL72 的 MLPerf 推理成绩,并给出跨机架扩展与软件迭代的量化对比,可供判断推理经济学走向。

9月11日周五
9月10日周四
9月9日周三
  1. Mistral AI52

    Mistral 如何用 AI 智能体把 4 万行 Fortran 77 迁移到 C++

    Mistral 帮助一家欧洲能源运营商把 4 万行 Fortran 77 水库模拟器迁移到 C++,该代码库没有测试套件,也没有集中文档。做法是先搭数值一致性校验框架,用自研 parser 生成调用树并让上百个智能体借助 Mistral OCR 归档散落文档,再以 coder、tester、reviewer 加人工检查点的结构化工作流逐模块迁移。

9月5日周六
9月1日周二
8月25日周二
  1. Hugging Face Blog62

    Multiverse Computing 提出 Quantization-Aware Healing,4-bit 压缩模型反超其全精度版本

    Multiverse Computing 提出 Quantization-Aware Healing(QAH),把 GPT-OSS 120B 压缩到 60B 参数并量化为 MXFP4 后,直接在原始预压缩模型上做 KL 蒸馏而非从恢复出的 checkpoint 蒸馏,结果在 9 项基准中的 7 项超过该 60B 模型的 bfloat16 版本。

    推荐理由:论文给出压缩加量化后再蒸馏原始模型的做法,读者可比较其与常规 QAT 在精度和训练稳定性上的差异。

8月21日周五
8月20日周四
8月18日周二
8月12日周三
  1. Google DeepMind67

    Google DeepMind 发布手语转文本模型 SL2T,首发落地 Gboard 与 Live Transcribe

    Google DeepMind 发布手语转文本模型 SL2T,以超过 10 万小时、50 多种手语的数据训练,实现手语到文本的机器翻译。该模型首先在 Pixel 11 的 Gboard 与 Live Transcribe 中上线,支持美国手语(ASL)转英文,可用来搜索、写消息或向 Gemini 提问,更多设备和语言将后续支持。

    推荐理由:官方披露 SL2T 的训练规模、手语到文本的翻译路径与隐私处理方式,可了解手语 AI 首次落地消费产品的工程取舍。

8月11日周二
  1. Mistral AI62

    Mistral 推出区域推理端点与优先级服务,并新增欧洲算力联盟

    Mistral 宣布三项推进主权 AI 的动作:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲还是美国运行;Mistral Priority Tier 进入公开预览,提供自定义速率限制和带 SLA 的可用性承诺。

    推荐理由:Mistral 把推理区域选择、SLA 保障与第三方开源模型接入放进同一平台,可看作欧洲主权 AI 基础设施的具体落地路径。