跳到正文

#开源生态

今日 1 条
今天10月1日周四
9月30日周三
  1. AWS Machine Learning Blog67

    在 Amazon Bedrock AgentCore Runtime Instances 上构建多智能体音乐制作流水线

    AWS 官方博客演示如何在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线:作曲智能体用 Claude Sonnet 4.6 生成音乐简报并在实例自带的 NVIDIA L4 上运行开源音乐生成模型 ACE-Step,20 秒 48kHz 立体声渲染约 9 秒。

    推荐理由:文章给出三智能体共享 GPU 实例视频/音频流水线的完整代码与踩坑点,可迁移到其他长时任务编排。

9月29日周二
  1. Hugging Face Blog69

    NVIDIA 发布表格基础模型 Kumo Tabular,在四个基准排名第一

    NVIDIA 发布开源表格基础模型 Kumo Tabular,属于 Kumo Structured 模型系列,在 Hugging Face 上提供权重。给定带标签行的表格,它在单次前向传播中预测新行标签,无需训练、调参和特征工程,支持分类与回归,提供 28M 至 215M 三档参数规模,采用 OpenMDW-1.1 许可可商用。

    推荐理由:原文公开了表格基础模型的三档规模、单次前向推理方式和四个基准排名,可据此判断无训练微调的表格预测路径。

  2. Latent Space70

    AMD 以 82 亿美元收购 World Labs,Atlas 解决稀疏重建难题

    AMD 以 82 亿美元收购 World Labs,后者由李飞飞创立,专注空间智能。World Labs 近期发布 Atlas,这是一种从零训练的 omni 模型架构,能从 2D 图像输入预测新视角,性能超过专用模型,解决了计算机视觉中长期存在的稀疏重建问题,潜在应用覆盖机器人仿真、设计工程、科学等领域。

9月26日周六
  1. AWS Machine Learning Blog35

    在 Amazon EKS 上用 EFA 和 DeepEP 扩展 MoE 强化学习,吞吐量提升 40%

    AWS 博客介绍在 Amazon EKS 上结合 EFA 与 DeepEP 扩展 MoE 模型强化学习训练的架构,吞吐量提升 40%。该方案针对 rollout 生成与策略训练并行、数百加速器间高吞吐通信,以及 MoE 专家并行(EP)带来的跨节点动态 all-to-all 通信开销。文中覆盖 RLHF、GRPO 等大规模 RL 负载在计算、内存和网络带宽上的资源平衡问题。

9月25日周五
9月24日周四
  1. Latent Space36

    Foundries 与 Navigators:AI 如何降低科学研究的成本

    AI 让思考变得廉价但实验本身并未加速,生物科技行业由此分化出两种路径:Foundries 用下一代测序、高通量显微和物理自动化把实验数据生成速度提升一个数量级,Navigators 则把模型嵌入公司日常流程以加快决策。Navigators 虽不显眼却适用于所有公司,早期的 Endura Therapeutics 已用几小时搭建内部仪表盘,使实验分析从一周缩短到一小时。

9月22日周二
  1. Latent Space82

    小米发布 MiMo-V2.6-Pro 与 Flash:新的开放权重模型,训练成本约 300 万美元

    小米发布 MiMo-V2.6 系列,包含原生全模态的 MiMo-V2.6-Pro(1.02T 总参数、42B 激活)和 MiMo-V2.6-Flash,并推出输出速度最高快 20 倍的 UltraSpeed 版本。

    推荐理由:小米 MiMo-V2.6-Pro 以约 300 万美元训练成本登顶开放权重模型,其 RL 环境与训练配方同步开源值得关注。

9月16日周三
9月10日周四
9月8日周二
9月3日周四
  1. Hugging Face Blog70

    Hugging Face 发布 funes:为编码智能体提供自有记忆层

    Hugging Face 发布 funes,一个为编码智能体提供持久记忆层的开源工具,支持 Claude Code、Codex、pi 和 Hermes。它用单条命令安装,通过本地嵌入与重排把历史会话索引成本地 Lance 数据集,并可按需发布为默认私有的 Hugging Face 数据集,让不同智能体跨机器召回彼此推理过程。

    推荐理由:funes 把聊天记录变成可检索的本地记忆层,读者可据此判断跨智能体协作的落地方式。

9月1日周二
  1. Google Research66

    Google 发布 TimesFM-3:面向多变量预测的零样本基础模型

    Google 发布 TimesFM-3,这是其时间序列基础模型的新一代版本,原生支持多变量预测,参数规模 3.3 亿,在超过 1 万亿个时间点的真实与合成时序语料上预训练。

    推荐理由:TimesFM-3 从单变量扩展到原生多变量预测,读者可了解一次前向传播完成多序列预测的架构取舍。

8月26日周三
8月25日周二
8月21日周五
8月18日周二
8月14日周五
8月13日周四
  1. Hugging Face Blog77

    Hugging Face 用智能体复现 ICML 2026 的 2226 篇论文

    Hugging Face 在 7 月 15 日至 8 月 2 日举办 ICML 2026 开放复现挑战,1221 名社区成员用 Claude Code、Codex、Cursor 等编码智能体逐条验证论文结论,共发布 6816 份 Trackio logbook,覆盖 2226 篇论文,占会议接收论文的 34%。

    推荐理由:Hugging Face 公开 ICML 2026 论文复现活动的数据与方法,读者可据此看到智能体做科研复现的真实边界与人类角色。

8月11日周二
  1. Mistral AI62

    Mistral 推出区域推理端点与优先级服务,并新增欧洲算力联盟

    Mistral 宣布三项推进主权 AI 的动作:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲还是美国运行;Mistral Priority Tier 进入公开预览,提供自定义速率限制和带 SLA 的可用性承诺。

    推荐理由:Mistral 把推理区域选择、SLA 保障与第三方开源模型接入放进同一平台,可看作欧洲主权 AI 基础设施的具体落地路径。

8月10日周一
8月6日周四
  1. Google DeepMind76

    Google DeepMind 开源 WeatherNext 气象模型,气旋预测多出一天预警时间

    Google DeepMind 在 Nature 发表论文,称 WeatherNext AI 模型在气旋路径、强度和风场结构预测上达到 SOTA,平均可多提供一天预报时效,三天预报精度相当于此前模型的两天水平。

    推荐理由:官方给出气旋路径与强度预测多出一天预警时间的评估结果,并同时开源模型与权重,可据此判断气象预报模型的可用边界。