跳到正文

#数据/训练

今日 2 条
8月10日周一
8月6日周四
  1. Google DeepMind76

    Google DeepMind 开源 WeatherNext 气象模型,气旋预测多出一天预警时间

    Google DeepMind 在 Nature 发表论文,称 WeatherNext AI 模型在气旋路径、强度和风场结构预测上达到 SOTA,平均可多提供一天预报时效,三天预报精度相当于此前模型的两天水平。

    推荐理由:官方给出气旋路径与强度预测多出一天预警时间的评估结果,并同时开源模型与权重,可据此判断气象预报模型的可用边界。

8月4日周二
  1. Microsoft Research70

    微软研究院开源 Orchard:面向可扩展智能体的开放框架

    微软研究院开源 Orchard,一个面向可扩展智能体 AI 研究的框架,核心是可在软件工程、网页导航和智能助手等任务间复用的 Orchard Env 环境服务,并支持直接在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中训练智能体。

    推荐理由:微软研究院开源 Orchard 环境服务与三套训练配方,读者可了解小参数模型在真实 harness 内训练后能达到的智能体水平。

7月30日周四
  1. Hugging Face Blog19

    GPU 管理:为什么闲置 GPU 正在成为新的停飞客机

    继模型质量之后,GPU 利用率正成为企业 AI 的下一个真实约束:GPU 成本按日历小时计(融资、折旧、电力、制冷),产出却只按计算小时计,而需求并非全天候。到 2026 年,连 Anthropic 都同时在 Amazon、Google、Microsoft 和 AMD 四家平台上做多吉瓦级承诺,Meta 也签下类似规模的多吉瓦协议,算力获取仍是活生生的战略约束。

7月22日周三
7月21日周二
  1. Hugging Face Blog61

    Hugging Face 发布 Grabette:录制机器人操作数据的开源系统

    Hugging Face 发布开源系统 Grabette,用手持夹爪在几分钟内录制操作任务,并自动转换为可训练的 LeRobot 数据集。Grabette 配备广角鱼眼相机与 RGBD 相机,硬件 BOM 成本约 490€,配套的机器人夹爪 Gripette 成本约 120€,硬件、采集软件、处理流程均已开源。

    推荐理由:原文给出了一套低成本采集操作数据的完整开源方案,读者可以据此了解机器人学习数据瓶颈的另一种解法。

7月16日周四
  1. Hugging Face Blog31

    新模型来了,优势依旧:DharmaOCR 在巴西葡萄牙语上仍胜过 Mistral OCR4 与 Unlimited-OCR

    DharmaOCR 在葡萄牙语专用基准上得分 0.925,超过 Mistral OCR4 的 0.798 和 Unlimited-OCR 的 0.7587。该模型经葡萄牙语语料监督微调后,再用 DPO 提升推理稳定性、降低退化率。作者认为,把全部参数集中到单一语言领域,是其相对多语言模型的结构性优势。

7月7日周二
  1. Berkeley AI Research34

    智能免费之后怎么办?面向智能体、由智能体运行的数据系统

    UC Berkeley 的 Aditya G. Parameswaran 等提出近零推理成本下的三大数据系统挑战:为智能体服务的数据系统、由智能体运行的数据系统、以及由智能体合成的数据系统。GPT-4 级能力从 2023 年初约 $30/百万 token 降至如今不到 $1,部分厂商已低于 $0.10,推理价格年降幅在 9x 到 900x 之间,中位数约 50x。

  2. Hugging Face Blog61

    Hugging Face 与 SkyPilot 联合推出零出网存储集成

    Hugging Face 与 SkyPilot 联合发布集成,用户可用一个 hf:// URL 将 Hugging Face Bucket 或模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20 多个云、Kubernetes 和本地集群上运行。

    推荐理由:原文给出 hf:// 挂载方式与免费出网机制,读者可据此判断跨云训练工作流的存储成本变化。

7月6日周一
  1. Hugging Face Blog30

    PRX Part 4:数据策略详解

    Hugging Face 发布 PRX 系列第四篇,披露其数据策略:预训练数据由公开与内部数据集混合组成,用 VLM 重新生成图像长描述,再转为可流式语料。训练文本编码器换为 Qwen3-VL 并改为实时计算 latent,仅带来约 3–4% 吞吐损失;图像统一以 JPEG quality 92 编码。

7月1日周三
6月30日周二
  1. Google Research69

    Google Research 发布 TabFM:面向表格数据的零样本基础模型

    Google Research 发布 TabFM,一个面向表格数据分类与回归的零样本基础模型,将表格预测重构为上下文学习(ICL)问题,无需手动训练、超参数调优和特征工程,单次前向传播即可对未见过的表格生成预测。

    推荐理由:TabFM 把零样本思路带到表格分类与回归,读者可据此了解免训练预测在企业数据场景的落地方式。

6月29日周一
6月25日周四
  1. Google Research41

    Google Research 研究:推理如何解锁 LLM 的参数化知识回忆

    Google Research 在 COLM 2026 论文《Thinking to Recall》中提出,让 LLM 生成推理轨迹能解锁原本无法触及的参数化事实,且这一效应在简单单跳问题上同样成立。研究用 Gemini-2.5 Flash/Pro 和 Qwen3-32B 在 SimpleQA Verified、EntityQuestions 上对比推理开关,识别出计算缓冲与事实启动两种机制。

6月17日周三
6月13日周六
  1. Google Research39

    用退役手机搭建低碳计算平台:加州大学圣地亚哥分校与 Google 打造 2000 台 Pixel 手机集群

    加州大学圣地亚哥分校在 Google 支持下,将退役智能手机的主板拆出组成集群,部署一个由 2000 台 Pixel 手机搭建的数据中心,为数百名研究者与学生提供低成本、低碳的云计算。研究显示 25-50 台手机约等于一台现代服务器,20 台手机的小型集群已能支撑 75 人以上课程的评分负载,且延迟低于 AWS 默认后端。该系统预计 2026 年秋季全面上线。

6月8日周一
6月4日周四
6月1日周一
5月28日周四
  1. Google Research37

    Google 推出零信任聚合的私有分析方案,结合密码学与 TEE

    Google 公布一套面向私有分析的零信任聚合新方案,用新型密码学聚合协议保护用户数据,设备只需发送单条消息、无需多轮在线交互,Google 只能得到匿名化的群体聚合结果。该方案将密码学层与 TEE 结合,在硬件保护失效时数据仍不会被还原,并借助 TEE 远程证明向参与者验证协议按公开代码正确执行。

5月27日周三
5月23日周六
  1. Mistral AI60

    Mistral 收购 Physics AI 公司 Emmi,推进工业 AI 布局

    Mistral AI 宣布已就收购 Physics AI 公司 Emmi AI 达成最终协议,以强化其面向工业企业的 AI 转型能力。Emmi AI 成立于奥地利,专注 Physics AI 并开发大型工程模型,可实现实时仿真、替代多日计算并构建数字孪生;其 30 多名研究人员与工程师将在 5 月加入 Mistral 的 Science 与 Applied AI 团队。

    推荐理由:Mistral 收购 Physics AI 公司 Emmi,说明其正把物理建模能力与工程工具接入纳入工业 AI 路线。

5月22日周五
  1. Google DeepMind28

    Google DeepMind 在亚太推出加速器计划,聚焦“AI for the Planet”应对环境风险

    Google DeepMind 在亚太地区启动首个加速器计划,聚焦“AI for the Planet”,为期三个月,面向该地区初创公司、研究团队和非营利组织,用前沿 AI 解决自然、气候、农业、能源等问题。入选机构将获得专家指导、定制支持,以及 Google AI 专家协助把前沿 AI 和科学 AI 模型整合进其项目或产品。计划以在新加坡举办的线下训练营启动,现已开放注册意向。

5月19日周二
5月18日周一
5月16日周六
  1. Google DeepMind39

    剑桥教授用 Co-Scientist 寻找跨物种传播疾病的分子开关

    剑桥大学 Clare Bryant 教授用 Google DeepMind 的 Co-Scientist 研究流感等病原体跨物种传播引发败血症的分子机制。Co-Scientist 在未公开数据辅助下将候选靶点从蛋白质细化到具体氨基酸,团队正据此构建含氨基酸突变的细胞系验证假设。Bryant 称,原本需两到三年的精确氨基酸定位工作,若靶点正确,实验室有望在六个月内完成。

  2. Google DeepMind50

    Google Co-Scientist 助力发现抗肝纤维化老药新用途

    Google DeepMind 的 Co-Scientist 帮助斯坦福大学医学院遗传学家 Gary Peltz 筛选可老药新用治疗肝纤维化的药物。Peltz 自己挑选的两款候选药在活体人类肝细胞测试中无效,而 Co-Scientist 提出的三款候选药中有两款阻断了纤维化并促进肝细胞再生,其中癌症药物 vorinostat 阻断了 91% 可致肝疤痕的损伤反应。

5月4日周一
5月2日周六
4月30日周四
4月22日周三
4月16日周四
  1. Google Research32

    Google Research 用 AI 合成神经元加速脑图谱重建,MoGen 在 ICLR 2026 亮相

    Google Research 提出神经元形态生成模型 MoGen,用点云流匹配生成合成神经元形状,加入 PATHFINDER 训练管线后使小鼠轴突重建错误率降低 4.4%,主要来自合并错误的减少。在完整小鼠脑规模下,这相当于节省 157 人年的手动校对。MoGen 已开源,论文将在 ICLR 2026 展示。

4月1日周三
  1. Google Research28

    Google Research 研究:AI 基准测试需要多少标注者才够?

    Google Research 用模拟器研究 AI 评测中「标注多少条目(N)」与「每条目标注多少人(K)」的权衡,发现常见的每条目 1、3、5 名标注者往往不够,反映人类观点细微差异常需每条目 10 名以上标注者。若只关心多数投票,增加条目更有效;若想捕捉观点分布,则必须增加标注者;在约 1000 条总标注的适度预算下,按指标选对比例即可获得高可复现结果。该模拟器已在 GitHub 开源。

3月25日周三
3月18日周三
  1. Mistral AI66

    Mistral AI 发布 Forge,让企业用私有知识训练前沿模型

    Mistral AI 发布 Forge,一套让企业基于专有知识训练前沿级 AI 模型的系统。Forge 覆盖预训练、后训练和强化学习等模型生命周期阶段,支持 dense 与 MoE 架构及多模态输入,并可由 Mistral Vibe 等智能体用自然语言完成微调和调参。

    推荐理由:原文给出企业用私有数据训练前沿模型的分阶段方案与多个行业落地场景,可据此判断企业自建模型的能力边界。