跳到正文

全部动态

今日 47 条
3月24日周二
  1. Mistral AI71

    Mistral AI 发布 Voxtral TTS 语音合成模型

    Mistral AI 发布首款文本转语音模型 Voxtral TTS,4B 参数,支持英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语、印地语和阿拉伯语共 9 种语言的语音生成。

    推荐理由:原文给出了架构、延迟与定价,读者可据此判断它在企业语音工作流中的位置。

3月18日周三
  1. Mistral AI66

    Mistral AI 发布 Forge,让企业用私有知识训练前沿模型

    Mistral AI 发布 Forge,一套让企业基于专有知识训练前沿级 AI 模型的系统。Forge 覆盖预训练、后训练和强化学习等模型生命周期阶段,支持 dense 与 MoE 架构及多模态输入,并可由 Mistral Vibe 等智能体用自然语言完成微调和调参。

    推荐理由:原文给出企业用私有数据训练前沿模型的分阶段方案与多个行业落地场景,可据此判断企业自建模型的能力边界。

3月17日周二
  1. Mistral AI74

    Mistral 发布 Mistral Small 4 开源模型,统一推理、多模态与编码能力

    Mistral AI 发布 Mistral Small 4,这是 Mistral Small 系列的下一个主要版本,也是首个把 Magistral 推理、Pixtral 多模态与 Devstral 编码智能体能力统一到单一模型的 Mistral 模型,采用 Apache 2.0 许可。

    推荐理由:Mistral 首次把推理、多模态与编码智能体能力合并进一个开源模型,并给出可调推理强度与延迟数据。

3月13日周五
3月12日周四
  1. Google Research67

    Google 与 BIDMC 开展 AMIE 对话诊断 AI 真实临床可行性研究

    Google Research 与 Beth Israel Deaconess Medical Center 合作开展 AMIE 对话诊断 AI 的前瞻性单中心可行性研究,让 100 名成人在门诊预约前先与 AMIE 进行文本问诊。

    推荐理由:Google 与 BIDMC 公布 AMIE 在真实门诊的前瞻性可行性研究结果,包含安全监督、诊断准确率与患者态度变化等具体数据。

3月11日周三
2月5日周四
1月28日周三
  1. Mistral AI61

    Mistral 发布终端编码智能体 Mistral Vibe 2.0

    Mistral 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的重大升级,由 Devstral 2 模型系列驱动。新版本支持自定义子智能体、多选项澄清、斜杠命令技能、统一智能体模式和自动更新,已在 Le Chat Pro 和 Team 套餐上线,超出额度可按 API 价格按量付费或自带 API key。

    推荐理由:原文列出了子智能体、斜杠命令技能与计费方式的变化,读者可据此判断终端编码智能体的可用范围。

1月22日周四
1月10日周六
  1. Berkeley AI Research23

    伯克利提出信息驱动成像系统设计框架,NeurIPS 2025 论文验证四大成像领域

    伯克利 AI Research 提出一种直接评估和优化成像系统信息量的框架,仅用含噪测量和噪声模型估计互信息,可预测解码器性能。在 NeurIPS 2025 论文中,该方法在彩色摄影、射电天文、无透镜成像和显微成像四个领域验证了信息估计与下游任务表现的一致性,优化后的设计达到 SOTA 端到端方法水平,同时占用更少内存和算力、无需任务专用解码器。

12月17日周三
  1. Mistral AI64

    Mistral AI 发布 Mistral OCR 3,在表单与手写文档上较上代提升 74%

    Mistral AI 发布 Mistral OCR 3,在表单、扫描文档、复杂表格和手写内容上相对 Mistral OCR 2 取得 74% 的整体胜率。该模型支持 markdown 输出并可用 HTML 标签还原表格结构,定价为每 1000 页 2 美元,Batch API 折扣下降至每 1000 页 1 美元,模型 API 名为 mistral-ocr-2512。

    推荐理由:原文给出 OCR 3 相对上一代的提升幅度和按页计价,读者可据此估算文档处理流水线的成本变化。

12月9日周二
  1. Mistral AI71

    Mistral 发布 Devstral 2 编码模型与 Mistral Vibe CLI

    Mistral AI 发布 Devstral 2 编码模型家族,包括 123B 的 Devstral 2 和 24B 的 Devstral Small 2,两者分别采用修改版 MIT 和 Apache 2.0 许可,均为开源。

    推荐理由:官方给出了 Devstral 2 的 SWE-bench Verified 成绩、参数规模与定价,可据此判断开源编码模型的性价比位置。

12月3日周三
11月19日周三
  1. Mistral AI39

    Mistral AI 与 SAP、Helsing 达成合作,打造面向德国的主权 AI 技术栈

    Mistral AI 宣布与 SAP 建立多年合作,将模型集成进 SAP 的 AI Foundation,共同为德国和欧洲打造完全主权的 AI 技术栈,并联合开发面向复杂行业与政府机构的行业解决方案。Mistral AI 同时携手 Helsing 加速面向真实场景防御与安全应用的视觉-语言-动作模型研发。为推进在德布局,Mistral AI 正大幅扩充本地团队,并将在未来数月内开设德国办公室。

11月1日周六
  1. Berkeley AI Research30

    Berkeley AI Research:不依赖 TD 学习的强化学习,用分治法扩展长时程任务

    Berkeley AI Research 提出一种基于分治法(divide and conquer)的强化学习算法,不依赖时序差分(TD)学习,可将 Bellman 递归次数从线性降为对数级,从而扩展到任意长时程任务。该工作与 Aditya 共同主导,在 goal-conditioned RL 上首次实现了分治法价值学习的规模化扩展,利用三角形不等式构造传递式 Bellman 更新规则。

10月24日周五
9月9日周二
9月2日周二
  1. Mistral AI54

    Mistral 为 Le Chat 推出 Memories 测试版

    Mistral 在 Le Chat 上线 Memories(beta)记忆功能,采用自动保存加按需召回的方式,被调用时会显示来源链接。Le Chat 支持随时关闭记忆、开启不使用记忆的隐身对话、编辑或删除单条记忆,并可导出和导入记忆。同期推出 Memory Insights,用轻量提示帮助用户查看模型记住了什么;官方称底层采用基于图的架构。

9月1日周一
8月1日周五
7月30日周三
7月23日周三
7月17日周四
  1. Mistral AI63

    Mistral 为 Le Chat 上线 Deep Research、Voxtral 语音与图像编辑等功能

    Mistral 为 Le Chat 推出多项新功能,包括预览版 Deep Research 模式、由新语音模型 Voxtral 驱动的 Voice 模式、由推理模型 Magistral 支持的 Think 模式、用于整理对话的 Projects,以及与 Black Forest Labs 合作的高级图像编辑。

    推荐理由:Mistral 一口气给 Le Chat 补上研究、语音、推理与图像编辑,读者可据此判断其产品线扩张方向。

7月15日周二
  1. Mistral AI74

    Mistral 发布 Voxtral 语音理解模型,24B 与 3B 两个版本均以 Apache 2.0 开源

    Mistral AI 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,均以 Apache 2.0 许可开源并上线 API。模型支持 32k token 上下文,可处理最长 30 分钟转录或 40 分钟理解,并具备音频问答、摘要、多语言识别与语音触发函数调用能力,其语言模型骨干继承自 Mistral Small 3.1。

    推荐理由:Mistral 开源语音理解模型,给出两款尺寸、32k 上下文与转录基准对比,可据此判断开源语音方案的落地成本。

7月11日周五
7月3日周四
6月11日周三
6月10日周二
6月4日周三
  1. Mistral AI64

    Mistral 发布企业级 AI 编码助手 Mistral Code

    Mistral AI 发布企业级 AI 编码助手 Mistral Code,整合 Codestral、Codestral Embed、Devstral 和 Mistral Medium 四个模型、IDE 内助手、本地部署选项与企业管控工具,基于开源项目 Continue 构建。

    推荐理由:官方给出模型组合、部署形态和三家大企业落地细节,可据此判断企业级 AI 编码工具的选型与合规边界。

5月28日周三
5月27日周二
5月21日周三