TypeSafe AI 发布 Jev:只输出浮点决策的 System One 模型
TypeSafe AI 发布 Jev,这是其称为 System One 模型的新类别,仍接受文本输入,但输出的是对应分类、是/否问题和评分的浮点数字及置信度,输入定价 $0.042/百万 token,输出免费。
TypeSafe AI 发布 Jev,这是其称为 System One 模型的新类别,仍接受文本输入,但输出的是对应分类、是/否问题和评分的浮点数字及置信度,输入定价 $0.042/百万 token,输出免费。
TypeSafe 发布名为 Jev 的决策模型,官方称其专为分类、路由与打分等决策任务优化,采用 RLCD 训练,比小型前沿 LLM 快 100 倍以上、便宜 200 倍以上,输出 token 不计费。
Google DeepMind 发布手语转文本模型 SL2T,以超过 10 万小时、50 多种手语的数据训练,实现手语到文本的机器翻译。该模型首先在 Pixel 11 的 Gboard 与 Live Transcribe 中上线,支持美国手语(ASL)转英文,可用来搜索、写消息或向 Gemini 提问,更多设备和语言将后续支持。
推荐理由:官方披露 SL2T 的训练规模、手语到文本的翻译路径与隐私处理方式,可了解手语 AI 首次落地消费产品的工程取舍。
NVIDIA Magpie TTS Multilingual 开放权重模型开放权重、364M 参数,新增 Modern Standard Arabic、韩语和巴西葡萄牙语,共支持 12 种语言,并经由 NVIDIA NIM 在自有基础设施部署。
Meta 发布开源多模态模型 Muse Glimmer,从 Muse 蒸馏至 30B 参数,采用 Apache 2.0 许可,面向编码、文档分析、个人助理等本地智能体场景。
推荐理由:Meta 开源 30B 多模态模型,附 day-0 推理与量化支持,可用于评估本地智能体模型的落地方案。
NVIDIA 推出 Cosmos-H-Dreams,一个面向手术机器人的实时、动作条件生成式仿真器,可将 Cosmos-H-Surgical-Simulator 蒸馏为因果少步学生模型,每帧潜变量最少只需 2 步去噪。
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 两款新模型,并推出面向网络安全的 Gemini 3.5 Flash Cyber。
推荐理由:官方给出三款新模型的价格、token 效率与多项基准对比,可据此判断智能体工作流的成本变化。
Mistral 发布文档解析模型 OCR 4,在提取文本之外新增边界框、区块分类和内联置信度评分,支持 170 种语言并可单容器自托管部署。官方称独立标注者在 600+ 份、12+ 种语言的文档对比中平均 72% 情况下更偏好 OCR 4,该模型在 OlmOCRBench 得 85.20、OmniDocBench 得 93.07。
推荐理由:Mistral OCR 4 在文本框选、区块分类和自托管上的变化,让文档解析可直接进入 RAG 与智能体管线。
Google DeepMind 发布实验性开放模型 DiffusionGemma,基于 Gemma 4 与 Gemini Diffusion 研究,用文本扩散同时生成整块 token,在专用 GPU 上最高提速 4 倍,单张 NVIDIA H100 超 1000 tokens/秒、RTX 5090 超 700 tokens/秒。
推荐理由:原文给出扩散文本生成的速度收益、硬件门槛与质量取舍,读者可据此判断它适合哪类本地推理场景。
Google DeepMind 推出 Gemini Robotics-ER 1.6,定位为机器人的高层推理模型,强化空间推理与多视角理解,可通过 Gemini API 和 Google AI Studio 供开发者使用。
Mistral AI 发布 Mistral OCR 3,在表单、扫描文档、复杂表格和手写内容上相对 Mistral OCR 2 取得 74% 的整体胜率。该模型支持 markdown 输出并可用 HTML 标签还原表格结构,定价为每 1000 页 2 美元,Batch API 折扣下降至每 1000 页 1 美元,模型 API 名为 mistral-ocr-2512。
推荐理由:原文给出 OCR 3 相对上一代的提升幅度和按页计价,读者可据此估算文档处理流水线的成本变化。
Mistral 发布 Mistral 3 系列,包含 3B、8B、14B 三个 Ministral 3 密集模型,以及总参数 675B、激活 41B 的稀疏 MoE 模型 Mistral Large 3,全部以 Apache 2.0 许可开源。
推荐理由:Mistral 3 一次性放出从 3B 到 675B 的全系开源模型,读者可据此判断小模型与 MoE 大模型的分工。
Mistral AI 发布首个代码专用嵌入模型 Codestral Embed,在真实代码检索任务上显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大型嵌入模型。
Mistral AI 发布 Mistral Medium 3,官方称其在多项基准上达到 Claude Sonnet 3.7 的 90% 或以上,价格低至每 M token 输入 $0.4、输出 $2。
推荐理由:官方给出 Mistral Medium 3 在成本、部署门槛与专业任务上的定位,可与 Claude、Llama 4、DeepSeek v3 对比。