Google 发布 Gemini 4 Argon,缩小与 OpenAI、Anthropic 的差距但未明显领先
Google 发布新一代前沿模型 Gemini 4 Argon,在部分关键基准上超过 OpenAI 和 Anthropic 的竞品,但并未取得明显领先。
Google 发布新一代前沿模型 Gemini 4 Argon,在部分关键基准上超过 OpenAI 和 Anthropic 的竞品,但并未取得明显领先。
AINews 汇总 9/24-9/25 动态,Claude Opus 5.5 本周发布后反响积极,以 88.4% 领跑 SimpleBench,并被指在生成讲解视频上表现突出。
推荐理由:汇总一周内多个模型与工具的动态,便于快速了解前沿模型在基准、成本和视频生成上的位置。
DharmaOCR 在葡萄牙语专用基准上得分 0.925,超过 Mistral OCR4 的 0.798 和 Unlimited-OCR 的 0.7587。该模型经葡萄牙语语料监督微调后,再用 DPO 提升推理稳定性、降低退化率。作者认为,把全部参数集中到单一语言领域,是其相对多语言模型的结构性优势。
Mistral AI 发布首个代码专用嵌入模型 Codestral Embed,在真实代码检索任务上显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大型嵌入模型。