DeepSeek 联合华为为昇腾芯片发布开源编程工具
DeepSeek 与华为合作为昇腾芯片构建编程工具,并全部开源,Huawei 表示对此工作给予完全支持。核心是北京大学研究者最初开发的编程语言 TileLang,DeepSeek 已使用约一年,认为它比 CUDA 的编程模型更简单,它也是 DeepSeek 面向 AGI 工作的主要工具。
DeepSeek 与华为合作为昇腾芯片构建编程工具,并全部开源,Huawei 表示对此工作给予完全支持。核心是北京大学研究者最初开发的编程语言 TileLang,DeepSeek 已使用约一年,认为它比 CUDA 的编程模型更简单,它也是 DeepSeek 面向 AGI 工作的主要工具。
OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol、Ultrafast 加速模式与 Decisions API,并推出 ChatGPT Spaces、Marketplace 及 Sign in with ChatGPT 等平台更新。
推荐理由:汇总 OpenAI DevDay 2026 多项发布与独立评测数据,便于对比定价、能力与平台策略变化。
小米发布 MiMo-V2.6 系列,包含原生全模态的 MiMo-V2.6-Pro(1.02T 总参数、42B 激活)和 MiMo-V2.6-Flash,并推出输出速度最高快 20 倍的 UltraSpeed 版本。
推荐理由:小米 MiMo-V2.6-Pro 以约 300 万美元训练成本登顶开放权重模型,其 RL 环境与训练配方同步开源值得关注。
Jev 发布两天内出现至少 6 个复现方案,包括基于 ModernBERT 的 Laya、基于扩散模型的 DiffusionGemmaJev,以及 Qwen3.5-9B LoRA 微调的 Bespoke Nimble 等,其数据被承认 100% 为合成数据。
Steve Yegge 关停了 Gas Town,并承认每月花费数千美元订阅编码智能体,却只做出这一个项目。Databricks 向约 3500 名工程师铺开 GPT-6 Astra,表示其在复杂长周期任务上"明确"优于 Opus 5 / Sol 5.6,但整体编码支出增加约 60%。OpenAI 发布模型失准事件追踪与披露框架,并附上过去六个月的六份案例报告。
Baseten 成为 Hugging Face Hub 新支持的 Inference Provider,首批上线对话与文本生成任务,可访问 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等热门开源权重 LLM。
英国 AI Security Institute 首次公开分析领先开源权重模型与闭源前沿模型的网络安全能力差距,发现这一差距正在缩小:GLM-5.2 与 DeepSeek V4-Pro 的性能大致相当于比它们早 4 到 7 个月发布的闭源前沿模型,而 2025 年大部分时间测得的差距是 6 到 10 个月。