AI 早报 2026-09-22
过去 12 小时,AI 圈的焦点集中在小米 MiMo-V2.6 系列的发布与开源:Pro 模型在多项开放权重评测中冲上前列,同时 Grok 4.7 的智能体编码表现也受到关注。产业侧,AI 智能体的安全边界与代码验证效率继续成为讨论热点。
模型发布/更新
小米 MiMo-V2.6-Pro 登上 Code Arena WebDev 榜前十
来源:X:Arena(@arena)|今天 05:08|原文
小米 MiMo-V2.6-Pro 在 Code Arena 的 WebDev 榜以 1628 分(AutoEval)位列约第 10 名,在开源权重模型中约排名第 3,较 MiMo-V2.5-Pro 提升 153 分。
MiMo-V2.6-Pro 登顶 Artificial Analysis 开放权重模型智能指数
来源:X:Clément Delangue(Hugging Face CEO)|今天 05:03|原文
该模型在 Artificial Analysis Intelligence Index 得分 46,超过前代的 26,成为当前开放权重模型中的最高分。
小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型
来源:X:小米 MiMo(@XiaomiMiMo)|今天 04:51|原文
MiMo-V2.6 Pro 与 Flash 均为原生全模态模型,覆盖编码、computer use、3D 推理和创作等能力。官方称 Pro 在多数 Agent 基准上可与 Claude Opus 5 和 GPT-5.6 Sol 相当。
MiMo-V2.6 系列开源,探索递归自我改进路径
来源:公众号:小米 MiMo|今天 04:18|原文
小米正式开源 MiMo-V2.6 Pro 与 Flash,强调通过扩大强化学习规模,探索 RSI(递归自我改进)路径。
行业动态
不列颠哥伦比亚省起诉 OpenAI,追问高风险活动的转介机制
来源:X:Rohan Paul(@rohanpaul_ai)|今天 04:11|原文
不列颠哥伦比亚省在加州起诉 OpenAI,指称被标记的 ChatGPT 活动本应在 2026 年 2 月枪击案前通报警方,案件进一步引发对平台安全响应机制的讨论。
亚马逊封禁 Meta Muse 智能体代用户购物
来源:IT之家|今天 03:52|原文
亚马逊阻断 Meta 个人 AI 智能体 Muse 的购物访问,称其未获授权、没有表明身份,并可能采集和保存用户账号凭证,AI 代理的身份与权限边界再成焦点。
技巧与观点
Artificial Analysis:Grok 4.7 的智能体知识工作能力跻身前沿
来源:Artificial Analysis|今天 03:41|原文
评测显示,Grok 4.7 的 Intelligence Index 得分为 46,AA-Briefcase 得分 1657 Elo,较上一代提升 111 分,仅次于部分领先模型。
马斯克称 Grok 4.7 让 xAI 的智能体编码排名第三
来源:X:Elon Musk(@elonmusk,xAI)|今天 01:06|原文
马斯克援引 Artificial Analysis 的评测称,Grok 4.7 使 xAI 在智能体编码领域排名第三,仅次于 Anthropic 和 OpenAI。
Linear 重构 CI 流程,应对 AI 编码带来的验证瓶颈
来源:Linear Now|昨天 20:26|原文
随着 AI Agent 加速代码产出,Linear 重新设计 CI 流程,将 PR 等待时间从 6 分钟以上降到 5 分钟出头,并将单测 runner 时间缩短约一半。
开源模型的中美实力格局持续变化
来源:Nathan Lambert:Interconnects|昨天 19:56|原文
分析指出,中国开源权重模型已在下载量、基准成绩和学术采用上领先;自 2025 年 7 月起,中国模型在 Hugging Face 的下载量约领先 16 亿次。
今日关键词: MiMo-V2.6、开放权重模型、全模态、Grok 4.7、智能体编码、AI 安全、CI 验证