AI 早报 2026-09-23
过去 12 小时,AI 圈迎来两款重磅模型更新:OpenAI 发布 GPT-6 Sol 与 Luna,API 价格较 GPT-5.6 促销价降低 50%;Anthropic 发布 Claude Opus 5.5,主打更强的智能体与编码能力,同时降低运行成本。安全与产业侧,Meta Muse 暴露严重 0-day,过度依赖 AI 导致军事误击的调查也引发警示。
模型发布/更新
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降低 50%
来源:OpenAI 官网动态|今天凌晨 02:00|原文
两款模型基于 GPT-6 Astra 的训练方法,面向更快、更便宜的大规模工作负载。Sol 输入/输出价格为每百万 token 2/10 美元,Luna 为 0.10/0.50 美元。
Claude Opus 5.5 发布,成本较 Opus 5 降低 40%
来源:Anthropic Newsroom|今天凌晨 00:53|原文
Anthropic 发布 Claude 5.5 系列首个模型,称其在多数工作上达到 Fable 5.1 水平,典型负载成本比 Opus 5 低 40%。
Claude Opus 5.5 上线 OpenRouter,支持 1M 上下文
来源:X:OpenRouter(@OpenRouter)|今天凌晨 00:44|原文
Opus 5.5 在智能体编码、知识工作和计算机使用上领先 Opus 5,定价为每百万输入/输出 token 4/20 美元。
Qwen-Image-2.1 开源发布,登顶 Arena 图像编辑榜开源第一
来源:X:Arena(@arena)|今天晚上 23:13|原文
通义千问新模型开放权重,在 Image Edit Arena 以 1367 分位列开源第一,并登上 Text-to-Image Arena 开源第一。
Arena 上线 GPT-6 Sol 与 Luna 测试
来源:X:Arena(@arena)|今天凌晨 03:29|原文
Arena 邀请用户实测 GPT-6 Sol 和 Luna,模型评分将根据真实智能体任务投票公布。
Sam Altman 称 GPT-6 Sol 与 Luna 按任务定价暂无对手
来源:X:Sam Altman(@sama)|今天凌晨 02:28|原文
Altman 表示两款模型在智能、对齐、编码和计算机使用上均有提升,按任务成本衡量更具竞争力。
产品发布/更新
OpenAI 为 GPT-6 推出改进的提示词缓存系统与诊断工具
来源:OpenAI 官网动态|今天凌晨 05:00|原文
改进后的系统默认提高缓存命中率,对 30 分钟窗口内复用的合格共享前缀提供最高 90% 的缓存输入 token 折扣。
GPT-6 Sol 与 Luna 推送至 ChatGPT Work 和 Codex
来源:X:ChatGPT(@ChatGPT)|今天凌晨 02:16|原文
Plus、Pro、Business、Enterprise 和 Edu 用户可在 ChatGPT Work 与 Codex 中使用两款新模型。
Claude Code v2.1.280 将 Opus 5.5 设为默认 Opus 模型
来源:Claude Code GitHub Releases|今天凌晨 00:38|原文
新版本支持 1M 上下文,并将 Pro 和 Team Standard 计划的默认模型从 Sonnet 调整为 Opus。
LiteParse 9 月更新:PDFium 提速 20%-25%
来源:LlamaIndex|今天晚上 22:38|原文
LiteParse 2.14.6 通过优化自维护 PDFium fork 将文本提取耗时降低 20%-25%,并新增视觉定位与 is-complex 路由 API。
Apple 新款 Mac mini 与 Mac Studio 开售
来源:Apple Newsroom|今天晚上 20:59|原文
新款 Mac mini 搭载 M6 和 M5 Pro,Mac Studio 搭载 M5 Max 与 M5 Ultra,Apple 宣称 Mac mini AI 性能最高提升 4 倍。
行业动态
Meta Muse 助手曝出严重 0-day 漏洞,Amazon 开始封禁 Muse
来源:Hacker News 热门|今天凌晨 03:29|原文
本地应用或终端命令可获取 Muse 账户认证 token,从而完全控制智能体。Meta 在披露约 12 小时后发布热修复,Amazon 也因其未授权 AI agent 身份开始封禁购物功能。
过度依赖 Palantir Maven AI 被指与误击伊朗学校有关
来源:Hacker News:AI 热帖|今天凌晨 03:03|原文
据报道,五角大楼内部审查将情报过时、卫星图像长期未更新,以及部分人员过度依赖 Maven Smart System 列为误击事件原因之一。
Claude Opus 5.5 登上 Arena Agent Arena
来源:X:Arena(@arena)|今天凌晨 01:48|原文
Opus 5.5 进入基于真实长程智能体任务的评测,用户可通过投票影响排行榜。
论文研究
本时间段暂无精选论文条目。
技巧与观点
Artificial Analysis:GPT-6 Sol 与 Luna 成本减半,能力评测有升有降
来源:Artificial Analysis|今天凌晨 03:41|原文
评测显示 Sol 定价为每百万输入/输出 token 2/10 美元,Luna 为 0.10/0.50 美元;两款模型在不同评测中的表现并非全面提升。
Artificial Analysis:Claude Opus 5.5 登顶智能指数
来源:Artificial Analysis|今天凌晨 01:41|原文
Opus 5.5 取得 58 分,成为该评测测得的最高分模型,并在 Terminal-Bench 4.0 上与 GPT-6 Astra 持平。
Opus 5.5 实测比 Fable 5.1 更快且便宜 51%
来源:X:Boris Cherny(@bcherny)|今天凌晨 00:45|原文
在将 HAProxy 从 C 移植到 Rust的测试中,Opus 5.5 用时 9.5 小时,快于 Fable 5.1 的 12 小时,成本低 51%。
Artificial Analysis:GPT-6 Sol 与 Luna 的智能指数与前代持平
来源:X:Artificial Analysis(@ArtificialAnlys)|今天凌晨 02:20|原文
两款模型价格约为 GPT-5.6 对应版本的一半,但 Intelligence Index 与前代基本持平,体现出成本效率优先的产品取向。
今日关键词: GPT-6 Sol、GPT-6 Luna、Claude Opus 5.5、Qwen-Image-2.1、提示词缓存、智能体安全、Maven AI、开放权重模型