AI 早报 2026-10-08
过去 12 小时,AI 圈的焦点集中在新模型普及、智能体基础设施和模型调用成本下降:OpenAI 向所有 ChatGPT 用户推出 GPT-6 与可交互的 Intelligent UI,Anthropic 发布 Claude Haiku 5.5,Perplexity 开源多模态嵌入模型;同时,NVIDIA 与 Microsoft 推出面向 Windows PC 的 AI 硬件方案,Agent Lightning 也为智能体强化学习提供了更轻量的开源路径。
模型发布/更新
Anthropic 发布 Claude Haiku 5.5,智能指数一年提升 26 分
来源:X:Artificial Analysis(@ArtificialAnlys)|约 12 小时前|原文链接
Claude Haiku 5.5 在 Artificial Analysis 智能指数中获得 43 分,较上一代 Haiku 在一年内提升 26 分,显示轻量模型的能力仍在快速增长。
Perplexity 开源 pplx-embed-v2-late 多模态嵌入模型
来源:X:Aravind Srinivas(Perplexity CEO)(@AravSrinivas)|约 15 小时前|原文链接
Perplexity 开源了 9B 和 0.6B 两个 late-interaction 多向量嵌入模型,用于将文本和图像映射到共享空间。9B 适合多模态数据索引,0.6B 可在设备端查询 PDF 页面且无需 OCR;权重已发布到 Hugging Face。
产品发布/更新
OpenAI 向所有 ChatGPT 用户推出 GPT-6 与 Intelligent UI
来源:OpenAI:官网动态(RSS)|约 13 小时前|原文链接
OpenAI 将 GPT-6 推向更广泛的 ChatGPT 用户,并同步引入 Intelligent UI。回答可以生成图形、按钮、表单、图表和其他可交互组件,让对话从文本输出进一步延伸到可操作界面。
GPT-6 Luna Decisions 上架 OpenRouter
来源:X:OpenRouter(@OpenRouter)|约 11 小时前|原文链接
OpenRouter 宣布 GPT-6 Luna Decisions 上线。该 Decisions API 可帮助应用选择模型、工具或动作,支持文本、JSON 和图片输入,并返回带概率的类型化答案;输入价格为每百万 token 0.10 美元,输出免费,上下文长度为 1M。
NVIDIA 与 Microsoft 发布 RTX Spark 及 DGX Station for Windows
来源:NVIDIA Blog(RSS)|约 13 小时前|原文链接
NVIDIA 与 Microsoft 宣布面向 Windows PC 的 AI Agent 硬件和软件方案,包括 RTX Spark 与 DGX Station for Windows,目标是让更多智能体工作负载在本地设备上运行。
Cursor 公布 Claude Haiku 5.5 定价并下调 Sonnet 5.5 缓存读取价格
来源:X:Cursor(@cursor_ai)|约 13 小时前|原文链接
Claude Haiku 5.5 的输入价格为每百万 token 0.10 美元、输出 0.50 美元;输入超过 100K token 时分别为 0.50 美元和 2.50 美元。Claude Sonnet 5.5 的缓存读取价格则从 0.20 美元降至 0.10 美元。
Claude Code v2.1.293 发布,加入 Claude Haiku 5.5
来源:Claude Code:GitHub Releases(RSS)|约 13 小时前|原文链接
Claude Code v2.1.293 将 claude-haiku-5-5 加入可用模型,并将其作为 Anthropic API 的默认 Haiku 模型,支持 1M 上下文和新的分档价格,同时修复了多项问题。
Anthropic 为 Claude Max 和 Team 套餐增加月度 Platform API 额度
来源:X:Claude Devs(@ClaudeDevs)|约 13 小时前|原文链接
Anthropic 正向 Claude Max 和 Team 用户推出月度 Platform API 额度:Max 5x 为 100 美元、Max 20x 为 200 美元,Team 额度最高可达 500 美元且支持共享,可用于任何模型和第三方 harness。
LangChain 重构 Deep Agents 的 Skills 支持
来源:LangChain:Blog(RSS)|约 13 小时前|原文链接
Deep Agents 新增工具绑定、固定技能和线程内重载能力。工具只有在对应技能被读取时才加载;用户也可以通过类似 /meeting-prep 的显式请求预加载技能,长线程则可重新加载新增或变更的技能。
行业动态
亚利桑那州法院裁定 AI 生成受害者视频带有不当情感分量
来源:404 Media(RSS)|约 17 小时前|原文链接
亚利桑那州上诉法院维持一起过失杀人案的定罪,但认为量刑听证中播放的 AI 生成受害者视频带有不当情感影响,要求法官重新考虑刑期。这一案件凸显生成式内容进入司法程序后的证据和程序风险。
论文研究
Microsoft Research Asia 开源 Agent Lightning v1.0
来源:Microsoft Research 博客(RSS)|约 15 小时前|原文链接
Agent Lightning v1.0 提出 Harnessed Agentic RL 训练范式,让部署时使用的同一套 agent harness 直接参与强化学习,无需在训练框架内重写 agent。项目约 3,500 行代码,已开源。
Nemotron 系列微调后达到 IOI 2026 与 IMO 2026 金牌水平
来源:Hugging Face 社区博客(混合发现)|约 19 小时前|原文链接
NVIDIA Nemotron 团队基于 Nemotron 3,分别结合监督微调、强化学习和反馈驱动推理,构建出在 IOI 2026 与 IMO 2026 中达到金牌水平的系统,展示了同一模型家族在不同高难度推理任务上的适配能力。
技巧与观点
Unsloth 开源教程:本地训练 Qwen3.5 0.8B 决策模型
来源:X:Unsloth(@UnslothAI)|约 15 小时前|原文链接
Unsloth 发布教程和开源仓库,演示如何将 Qwen3.5、Gemma 4 等模型微调为输出选项概率的决策模型。Qwen3.5 0.8B 在三个决策基准上的合计准确率从 20.7% 提升到 74.3%,训练仅需约 4GB 显存。
Google 开放 SynthID Detector 门户,检测图片、视频和音频中的 AI 水印
来源:X:Google(@Google)|约 17 小时前|原文链接
用户可以访问 SynthID Detector 上传图片、视频或音频,检查文件是否包含 Google 或合作伙伴的 SynthID 水印,为识别 AI 生成媒体提供了一个直接入口。
a16z 解析德州为何让数据中心排队等电
来源:a16z:News(RSS)|约 17 小时前|原文链接
分析认为,德州数据中心并网队列从 2024 年底的 63 GW 激增至今年 6 月的 474 GW,其中约 90% 与数据中心有关。大量投机性申请和社区沟通不足,促使当地暂停部分审批并重新评估电力接入机制。
今日关键词: GPT-6、Claude Haiku 5.5、Intelligent UI、AI Agent、多模态嵌入、Agent Lightning、SynthID Detector、数据中心电力。