AI 早报 2026-08-04
今天 AI 圈看点密集:OpenAI 推出 GPT-Live 实时音频新架构,让模型可以边听边说;欧盟《人工智能法案》透明度规则正式生效,违规最高罚 1500 万欧元;商汤发布仅 8B-MoT 参数的 SenseNova U1.5-Lite-Preview 开源多模态模型;微软开源 Orchard 智能体训练框架;Cloudflare Agents Week 持续放料,连发 @cloudflare/computer、Billable Usage API 和 Workers gRPC 支持;此外还有 AirLLM 单卡 4GB 跑 70B 推理、Claude Code 连接器复用技巧等实用内容。
模型发布/更新
商汤发布 SenseNova U1.5-Lite-Preview 开源模型
X:商汤 SenseTime (@SenseTime_AI) · 昨晚 22:40商汤推出 SenseNova U1.5-Lite-Preview,一个基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量。
产品发布/更新
GPT-Live 实时音频新架构发布
X:Greg Brockman (@gdb) · 今天清晨 06:25GPT-Live 是一种用于实时音频的新架构和栈:GPT-Live 可以在说话的同时聆听。为了让这种体验在 ChatGPT 规模下显得自然,团队从客户端到模型重建了语音栈。这一新架构让音频持续流动,因此更深入的推理和工具使用不会打断对话。
微软开源 Orchard 智能体训练框架
X:Microsoft Research (@MSFTResearch) · 今天凌晨 03:43Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它降低了复杂性,同时通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。
OpenRouter 推出 Ori Eval 简化评估流程
X:OpenRouter (@OpenRouter) · 昨晚 23:31推出 Ori Eval:编写首个评估的最简单方式。没有绝对最好的模型,只有最适合每项任务的模型。Ori Eval 利用 OpenRouter 的 API 处理代码库中的每项任务,然后评估结果。
Cloudflare 推出 @cloudflare/computer 预览版:为智能体提供虚拟文件系统与多执行环境
Cloudflare Blog · 昨晚 21:15Cloudflare 发布 @cloudflare/computer 早期预览版,这是一个开源智能体运行时,为每个智能体提供虚拟文件系统,并支持在 isolate、容器沙箱或浏览器中执行代码。
Cloudflare 推出 Billable Usage API:为自助账户提供按产品与计费周期的程序化成本可见性
Cloudflare Blog · 昨晚 21:00Cloudflare 发布 Billable Usage API,为自助账户提供单一端点,一次调用即可返回按产品和计费周期拆分的用量与成本,覆盖 Workers、R2、D1、Workers AI、Vectorize、Images 和 Stream。
Cloudflare Workers 与 Containers 现已支持入站 TCP 连接和 gRPC
Cloudflare Blog · 昨晚 21:00Cloudflare 在 Agents Week 期间推出 Workers 运行时新处理器 connect(socket),可直接接受 Spectrum 提供的入站 TCP 套接字,并支持将套接字转发至 Durable Objects 或 Containers,实现全双工通信。
行业动态
欧盟《人工智能法案》透明度规则生效,违规最高罚 1500 万欧元
The Verge:AI · 今天凌晨 01:38欧盟《人工智能法案》下的新透明度义务于 8 月 2 日生效,要求公司披露用户何时与 AI 模型互动,并为合成音视频和文本添加机器可读标记。欧盟还推出了一套可选的 AI 披露标签供平台采用,但标注要求本身是强制性的。违规公司面临最高 1500 万欧元(约 1720 万美元)或全球年营业额 3% 的罚款,8 月 2 日前推出的模型有 4 个月宽限期。
技巧与观点
Claude Code 连接器可复用至 Artifacts
X:Thariq (@trq212) · 今天清晨 05:13如果你连接了一个 Claude 连接器(例如你的 Gmail、日历、Slack 等),Claude Code 也将能够使用它们,包括在 Artifacts 中。很多人没有意识到这一能力的覆盖范围。
EA 首席战略官谈生成式 AI 如何进入可游玩的实时游戏世界
Runway:News · 今天凌晨 04:12EA 首席战略官 Mihir Vaidya 认为,游戏是 AI 的试验场,但生成式 AI 进入游戏面临 60 帧/秒、数千玩家同步和低延迟等严苛约束,不能只追求”看起来真实”,而必须”行为正确”。他主张采用神经符号架构,在生成能力之外保留确定性与可控性,并称”控制是下一个前沿”。EA 将 AI 影响分为效率、扩展和转型三个层面,其中《模拟人生》已服务超 5 亿玩家,拥有近万亿种游玩排列组合。
https://runwayml.com/news/company-news/electronic-arts-ai-summit-2026
AirLLM 实现单块 4GB GPU 运行 70B 模型推理
Hacker News 热门 · 今天凌晨 00:24AirLLM 项目支持在单块 4GB 显存 GPU 上运行 70B 参数大模型推理,无需多卡或大规模显存配置。该项目已开源,相关讨论在 Hacker News 上获得 103 点热度,引发社区关注。
Google Agent Skills 幕后:如何构建、测试与规模化
Google AI:DEV 作者专属 · 昨晚 22:33Google Agent Skills 团队详解其开源技能库的构建与治理流程:项目始于 Google Cloud Next 2026 前的”swarm”冲刺,发布后 GitHub 星标超 15,000。为保证规模化下的质量,每个技能须通过标准化目录结构、CI/CD 流水线(含 linter、链接检查、AI 辅助清单)及提交时与每周的持续评估,并优先引用远程 MCP 工具。
https://dev.to/googleai/behind-the-scenes-how-we-build-test-and-scale-google-agent-skills-1am5
Kimi Work 幻灯片制作教程发布
X:Kimi.ai (@Kimi_Moonshot) · 昨晚 19:51使用 Kimi Work 制作幻灯片 - 教程 #1。Kimi Slides 处理整个幻灯片制作流程:清晰的结构与研究(由 Kimi K3 驱动)、连贯的设计(包括精美的图表和 SmartArts)、可编辑并可直接下载。
今日关键词:GPT-Live 实时音频、欧盟 AI 法案、SenseNova U1.5-Lite、微软 Orchard、Cloudflare Agents Week、AirLLM 70B、Claude Code 连接器、Google Agent Skills、Kimi Work