AI 早报 2026-07-21
过去 12 小时的 AI 圈可谓热闹非凡:Kimi K3 开源模型的冲击波持续扩散,引发市场对中国 AI 实力的重新评估;NVIDIA 开源了 40 亿参数的 Cosmos 3 Edge 世界模型,剑指机器人实时推理;xAI 将 Grok 正式带入 Excel,Cursor 则展示了新一代 AI 智能体集群的惊人效率。安全方面,Hugging Face 披露遭自主 AI 智能体入侵,堪称 AI 攻防的”真实版演习”;学术圈则被一项研究刷屏——ArXiv 上超过 30% 的新投稿读起来像是 AI 写的。
模型发布/更新
- NVIDIA 发布 Cosmos 3 Edge:4B 参数开源世界模型,为机器人及边缘 AI 提供实时推理
来源:Hugging Face Blog · 昨晚 23:58
NVIDIA 在 Hugging Face 上开源了 Cosmos 3 Edge,一个 40 亿参数的世界模型,旨在帮助机器人和视觉 AI 智能体在边缘设备上理解环境、实时推理并生成动作。这是 NVIDIA Cosmos 世界模型系列的最新成员,主打低参数量下的高效推理能力。
https://huggingface.co/blog/nvidia/cosmos3edge
产品发布/更新
Grok for Excel 发布:用自然语言提问、写公式、运行场景
来源:xAI News · 昨晚
xAI 正式将 Grok 引入 Microsoft Excel,推出免费的 Microsoft 365 加载项。用户可在工作表中用自然语言提问、根据描述编写公式或运行场景,答案会引用具体单元格,图表可直接插入工作表。该加载项还支持连接 SharePoint 或 Google Drive 获取上下文,并已同步支持 Word 和 PowerPoint。
https://x.ai/news/introducing-excel-addinCursor 测试新型 AI 智能体集群:规划者+执行者分工,4 小时通过 80% SQL 测试
来源:Cursor Blog · 昨天
Cursor 测试了新型 AI 智能体集群架构,将任务分解为规划者(使用最强模型)和执行者(使用快速廉价模型)。使用 Grok 4.5 时,新集群在 4 小时内通过了 80% 的 SQL 测试套件,而旧集群在第二小时前就已失败。该系统已用于构建浏览器、修复漏洞和生成数十亿 token 合成训练数据。
https://cursor.com/blog/agent-swarm-model-economicsLoRA Speedrun 公开排行榜:6 分 05 秒微调 Qwen2.5-1.5B 达 GSM8K 61.1% 准确率
来源:Hacker News / buzzing.cc · 昨晚 20:21
LoRA Speedrun 项目推出公开排行榜,在固定硬件(单张 L40S)上比拼 Qwen2.5-1.5B 的微调运行时间。当前纪录为 6 分 05 秒,采用序列打包与仅完成损失掩码技术,相比基线 11 分 57 秒提速约 2 倍且准确率更高(61.1%)。项目提供免费 Modal 沙箱验证,任何提交需经 3 次独立复现确认。
https://github.com/Saivineeth147/lora-speedrunReplit 新统一工具栏集成数据库与双因素认证
来源:X「Replit」 · 昨晚
Replit 推出新的统一工具栏,将数据库、双因素认证、SEO 扫描器等项目所需功能整合到一个触手可及的入口,进一步降低全栈开发的门槛。
https://x.com/Replit/status/2079235154485109114
行业动态
《第九区》导演 Neill Blomkamp 发布首部完全由 AI 生成的短片《Nightborne》
来源:The Decoder · 昨晚
Neill Blomkamp 发布了 13 分钟科幻恐怖短片《Nightborne》,完全使用 Seedance 2.0 视频生成模型通过文本提示逐帧创作。影片采用纪录片风格,使用了 32 位真实人物的面部和声音(已获授权),人类艺术家负责概念艺术。Blomkamp 表示计划以相同格式拍摄一部长片,并已创立 AI 电影工作室 Barley Studios。
https://the-decoder.com/district-9-director-neill-blomkamp-releases-first-short-film-made-entirely-with-ai-video-generationHugging Face 遭自主 AI 智能体入侵,用 AI 工具完成数小时取证分析
来源:The Decoder · 昨晚 20:12
Hugging Face 披露其部分生产基础设施遭一个自主 AI 智能体系统入侵,攻击者通过恶意数据集利用数据处理管道中的代码执行漏洞,窃取了内部数据集和多项服务凭证。事后该公司部署 LLM 驱动的分析智能体,在数小时内完成了对 17000 多条攻击行为的取证分析,而此类工作通常需要数天——堪称”用 AI 对抗 AI”的经典案例。
https://the-decoder.com/hugging-face-says-an-ai-agent-hacked-its-infrastructure-and-it-used-ai-to-fight-back
论文研究
- ArXiv 上超 30% 新投稿文本特征与 AI 撰写一致
来源:Hacker News / buzzing.cc · 昨晚
一项对 12750 篇 ArXiv 论文全文的检测显示,截至 2026 年 7 月,约 32% 的新投稿文本特征与 AI 撰写一致,该比例在 2026 年初峰值接近 39%。计算机科学领域比例最高(65%),数学领域最低(0.7%)。检测器在 0.4% 假阳性率下可识别 85% 的 AI 学术文本。
https://unslop.run/blog/measuring-ai-writing-on-arxiv
技巧与观点
- 中国 AI 几乎追平美国,Kimi K3 开源模型引发市场震荡
来源:Gary Marcus「The Road to AI We Can Trust」 · 昨晚
中国公司月之暗面(Moonshot.AI)发布 Kimi K3 模型,性能与最佳美国模型相当,且为开源权重模型,用户可免费下载本地运行。受此消息影响,美国股市上周五下跌,OpenAI 和 Anthropic 的商业模式及 IPO 前景受到严重质疑。Gary Marcus 认为美国在 AI 软件领域的护城河已不如预期,AI 竞赛正演变为工业系统竞争。
https://garymarcus.substack.com/p/china-has-all-but-caught-up-the-us
今日关键词:Kimi K3、Cosmos 3 Edge、Grok for Excel、AI 智能体集群、ArXiv AI 写作、AI 电影、Hugging Face 攻防