AI 早报 2026-09-19
过去 12 小时,AI 圈的焦点集中在安全评估、军事情报可靠性和智能体风险。Anthropic 与 Accenture 宣布开展大规模嵌入式独立评估;与此同时,AI 幻觉导致美军险些对中国船只采取行动的报道,再次凸显高风险场景中的校验和责任边界。模型能力之外,版权诉讼与智能体规模化攻击也在持续升温。
行业动态
Anthropic 与 Accenture 合作开展嵌入式独立评估,双方各投入至少 10 亿美元
Anthropic:Newsroom(网页) · 今天凌晨 04:21 · 阅读原文
Anthropic 宣布与 Accenture 合作,对前沿模型进行嵌入式独立评估。合作由 Accenture 旗下 AI 业务 Faculty 主导,涵盖模型评估与红队测试、对齐评估和安全防护测试;双方预计未来五年各投入至少 10 亿美元。
美军因 AI 幻觉情报报告险些拦截中国船只
Hacker News:AI 热帖 · 今天凌晨 01:28 · 阅读原文
据 CNN 报道,一份由特种作战司令部分析师借助聊天机器人生成的情报报告错误称一艘中东中国船只运输核武器部件,美军一度准备武装登船拦截,行动前才发现报告完全不实。事件暴露出 AI 工具分散部署、缺乏统一校验标准等问题。
媒体公司援引 OpenAI 与微软高管内部言论,质疑 AI 训练的合理使用抗辩
The Decoder:AI News(RSS) · 今天凌晨 00:27 · 阅读原文
《纽约时报》、Daily News 集团、Ziff Davis 等媒体公司向纽约联邦法院提交 92 页简要判决动议,就 AI 训练版权侵权向 OpenAI 和微软索赔数十亿美元,并援引此前未披露的内部邮件和宣誓证词。
技巧与观点
Gary Marcus:近期更该警惕的是智能体 AI 引发的规模化黑客攻击
Gary Marcus:The Road to AI We Can Trust(RSS) · 今天凌晨 00:29 · 阅读原文
Gary Marcus 撰文称,近期真正应担心的不是失控的超级智能,而是被放开的 agentic AI 造成互联网规模化的黑客攻击。随着智能体获得更多工具调用和执行权限,防护重点也需要从模型本身扩展到完整的行动链路。
Ethan Mollick 谈能力悬差:现有模型能力远未被大多数人用尽
Ethan Mollick:One Useful Thing(RSS) · 今天凌晨 01:54 · 阅读原文
Ethan Mollick 撰文指出,GPT-6 Astra 和 Fable 5.1 已能可靠完成数周量级的人类工作,但大多数人远未用尽其能力,形成能力悬差。对个人和组织而言,如何把已有模型能力转化为稳定工作流,可能比等待下一代模型更重要。
AI 幻觉情报事件引发对高风险决策中人机协同的反思
Gary Marcus:The Road to AI We Can Trust(RSS) · 今天凌晨 03:52 · 阅读原文
Gary Marcus 进一步评论称,AI 辅助情报报告的幻觉曾险些引发严重军事行动。事件提醒人们,在军事、金融和公共安全等高风险领域,模型输出必须经过独立来源核验,不能因为文本看起来专业就直接进入决策流程。
今日关键词: 嵌入式评估、红队测试、AI 幻觉、军事情报、智能体安全、规模化黑客攻击、AI 训练版权、能力悬差