AI 晚报 2026-10-09
今天的 AI 动态主要聚焦于 OpenAI 的内部治理与前沿模型安全,以及 Mistral 新模型在智能体评测中的表现。OpenAI 研究负责人回应三名员工离职争议,Mistral Large 4 则进入 Agent Arena 前十五实验室,显示智能体能力评测仍在快速演进。
模型发布/更新
Mistral Large 4 进入 Agent Arena 前十五实验室,排名第 43
来源:X:Arena (@arena)|今天上午 11:53|查看原文
Arena 宣布 Mistral Large 4 进入 Agent Arena 前十五实验室。基于超过 5000 个真实智能体会话,这一预览版的净改进分为 -6.6%,总排名第 43,比前代 Mistral Medium 3.5 高出 11 位,为观察模型在真实智能体任务中的表现提供了新的参考。
行业动态
OpenAI 研究负责人发声明回应三名员工离职争议
来源:X:OpenAI Newsroom (@OpenAINewsroom)|今天下午 14:17|查看原文
OpenAI 研究负责人表示,公司在调查发现 Jasmine、Mikita 和 Tomek 违反敏感信息处理政策后终止了三人的雇佣,并称内部调查发现了超出三人公开信所述的重大信任违规。声明强调解雇与员工提出安全担忧无关,同时表示正在敲定与第三方安全评估机构的合同,并将在数周内公布详情;声明也认同,保持前沿模型可监测性需要全行业共同承诺。
今日关键词: Mistral Large 4、Agent Arena、智能体评测、OpenAI、模型安全、AI 治理