过去 12 小时的 AI 精选资讯聚焦模型能力、安全与行业治理:阶跃星辰发布 StepAudio 3 系列语音模型,OpenAI 的 GPT-Live-1 登顶语音对语音评测榜;与此同时,前沿 AI 是否应放缓开发、模型训练中的人工审核,以及 AI 代码修复基准的可信度,也成为讨论焦点。

模型发布/更新

阶跃星辰发布 StepAudio 3 系列语音大模型,多款登上 Artificial Analysis 榜单前列

来源:公众号:阶跃星辰(Step)|时间:今天下午 15:29|阅读原文

StepAudio 3 系列包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已上线阶跃星辰开放平台,覆盖实时语音交互、语音识别、语音合成和音乐生成等场景。

技巧与观点

404 Media 曝光 OpenAI“莉莉计划”:人工审核 ChatGPT 聊天记录以优化模型

来源:IT之家(RSS)|时间:今天晚上 19:48|阅读原文

报道称,OpenAI 内部代号为 Project Lily 的项目会让时薪超过 50 美元的提示词审核员查看匿名化后的真实用户聊天记录,用于评判回复是否切题,以及是否存在 AI 式话术和谄媚口吻。这再次凸显模型改进与用户隐私之间的平衡问题。

Trail of Bits 质疑 1Password 的 AI 补丁基准存在误导

来源:Trail of Bits:AI安全研究|时间:今天晚上 19:00|阅读原文

Trail of Bits 认为,1Password 报告中的 26% AI 干净修复率受到实验设计影响,包括部分提示词刻意引导智能体应用错误修复、部分试验禁止编译测试,以及推理档位设置差异。结论提醒开发者,评估 AI 编程能力时必须仔细检查测试条件。

Anthropic、OpenAI 提议协调放缓前沿 AI 开发,动机受到质疑

来源:The Decoder:AI News(RSS)|时间:今天下午 17:04|阅读原文

Anthropic CEO Dario Amodei 呼吁行业与政府协调放缓前沿 AI 开发,并寻求反垄断豁免;Sam Altman 与 Elon Musk 表示同意,但 Cohere CEO 等批评者质疑这一提议是否真正出于安全考虑。

Artificial Analysis 评测:GPT-Live-1 登顶 Speech to Speech Index

来源:X:Artificial Analysis (@ArtificialAnlys)|时间:今天上午 11:14|阅读原文

在 Artificial Analysis 发布的 Speech to Speech Index 中,OpenAI 的 GPT-Live-1 以 81.5 分排名第一,略高于 Grok Voice Think Fast 2.0 High 的 81.3 分;不同后端配置也进入前三,显示语音到语音交互的模型竞争正在加速。


今日关键词: StepAudio 3、语音大模型、GPT-Live-1、Speech to Speech、OpenAI、Anthropic、AI 安全、代码修复评测