过去 12 小时 AI 圈共有 6 条精选资讯:3 款新模型发布(通义 TTS、神珍多模态、MiniCPM 具身智能),2 项产品/工具更新(LoRA Speedrun 排行榜、UltraEP 负载均衡),以及 Hugging Face 遭 AI 智能体入侵的重大安全事件。

模型发布/更新

通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型
来源:公众号「通义实验室」 · 约6小时前 · 链接

通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约 300ms)和 Plus 两个版本。Plus 版本在 Artificial Analysis 榜单夺冠,支持 16 种语言和 20 种中文方言,平均 WER/CER 低至 3.87(Flash),说话人相似度最高达 82.75(Plus)。

上海科学智能研究院开放科学多模态基础模型”神珍”
来源:IT之家 · 约8小时前 · 链接

上海科学智能研究院开放科学多模态基础模型”神珍”,总参数约 110 亿,可处理 DNA、RNA、蛋白质、小分子、地球系统和医学影像六类数据。在生物序列 20 项任务中 9 项最优;医学影像分割平均 Dice 得分 91.20,在 7 种参评方法中最优。模型权重及代码已在星河启智、Hugging Face 和 GitHub 开放。

面壁智能发布 MiniCPM-Robot 系列具身智能模型
来源:公众号「面壁智能」 · 约11小时前 · 链接

面壁智能联合 OpenBMB 发布并开源 MiniCPM-Robot 系列,包括通用 VLA 模型 MiniCPM-RobotManip(1.5B 参数)与移动跟踪模型 MiniCPM-RobotTrack(0.9B 参数),标志着面壁智能正式进军具身智能领域。

产品发布/更新

LoRA Speedrun 公开排行榜:6 分 05 秒微调 Qwen2.5-1.5B 达 GSM8K 61.1% 准确率
来源:Hacker News 热门 · 约3小时前 · 链接

LoRA Speedrun 项目推出公开排行榜,在固定硬件(单张 L40S)上比拼 Qwen2.5-1.5B 的微调运行时间。当前纪录以 6 分 05 秒保持,采用序列打包与仅完成损失掩码技术,相比基线 11 分 57 秒提速约 2 倍且准确率更高(61.1%)。项目提供免费 Modal 沙箱验证。

小红书与北大开源 UltraEP:面向大规模 MoE 训推的实时负载均衡方案
来源:公众号「小红书技术」 · 约7小时前 · 链接

小红书与北大提出 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每一层动态复制热点专家。在 Qwen3-235B 等模型上,训练吞吐平均达到理想性能的 94.6%,相比 Megatron-LM 提升 42%;推理 prefill 吞吐相比 SGLang 提升 1.56 倍。

行业动态

Hugging Face 遭自主 AI 智能体入侵,用 AI 工具完成数小时取证分析
来源:The Decoder · 约3小时前 · 链接

Hugging Face 披露其部分生产基础设施遭一个自主 AI 智能体系统入侵,攻击者通过恶意数据集利用数据处理管道中的代码执行漏洞,窃取了内部数据集和多项服务凭证。该公司部署 LLM 驱动的分析智能体,在数小时内完成了对 17000 多条攻击行为的取证分析,而此类工作通常需要数天。


今日关键词:Qwen-Audio-3.0-TTS · 神珍 · MiniCPM-Robot · LoRA Speedrun · UltraEP · AI 安全