AI 晚报 2026-09-10
过去 12 小时的 AI 精选资讯几乎被 DeepSeek-V4.1-Flash 刷屏:这款 552B MoE 多模态模型支持 1M 上下文,主打更低的 KV cache 需求与更低的 API 成本,并已在 SiliconFlow 等平台上线。此外,Devin 智能体完成 RSA-260 因式分解,刷新公开 RSA 挑战纪录。
模型发布/更新
DeepSeek-V4.1-Flash 上线 SiliconFlow,支持 1M 上下文
来源:X:硅基流动 SiliconFlow (@SiliconFlowAI)|今天晚上 22:21|阅读原文
硅基流动宣布 DeepSeek-V4.1-Flash 于发布当天上线其平台。该模型为 552B MoE,prefill 约 8B 激活、decode 约 16B 激活,支持原生视觉和 1M 上下文窗口,KV cache 占用约为 V4 Flash 的四分之一,并采用 MIT 许可证。
DeepSeek 发布 V4.1-Flash,降低 AI Agent 的 KV cache 内存需求
来源:The Decoder:AI News(RSS)|今天晚上 20:40|阅读原文
DeepSeek 发布多模态模型 V4.1-Flash,并以 MIT 许可开源至 Hugging Face,重点是压缩 KV cache 和长上下文处理成本,面向 AI Agent 等需要持续上下文的场景。
DeepSeek-V4.1-Flash 采用新架构,具备原生视觉理解
来源:X:Kim (@kimmonismus)|今天下午 16:49|阅读原文
该模型采用 Causal Encoder-Decoder 新架构,支持原生视觉理解,拥有 552B MoE 参数,其中输入处理激活约 8B、输出生成激活约 16B。
DeepSeek-V4.1-Flash 将 KV cache 需求降至更低水平
来源:X:Kim (@kimmonismus)|今天下午 16:16|阅读原文
V4.1-Flash 是 DeepSeek 新架构家族中的小型模型,KV cache 需求降至上一代的四分之一、SSD 存储需求降至八分之一,同时 API 价格进一步下调。
DeepSeek-V4.1-Flash 引入 FP4 KV 缓存与跨层注意力复用
来源:MarkTechPost(RSS)|今天下午 15:31|阅读原文
这款多模态 MoE 模型包含 552B 主干和 196B Engram 参数,支持 1M 上下文;全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的四分之一。
DeepSeek 发布 V4.1-Flash,API 价格同步下调
来源:DeepSeek:API 更新日志|今天下午 13:58|阅读原文
DeepSeek 表示,V4.1-Flash 是全新模型结构系列中尺寸较小的一款,具备原生多模态视觉理解能力;官方列出的评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471 和 Terminal-Bench 2.1 90.6 等。
技巧与观点
Devin 智能体完成 RSA-260 因式分解,刷新公开纪录
来源:Hacker News 热门(buzzing.cc 中文翻译)|今天晚上 18:50|阅读原文
Cognition 员工 samyok 带领团队驱动多个 Devin 智能体构建高性能 GPU 格子筛,完成 RSA-260 因式分解,刷新此前由 2020 年 RSA-250 创下的公开 RSA 挑战纪录。这一案例展示了智能体协作与专用工程优化结合后的潜力。
今日关键词:DeepSeek-V4.1-Flash、1M 上下文、KV cache、原生视觉、MoE、MIT 许可证、AI Agent、RSA-260