过去 12 小时的 AI 精选资讯几乎被 DeepSeek-V4.1-Flash 刷屏:这款 552B MoE 多模态模型支持 1M 上下文,主打更低的 KV cache 需求与更低的 API 成本,并已在 SiliconFlow 等平台上线。此外,Devin 智能体完成 RSA-260 因式分解,刷新公开 RSA 挑战纪录。

模型发布/更新

DeepSeek-V4.1-Flash 上线 SiliconFlow,支持 1M 上下文

来源:X:硅基流动 SiliconFlow (@SiliconFlowAI)|今天晚上 22:21|阅读原文

硅基流动宣布 DeepSeek-V4.1-Flash 于发布当天上线其平台。该模型为 552B MoE,prefill 约 8B 激活、decode 约 16B 激活,支持原生视觉和 1M 上下文窗口,KV cache 占用约为 V4 Flash 的四分之一,并采用 MIT 许可证。

DeepSeek 发布 V4.1-Flash,降低 AI Agent 的 KV cache 内存需求

来源:The Decoder:AI News(RSS)|今天晚上 20:40|阅读原文

DeepSeek 发布多模态模型 V4.1-Flash,并以 MIT 许可开源至 Hugging Face,重点是压缩 KV cache 和长上下文处理成本,面向 AI Agent 等需要持续上下文的场景。

DeepSeek-V4.1-Flash 采用新架构,具备原生视觉理解

来源:X:Kim (@kimmonismus)|今天下午 16:49|阅读原文

该模型采用 Causal Encoder-Decoder 新架构,支持原生视觉理解,拥有 552B MoE 参数,其中输入处理激活约 8B、输出生成激活约 16B。

DeepSeek-V4.1-Flash 将 KV cache 需求降至更低水平

来源:X:Kim (@kimmonismus)|今天下午 16:16|阅读原文

V4.1-Flash 是 DeepSeek 新架构家族中的小型模型,KV cache 需求降至上一代的四分之一、SSD 存储需求降至八分之一,同时 API 价格进一步下调。

DeepSeek-V4.1-Flash 引入 FP4 KV 缓存与跨层注意力复用

来源:MarkTechPost(RSS)|今天下午 15:31|阅读原文

这款多模态 MoE 模型包含 552B 主干和 196B Engram 参数,支持 1M 上下文;全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的四分之一。

DeepSeek 发布 V4.1-Flash,API 价格同步下调

来源:DeepSeek:API 更新日志|今天下午 13:58|阅读原文

DeepSeek 表示,V4.1-Flash 是全新模型结构系列中尺寸较小的一款,具备原生多模态视觉理解能力;官方列出的评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471 和 Terminal-Bench 2.1 90.6 等。

技巧与观点

Devin 智能体完成 RSA-260 因式分解,刷新公开纪录

来源:Hacker News 热门(buzzing.cc 中文翻译)|今天晚上 18:50|阅读原文

Cognition 员工 samyok 带领团队驱动多个 Devin 智能体构建高性能 GPU 格子筛,完成 RSA-260 因式分解,刷新此前由 2020 年 RSA-250 创下的公开 RSA 挑战纪录。这一案例展示了智能体协作与专用工程优化结合后的潜力。


今日关键词:DeepSeek-V4.1-Flash、1M 上下文、KV cache、原生视觉、MoE、MIT 许可证、AI Agent、RSA-260