97AI.PRO
2026-09-10 · AI 资讯

DeepSeek V4.1 Flash 正式发布:全新 MoE 架构,性能与成本双重突破

DeepSeek V4.1 Flash 正式发布:全新 MoE 架构,性能与成本双重突破
DeepSeek V4.1 Flash 正式发布:全新 MoE 架构,性能与成本双重突破

深度求索正式发布了其最新一代模型 DeepSeek V4.1 Flash。作为该系列尺寸最小的成员,这款 552B 参数的 MoE 模型引入了创新的 Causal-Encoder-Decoder 结构,通过不对称的输入激活(8B)与输出激活(16B)设计,在保持高性能的同时显著降低了计算成本。

DeepSeek V4.1 Flash 正式发布:全新 MoE 架构,性能与成本双重突破

新模型在智能水平上全面超越了之前的旗舰版 V4 Pro。此外,官方通过大幅优化 KV Cache,将其对 HBM 和 SSD 的需求分别降低至原有的 1/4 和 1/8,极大优化了 Agent 类任务的运行效率。

DeepSeek V4.1 Flash 已上线 API 并支持原生多模态视觉处理。官方计划于 9 月 14 日将 V4 Pro 路由至新模型,并同步调整了定价机制,包括更具竞争力的峰谷定价策略,腾讯 WorkBuddy 等生态伙伴已首批接入。