DeepSeek 发布 V4.1 Flash 模型,性能超旗舰且缓存大降
18 小时前
DeepSeek 正式发布 552B 参数的 MoE 模型 DeepSeek V4.1 Flash,为其全新模型架构系列中尺寸最小成员,采用全新 Causal-Encoder-Decoder 架构,输入激活参数 8B、输出激活 16B,性能超越 DeepSeek V4 Pro 等多款前沿旗舰模型。该模型定价下调,保留峰谷定价机制,新价格已生效。KV Cache 缓存效率大幅提升,HBM 需求减至前代 V4 Flash 的 1/4、SSD 需求减至 1/8,上下文拉长至 1M,解码成本几乎不随上下文长度增长。目前该模型已上线 API,旧版本 V4 Flash 等已下线,V4 Pro 将于 9 月 14 日起有序下线,其请求将路由至新模型按新单价计费。此外,DeepSeek 全力支持开源社区适配,同步上线 DeepSeek Harness v0.1.5 版本,腾讯 WorkBuddy 等及 OpenCode 已全量接入该模型,同期还开源了跨后端的轻量级 xPU 内核 JIT 编译库 DeepJIT。
刚刚,DeepSeek 新模型上线,长文本缓存硬盘占用暴降 88%
36Kr/maomu.com
刚刚,DeepSeek 新模型上线,长文本缓存硬盘占用暴降 88%
智东西 / maomu.com
2026-09-10
DeepSeek 发布 V4.1 Flash 模型,性能超旗舰且缓存大降2026-09-10
DeepSeek 合并快速、专家、识图模式2026-09-09
DeepSeek 把 V4 Pro 静默路由到 Flash,遭用户反对2026-09-08
DeepSeek V4.1 Flash 开启中间版本内测2026-08-31
DeepSeek-V4 首个实验性多模态视觉模型开源2026-07-20
DeepSeek V4「满血版」最快明天发布2026-04-29
阿里云百炼宣布 DeepSeek-V4-Pro 模型隐式缓存降价查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。