周边资讯

返回 主页

内容开始

DeepSeek V4.1 Flash正式发布,较前代减少对HBM和SSD的需求

M 2026-09-11 17:02

DeepSeek V4.1 Flash模型近日正式发布,是DeepSeek全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。

DeepSeek V4.1 Flash为552B参数的MoE模型,采用了全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括DeepSeek V4 Pro在内的一众旗舰模型的智能水平。

值得注意的是,DeepSeek V4.1 Flash大幅减少了KV Cache缓存的大小。与上一代模型相比,该模型对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高。DeepSeek V4.1 Flash对KV Cache需求的变化,使得同样的任务需要占用的高速显存和存储资源更少,大幅降低了 Agent 类任务的使用成本。

更多资讯

top

深圳市闪存市场资讯有限公司 客服
Copyright©2008-2026 CFM闪存市场 版权所有

CFMS|MemoryS 2026会后专题 打开APP