(相关资料图)
金吾财讯 | 9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型,是该公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。据介绍,DeepSeek V4.1 Flash为552B参数的MoE模型,采用全新的Causal-Encoder-Decoder结构,成本显著低于已知的同尺寸模型。同时,V4.1 Flash还采用新的预训练方式、经过更大规模的强化学习后训练,在基准测试中,成功超越了包括DeepSeekV4Pro在内的一众旗舰模型的智能水平。此外,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。
责任编辑:QL0009
















