Deepseek V4.1 Flash模型于2026年9月15日发布,采用全新CORAL ENCODE DECODE架构,将视觉能力设为原生组成,API原生支持多模态。模型含384个路由专家与1个共享专家,单token输入激活8B参数、输出激活16B参数,总参数量552B。
Deepseek V4.1 Flash模型本地部署门槛升至510GB,需四张H200单卡勉强承载。显存要求高,多数机构难以满足,这是部署时需重点关注的技术挑战。
Deepseek V4.1 Flash模型在估值建模和行业研究任务表现优异,估值建模仅次于GPT6,能完成完整财务预测与估值模型;行业研究知识库质量仅次于GPT6,覆盖半导体设备全产业链。
Deepseek V4.1 Flash模型定价较V4 Pro大幅下调,缓存未命中时输入输出价格降69%-86%,缓存命中时每百万token仅0.006美元,低峰期低至0.003美元,性价比突出,适合大规模应用场景。
Deepseek V4.1 Flash模型存在本地部署挑战,显存要求高多数机构难以满足;回测任务未考虑涨跌停、交易成本等约束,可执行性弱;估值建模未拆分细分产品,行业研究缺乏明确来源标注,模型优化空间较大。