核心观点
DeepSeek-V3.1采用全新UE8M0 FP8参数精度,大幅提升训练推理效率,有望助推国产算力竞争力提升。工具使用等Agent关键功能支持升级,为国产AI应用开发提供高效新基座,结合混合推理等降本措施,加速Agent落地高价值复杂行业场景应用。
周观点
深度求索正式发布DeepSeek-V3.1模型,官方定调迈向Agent第一步,从成本和性能两个角度加强对Agent应用落地支持。V3.1沿用了V3的架构,使用6710亿参数,单次激活370亿,输入(缓存命中)/输入(缓存未命中)/输出API定价每百万Tokens为0.5/4/12元,与当前API价格相当。
三大维度重点提升
- 关键变化:全新UE8M0 FP8参数精度大幅提升训练推理效率,助推国产算力竞争力提升。
- 应用降本:混合推理、思考效率提升,结合参数精度带动国产AI应用降本。
- 性能提升:以工具调用和长上下文为代表提升Agent支持。
研究结论
国产模型算力相向而行,共同掘金Agent时代。DeepSeek-V3.1在工具使用等Agent关键功能支持升级,为国产AI应用开发提供高效新基座,结合混合推理等降本措施,加速Agent落地高价值复杂行业场景应用机会。
建议关注
- 算力产业链:考虑模型规模扩大带动下一代算力架构升级、scale up + scale out将并行优化的预期,建议关注国产算力芯片头部公司、工业富联、浪潮信息、深信服、金山云、网宿科技、智微智能等。
- 通用Agent应用:Agent流程更复杂、高效个性化,企业级Agent价值提升,建议关注金山办公、金蝶国际、用友网络、税友股份、北森控股、第四范式等。
- 垂直Agent/多模态应用:多模态打开全新应用场景,建议关注科大讯飞、讯飞医疗科技、京东健康、同花顺、恒生电子、宇信科技、广联达、中望软件、华大九天、焦点科技、光云科技、当虹科技、明源云等。