DeepSeek系列爆火预示着投资方向的变化
深度分析
- DeepSeek系列 在多个测试中展现了与OpenAI-o1媲美的模型能力,且成本大幅下降。
- DeepSeek-R1 的API服务输出定价为16元/1MTokens,相较于OpenAI-o1下降96%;2024年12月发布的DeepSeek-V3价格更是低至8元(活动优惠期间为2元)/1MTokens。
关键技术突破
- DeepSeekV3 通过动态调整专家负载,解决了传统MoE模型的负载均衡问题,并通过FP8混合精度训练框架验证了FP8在超大规模模型上的可行性。
- DeepSeekR1/R1-zero 通过大规模强化学习训练,展现出强大的推理能力。R1-zero省略了监督有监督微调环节,完全依赖于强化学习,减少了人工干预。
影响与展望
- 开源模型 的突破意味着模型门槛降低,更多企业和技术人员可以进入大模型领域。
- 范式转变 从预训练转向基于强化学习的后训练,DeepSeekR1已展现后训练的强大推理能力。
- 算力与应用:尽管成本下降,但更低的成本将刺激更大需求,AI应用将迎来更广阔的发展空间。
产业链受益
- 人形机器人 有望受益于AI性能的提升和算力成本的下降。
- 机械自动化:中国地区订单出现回暖,尤其是工业机器人和叉车销量增长显著。
- 工程机械:出口表现稳健,挖机销量同比增长16.0%,其中国内销量增长22.1%。
数据跟踪
- 机械行业 子版块普遍上涨,通用设备、专用设备、工程机械等细分领域表现较好。
- 宏观经济指标:2024年1-12月中国工业企业利润总额增速为-3.3%,部分行业如化学纤维制造、铁路船舶等行业表现亮眼。
- 金融市场指标:美元兑人民币汇率稳定,社融规模和M2均保持增长态势。
总结
DeepSeek系列的爆火标志着大模型领域的重要突破,降低了模型开发门槛,推动了AI应用的广泛发展。人形机器人、机械自动化和工程机械等领域有望受益于AI技术的进步。