登录
注册
个人信息
我的订单
我的报告豆
我的优惠券
我的笔记
我的阅读
我的收藏
我的下载
我的上传
我的订阅
在线客服
退出登录
回到首页
AI
搜索
发现报告
发现数据
发现专题
专题报告
专题百科
研选报告
定制报告
VIP
权益
付费社群
发现一下
行业研究
公司研究
宏观策略
财报
招股书
会议纪要
Token
低空经济
十五五
AIGC
大模型
当前位置:首页
/
行业研究
/
报告详情
计算机行业:DEEPSEEK_V3发布,技术创新和商业化落地的共振
信息技术
2024-12-28
财通证券
李辰
核心观点
DeepSeek-V3模型正式发布,性能对齐海外头部模型,多项评测成绩超越Qwen2.5-72B和Llama-3.1-405B等开源模型,与GPT-4o(0513版本)及Claude-3.5-Sonnet-1022等闭源模型性能相当。
国内头部自研开源模型,创新引入无辅助损失的负载均衡策略和多token预测(MTP)策略,结合监督微调(SFT)和强化学习(RL)后训练,提升模型泛化能力和任务适应能力。
完整训练仅需278.8万H800GPU小时,采用FP8混合精度训练框架,成本效益显著,性能/价格比最优,API服务定价为每百万输入tokens 0.5元(缓存命中)/ 2元(缓存未命中),每百万输出tokens 8元。
关键数据
DeepSeek-V3参数量:671B,激活量:37B,预训练token数:14.8T。
MATH500(EM)测试准确率:90.2%,Codeforces(Percentile)测试准确率:51.6%。
完整训练GPU小时数:278.8万H800。
API服务定价:输入tokens(缓存命中/未命中)0.5/2元,输出tokens 8元。
研究结论
DeepSeek-V3是目前最强的开源模型,性能媲美闭源模型,且训练高效、成本可控,推动普惠AGI发展。
创新训练策略(无辅助损失负载均衡、MTP)和后训练优化(SFT+RL)显著提升模型性能和任务适应能力。
未来将持续优化架构、数据质量、推理能力和评估方法。
风险提示
技术迭代不及预期、商业化落地不及预期、政策支持不及预期、全球宏观经济风险。
你可能感兴趣
【电报解读】国内AI应用迎来政策和需求共振,场景应用端的商业化初具规模、机构称这四大领域有望率先落地,这家公司率先发布下一代智能邮箱demo,重点对标Googlede的Gmail
未知机构
2023-11-27
计算机行业研究周报:持续关注景气行业,静候技术创新和产业变革的落地
信息技术
国金证券
2017-08-13
机器人行业研究:技术创新与市场共振,机器人产业商业化进程提速
机械设备
源达信息
2025-09-12
【自动驾驶里程碑】四部委发布L3/L4国家层面试点通知,《关于开展智能网联汽车准入和上路通行试点工作的通知》以推动在乘用车L3,出行服务L4,商业化落地
未知机构
2023-11-15
盘中宝多重共振下该领域投资火热行业或迈入技术兑现与商业化落地的关键元年这家公司相关产品已获得注册批准20260723
未知机构
2026-07-23
计算机行业周报:车联网再迎政策和技术落地双共振
信息技术
华安证券
2020-06-08
2024清洁技术创新的融资和商业化报告
医药生物
欧洲专利局&欧洲投资银行
2024-04-01
计算机行业跟踪报告:“Token”中文名确定为“词元”,关注“词元经济”和AI大模型的商业化路径
信息技术
万联证券
2026-03-30
计算机行业快评报告:全球首款通用AI Agent Manus发布,关注AI应用的加速落地
信息技术
万联证券
2025-03-07
【电报解读】脑机接口等国家标准发布!机构称脑机接口产业正处于从“技术验证”向“商业化落地”加速转折的关键窗口期,这家公司正推进与脑机接口企业的技术协同落地-20260413
未知机构
2026-04-13