DeepSeek 是由幻方量化创始人梁文锋创立的人工智能公司,其核心产品 DeepSeek-R1 模型在性能和成本方面具有显著优势,并已开源,引发全球 AI 界关注。
- 核心优势: DeepSeek-R1 模型在正式发布前数月已开放预览,其性能接近 GPT-4o,但训练成本仅为 560 万美元,远低于美国开放人工智能研究中心、谷歌等科技巨头的技术投入成本。此外,DeepSeek-R1 的推理成本也远低于 ChatGPT,仅为 GPT-4 的 5%-20%,且个人用户使用完全免费或月费 4.5 美元。
- 技术突破: DeepSeek 通过架构创新(MoE、MLA)和工程优化(FP8、DualPipe)降低算力需求,同时以开源策略推动技术普惠。
- 应用场景: DeepSeek-R1 已被众多知名央国企、造车大厂、海外名企等接入,覆盖十大核心产业,并应用于办公、教育、医疗、金融等多个领域。
- 争议话题: 研报还探讨了 DeepSeek 面临的十大争议话题,包括创始人背景、训练成本、开源策略、对现有巨头的影响、技术原创性、功能覆盖范围、联网功能、开源版本与商业版能力差异、能力边界以及数据隐私与合规风险等。
- 未来展望: DeepSeek 的出现被视为国产 AI 产业的里程碑,其技术创新和开源策略有望重构全球 AI 竞争格局,推动 AI 技术的普及和应用。