中国端侧大模型行业研究总结
定义与分类
端侧大模型是指运行在设备端的大规模人工智能模型,部署于智能手机、IoT、PC、机器人等本地设备,参数量较云端大模型更小,可直接使用设备算力运行,无需依赖云端算力。与云端大模型相比,端侧大模型在参数量、训练方式、推理方式和应用场景上存在显著差异。
驱动力
端侧大模型在成本、能耗、可靠性、隐私和个性化方面相比云端推理具有显著优势。具体表现为:
- 成本优势:AI推理规模远高于训练,云端推理成本极高,端侧可降低成本实现规模化扩展。
- 能耗优势:边缘终端能效领先,低能耗运行生成式AI模型。
- 可靠性优势:终端侧AI处理媲美甚至优于云端性能,避免高峰期延迟。
- 隐私优势:查询和个人信息保留在终端,保护用户隐私。
- 个性化优势:数字助手可根据用户表情、喜好定制,形成动态用户画像。
市场规模
2023年中国端侧大模型市场规模达8亿元,预计2024年将达到21亿元,CAGR为58%。生成式AI市场的兴起和下游市场需求(特别是手机与自动驾驶行业)的强劲增长,正强力拉动端侧大模型市场扩张。
产业链分析
- 上游:AI芯片供应商、云计算服务商、数据服务商。
- 中游:端侧大模型科技厂商、端侧科技企业。
- 下游:设备端企业(如汽车、教育等行业)。
模型压缩技术
知识蒸馏技术通过让高性能大模型(教师模型)指导小型模型(学生模型),在保持较高性能的同时大幅减少模型参数量和计算复杂度,使复杂AI模型在端侧设备上高效运行。
成本构成
- 硬件成本:AI芯片成本占比最高(60%)。
- 研发成本:研发人员及显卡成本需兼顾,确保研发经济可持续。
- 其他成本:管理、运营、市场推广等间接成本。
行业场景
端侧大模型将推动各行业智能化发展,其应用受行业对数据安全、隐私保护的需求、智能设备普及程度和AI大模型技术成熟度的影响。高需求行业包括政务、金融、医疗等。
业务场景
- 按设备类型:AI手机(数据隐私性、计算实时性)、自动驾驶(实时决策、安全性)、机器人(个性化服务、效率提升)。
- 按技术类型:文本生成(较成熟)、图片生成(逐步发展)、音频生成(相对较新)、视频生成和多模态生成(起步阶段)。
政策分析
中国政府积极支持人工智能产业发展,出台多项政策规范和引导端侧大模型发展,包括:
- 《数字中国建设整体布局规划》
- 《关于加快场景创新以人工智能高水平应用促进经济高质量发展2022-07的指导意见》
- 《关于促进新一代人工智能产业高质量发展的若干措施》
- 《国家新一代人工智能标准体系建设指南》
竞争格局
头部大模型厂商(商汤、阿里云、面壁智能等)依托技术实力和生态建设,率先在端侧大模型领域取得领先突破。未来竞争将聚焦于技术融合、生态系统构建和创新合作模式。
发展趋势
技术融合与创新驱动将加剧市场竞争,厂商将趋向跨领域技术集成,构建开放合作的生态系统,并通过联合研发、数据共享等创新合作模式提升竞争力。