核心观点
- Kimi K3 与智谱 GM5.2 的对比:Kimi K3 在性能和多模态方面超越智谱 GM5.2,但成本和售价也更高,定价策略考虑了市场竞争。
- 市场选择:市场对 K3 的过度期待可能存在误区,编程和软件工程领域用户更注重性价比,K3 主要抢夺 MiniMax、DeepSeek 等厂商的市场份额,对智谱 GM5.2 的冲击有限。
- 算力租赁与 Token 工厂:算力租赁模式稳定,Token 工厂回报率更高,但受技术、部署地点、运营能力等因素影响较大。
- 算力租赁盈利:B300 服务器月流水理论值 180 万,实际约 40 万,净利润约 38.5 万(设备不折旧情况下),成本主要来自设备折旧和运维。
- Token 价格趋势:Token 价格可能下降,但总产值可能不会降低,算力租赁方需通过闲时租赁和 Token 出海等方式提高利润。
- 运营商入局:运营商在 Token 工厂和销售方面竞争力不足,但拥有机房和网络基础设施优势,未来可能在 Token 工厂领域发力。
- 算力卡残值:算力市场波动较大,新技术推出可能导致算力卡残值大幅贬值,NVL72+LPX 方案可能带来 B300 跌价风险。
关键数据
- Kimi K3 与智谱 GM5.2 的成本和售价:Kimi K3 成本是智谱的 3.5-4 倍,售价也是 3.5-4 倍。
- B300 服务器:理论月流水 180 万,实际约 40 万,净利润约 38.5 万(设备不折旧情况下),电费和租机房租赁费约 1.5 万/月。
- 超节点部署成本:海外 B300 部署成本约 150 万美元,国内 910B/910C 部署成本约 1 亿人民币。
- Token 价格:智谱订阅制 Pro 版本约 150 元/月,按量付费约 3900 元/月,第三方部署折扣约 4-7 折。
- 算力需求增速:国内算力需求增速超过 50%。
研究结论
- Token 工厂长期回报率可能高于算力租赁,但运营难度和差异较大。
- 英伟达 NVL72+LPX 方案可能导致 B300 跌价,算力卡残值存在贬值风险。
- 运营商在 Token 工厂领域具有潜力,但需时间积累经验。
- 算力租赁方需关注 Token 价格趋势,并通过多种方式提高利润。