Moonshot AI 于 2023 年 7 月 16 日发布了 Kimi K3 模型,这是一个 2.8 万亿参数的 MoE 模型,拥有 1000 万 token 的上下文窗口和原生多模态输入,是目前全球发布的最大开源权重模型。K3 在架构上引入了 Kimi Delta Attention 和 Attention Residuals 技术,在成本结构高效的情况下提升了模型能力。在性能上,K3 在 Arena 的前端代码排行榜上排名第一,相比 K2.6 提升了 17 名,超过 Claude Fable 5 和 GPT-5.6 Sol。在定价上,Moonshot AI 将 K3 的价格定为每百万输入/输出 token 3/15 美元,是目前最昂贵的中国模型,K3 的定价是 Claude Opus 4.8 的 60%,约是 GPT-5.6 Sol 的一半,相比 K2.6 的 0.95/4 美元有显著提升,与智谱的 GLM5.2 相比,K3 的价格是后者的 2-3 倍。
Moonshot AI 是由清华校友杨志林、周新宇、吴宇欣于 2023 年 3 月在北京创立的领先独立 AI 实验室,其旗舰 AI 模型系列为 Kimi。Moonshot AI 以长上下文处理能力闻名,并在 2025 年 7 月发布了 1 万亿参数的 Kimi K2,随后转向开源,发布了 K2 思考和 multimodal K2.5/K2.6 系列。Bloomberg 报道称,阿里巴巴和腾讯都参与了 Moonshot AI 之前的融资。
K3 的发布对中国 AI/互联网行业和关键股票的影响如下:尽管中国存在持续的硬件/计算能力限制,但 K3 证明,预训练扩展与架构创新相结合,仍然可以为旗舰中国模型带来跨越式增长。Moonshot AI 将参数规模扩大了近三倍(2.8 万亿 vs. 1 万亿),其他中国模型实验室也都在尝试在下一代模型中扩大规模。对于腾讯,K3 的发布被视为中性,因为腾讯仍在追赶,因此受益于其他 AI 实验室推动的 AI 技术知识的民主化。对于阿里巴巴,虽然其云服务受益于紧张的算力环境下的 AI 训练/使用增长,但阿里巴巴 Qwen 的“开源领导者”叙事可能会面临一些挑战。最后,K3 提升了中国 AI 模型的能力上限,将证明责任转移给了其他独立 AI 实验室(例如智谱和 MiniMax)。这也加深了投资者对模型层护城河的怀疑,因为竞争领导地位已成为越来越短暂的事情。