00:02:33 预览解读及同业比较目前费者均处于精英状。下面开始播免责声明,声明播完后主讲人可开始发言。本次电话会议仅面向国金证券的专业投资机构客户或受邀客户,仅供交流研究观点。专家发言内容仅代表其个人观点,会议内容并不构成对任何人的投资建议。未经国金证券事先书面许可,任何机构或个人严禁以任何形式将会议内容和相关信息对外公布、转发、转载、传播、复制、编辑、修改、解读等。涉嫌违反上述情形的,我们将保留一切法律权利。感谢您的理解和支持,谢谢。 00:03:20 好的,各位尊敬的投资者,大家晚上好。那今天的这个时间呢,主要跟大家汇报一下呃阿里的这个Q问3.8max preview啊,这个版本的一些最新情况,以及最近我们看到从呃Kimi K3到这个呃Q13.8max后续啊,也会正式发布,再到最近呃DeepSeek V4啊可能正式也是开放权重。那呃国产模型其实密集进入到一个呃大参数的模型的一个释放期啊,同时从开源角度来讲,正在不断的提升全球的一个市场的份额。 00:03:55 那在这样的一个情况下和背景之下,我们如何看待首先是阿里的这个模型以及对阿里的生态的一个影响啊,还有就是说从呃全球的这个模型的横向比较来看啊,这个叙事后续会如何演绎。那对于国内自己的竞争以及海外的这个全球的这个竞争来讲,会有什么样的影响? 00:04:17 那今天呢主要从这几个方面会跟大家做。 00:04:21 做一个我们观点的一个分享,那首先我们看到其实。这个呃阿里的这个就是呃Q问3.8max Pro,那这个呃麦maxvi版本啊是在19号的时候啊,由这个阿里的token play个人版正式去发布,那是在这个里面,用户可以去啊抢先去体验这个呃3.0max preview的这个 版本。那从它的参数量级来讲,目前来看是达到了2.4T啊,是呃我们看到之前呃刚发的这个Kimi K3是2.8T啊,迈入这个以上量级的应该Qwen3.8max算是第二个啊,那在整个的代码工程和专业办公场景里面是它突出的能力。那从官方的趋势来讲说呃定位这个qen3.8max的话,可能是除了飞波5外最强的大模型,就是官方的一个定位。 00:05:15 但是目前呢,因为还是一个preview的预览版啊,没有全量的数据去参与第三方的权威的测评,那呃当然正式版我们看到有可能于这个月内啊就是近期。 00:05:26 期进行一个呃发布并开源啊,所以这是进度上的一个预期,那呃。所以目前其实从官方的这个排序口径来看是这样的一个数,但没有一个第三方权威的测试,呃权威的榜单测试。那从我们现在去自己体验,呃这个呃Q问3.8max preview的一个呃测试的一个感受来讲啊,我们觉得至少是呃接近于这个opus4.8左右的水平啊。那因为正式的版本距离preview的版本可能还会有性能的提升,所以到时候正式版这个呃3.8max的版本的一个能力,要需要等它呃正式放出之后去做一个横向的一个测评和对比啊。 00:06:09 所以这是我们目前对这个模型能力的一个大概的范畴的一个界定。 00:06:14 那从token play本身的这个套餐来讲,因为现在也分为个人版跟团队版啊,像个人版的lite是每个月39块钱人民币,现在应该是65折的一个价格。那像呃standard版大概是每个月139元人民币啊,大概是7.7折,然后Pro版的话是499元每月啊,现在是。8.3折这样的一个限时的优惠,那团队版的话每就是。的每席位呃每月大概是150元人民币,那高级版的话大概是呃550元每月每席位,那尊享的话是呃1398啊,它是这三档。那呃在我们看到目前的现时活动当中的话,呃基本上这个这个整体。Credit的消耗大概在一折左右啊,然后那个人版的token play夜间的话在这个基础上再享两折。 00:07:05 所以呃,我们看到除了像token play以外,像code包括code work也在上面可以首发体验这个呃, 00:07:13 Q问3.8max preview的一个一个版本。那同时呢,千问的PC版,那PC版啊上也可以去免费体验啊,这是目前大概就是announce的官方的一些信息啊,我们也看到呃有这样这样的一些数据和和这个呃效果出来。那我们自己其实也跑了一些用这个呃QN3max preview啊,其实跑了一些相应的测试啊,因为最近刚刚提到国国产大模型密集这个能力抬升和发布啊。然后那我们看到Q问的上一个版本是呃5月份发布的Q问3.7max啊,所以其实到preview的话差不多也是快两个月的时间啊。两个月的时间, 00:07:56 我们看到Q问3.8max的参数,从3.7时代当时呃就是我们说超万亿的这个呃千问的模型,到现在2.4T,那整个的呃这个这个这个这个体量提升还是非常明显的。那呃其实呃虽然说正式版还没上线,就国内其实大家讨讨论Q问3.8max preview的这个热度比Q呃Kimi K3要低,但是其实在海外我们看到呃,其实对于Q Q3.8max的一个讨论也非常高啊,其实热度跟Kimi呃虽然差一点,但是整体没有差那么多。 00:08:32 那大家也在等待正式版和满血版的这个QN3.8max啊,以及这个模型本身的benchmark的一个一个一个测评,包括激活参数的一个呃量啊,还有像比如说最后这个Hugging Face上带许可证的真实的权重啊是多少,这个其实是大家在等待的。那我们看到说对比之前像会员呃3的这个预览版的正式版,它呃隔了3个月时间中间,但是这个模型中间的能力差别非常大,那呃这次QV3max肯定就是间隔时间会短很多啊,但是我们觉得对正式模型能力提升还是有所期待的。 00:09:09 那现在我们可以看到说,现在几乎所有的大模型公司都做了自己的类似这个,这个coding端的这个应用啊,类codetex的这个应用,那Q问用于编程和效率工作场景的应用相对来说像code code work这次也是啊,加入了对这个preview的测试。那从性能上刚刚提到像编码跟呃。长城能力的这个这个呃落地吧,也是这个模型提升非常看重的啊那。这个在模型的上下文窗口的一个设置当中啊,最多可以拉到em m,就是支持百万字的这个上下文的一个一个一个体现。 00:09:47 那从我们的一个测试来讲,包括做了像呃一些这个前端的设置,包括3D的生成啊,这个 前端页面的展示,还有像呃可能就是做做了一些简单的小游戏啊,做了这样的一些测试。 00:10:02 那整体来看的话,我们会觉得说呃在部分场景里面,其实它的呃答复率相对来说还没有那么那么高啊,就是包括一些复刻一些APP啊等等。那呃整体来讲,我们觉得呃这里面其实还仍然有提升的这个空间啊, 00:10:19 但是呢呃就是呃有有的领域,比如说像一些深度研究领域,我们测试下来跟可能Q问3.7max呃不没有差距特别大,但是在前端啊包括一些这个coding领域的提升还是蛮明显的。那呃就是就是从目前来看,刚刚提到就是因为目前是一个preview。 00:10:39 嘛就是后面max测试的能力,我觉得大概率是呃,就是至少是达到接近这个opus4.8哈或甚至是超过4.8的一个水平。那至于能不能达到Kimi K3啊,就是这样的一个一个能力,或者说超过呃这个呃GPT5.6soul等等,我们觉得需要呃等正式的这个官方的测评啊。那确实在在某一些维度上,我们觉得其实呃某些单项能力上,目前我们测下来是有望超过呃GPT5.6so的啊,所以大概可能趋于这样的一个能力之间吧。 00:11:12 那呃现在因为确实从开源模型的这个呃集体的矩阵来讲,从之前不久的QM5.2到Kimi K3,再到呃现在的可能Q问呃这个呃3.8max,再到后面的DeepSeek呃就是V4的正式版等等。 00:11:30 呃我我觉得就是呃整体其实能力上我觉得可以验证一件事儿啊,就是呃之前大家觉得国产的大模型跟海外。差距是3~6个月,那经过这一系列的提升之后,其实我们觉得差距可能就缩到了3个月以内啊。所以当然这是从发布的维度,因为国内其实模型从呃的,从训练调试到发布的整个的周期会比海外要更短啊。 00:11:54 所以真实的这个差距是多少?我觉得这个里面可能有一些时间的gap,但整体上从发布维度去感知来看,大概呃肯定是一个明显缩短差距时间轴的这样的一个呃结论。那呃我们看到这个月刚刚提到可能有QN3.8max,然后呃第四个V4的正式版预期也是这个月内有望去发布吧。但具体的时间还不知道啊,然后从呃后面接下来两个月,其实像MiniMax的M3 的Pro啊可能也会发布出来啊,至至少可能下个月或者或者下下个月。 那另外的话后续像GM5.5等等啊可能都会陆续的去推出, 00:12:33 那呃我们会看到说,呃这个确实从整个的呃这个开源模型的这个数量的占比来讲啊,中国呃包括能力的这个头部能力的这个模型来讲,中国当之无愧是呃跨越了非常大的一步。那我们会呃觉得说整个的呃这个国产跟海外的模型的差距,开源跟闭源的差距确实在呃变得更少呃就是更短,或者说它的差距在缩短,那呃从。这个下游的呃企业真实使用的场景里面,我们也会看到说可能会催生一个变化,就是会有更多的呃特别是海外的企业,会愿意在本地化去部署这个开源的模型。在在自建算力这样的一个模式啊那呃因为现在有更多的一个选择, 00:13:22 那所以对于其实这个事情可能冲击最大的还是海外的, 00:13:26 呃两个头部的大模型,对于不管是它的增速的预期还是估值啊,可能海外都有了些许的一个担忧啊。 00:13:33 但是我们会看到说从。国内的这个大模型能力的追赶来讲啊,这个趋事其实是在呃持续强化的,那呃这是我们对呃目前的目前的一点看法啊。 00:13:46 当然我们会觉得说整个的这个呃逻辑上来讲啊,因为刚才我们也分析了这个QV3.8max的一些呃呃具体的情况。那呃从现在我们从它的优劣势来讲,大概总结来看就是呃,可能首先2.4万亿的参数,肯定是在已公开参数的模型中是比较前列的,刚刚也提到仅次于KimiK3的2.8万。那呃早期目前因为preview版本是这个非常低的折扣嘛,所以这个里面是是有比较强的优惠的,那呃因为有了开源的承诺,那呃如果这个权重如期开放的话,也是我觉得也会成为今年其实整个开放权重非常重要的一件事儿啊。 00:14:28 然后刚刚说从导向来讲,聚焦编码coding和生产力,那与整个开发者的工作流是密切结合的啊。所以所以从呃这个接口来讲,可能也支持OpenAI和S的协议吧,所以相对来说能够去接入到克劳迪扣的,包括科S嗽呃Cursor等等这样的一些工具,那从呃。目前呃来讲的话,因为权重还没有正式开放啊,就是呃就是就是现在是没办法去托管的一个状态。那目前在preview阶段相对稳定性我们看下来也会稍微差一点啊, 00:15:03 而且呃没有第三方的这个,对于测评的一个专业化的一个第三方的一个认证啊,这是这是我们看目前的一个情况吧。那后续刚刚提到呃正式版的一个发布啊,可能就成为大家去呃关注的一个,一个呃特呃等待的一个一个特呃特定的点吧。所以从这个维度上来讲,我们是这么看的。 00:15:25 那呃刚才有提到说呃呃其实今天有一个这个嗯消息吧,包括最近国产大模型密切发布之后,呃,但其实也引发了美国不管是大模型厂商还是政策监管的一些声音啊, 00:15:40 和一些业业内人士的一些发声,那呃,今天其实有一个报道是,呃,这个access。就是因为这这个媒体,呃它是第一信源嘛,也是呃今天就是整体来讲就是呃报报道出来的,就是它是它属于像是科技政策的一个一个呃核心的一个爆料媒体吧。那呃相对来说他他呃暴暴露的事情。就是说整个呃美国的政府啊就是包括商务部BIS等等,那呃也在在内部就是讨论这个草案。啊,就是呃,就是包括重启讨论吧,或者是一个讨论啊。 00:16:19 这种管制中国大模型的类似的工具,包括将呃月之暗面DeepSeek等等,会不会纳入到实体清单啊,以及这种呃起草行政令啊,去要求美国企业去托管或者使用中国开源模型,要承担相应的安全合规的