00:00:00 大家好,欢迎参加西部正宏达国产大模型与国产算力共振加强。目前所有参会者均处于静音状态,下面开始播报声明。本次电话会议服务于西部证券研究所客户,不构成投资建议。相关人员应自主做出投资决策并自行承担投资风险。西部证券不应使用本次内容所导致的任何损失承担任何责任。专家发言内容仅代表专家个人观点,不代表本公司观点。本次会议内容不涉及国家保密信息,内幕信息、未公开重大信息、商业秘密、个人隐私,不得涉及可能引发不当炒作或股价异常波动的敏感信息,不得涉及影响社会或资本市场稳定的言论。 00:00:44 未经西部证券事先书面许可,任何机构或个人不得以任何形式复制,刊载,转载,转发,引用本次会议内容。否则,由此造成的一切后果及法律责任由该机构或个人承担,本公司保留追究其法律责任的权利。 00:01:03 嗯,大家早上好啊,我是西部证券的副所长,科技行业首席分析师。呃,郑宏达。呃,今天早晨呢,这个又是新的一周啊,这个呃今天早晨呢,想跟大家交流一下,就是Kimi出的这个K3的模型。另外呢就是呃周末去逛了一下这个世界人工智能大会,然后呃说一说就是我的一些感想和心得,还有就是目前,呃,怎么看现在的一些AI的行情?OK, 00:01:31 先说一下这个嗯,月之暗面推的K3这个大模型, 00:01:35 呃,这个模型呢,它的总参数是2.8万亿啊,两点儿8个T的一个总参数量,这个参数量目前应该是国内最大的了,呃,它超过了这个DeepSeek V4Pro的1.6万亿的一个参数量。呃,所以这意味着什么呢?这就意味着这个中国大模型已经开始进入3万亿,这个三万亿左右这么一个大的参数量的时代了啊呃, 00:01:59 当然北美差不多到了5万亿参数了啊确实我们从参数量目前来看的话,还是要比呃北美最先进的模型还是稍微稍微低一点的。呃但它它既然还是这个符合这个Scaling Law的这么一个规律,就是确实整个参数量堆上去之后,模型能力会提升,这这没办法,这现在确实就是遵循的这么一个规律。 00:02:24 然后呢,而且它应该是全世界最大的一个开源模型,因为它要开源嘛,它大概是7月底左右,它会完全把它的权重给开源掉。呃,他用了呃896个expert,嗯,它的激活量很低啊,它激活量只激活十几到二十几个expert的啊,所以它的它的激活量比较低,也就是说呃推理起来的话,它的整个负担还是比较轻的。然后呢,它的上下文达到了100万token的这个量啊,这个100万token的上下文现在基本都是标配了啊,就是如果新出这一个模型,如果到不了100万token的这个上下文,那就都不好意思发出来。 00:03:00 呃,它的价格很有意思,它的价格是每百万token的输出价格是15美元。哦,15美元这个价格是一点儿都不便宜啊,这个这个基本上就跟北美的价格是在同一个水平线上了。呃,Fi豹5和Maxus5的价格是多少?它们的价格是每百万token50美元对吧?OpenAI呢OpenAI呃opus呢,opus的价格大概是30美元。哎,这个Kimi呢,这个K3呢,比他们俩稍微便宜一点,也达到了一个15美元级别级别的这个每百万token的这个量啊。这个其实跟北美的这个价格模型是一个价格体系的, 00:03:39 呃,其实也已经打破了国产模型价格的一个天花板啊,就是它它不便宜,确实一点儿都不便宜了啊,一点儿都不便宜。嗯,所以呢,其实可以看出来,Kimi这个模型呢,它就不是走性价比这个路线啊,它还是走的是这个哎性能。嗯,非常好,然后价格很贵的这么一个路线,就跟北美的模型是一个路线的。 00:04:01 那我们从Kimi K3的这个模型上,我们我觉得有有三种启示啊,那第一点就是国产大模型的军备竞赛已经开始了啊,毫无疑问已经开始了。呃,其实北美大模型已经卷完了对吧,其实已经卷完了,就剩下这么两到三家了,大概可能还有一家你要掉队,嗯,但但没关系啊,他他已经卷完了,但是国产大模型这个军备竞赛其实刚开始。 00:04:28 呃,接下来一周或者或者再一周,呃,应该就能看到像DeepSeek v满血版的DeepSeek V4也要发,呃,千份的新版本也要发对吧,质谱的新版本前面刚发了,这个Kimi的K3也在刚发了,也就是说中国这些大模型呢,没有一个掉队的,还在不断的往前卷,还是在卷的啊。那这个这个他每一次的一个旗舰级的模型的发布,它都是带来这个新的算力的需求和新的应用的诞生和新的能力的进步, 00:05:01 呃,所以呢,国产大模型还是在卷的啊,还而且而且这个比北美还要激烈,这个国产大模型的这个卷度,那第二个呢就是。这个,嗯。2.8万亿的参数量呢,它叠加百万级的这个百万token的上下文,这意味着什么呢?意味着就是推理侧的算力和这个,这个它的kvcache的缓存需求是非线性增长的是非线性增长的啊。这个这个现在的Agent的时代一个任务,它的后面可能又是这个几十轮的这个工具的调用和长链路的推理啊。那所以它这个token的消耗量是巨大的啊,是非常巨大的。这个嗯,也就是说,也就是说模型它每上一个台阶,整个算力的需求还是非常大的。 00:05:53 目前来看非常大啊,这个而且叠加这个国产大模型,要进入到一个3万亿的参数量和百万token的上下文, 00:06:03 这么一个标配的阶段来看的话,它整个token量还是呈指数性的急剧往上在上升上升。 00:06:11 第三个呢就是。嗯,一旦用起来推理算力对国产算力需求还是非常刚性。呃,大家不知道大家有没有用这个K3,反正我用了我周末用了两天, 00:06:22 呃,给我最大的一个感受就是太慢了啊,就非常的慢。呃,给他做一个稍微复杂的任务,他起码要做个一两个小时。嗯,有时候有时候就我就把电脑放着打开让他做,我去干别的事情,回头来看他还在还还在干。 00:06:39 呃,这个这个比如说下午让他做了,晚上吃完晚饭回来再看啊,他确实做完了,但是中间 可能相差了三四个小时。呃,他有可能两个小时做完,有可能3个小时做完,他确实是非常慢啊,非常慢啊,这个嗯,慢的核心原因就是还是缺算力,还是缺算力啊,就算力的优化做的也不是很好,但模式能力很强,但你算力优化做得不是很好,然后又缺算力,就导致的是非常慢啊,极其的慢,极其的慢。呃,所以呢,就可以看出来就是需求很旺盛啊,模型国产的大模型能力上一个台阶之后,叠加了需求非常旺盛。 00:07:19 呃,Kimi他在周末已经暂停了免费版用户的一个使用了啊,就是你你用免费版用户你问他问题,他他几乎就不回答你了对吧?嗯,他全都给付费版的用户了,就说明他缺算力,呃,算力优化也做得不好,但模型能力很强,激发了需求,那算力没跟上啊,所以还是算力非常重要的,目前来看算力还是非常重要,呃,所以这是K3的情况。 00:07:42 第二个呢就是呃大家如果去逛这个世界人工智能大会啊,就发现这个华为生成的950整个超节点,呃升腾的950超节点应该是它第一次面向公众来这个展出啊,应该第一次面向公众来展出。呃它是它的基本呢是用950DT来做的,呃它是以64张卡为基本单元,然后它可以扩张到8192张卡啊,可以做一个一个将近万卡的一个集群,所以它既可以做小集群又可以做一个大的集群啊呃,它的FP8它支持F。IP4啊,它这是IP4,它的IP4的整个算力可以达到十六十六亿eflops啊,就非常大啊。 00:08:27 而且呢,它的卡间互联和整个系统的总内存整个呃这个这个数量级也非常强呃,它用的是800G光模块儿啊,但是现在国产算力的主流是用的400G光模块呃,但是华为生成这个超节点它用的是800G光模块啊。 00:08:44 啊,我们一直说就是这个这个如果推理起来的话,那超级的需求一定会放量。哎,所以呢,我们现在看到的一个趋势就是国产大模型起来了,它也带动了国产超级点在不断的放量。 00:08:57 呃,其实我们可以看到像像海光像阿里对吧,像华为都做了自己的超节点啊,所以应该说到了下半年,呃,国产超节点都在不断的放量,其实这一点我们可以从华擎啊呃从浪潮呃 的身上也能看到他们的变化,呃,超级点的一个变化啊。呃,所以这个应该是目前应该是目前水平最好的国产超节点之一吧,就是国这个升腾950超节点OK。嗯,所以从这个性能目前来看的话,现在超节点可以完完全全做大模型的深度推理是没有什么问题的啊,而且用超级点来超级点来做推理,它效果也非常不错啊,效果非常不错。 00:09:41 当然里面呢,生成整个体系里面它基本上全都是国产化的啊,里面的各种的包括CPU啊啊等等也都是用的是华为自己的。 00:09:51 呃,周末呢逛了两天这个世界人工智能大会啊,waic我觉得有几个感受啊。 00:09:57 第一个呢就是呃,国产算力的进步确实非常快啊,国产算力进步非常快。呃,我们去了这些国产的这个展台都去逛了一下,也跟这个这个工作人员也做了交流。 00:10:11 呃,整个国产产的订单还是非常乐观的啊,非常乐观啊,就是各大厂商都推出了,要么就是已经推了,要么就马上推自己的新一代的国产的AI芯片。呃,不管是算力能力还是互联集群能力都上了一个台阶,都上了一个台阶,还是大模型推理能力都上了一个台阶。呃,当然呢,就是可能在部分厂商它的供给还是还是有限的啊,供给还是有限,啊,就是呃但是订单需求很旺盛,呃供给在某些厂商上可能还是还是存在问题,但整个需求依然很非常旺盛。呃, 00:10:47 目前来看的话,包括今年,包括明年。呃,供小于求的这个国产算力的趋势依然还是存在,就供小于求的这个这个基本格局还是没改变,需求非常旺盛啊,整个我们每一家聊下来的每一家的订单都非常乐观,都很乐观啊。呃,当然还是有可能还有三五家的公司要上市,呃,就是有一些厂商,有一些厂商啊,当然现在已经厂已已经有这么六七家厂商GPU厂商上市了,当然可能还是有三四家厂商要上市。 00:11:21 所以如果如果再算上一些大厂的大厂自研,包括阿里的包括华为对吧,包括这个这个百度的昆仑芯,哎,所以国产的AI芯片可能有十几家的公司在里面做竞争啊,所以竞争还是 非常激烈的。 00:11:37 呃,另外呢,就是第二点呢,就是我们看到国产算力它的cp o啊NPO o的方案在逐渐的成熟,逐渐成熟。呃,目前主流的还是400G光模块儿,呃,但是华为升腾也开始用了800G了。呃,但是下一代我们看到下一代的这个国产AI芯片做的集群,基本上也都开始用800G了啊,所以互联方案越来越成熟,然后呢,在整个互联需求里面,我们看到像智能网卡的需求可能会是个比较大的增量啊。智能网卡的需求比较增比较大的增量,像华为啊中兴啊云脉等等公司做的非常不错啊。另外呢,就是嗯, 00:12:14 整个世界人工智大智能大会里面有一个非常重要的一个组成部分, 00:12:18 就是机器人儿呃人形机器人儿呃,但是说实话,我没有看到人形机器人大脑有什么进步啊。当然本体是有进步的啊,本体做得更灵活了啊,这个这个打个拳啊跳个舞啊,确实是要比去年更灵活,但是这个我想大家在春节晚会上已经看出来。这个有些公司的这个本体确实做得非常灵活,但是大脑呃没看出进步来啊,大脑还是那样啊,机器人大脑还是没看出进步来。现在机器人大脑还停留在啊要要要要多更多的采集数据,要给大模型来做训练这个阶段啊,所以机器人的大脑没有看出,至少我没有看出有什么进步来。OK啊呃, 00:13:01 所以呃所以从整个呃世界人工智能大会上来看, 00:13:06 嗯来看的话,我觉得嗯,给我最大的感受就是国产算力的进步非常快啊,国产算力跟国产大模型越来越成为一个互相促进的一个飞轮效应,已经开始转起来了。来这个效应越来越重要,这个体系越来越重要, 00:13:23 不知道大家有没有看这个嗯,刚结束的这个世界杯决赛,西班牙对阿根廷,那你会发现就是就是阿根廷其实全场基本就没什么机会。呃西班牙是个体系啊,就里面可能换一个球员换成另外一个球员,其实可能没什么变化。他他的一脚传球对吧,他整个体系全场端压制阿根廷这个这个这