您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [未知机构]:国产算力专家 - 发现报告

国产算力专家

2026-07-03 未知机构 GHK
报告封面

核⼼要点 1.壁仞已进⼊阿⾥供应链,量产正在起量。阿⾥已经下单万卡以上壁仞⼀代产品;壁仞⼆代与阿⾥签了10万卡以上订单,⽬前量产已经起来了,也在积极备货HBM。 2.摩尔S5000双带版本仍未正式量产,⽬前主要卡在双带性能和带间互联指标,后续会重新流⽚优化。 3.沐曦C600分互联⽹版和信创版,运营商和政企项⽬更偏信创版本,互联⽹客户对国产制程要求没那么硬。 4.寒武纪690还没有形成批量交付,2026年资源优先放在580和590,690⽬前不是交付主线。 5.寒武纪超节点还没有进⼊⾃建或量产部署阶段,更多是和OEM平台做适配验证,关键约束还是产能。 6.墨芯⽐较依赖具体场景适配,稀疏路线带来性能优势的同时,也提⾼了⽤户迁移和精度对⻬难度。 7.阿⾥Token Foundry主要是在整合内部模型资源,短期看仍需要集团内部其他业务补贴,稳定可能还需要时间。 8.阿⾥云增速放缓更像内部组织和价格策略问题;⽕⼭云更聚焦AI,策略更简单,仍处于快增⻓阶段。 9.IDC涨价已经落地,并不只是单家公司现象。2026年整体涨幅达到30%-50%基本合理,部分客户侧已经涨价20%-30%。 10.企业端已经开始管控Token预算,但由于业务使⽤频率上升,旗舰模型收⼊未必下降。 11.平头哥拆分上市在推进,但阿⾥不会急着拆,还是要等平头哥具备更强独⽴运营能⼒。 ⼀、国产AI芯⽚与产品进展 1.壁仞是否已经进⼊阿⾥供应链?⼆代订单情况如何? 问:壁仞在阿⾥供应链中的进展如何?⼆代产品是否已有明确订单? 答:阿⾥已经下单了万卡以上的壁仞⼀代产品订单,可以确认壁仞已经进⼊阿⾥供应链。这个订单说明壁仞不只是测试或适配阶段,⽽是已经进⼊阿⾥的实际采购和部署链条。 壁仞⼆代产品也已经和阿⾥签了10万卡以上的订单,但后续还要看实际交付情况。订单签订本身说明阿⾥对壁仞⼆代有明确需求和供应链预留,但最终能够兑现多少,仍取决于壁仞⼆代产品的量产、良率、交付节奏和阿⾥内部部署计划。 现在壁仞的量产已经进⼊起量阶段,HBM也在积极备货。这个事情可以看得⽐较正⾯,因为如果只是前期验证,不会这么早去备HBM。现在备货说明后⾯交付是要往上⾛的,阿⾥这边也不是简单做测试,⽽是已经按订单和后续部署节奏在推进。壁仞⼆代具体能交多少,还是要看后续产能和交付,但⽬前这个状态⽐之前市场理解的要积极。 2. S5000⾼阶双带版本是否已经量产? 问:S5000⾼阶双带版本最近是不是已经量产? 答:还没有。S5000双带版本现在仍在摩尔内部做评测,没有到正式量产阶段。从评测反馈看,主要问题在双带协同和带间互联上,相关指标还没达到预期。后⾯⼤概率要重新流⽚,把带间互联带宽这块再做优化。 之前没有把这款双带版本送给互联⽹客户评测,原因也在这⾥。带间互联是这代产品最明显的短板,如果现在给客户测,结果不会好看。成本⾄少翻⼀倍,但性能提升不到两倍,可能只有⼀点⼏倍。按照这个投⼊产出,字节、阿⾥这类客户很难通过评测,所以现在也没有形成明确需求。 3.沐曦C600是否分互联⽹版本和信创版本? 问:沐曦C600有互联⽹版和信创版的区别吗?国产卡是不是都有这种区分? 答:沐曦是有这两个版本的。信创版主要是为了满⾜国产化要求,但这个要求并不是所有环节都必须百分之百国产。⼀般来说,如果要进信创场景,产品⾄少要在国内制程上实现⽣产,但不代表每⼀款产品、每⼀个环节都必须完全国产,部分海外制程仍然可以存在。 现在卖给运营商的产品,⼤多数都会按信创版本来做,因为运营商的信创要求⽐较明确。互联⽹客户这边要求没那么硬,有些⼚家会给互联⽹客户卖⾮国产制程的卡。运营商和政府相关项⽬基本还是以信创版为主,也就是通常说的国产版本。 4.信创版价格是否普遍⽐互联⽹版低30%? 问:信创版是不是⼀般会⽐互联⽹版本便宜30%? 答:有这种可能。国产制程成本相对低⼀些,所以价格上可能更便宜,但性能或者其他指标也可能会有差距。⽐如海光有⼀款新产品,海外⽣产版本频率能做到400多T,国产⽣产版本⼤概是300多T,两者不是完全⼀样的产品状态。 5.腾讯是否最近向寒武纪提出新需求? 问:腾讯最近有没有对寒武纪提出采购需求? 答:没有看到腾讯向寒武纪提出明确采购需求。腾讯只是测过寒武纪590和690,对产品性能做了⼀些了解。寒武纪这边也表示2026年没有机会向腾讯交付,因为产能已经排满了。所以⽬前腾讯这⾥不是量产计划,更像是了解和测试。 6. 690中芯版本是否已经量产? 问:690中芯版本最近是不是已经开始量产了? 答:还没有批量出货。寒武纪2026年主要产能还是优先保障580和590,690没有⼤规模出货计划,也没有积极往客户侧推⼴。原因很简单,即使推⼴出去也没有产能交付。2026年690在量产优先级⾥排不上,当前也没有形成批量客户。 7. 690的节奏会不会影响后续790? 问:690如果没有⼤规模跑起来,会不会影响790流⽚和后续时间表? 答:会有影响。690本身可以理解为790前⾯的⼀代批量验证产品。如果690没有经过⾜够⼤规模的使⽤验证,790后续推进⾃然会更谨慎。寒武纪现在最⼤的问题不是客户不知道产品,⽽是产能有限。贸然推进790,也会进⼀步占⽤本来就紧张的产能。 8.寒武纪超节点部署有什么进展? 问:寒武纪最近在超节点上的推进情况怎么样? 答:寒武纪⾃⼰没有做超节点,也没有明确的⾃建超节点计划。现在主要是给⼀些做超节点的⼚商提供产品做验证和适配。2026年还没有客户明确要求寒武纪去部署超节点,⽽且产能也不⽀持这么做。 ⽬前寒武纪⾸先要保证字节的需求,普通⼋卡服务器交付都⽐较紧张,没有多余产能去做超节点。今年字节本身也没有超节点部署计划,相关计划更偏2027年。 腾讯和阿⾥也有超节点⽅向的规划,但寒武纪没有办法保证供货,所以没有真正推进到客户部署层⾯。现在更多是和OEM⼚商做平台适配,⽐如阿⾥的盘古、浪潮、新华三等平台已经做过适配,但没有量产安排。 9.如何看字节对墨芯的采购? 问:字节采购墨芯是什么情况?墨芯这张卡的性能和后续空间怎么看? 答:字节不是把墨芯拿去做内部seed业务。实际路径是通过⽕⼭云,墨芯把⾃⼰的产品放进⽕⼭云体系,但客户需要墨芯⾃⼰带。⽕⼭云更像是提供⼀个云上承载位置,不等于⽕⼭⾃⼰⼤规模消化墨芯卡。 墨芯的问题主要在产品路线⽐较特殊。它⽤了很⾼⽐例的稀疏,稀疏系数可以到1:8,这在⾏业⾥⽐较少⻅。好处是特定场景下性能可以做得不错,但坏处是⾮常挑⽤户、挑模型、挑场景。很多业务需要墨芯⼯程师深度介⼊适配,否则⽤户很难在墨芯卡上做到和英伟达或其他国产卡⼀致的精度表现。 如果某个客户模型完成了精度对⻬,墨芯的实际效果并不差,但前期适配成本⽐较⾼。现在它还没有特别⼤体量的潜在客户,主要还是墨芯⾃⼰开发的⼀些⾏业客户,⽐如视频监控、⽂字⽣成等。这些场景⾥,墨芯通常会替客户做模型迁移和优化,真正主动迁移到墨芯上的通⽤客户还不多。 10.智谱coding资源消耗和表现主要取决于什么? 问:智谱coding为什么看起来资源消耗更低、表现也不错?核⼼原因是什么? 答:严格说,智谱在coding上的资源消耗并不是绝对低,只是它在模型设计和训练阶段对coding做了更多针对性优化。⽐较重要的原因有两个。 第⼀,智谱5.1版本没有⽀持超⻓上下⽂,5.2才开放相关能⼒,⽽且5.2的资源消耗还在早期评估中。5.1版本因为上下⽂⻓度较短,所以在coding任务上消耗会⼩⼀些,尤其和DeepSeek⽐,会显得更省资源。 第⼆,coding过程中cache命中率⽐较关键。智谱在这块命中率相对⾼,运⾏时Token消耗就会低。DeepSeek的问题是cache命中率不⾼,模型运⾏周期被拉⻓,⼀个问题往往需要多轮推理才能结束。智谱还会针对客户应⽤场景做优化,所以在⼀些coding场景下表现会更好。 ⼆、阿⾥、⽕⼭云与Token Foundry 11.如何看阿⾥近期调整,尤其是Token Foundry? 问:阿⾥最近这些组织和业务调整怎么看?Token Foundry是不是⽐较重要? 答:Token Foundry更像是阿⾥把内部⼤模型资源重新收拢。过去阿⾥内部不同⼤模型团队、不同业务部⻔各⾃对外,商业模式也不完全⼀样。有的卖Token,有的卖API,有的卖打包模型产品,客户接触到的报价、⽀持和服务⼝径都不⼀致。 这种状态下,客户会在阿⾥内部不同团队之间⽐价、询价,不同部⻔之间也容易互相竞争。对客户来说可能拿到了更便宜的条件,但对阿⾥来说内部消耗很⼤。 现在阿⾥把相关资源整合到⼀起,由统⼀负责⼈来安排Token Foundry的整体业务。这样⾄少能减少内部各⾃为战的问题。不过Token Foundry本身短期未必能赚钱,⽬前市场Token价格折扣很深,云⼚商普遍需要⽤其他业务去补贴。阿⾥整合之后,⼤概率也需要集团其他部⻔继续给Token Foundry输⾎。预计还需要半年左右才能稳定下来。 12.阿⾥云收⼊增速放缓,⽕⼭云是否也会类似? 问:市场说阿⾥云增⻓变慢了,⽕⼭云会不会也遇到类似问题? 答:阿⾥云放缓主要还是内部管理和业务策略导致。过去阿⾥云内部多个部⻔各做各的模型和业务,争取客户时甚⾄会在同⼀个客户上互相竞争。为了拿客户,不同部⻔会压价格、给承诺,最后客户拿到了优惠,阿⾥⾃⼰承担了⼤量补贴,收⼊增⻓就会受到影响。 ⽕⼭云现在情况不太⼀样。它还在较快增⻓阶段,⽽且业务焦点更集中。⽕⼭云传统云业务占⽐不⾼,核⼼就是围绕AI业务展开,所以整体策略更清楚。 客户侧也⽐较容易理解⽕⼭云的定位:需要AI相关⽀持,就找⽕⼭云。报价、资源⽀持和服务路径都⽐较直接。⽕⼭云为了降低KPI压⼒,也会尽量少收购外部算⼒中⼼,更多采⽤租赁⽅式拿资源,减少⼀次性资本开⽀。 13.阿⾥未来会不会更多租⽤算⼒? 问:阿⾥接下来半年到⼀年,会不会从⾃建或收购转向更多租⽤算⼒? 答:⽬前看阿⾥还是更倾向⾃建或收购,不太像要⼤规模转向租⽤。这⾥说的⾃建也不完全是阿⾥⾃⼰从零开始建,⽽是其他建设⽅按阿⾥要求建设,建完之后阿⾥整体收购。 字节和腾讯的做法不⼀样。字节要么⾃⼰建,要么租,不太会收购别⼈建好的算⼒中⼼。⽐如字节和润泽的合作就是租赁,资产仍然在润泽⼿⾥。⽕⼭云⼀直⽐较明确,就是⾃建或者租⽤。 阿⾥认为⾃⼰对AIDC建设逻辑⽐较熟,可以把利润空间压得很低,建设⽅能赚的钱有限。在这种情况下,阿⾥仍愿意继续采⽤收购模式。 三、IDC涨价与成本传导 14.字节系IDC涨价5%-10%是否属实? 问:字节系IDC涨价5%-10%这个说法真实吗?是不是整个⾏业都在涨? 答:涨价是属实的,⽽且不是孤⽴现象。字节并不是所有模型都⽤⾃研,也会外采GLM、DeepSeek等模型。上游模型涨价后,字节会把成本继续传导给下游客户。客户侧涨幅⼀般在20%-30%,因为字节⾃身也很难完全消化这部分成本。 15.这轮涨价是不是对字节、腾讯影响更⼤,对阿⾥影响较⼩? 问:这次IDC和模型相关涨价,是不是字节、腾讯受影响更⼤,阿⾥相对⼩⼀些? 答:阿⾥受到的影响相对⼩。原因是阿⾥更多采⽤⾃有或收购资产,⾃⼰掌握资源,所以外部涨价对它的直接冲击有限。除⾮阿⾥某些业务租⽤了其他⼤模型⼚家的Token,⽽这些⼚家⼜涨价,阿⾥才会受到影响。但⽬前看,阿⾥云并没有⼤规模使⽤其他⼚家的Token。 16.国内IDC调价频率和幅度通常如何? 问:国内IDC⼀般多久调⼀次价,涨幅⼤概是什么⽔平? 答:过去IDC调价通常⼀年⼀次,所以很多客户只愿意签⼀年合同,怕第⼆年价格变。最近变化⽐较明显,已经出现半年调⼀次的情况。有些模型⼚家2026年上半年已经调过两次价,下半年预计还会再调⼀次。也就是说,2026年全年⾄少可能有三次以上调价。 17. 2026年IDC整体涨幅到30%-50%靠谱吗? 问:有⼈说2026年IDC整体涨幅可能到30%-50%,这个