Vera Rubin1️⃣从“发布”进入“全球交付”,Q3海外算力爆发已至,客户侧开始落地交付。英伟达7月21日宣布,Vera Rubin NVL72已在CoreWeave、谷歌云、微软Azure和甲骨文云等平台启动部署,覆盖全球30个国家、350多个工厂节点。 2️⃣计算效率10倍提升。CoreWeave基于真实硬件运行DeepSeek-R1测试,结果显示VeraRubin较Grace Blackwell NVL72每兆瓦Token吞吐提升约10倍。在电力成为AI工厂核心约束的背景下,算力竞争正式从“芯片性能”转向“每瓦产出”和“每百万Token成本”。吞吐量提升有利于单台服务器的token产出。利好模型端,提升其单位服务器可获取的算力以及对应的收入。 3️⃣展望下半年,英伟达Rubin、谷歌TPU v8,进入交付或部署窗口,目前算力租赁主要是以B卡为主,后面Vera Rubin量产有望驱使美国放开老款卡对外销售,提升算力租赁公司的交付能力。目前下游算力依然是收入的木桶短板,需求旺盛,只缺交付,整体逻辑演绎对算力租赁板块是利好催化。 #建议重点关注: 1)国产大模型:智谱等。2)算力租赁:业绩加速兑现的核心龙头行云科技、利通电子、协创数据等,以及转型规划深入有进展的杰创智能、华策影视、平治信息等。3)受益于模型红利的云厂:阿里巴巴等。风险提示:老款卡对华清库存的节奏与力度影响供给、芯片进口政策变化影响供给、Token使用量与付费转化等商业化节奏不及预期影响需求等风险。☎️模型、算力租赁、云等近期深度路演欢迎联系浙商AI战队冯翠婷#文字观点