-
算力规划与采购
- 2025年5/6月前无算力上下修,全年AI CapEx约1500亿(900亿+整体投入+500亿+CPU采购),6月后根据情况调整。
- 倾向多采购CPU,2024年采购65万台(总储备240万,与阿里一致),2025年底可能提升至85万台。
- CPU上修因字节云从租改自建,目标对外售卖200多亿。
-
拆分与供应商分布
- 海外采购500亿(90% NV,170-180亿B200/H200,10% AMD;国内主体采购不进国内,用于seed模型训练)。
- 国内采购400亿(200亿NV服务器,80亿昇腾服务器,80多亿寒武纪服务器,其余国产卡)。
- 芯片占服务器70%。
-
H20性能与交付
- FP8精度下文本推理表现良好,FP16精度约H800的70%。
- 5月节前国内组装H20有大量未交付订单,尾单交付不确定。
-
字节现有卡量
- 国内:A100 1.6-1.7万张,A800 6万张,H800 2.4-2.5万张;海外:H100 2万多张,H200 7万张,L20/L40等几十万张。
-
Token调用量与需求
- 2024年日均4万亿,2025年底预估40万亿(需55万芯片,70%训练芯片)。
- 目前日均12万亿,图像理解占3.5-4万亿(占字节总调用量1/2,主要应用内部内容标签、审核等)。
-
模型Roadmap
- 2025年计划:2月视频5s/15s模型,3月深度思考模型TOC上线,4月TOB上线,5月视频理解模型,6月语音对话端到端模型。
-
豆包业务数据
- 日均DAU 1600万,MAU 7000-8000万,次日/7日/10日留存率分别为30%/23%/10%。
- 日均对话7-8轮,token数2500-3000,2025年目标5000万DAU。
-
豆包投放策略
- 月预算6000万,40%内部渠道(巨量比外部低30%),60%外部渠道。