国内大模型高性价比、有望实现Token出海
3.2-3.8 OpenRouter中国模型总用量达4.2万亿Token,环比+34.9%,再次超过美国。MiniMax M2.5、DeepSeek V3.2、Step3.5 Flash位列前五。
核心观点
-
Token出海凸显国内AI性价比:
- Agent时代模型Token消耗量指数级提升,开发者更敏感于单Token价格。
- 国产模型综合成本仅为海外模型的1/6-1/10,性价比优势显著。
- 性价比来源:ds架构提升(MLA和稀疏架构降低推理成本)、国内电力成本优势(单B200卡每年节省900美元)。
-
AI Native终端初现:
- Agent成为OS雏形,分层结构:底层(OpenClaw+基础模型)、中间层(工具/技能衔接)、上层(解决实际问题)。
- AI终端形态转变,垂直行业深度定制是关键(工业、法律、金融、医疗等领域)。
- 商业模式转型:从“一次性买断”向“硬件+AI服务订阅”发展。