腾讯混元Hy3模型正式发布,能力显著提升,性价比突出。
- 模型能力提升:与两个月前的preview版本相比,Hy3的Agent任务解决率从72%提升至90%,幻觉率降至5.4%,常识错误率降至12.7%,在办公、开发等生产力任务上进步显著。
- 对比国内其他模型:Hy3的性价比突出,每百万tokens输入/输出定价为1/4元;内部盲测中分数高于GLM5.1(定价6/24元),但与GLM5.2(定价8/28元)能力有差距,token消耗更少,文档处理比GLM5.2节省47.4%。需补足的能力包括上下文长度(256K,落后DeepSeek V4的1M),仍属比肩而非超越旗舰。
- 研究结论:
- Hy3验证了姚顺雨主导的底层重构有效性;
- 腾讯真正的差异化壁垒不在价格,而在模型—产品闭环(元宝、ima、WorkBuddy多端接入,对话反馈反哺降幻觉,业务反哺模型链路),纯模型厂难复制。
- 市场预期与关注点:当前股价体现市场对腾讯AI预期仍偏悲观(26年PE13x),但AI产品(WorkBuddy、微信AI)、基模均在持续迭代优化,关注AI叙事反转。