太阳事件:Opus 5于7月25日凌晨发布,定位并非取代Fable 5的绝对性能档,旨在用Opus级价格逼近Fable级能力。模型支持1M上下文和12.8万token最大输出。 太阳提升1【Agent Coding接近Fable 5,性价比提升】 FrontierBench得分43.3,较Opus 4.8的21.1翻倍,并超过Fable 5的33.8和GPT-5.6 Sol的34.4;但DeepSWE v1.1得分68.8,低于Fable 5的69.7和GPT-5.6 Sol的72.7,FrontierCode Main也以53.4略逊Fable 5的53.5。CursorBench 3.2最大算力得分距Fable5峰值不足0.5%,单任务成本仅为一半。#Agent Coding已逼近Fable级,#兼具优异性能和性价比。 太阳提升2【知识工作、工具调用能力增强】 GDPval-AA v2以1861 Elo排名第一,领先Opus 4.8 (1593)、Fable 5 (1747)及GPT-5.6 Sol(1736);OSWorld 2.0达到70.6%,高于Fable 5 (66.1%),BrowseComp达到90.8%,同样超过Fable 5 (87.4)和GPT-5.6 Sol (90.4)。#模型处理真实职业任务、执行跨应用计算机操作、网络检索与信息整合能力增强。 太阳【定价与Opus 4.8一致】 Opus 5已在所有付费套餐、Claude Code、Claude API及主要云平台开放,价格维持Opus4.8的每百万输入/输出Token 5/25美元,为Fable 5的50%。#定位为用Opus级价格逼近Fable级能力的更具性价比版本。 太阳【先进模型减少Agent提示词不影响效果】 Anthropic Claude Code团队近期大幅精简了系统提示词,在Claude Opus 5和ClaudeFable 5等最新模型上删减超过80%的系统指令后,核心编码评测指标并未出现可衡量的下降。结合此前Superpower等知名skill在搭配GPT-5.6 sol模型使用效果不理想的情况,#我们认为随着基模进化并对复杂任务处理效果大幅提升,#Agent提示词所发挥的作用正在下降。