Meta发布Muse Spark 1.1,定位多模态Agent编码模型,面向多步推理、复杂工作流管理、企业系统自动化等场景。扎克伯格称其为"以极低价格提供的强大Agent编码模型",强调其在Agent性能、工具调用和计算机使用方面最强。
核心能力:
- 采用JEPA架构,具备多模态能力,工具调用成功率领先;
- 支持多步推理,管理复杂数字工作流、修复Bug、处理大规模代码迁移;
- RuntimeWire实时对比中,以104.5:94.5击败Anthropic Opus 4.8(7:2任务胜出),在指令遵循、格式约束、SQL/JSON结构化输出等可靠性维度上领先;
- Terminal Bench 2.1评测中,Meta自评使用89个任务,但社区指出资源上限超出标准限制,结果存在争议;DeepSWE评测表现不够突出。
定价:
- API定价为每百万Token输入$1.25/输出$4.25,缓存命中仅$0.15/百万Token;
- 对标海外全行业最低,缓存命中价格$0.15仅为Grok 4.5($0.50)的30%,多轮编码场景下实际成本优势显著;
- 社区评价:"Opus级智能、Haiku级价格"。
产品生态:
- 在meta.ai上已接入16个工具,包括网页搜索、内容语义搜索、商品目录搜索、AI图像生成、Python代码解释器等;
- 提供三种推理模式:Instant(即时)、Thinking(思考)及规划中的Contemplating(深度沉思,对标Gemini Deep Think/GPT-5.4 Pro);
- 同步发布AI图像生成模型Muse Image,AI产品矩阵持续扩展。