Meta 发布 Muse Spark 1.3:五个月内第四版,智能指数逼近第一梯队
事件背景
Meta 于 9 月 2 日发布 Muse Spark 1.3,官方称这是其在编码和智能体工作上的最大跃升,已在 Meta 模型 API 和 Muse Code 上推出,价格极低。这是五个月内第四个 Muse Spark 版本。Meta 首席 AI 官 Alexandr Wang 称其编码能力超越 GPT-5.6 Sol、与 Claude Fable 5.1 持平。
基准成绩单
| 基准 | Muse Spark 1.3 | 参照 |
|---|---|---|
| DeepSWE 1.1 | 超过 GPT-5.6 与 Opus 5 | — |
| MRCR 256K–512K(长上下文) | 98.5 | GPT-5.6 Sol:91.5 |
| JobBench | 64.9 | Opus 5:65.7 |
| OSWorld | 66.9 | Opus 5:68.3 |
| AutomationBench | 49.4 | Opus 5:50.3 |
| Artificial Analysis 智能指数 | xhigh 61 / max(合作伙伴限时预览)62 | 逼近 Claude 与 GPT-5.6 |
效率与价格两条线
- 更省:相比 1.2 版本,Muse Spark 1.3 减少 20% 工具调用和 25% token 用量——对长周期智能体任务,这直接决定账单。
- 更便宜:官方称以极低价格切入;9 月 3 日起已在 OpenCode 上免费开放使用。
时间线要点
- 9 月 2 日 19:43:Alexandr Wang 与 Testing Catalog 率先官宣发布。
- 20:43-21:40:Artificial Analysis 评测上线,xhigh 得 61 分、max 变体 62 分。
- 23:29:IT之家跟进,确认主打编码与长周期智能体任务。
- 9 月 3 日 11:10:Muse Spark 1.3 在 OpenCode 免费开放。
编辑部的看法
「最先进模型已便宜到无法计量」——这句评论抓住了本周的主旋律:当 61-62 分的模型可以免费随便用,竞争焦点从「能力上限」彻底转向「单位任务成本」。对做智能体产品的团队,现在是重新测算成本曲线、重审模型选型的窗口期。
数据来源与原文出处
数据来源:AIHOT(热点聚合时间线)
- Alexandr Wang(Meta 首席 AI 官):发布推文 / 智能指数推文
- Testing Catalog:官方发布推文
- Artificial Analysis:评测推文
- Rohan Paul:基准汇总推文
- Kim:智能指数 62 推文 / OpenCode 免费开放推文
- The Decoder:Meta 发布 Muse Spark 1.3,智能体任务提升明显且以低价切入
- IT之家:Meta 发布 Muse Spark 1.3,主打编码与长周期智能体任务
—— 完 ——