Meta 发布新旗舰 Muse Spark 1.3:智能指数 62 分紧咬 Claude,价格比 DeepSeek 高峰期还便宜
Meta 今天正式发布新一代旗舰模型 Muse Spark 1.3。在独立评测机构 Artificial Analysis 的大模型智能指数上,这款模型拿到 62 分,仅次于 Claude Fable 5.1(66 分)和 Claude Opus 5(63 分),排在全行业第三——把 4 个小时前刚刚登顶的谷歌 Gemini 3.8 Flash(59 分)压到了身后。
这是 Meta 首次在大模型第一梯队里站稳脚跟。
跑分:第三名,但意义不同
对 Meta 来说,这个第三名和以往不一样。过去一年多,Artificial Analysis 榜单前排长期被 Anthropic 和 OpenAI 包揽,Meta 的模型一直差着一截。这次 Muse Spark 1.3 是第一个真正"咬住"Claude 旗舰的 Meta 模型——和第二名 Opus 5 只差 1 分。
从 Meta 官方公布的基准测试看,Muse Spark 1.3 拿下 5 项第一,在下文续写和编程类的大部分测试中优于 GPT-5.6 Sol 和 Claude Opus 5,只在 Terminal-Bench 终端操作 Agent 测试上与 GPT-5.6 Sol 打平。
短板也明显:在需要联网搜索的 Agent 任务和通用知识测试 GDPVal-AA v2 上,分数偏低。如果你的场景重度依赖联网检索型智能体,这代还未必是最优解。
编程和智能体是主打
Meta 超级智能实验室负责人汪滔(Alexander Wang)称,这代模型在智能体、编程能力和易用性上大幅提升,"成本低到几乎可以忽略不计"。
搭配官方编程工具 Muse Code 使用时,官方评测称其表现可与"Claude Code + Opus 5""Claude Code + Fable 5"的组合媲美。扎克伯格本人在 X 上说性能"超乎想象"。
一个更直观的案例:有开发者用 Muse Spark 1.3 做出了一个《我的世界》风格的游戏,API 花费仅 10 美分(约 0.67 元人民币)。
价格:加量不加价,继续压价
定价与前代 1.2 完全持平:
- 输入(缓存未命中):1.25 美元 / 百万 token(约 8.4 元)
- 输入(缓存命中):0.15 美元 / 百万 token(约 1 元)
- 输出:4.25 美元 / 百万 token(约 28.55 元)
横向对比:比 Gemini 3.8 Flash 略贵,但比 DeepSeek-V4-Pro 的高峰期价格还要便宜。同样的钱能买到排名第三的模型,对做成本敏感型应用的开发者来说,是多了一个实打实的比价筹码。
上线状态
Muse Spark 1.3 已在 Muse Code 和 Meta Model API 中逐步推送上线,此前支持的推理模式现已可用。更激进的 max-reasoning(极致推理)模式还要等一轮安全测试后再开放。据多家媒体转述,模型支持 100 万 token 上下文,可输入文本、图像和视频。
五个月迭代四代:Meta 在赶时间
看迭代节奏就知道 Meta 有多急:4 月发布初代 Muse Spark,7 月 1.1,8 月 1.2,9 月 1.3——五个月四代。
竞争层面,这次发布的时间点也很微妙:谷歌 4 个小时前刚发布号称"迄今最强"的 Gemini 3.8 系列(Flash 与 Flash Cyber),在 Artificial Analysis 榜单上领先了没几个小时,就被 Meta 反超。汪滔随后在社交平台贴脸开大:"gemini who?"——还补了一句"Gemini 现在取消上线还不算晚"。
好消息是,头部厂商卷得越凶,开发者拿到的模型就越便宜、越强。至于 Meta 能不能把这个第三名守住,就看下一轮更新了。
---
*来源说明:本文基于 Meta 官方博客、Artificial Analysis 评测,以及 SiliconANGLE、Axios、TechTimes、智东西等多家媒体转述整理。*