Este artículo aún no está disponible en español — abajo se muestra la versión original en chino.
Fable 5.1 砍缓存价 75%,Muse Spark 1.3 平价突袭:一周内旗舰格局重排
9 月第一周三大厂密集出牌:Anthropic 发布 Claude Fable 5.1 并把缓存读取价砍到 $0.25,Meta 用 Muse Spark 1.3 以 $1.25/$4.25 抢占性价比位,OpenAI 则靠 GPT-6 Astra 把旗舰价抬到 $10/$50。本文拆解三种定价策略背后的逻辑,并给出多级路由的成本最优解。
9 月第一周,三大厂商在 48 小时内密集出牌:Anthropic 在 9 月 2 日发布 Claude Fable 5.1(连同 Mythos 5.1),把 Prompt 缓存读取价直接砍掉 75%;Meta 紧接着推出 Muse Spark 1.3,维持上一代定价虎视编码赛道;OpenAI 则在 9 月 3 日用 GPT-6 Astra 把旗舰价抬到 $10/$50。三家公司一个降、一个稳、一个涨,旗舰格局在一周之内完成重排。
三家新模型定价一览
| 模型 | 输入 | 输出 | 缓存读取 | 上下文 | 相对上代 |
|---|---|---|---|---|---|
| Claude Fable 5.1 | $10 | $50 | $0.25 | 1M | 缓存读取降价 75% |
| Muse Spark 1.3 | $1.25 | $4.25 | $0.15 | 1M | 价格持平 1.2 |
| GPT-6 Astra | $10 | $50 | $1 | 1.05M | 输入/输出上涨 2.5 倍 |
作为参照,被 Astra 取代的 GPT-5.6 Sol 定价为输入 $5、输出 $30;而 Muse Spark 1.3 的价格只有旗舰的八分之一。
Anthropic:缓存战争正式开打
Fable 5.1 的输入、输出价格与 Fable 5 完全一致($10/$50),真正的杀招在缓存读取:从每百万 token $1 降到 $0.25。Anthropic 官方给出的测算是:典型 AI 应用工作负载总成本下降约 25%,上下文长、多轮调用的 Agent 类任务最高可省 45%。
这个数字要理性看待:省多少取决于工作负载里缓存读取的占比。对一次提问、一次回答的传统用法,缓存占比低,体感变化不大;但对代码 Agent、深度研究这类「同一份大上下文反复读」的场景,缓存读取往往占总 token 的七成以上,75% 的缓存降幅会直接把账单砍掉一半。有媒体实测某项长周期任务成本降至 $2.72,比 Astra 同任务便宜了一截。
更值得玩味的是时机:在 OpenAI 用 Astra 把旗舰价抬高的同一天档口,Anthropic 选择在「隐性成本」上让利。表面价格打平 $10/$50,实际跑起 Agent 工作流,Fable 5.1 的综合成本显著更低——这是把定价竞争从牌面挪到了账单里。
Meta:用八分之一的价格抢中档
Muse Spark 1.3 维持与 1.2 完全相同的定价(输入 $1.25 / 缓存读取 $0.15 / 输出 $4.25),却把编码能力抬到官方宣称「超过 GPT-5.6 Sol」的水平,并配齐 1M 上下文。这是 Meta 五个月内的第四次模型更新,节奏明显在追赶。
$1.25/$4.25 是个精心挑选的价位:它比 GPT-5.6 Terra($2/$12)还低一截,输出价不到旗舰的十分之一。对大批量的代码审查、文档处理、轻量 Agent 任务,这个价位的模型质量已经「够用」,Meta 官方也直言这一定价「具有进攻性」。此外 Meta 延续了贡献者档策略:允许 Meta 使用提交内容改进模型,换取更低的价格,这一档在开发者社区颇受欢迎。
OpenAI:涨价立旗,把「AGI 档」定在 $10/$50
GPT-6 Astra 的详细解读我们在上一篇文章里已经展开:$10/$50 的定价比 GPT-5.6 Sol 高出 2.5 倍,1.05M 上下文,输入超过 27.2 万 token 后输出价升至 $75。有趣的是,这个价格与 Claude Fable 5.1 完全持平——两大旗舰在「AGI 档」上达成了默契,$10/$50 正在成为顶级模型的行业基准价。
三家放在一起看,策略分化非常清晰:OpenAI 涨价立旗、吃定「最强模型」的溢价;Anthropic 面上持平、暗中用缓存降价抢 Agent 开发者;Meta 则绕开正面战场,用八分之一的价格收割对成本敏感的大批量任务。
多级路由怎么配最省钱
新格局下,按任务难度分级路由比任何时候都更值钱:
- 轻量预处理(分类、抽取、格式转换):Muse Spark 1.3 是新的性价比之王,$1.25/$4.25 配 1M 上下文几乎无竞争对手;预算敏感的批处理也可以继续用 GPT-5.6 Luna。
- 中端主力(日常编码、RAG 问答):GPT-5.6 Sol / Terra 仍是均衡之选;如果你的工作流缓存命中率高的,可以直接上 Fable 5.1——缓存读取 $0.25 之后,旗舰的价格未必比中档贵多少。
- 旗舰攻坚(复杂推理、长周期 Agent):Fable 5.1 与 GPT-6 Astra 同价,但在 Agent 场景下 Fable 5.1 的缓存优势会让实际账单低 30%~45%,可以作为默认旗舰;需要 Astra 独有的 1.05M 超长上下文时再切换。
配合 Prompt Caching 使用效果更佳:把系统提示词、工具定义、长文档等稳定前缀放在请求前部,缓存命中率越高,Fable 5.1 的降价红利就吃得越足。
MuiRouter 已实时跟进
MuiRouter 已上线 Claude Fable 5.1 与 Muse Spark 1.3,价格与官方同步(Fable 5.1 缓存读取 $0.25、Muse Spark 1.3 $1.25/$4.25);GPT-6 Astra 已于昨日先行接入。三者均可在 Playground 直接体验,模型列表与计费价格已实时更新。
在 MuiRouter 的多级路由里,你可以把同一类请求按难度分发给不同档位的模型——在旗舰定价趋同、中档突袭的当下,这依然是把成本压到最低的唯一可控手段。
Fuentes de referencia
Fuente principal publicada el 2 de septiembre de 2026.
Prepárate para el próximo cambio de la IA
Empieza con una API Key y una ruta más clara para mantener estable el acceso a modelos mientras cambian las herramientas y la disponibilidad upstream.