MuiRouter

この記事はまだ日本語版がありません — 原文(中国語)を表示しています。

6分で読めます

Fable 5.1 砍缓存价 75%,Muse Spark 1.3 平价突袭:一周内旗舰格局重排

9 月第一周三大厂密集出牌:Anthropic 发布 Claude Fable 5.1 并把缓存读取价砍到 $0.25,Meta 用 Muse Spark 1.3 以 $1.25/$4.25 抢占性价比位,OpenAI 则靠 GPT-6 Astra 把旗舰价抬到 $10/$50。本文拆解三种定价策略背后的逻辑,并给出多级路由的成本最优解。

ClaudeMetaGPT调价AI 编程

9 月第一周,三大厂商在 48 小时内密集出牌:Anthropic 在 9 月 2 日发布 Claude Fable 5.1(连同 Mythos 5.1),把 Prompt 缓存读取价直接砍掉 75%;Meta 紧接着推出 Muse Spark 1.3,维持上一代定价虎视编码赛道;OpenAI 则在 9 月 3 日用 GPT-6 Astra 把旗舰价抬到 $10/$50。三家公司一个降、一个稳、一个涨,旗舰格局在一周之内完成重排。

三家新模型定价一览

模型输入输出缓存读取上下文相对上代
Claude Fable 5.1$10$50$0.251M缓存读取降价 75%
Muse Spark 1.3$1.25$4.25$0.151M价格持平 1.2
GPT-6 Astra$10$50$11.05M输入/输出上涨 2.5 倍

作为参照,被 Astra 取代的 GPT-5.6 Sol 定价为输入 $5、输出 $30;而 Muse Spark 1.3 的价格只有旗舰的八分之一。

Anthropic:缓存战争正式开打

Fable 5.1 的输入、输出价格与 Fable 5 完全一致($10/$50),真正的杀招在缓存读取:从每百万 token $1 降到 $0.25。Anthropic 官方给出的测算是:典型 AI 应用工作负载总成本下降约 25%,上下文长、多轮调用的 Agent 类任务最高可省 45%。

这个数字要理性看待:省多少取决于工作负载里缓存读取的占比。对一次提问、一次回答的传统用法,缓存占比低,体感变化不大;但对代码 Agent、深度研究这类「同一份大上下文反复读」的场景,缓存读取往往占总 token 的七成以上,75% 的缓存降幅会直接把账单砍掉一半。有媒体实测某项长周期任务成本降至 $2.72,比 Astra 同任务便宜了一截。

更值得玩味的是时机:在 OpenAI 用 Astra 把旗舰价抬高的同一天档口,Anthropic 选择在「隐性成本」上让利。表面价格打平 $10/$50,实际跑起 Agent 工作流,Fable 5.1 的综合成本显著更低——这是把定价竞争从牌面挪到了账单里。

Meta:用八分之一的价格抢中档

Muse Spark 1.3 维持与 1.2 完全相同的定价(输入 $1.25 / 缓存读取 $0.15 / 输出 $4.25),却把编码能力抬到官方宣称「超过 GPT-5.6 Sol」的水平,并配齐 1M 上下文。这是 Meta 五个月内的第四次模型更新,节奏明显在追赶。

$1.25/$4.25 是个精心挑选的价位:它比 GPT-5.6 Terra($2/$12)还低一截,输出价不到旗舰的十分之一。对大批量的代码审查、文档处理、轻量 Agent 任务,这个价位的模型质量已经「够用」,Meta 官方也直言这一定价「具有进攻性」。此外 Meta 延续了贡献者档策略:允许 Meta 使用提交内容改进模型,换取更低的价格,这一档在开发者社区颇受欢迎。

OpenAI:涨价立旗,把「AGI 档」定在 $10/$50

GPT-6 Astra 的详细解读我们在上一篇文章里已经展开:$10/$50 的定价比 GPT-5.6 Sol 高出 2.5 倍,1.05M 上下文,输入超过 27.2 万 token 后输出价升至 $75。有趣的是,这个价格与 Claude Fable 5.1 完全持平——两大旗舰在「AGI 档」上达成了默契,$10/$50 正在成为顶级模型的行业基准价。

三家放在一起看,策略分化非常清晰:OpenAI 涨价立旗、吃定「最强模型」的溢价;Anthropic 面上持平、暗中用缓存降价抢 Agent 开发者;Meta 则绕开正面战场,用八分之一的价格收割对成本敏感的大批量任务。

多级路由怎么配最省钱

新格局下,按任务难度分级路由比任何时候都更值钱:

  • 轻量预处理(分类、抽取、格式转换):Muse Spark 1.3 是新的性价比之王,$1.25/$4.25 配 1M 上下文几乎无竞争对手;预算敏感的批处理也可以继续用 GPT-5.6 Luna。
  • 中端主力(日常编码、RAG 问答):GPT-5.6 Sol / Terra 仍是均衡之选;如果你的工作流缓存命中率高的,可以直接上 Fable 5.1——缓存读取 $0.25 之后,旗舰的价格未必比中档贵多少。
  • 旗舰攻坚(复杂推理、长周期 Agent):Fable 5.1 与 GPT-6 Astra 同价,但在 Agent 场景下 Fable 5.1 的缓存优势会让实际账单低 30%~45%,可以作为默认旗舰;需要 Astra 独有的 1.05M 超长上下文时再切换。

配合 Prompt Caching 使用效果更佳:把系统提示词、工具定义、长文档等稳定前缀放在请求前部,缓存命中率越高,Fable 5.1 的降价红利就吃得越足。

MuiRouter 已实时跟进

MuiRouter 已上线 Claude Fable 5.1Muse Spark 1.3,价格与官方同步(Fable 5.1 缓存读取 $0.25、Muse Spark 1.3 $1.25/$4.25);GPT-6 Astra 已于昨日先行接入。三者均可在 Playground 直接体验,模型列表与计费价格已实时更新。

在 MuiRouter 的多级路由里,你可以把同一类请求按难度分发给不同档位的模型——在旗舰定价趋同、中档突袭的当下,这依然是把成本压到最低的唯一可控手段。

参考ソース

主要ソースの公開日: 2026年9月2日

次の AI の変化に備える

1つの API Key から始め、ツールや upstream の提供状況が変わってもモデルアクセスを安定させる明確な経路を持てます。

新規登録

コメント