MuiRouter
按 token 计费的 AI 模型价格

AI 模型 API 价格

没有订阅套餐,也没有包量限制。这里整理了 OpenAI 和 Gemini 最新公开价格,方便你快速横向比较。

没有订阅

不卖套餐,不收月费,也没有按套餐分层的模型限制。

官方原价

本页展示的是供应商公开参考价,不是 MuiRouter 的加价后价格。

统一单位

所有价格统一按 USD / 1M tokens 展示。

最近同步

2026-09-16

MuiRouter 的实际扣费以控制台中的模型定价配置为准,这个页面只提供公开价格参考。

OpenAI
OpenAI
OpenAI 当前公开的旗舰模型与代码模型 token 定价。
官方来源

gpt-4.1

输入
$2.00
缓存输入
$0.20
输出
$8.00
说明
-

gpt-4o

输入
$2.50
缓存输入
$0.25
输出
$10.00
说明
-

gpt-4o-mini

输入
$0.15
缓存输入
$0.015
输出
$0.60
说明
-

gpt-5

输入
$1.25
缓存输入
$0.125
输出
$10.00
说明
-

gpt-5-mini

输入
$0.25
缓存输入
$0.025
输出
$2.00
说明
-

gpt-5-nano

输入
$0.05
缓存输入
$0.005
输出
$0.40
说明
-

gpt-5.4

输入
$2.50
缓存输入
$0.25
输出
$15.00
说明
超过 272,000 tokens 后启用长上下文档位:输入 $5.00 / 缓存输入 $0.50 / 输出 $22.50。

gpt-5.5

输入
$5.00
缓存输入
$0.50
输出
$30.00
说明
-

gpt-5.6

输入
$4.00
缓存输入
$0.40
输出
$20.00
说明
超过 272,000 tokens 后启用长上下文档位:输入 $8.00 / 缓存输入 $0.80 / 输出 $30.00。

gpt-5.6-luna

输入
$0.20
缓存输入
$0.02
输出
$1.20
说明
超过 272,000 tokens 后启用长上下文档位:输入 $0.40 / 缓存输入 $0.04 / 输出 $1.80。

gpt-5.6-sol

输入
$4.00
缓存输入
$0.40
输出
$20.00
说明
超过 272,000 tokens 后启用长上下文档位:输入 $8.00 / 缓存输入 $0.80 / 输出 $30.00。

gpt-5.6-terra

输入
$2.00
缓存输入
$0.20
输出
$12.00
说明
超过 272,000 tokens 后启用长上下文档位:输入 $4.00 / 缓存输入 $0.40 / 输出 $18.00。

gpt-6-astra

输入
$10.00
缓存输入
$1.00
输出
$50.00
说明
超过 272,000 tokens 后启用长上下文档位:输入 $20.00 / 缓存输入 $2.00 / 输出 $75.00。

gpt-image-2

输入
$8.00
缓存输入
-
输出
$30.00
说明
-
Anthropic
Anthropic
Anthropic Claude 当前公开的旗舰、Sonnet 与 Haiku 系列 token 定价。
官方来源

claude-fable-5

输入
$10.00
缓存输入
$1.00
输出
$50.00
说明
-

claude-fable-5-1

输入
$10.00
缓存输入
$0.25
输出
$50.00
说明
-

claude-fable-5.1

输入
$10.00
缓存输入
$0.25
输出
$50.00
说明
-

claude-haiku-4-5

输入
$1.00
缓存输入
$0.10
输出
$5.00
说明
-

claude-opus-4-6

输入
$5.00
缓存输入
$0.50
输出
$25.00
说明
-

claude-opus-4-7

输入
$5.00
缓存输入
$0.50
输出
$25.00
说明
-

claude-opus-4-8

输入
$5.00
缓存输入
$0.50
输出
$25.00
说明
-

claude-opus-5

输入
$5.00
缓存输入
$0.50
输出
$25.00
说明
-

claude-sonnet-4-6

输入
$3.00
缓存输入
$0.30
输出
$15.00
说明
-

claude-sonnet-5

输入
$3.00
缓存输入
$0.30
输出
$15.00
说明
-
DeepSeek
DeepSeek
DeepSeek 当前公开的 V4/V3/R1 系列 token 定价。
官方来源

deepseek-v4-1-flash

输入
$0.14
缓存输入
$0.003
输出
$0.28
说明
-

deepseek-v4-flash

输入
$0.14
缓存输入
$0.003
输出
$0.28
说明
-

deepseek-v4-flash-vision-exp

输入
$0.22
缓存输入
$0.007
输出
$0.66
说明
-

deepseek-v4-pro

输入
$0.435
缓存输入
$0.004
输出
$0.87
说明
-

deepseek-v4.1-flash

输入
$0.14
缓存输入
$0.003
输出
$0.28
说明
-
Moonshot AI
Moonshot AI
Moonshot AI Kimi K3 当前公开的 token 定价,包含 Prompt 缓存命中价。
官方来源

kimi-k2.7-code

输入
$0.95
缓存输入
$0.19
输出
$4.00
说明
-

kimi-k3

输入
$3.00
缓存输入
$0.30
输出
$15.00
说明
-
xAI Grok
xAI Grok
xAI Grok 当前公开的旗舰与代码导向模型 token 定价。
官方来源

grok-4

输入
$2.00
缓存输入
-
输出
$6.00
说明
-

grok-4.3

输入
$1.25
缓存输入
-
输出
$2.50
说明
-

grok-4.5

输入
$2.00
缓存输入
-
输出
$6.00
说明
-

grok-4.6

输入
$2.00
缓存输入
-
输出
$6.00
说明
-

grok-build-0.1

输入
$1.00
缓存输入
$0.20
输出
$2.00
说明
超过 200,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.40 / 输出 $4.00。

grok-imagine-video

输入
$0.00
缓存输入
-
输出
$1.00
说明
-

grok-imagine-video-1.5

输入
$0.00
缓存输入
-
输出
$1.00
说明
-
Zhipu GLM
Zhipu GLM
智谱 GLM 当前公开的旗舰与 Flash 系列 token 定价。
官方来源

glm-5.1

输入
$1.40
缓存输入
$0.26
输出
$4.40
说明
-

glm-5.2

输入
$1.40
缓存输入
$0.26
输出
$4.40
说明
-

glm-5.3

输入
$1.40
缓存输入
$0.26
输出
$4.40
说明
-

glm-5.3-flash

输入
$0.15
缓存输入
$0.03
输出
$0.50
说明
-
Qwen
Qwen
阿里千问当前公开的 Max/Plus/Qwen3 系列 token 定价。
官方来源

qwen3.6-plus

输入
$0.50
缓存输入
$0.05
输出
$3.00
说明
超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。

qwen3.7-max

输入
$2.50
缓存输入
$0.50
输出
$7.50
说明
-

qwen3.7-plus

输入
$0.40
缓存输入
$0.04
输出
$1.60
说明
超过 256,000 tokens 后启用长上下文档位:输入 $1.20 / 缓存输入 $0.12 / 输出 $4.80。

qwen3.8-max

输入
$2.00
缓存输入
$0.25
输出
$6.00
说明
-
MiniMax
MiniMax
MiniMax 当前公开的 M 系列 token 定价。
官方来源

minimax-m2.5

输入
$0.30
缓存输入
$0.06
输出
$1.20
说明
-

minimax-m2.7

输入
$0.30
缓存输入
$0.06
输出
$1.20
说明
-

minimax-m3

输入
$0.30
缓存输入
$0.06
输出
$1.20
说明
-
Meta
Meta
Meta 及 LongCat/HY 当前公开的模型 token 定价。
官方来源

muse-spark-1.2-contributor

输入
$0.10
缓存输入
$0.002
输出
$0.20
说明
-

muse-spark-1.3

输入
$1.25
缓存输入
$0.15
输出
$4.25
说明
-
LongCat
LongCat
LongCat 当前公开的模型 token 定价。
官方来源

longcat-2.0

输入
$0.30
缓存输入
$0.006
输出
$1.20
说明
-
HY
HY
HY 当前公开的模型 token 定价。
官方来源

hy3

输入
$0.14
缓存输入
$0.035
输出
$0.58
说明
-
Gemini
Gemini
Google Gemini 当前公开的主流文本与多模态模型 token 定价。
官方来源

gemini-2.5-flash

输入
$0.30
缓存输入
$0.075
输出
$2.50
说明
-

gemini-2.5-flash-lite

输入
$0.10
缓存输入
$0.025
输出
$0.40
说明
-

gemini-2.5-pro

输入
$1.25
缓存输入
$0.313
输出
$10.00
说明
超过 200,000 tokens 后启用长上下文档位:输入 $2.50 / 缓存输入 $0.625 / 输出 $15.00。

gemini-3-flash

输入
$0.50
缓存输入
$0.125
输出
$3.00
说明
-

gemini-3.1-flash-lite-preview

输入
$0.25
缓存输入
-
输出
$1.50
说明
-

gemini-3.1-pro-preview

输入
$2.00
缓存输入
$0.20
输出
$12.00
说明
超过 200,000 tokens 后启用长上下文档位:输入 $4.00 / 缓存输入 $0.40 / 输出 $18.00。

gemini-3.5-flash

输入
$1.50
缓存输入
$0.15
输出
$9.00
说明
-

gemini-3.5-flash-lite

输入
$0.30
缓存输入
$0.03
输出
$2.50
说明
-

gemini-3.6-flash

输入
$1.50
缓存输入
$0.15
输出
$7.50
说明
-
Xiaomi MiMo
Xiaomi MiMo
Xiaomi MiMo 当前公开的文本与多模态模型 token 定价(按 ≤256K 档位列示)。
官方来源

mimo-v2-omni

输入
$0.40
缓存输入
$0.04
输出
$2.00
说明
超过 256,000 tokens 后启用长上下文档位:输入 $0.80 / 缓存输入 $0.08 / 输出 $4.00。

mimo-v2-pro

输入
$1.00
缓存输入
$0.10
输出
$3.00
说明
超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。

mimo-v2.5

输入
$0.40
缓存输入
$0.04
输出
$2.00
说明
超过 256,000 tokens 后启用长上下文档位:输入 $0.80 / 缓存输入 $0.08 / 输出 $4.00。

mimo-v2.5-flash

输入
$0.10
缓存输入
$0.01
输出
$0.30
说明
超过 256,000 tokens 后启用长上下文档位:输入 $0.20 / 缓存输入 $0.02 / 输出 $0.60。

mimo-v2.5-pro

输入
$1.00
缓存输入
$0.10
输出
$3.00
说明
超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。
Workers AI
Workers AI
官方来源

glm-4.7-flash

输入
$0.06
缓存输入
-
输出
$0.40
说明
-

kimi-k2.6

输入
$0.95
缓存输入
$0.16
输出
$4.00
说明
-

qwen3-30b

输入
$0.051
缓存输入
-
输出
$0.335
说明
-

补充说明

这里只展示核心文本与多模态 token 价格,不包含音频、图片生成、Live API、Batch、Grounding 和工具调用等额外收费项。

价格于 2026-09-16 手动同步自各供应商官方页面,后续官方如有调整,请以官方最新公布为准。

如果控制台里的模型价格与本页不一致,最终计费以控制台配置为准。