AI 模型 API 价格
没有订阅套餐,也没有包量限制。这里整理了 OpenAI 和 Gemini 最新公开价格,方便你快速横向比较。
没有订阅
不卖套餐,不收月费,也没有按套餐分层的模型限制。
官方原价
本页展示的是供应商公开参考价,不是 MuiRouter 的加价后价格。
统一单位
所有价格统一按 USD / 1M tokens 展示。
最近同步
2026-09-16
MuiRouter 的实际扣费以控制台中的模型定价配置为准,这个页面只提供公开价格参考。
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| gpt-4.1 | $2.00 | $0.20 | $8.00 | - |
| gpt-4o | $2.50 | $0.25 | $10.00 | - |
| gpt-4o-mini | $0.15 | $0.015 | $0.60 | - |
| gpt-5 | $1.25 | $0.125 | $10.00 | - |
| gpt-5-mini | $0.25 | $0.025 | $2.00 | - |
| gpt-5-nano | $0.05 | $0.005 | $0.40 | - |
| gpt-5.4 | $2.50 | $0.25 | $15.00 | 超过 272,000 tokens 后启用长上下文档位:输入 $5.00 / 缓存输入 $0.50 / 输出 $22.50。 |
| gpt-5.5 | $5.00 | $0.50 | $30.00 | - |
| gpt-5.6 | $4.00 | $0.40 | $20.00 | 超过 272,000 tokens 后启用长上下文档位:输入 $8.00 / 缓存输入 $0.80 / 输出 $30.00。 |
| gpt-5.6-luna | $0.20 | $0.02 | $1.20 | 超过 272,000 tokens 后启用长上下文档位:输入 $0.40 / 缓存输入 $0.04 / 输出 $1.80。 |
| gpt-5.6-sol | $4.00 | $0.40 | $20.00 | 超过 272,000 tokens 后启用长上下文档位:输入 $8.00 / 缓存输入 $0.80 / 输出 $30.00。 |
| gpt-5.6-terra | $2.00 | $0.20 | $12.00 | 超过 272,000 tokens 后启用长上下文档位:输入 $4.00 / 缓存输入 $0.40 / 输出 $18.00。 |
| gpt-6-astra | $10.00 | $1.00 | $50.00 | 超过 272,000 tokens 后启用长上下文档位:输入 $20.00 / 缓存输入 $2.00 / 输出 $75.00。 |
| gpt-image-2 | $8.00 | - | $30.00 | - |
gpt-4.1
- 输入
- $2.00
- 缓存输入
- $0.20
- 输出
- $8.00
- 说明
- -
gpt-4o
- 输入
- $2.50
- 缓存输入
- $0.25
- 输出
- $10.00
- 说明
- -
gpt-4o-mini
- 输入
- $0.15
- 缓存输入
- $0.015
- 输出
- $0.60
- 说明
- -
gpt-5
- 输入
- $1.25
- 缓存输入
- $0.125
- 输出
- $10.00
- 说明
- -
gpt-5-mini
- 输入
- $0.25
- 缓存输入
- $0.025
- 输出
- $2.00
- 说明
- -
gpt-5-nano
- 输入
- $0.05
- 缓存输入
- $0.005
- 输出
- $0.40
- 说明
- -
gpt-5.4
- 输入
- $2.50
- 缓存输入
- $0.25
- 输出
- $15.00
- 说明
- 超过 272,000 tokens 后启用长上下文档位:输入 $5.00 / 缓存输入 $0.50 / 输出 $22.50。
gpt-5.5
- 输入
- $5.00
- 缓存输入
- $0.50
- 输出
- $30.00
- 说明
- -
gpt-5.6
- 输入
- $4.00
- 缓存输入
- $0.40
- 输出
- $20.00
- 说明
- 超过 272,000 tokens 后启用长上下文档位:输入 $8.00 / 缓存输入 $0.80 / 输出 $30.00。
gpt-5.6-luna
- 输入
- $0.20
- 缓存输入
- $0.02
- 输出
- $1.20
- 说明
- 超过 272,000 tokens 后启用长上下文档位:输入 $0.40 / 缓存输入 $0.04 / 输出 $1.80。
gpt-5.6-sol
- 输入
- $4.00
- 缓存输入
- $0.40
- 输出
- $20.00
- 说明
- 超过 272,000 tokens 后启用长上下文档位:输入 $8.00 / 缓存输入 $0.80 / 输出 $30.00。
gpt-5.6-terra
- 输入
- $2.00
- 缓存输入
- $0.20
- 输出
- $12.00
- 说明
- 超过 272,000 tokens 后启用长上下文档位:输入 $4.00 / 缓存输入 $0.40 / 输出 $18.00。
gpt-6-astra
- 输入
- $10.00
- 缓存输入
- $1.00
- 输出
- $50.00
- 说明
- 超过 272,000 tokens 后启用长上下文档位:输入 $20.00 / 缓存输入 $2.00 / 输出 $75.00。
gpt-image-2
- 输入
- $8.00
- 缓存输入
- -
- 输出
- $30.00
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| claude-fable-5 | $10.00 | $1.00 | $50.00 | - |
| claude-fable-5-1 | $10.00 | $0.25 | $50.00 | - |
| claude-fable-5.1 | $10.00 | $0.25 | $50.00 | - |
| claude-haiku-4-5 | $1.00 | $0.10 | $5.00 | - |
| claude-opus-4-6 | $5.00 | $0.50 | $25.00 | - |
| claude-opus-4-7 | $5.00 | $0.50 | $25.00 | - |
| claude-opus-4-8 | $5.00 | $0.50 | $25.00 | - |
| claude-opus-5 | $5.00 | $0.50 | $25.00 | - |
| claude-sonnet-4-6 | $3.00 | $0.30 | $15.00 | - |
| claude-sonnet-5 | $3.00 | $0.30 | $15.00 | - |
claude-fable-5
- 输入
- $10.00
- 缓存输入
- $1.00
- 输出
- $50.00
- 说明
- -
claude-fable-5-1
- 输入
- $10.00
- 缓存输入
- $0.25
- 输出
- $50.00
- 说明
- -
claude-fable-5.1
- 输入
- $10.00
- 缓存输入
- $0.25
- 输出
- $50.00
- 说明
- -
claude-haiku-4-5
- 输入
- $1.00
- 缓存输入
- $0.10
- 输出
- $5.00
- 说明
- -
claude-opus-4-6
- 输入
- $5.00
- 缓存输入
- $0.50
- 输出
- $25.00
- 说明
- -
claude-opus-4-7
- 输入
- $5.00
- 缓存输入
- $0.50
- 输出
- $25.00
- 说明
- -
claude-opus-4-8
- 输入
- $5.00
- 缓存输入
- $0.50
- 输出
- $25.00
- 说明
- -
claude-opus-5
- 输入
- $5.00
- 缓存输入
- $0.50
- 输出
- $25.00
- 说明
- -
claude-sonnet-4-6
- 输入
- $3.00
- 缓存输入
- $0.30
- 输出
- $15.00
- 说明
- -
claude-sonnet-5
- 输入
- $3.00
- 缓存输入
- $0.30
- 输出
- $15.00
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| deepseek-v4-1-flash | $0.14 | $0.003 | $0.28 | - |
| deepseek-v4-flash | $0.14 | $0.003 | $0.28 | - |
| deepseek-v4-flash-vision-exp | $0.22 | $0.007 | $0.66 | - |
| deepseek-v4-pro | $0.435 | $0.004 | $0.87 | - |
| deepseek-v4.1-flash | $0.14 | $0.003 | $0.28 | - |
deepseek-v4-1-flash
- 输入
- $0.14
- 缓存输入
- $0.003
- 输出
- $0.28
- 说明
- -
deepseek-v4-flash
- 输入
- $0.14
- 缓存输入
- $0.003
- 输出
- $0.28
- 说明
- -
deepseek-v4-flash-vision-exp
- 输入
- $0.22
- 缓存输入
- $0.007
- 输出
- $0.66
- 说明
- -
deepseek-v4-pro
- 输入
- $0.435
- 缓存输入
- $0.004
- 输出
- $0.87
- 说明
- -
deepseek-v4.1-flash
- 输入
- $0.14
- 缓存输入
- $0.003
- 输出
- $0.28
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| kimi-k2.7-code | $0.95 | $0.19 | $4.00 | - |
| kimi-k3 | $3.00 | $0.30 | $15.00 | - |
kimi-k2.7-code
- 输入
- $0.95
- 缓存输入
- $0.19
- 输出
- $4.00
- 说明
- -
kimi-k3
- 输入
- $3.00
- 缓存输入
- $0.30
- 输出
- $15.00
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| grok-4 | $2.00 | - | $6.00 | - |
| grok-4.3 | $1.25 | - | $2.50 | - |
| grok-4.5 | $2.00 | - | $6.00 | - |
| grok-4.6 | $2.00 | - | $6.00 | - |
| grok-build-0.1 | $1.00 | $0.20 | $2.00 | 超过 200,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.40 / 输出 $4.00。 |
| grok-imagine-video | $0.00 | - | $1.00 | - |
| grok-imagine-video-1.5 | $0.00 | - | $1.00 | - |
grok-4
- 输入
- $2.00
- 缓存输入
- -
- 输出
- $6.00
- 说明
- -
grok-4.3
- 输入
- $1.25
- 缓存输入
- -
- 输出
- $2.50
- 说明
- -
grok-4.5
- 输入
- $2.00
- 缓存输入
- -
- 输出
- $6.00
- 说明
- -
grok-4.6
- 输入
- $2.00
- 缓存输入
- -
- 输出
- $6.00
- 说明
- -
grok-build-0.1
- 输入
- $1.00
- 缓存输入
- $0.20
- 输出
- $2.00
- 说明
- 超过 200,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.40 / 输出 $4.00。
grok-imagine-video
- 输入
- $0.00
- 缓存输入
- -
- 输出
- $1.00
- 说明
- -
grok-imagine-video-1.5
- 输入
- $0.00
- 缓存输入
- -
- 输出
- $1.00
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| glm-5.1 | $1.40 | $0.26 | $4.40 | - |
| glm-5.2 | $1.40 | $0.26 | $4.40 | - |
| glm-5.3 | $1.40 | $0.26 | $4.40 | - |
| glm-5.3-flash | $0.15 | $0.03 | $0.50 | - |
glm-5.1
- 输入
- $1.40
- 缓存输入
- $0.26
- 输出
- $4.40
- 说明
- -
glm-5.2
- 输入
- $1.40
- 缓存输入
- $0.26
- 输出
- $4.40
- 说明
- -
glm-5.3
- 输入
- $1.40
- 缓存输入
- $0.26
- 输出
- $4.40
- 说明
- -
glm-5.3-flash
- 输入
- $0.15
- 缓存输入
- $0.03
- 输出
- $0.50
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| qwen3.6-plus | $0.50 | $0.05 | $3.00 | 超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。 |
| qwen3.7-max | $2.50 | $0.50 | $7.50 | - |
| qwen3.7-plus | $0.40 | $0.04 | $1.60 | 超过 256,000 tokens 后启用长上下文档位:输入 $1.20 / 缓存输入 $0.12 / 输出 $4.80。 |
| qwen3.8-max | $2.00 | $0.25 | $6.00 | - |
qwen3.6-plus
- 输入
- $0.50
- 缓存输入
- $0.05
- 输出
- $3.00
- 说明
- 超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。
qwen3.7-max
- 输入
- $2.50
- 缓存输入
- $0.50
- 输出
- $7.50
- 说明
- -
qwen3.7-plus
- 输入
- $0.40
- 缓存输入
- $0.04
- 输出
- $1.60
- 说明
- 超过 256,000 tokens 后启用长上下文档位:输入 $1.20 / 缓存输入 $0.12 / 输出 $4.80。
qwen3.8-max
- 输入
- $2.00
- 缓存输入
- $0.25
- 输出
- $6.00
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| minimax-m2.5 | $0.30 | $0.06 | $1.20 | - |
| minimax-m2.7 | $0.30 | $0.06 | $1.20 | - |
| minimax-m3 | $0.30 | $0.06 | $1.20 | - |
minimax-m2.5
- 输入
- $0.30
- 缓存输入
- $0.06
- 输出
- $1.20
- 说明
- -
minimax-m2.7
- 输入
- $0.30
- 缓存输入
- $0.06
- 输出
- $1.20
- 说明
- -
minimax-m3
- 输入
- $0.30
- 缓存输入
- $0.06
- 输出
- $1.20
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| muse-spark-1.2-contributor | $0.10 | $0.002 | $0.20 | - |
| muse-spark-1.3 | $1.25 | $0.15 | $4.25 | - |
muse-spark-1.2-contributor
- 输入
- $0.10
- 缓存输入
- $0.002
- 输出
- $0.20
- 说明
- -
muse-spark-1.3
- 输入
- $1.25
- 缓存输入
- $0.15
- 输出
- $4.25
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| longcat-2.0 | $0.30 | $0.006 | $1.20 | - |
longcat-2.0
- 输入
- $0.30
- 缓存输入
- $0.006
- 输出
- $1.20
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| hy3 | $0.14 | $0.035 | $0.58 | - |
hy3
- 输入
- $0.14
- 缓存输入
- $0.035
- 输出
- $0.58
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| gemini-2.5-flash | $0.30 | $0.075 | $2.50 | - |
| gemini-2.5-flash-lite | $0.10 | $0.025 | $0.40 | - |
| gemini-2.5-pro | $1.25 | $0.313 | $10.00 | 超过 200,000 tokens 后启用长上下文档位:输入 $2.50 / 缓存输入 $0.625 / 输出 $15.00。 |
| gemini-3-flash | $0.50 | $0.125 | $3.00 | - |
| gemini-3.1-flash-lite-preview | $0.25 | - | $1.50 | - |
| gemini-3.1-pro-preview | $2.00 | $0.20 | $12.00 | 超过 200,000 tokens 后启用长上下文档位:输入 $4.00 / 缓存输入 $0.40 / 输出 $18.00。 |
| gemini-3.5-flash | $1.50 | $0.15 | $9.00 | - |
| gemini-3.5-flash-lite | $0.30 | $0.03 | $2.50 | - |
| gemini-3.6-flash | $1.50 | $0.15 | $7.50 | - |
gemini-2.5-flash
- 输入
- $0.30
- 缓存输入
- $0.075
- 输出
- $2.50
- 说明
- -
gemini-2.5-flash-lite
- 输入
- $0.10
- 缓存输入
- $0.025
- 输出
- $0.40
- 说明
- -
gemini-2.5-pro
- 输入
- $1.25
- 缓存输入
- $0.313
- 输出
- $10.00
- 说明
- 超过 200,000 tokens 后启用长上下文档位:输入 $2.50 / 缓存输入 $0.625 / 输出 $15.00。
gemini-3-flash
- 输入
- $0.50
- 缓存输入
- $0.125
- 输出
- $3.00
- 说明
- -
gemini-3.1-flash-lite-preview
- 输入
- $0.25
- 缓存输入
- -
- 输出
- $1.50
- 说明
- -
gemini-3.1-pro-preview
- 输入
- $2.00
- 缓存输入
- $0.20
- 输出
- $12.00
- 说明
- 超过 200,000 tokens 后启用长上下文档位:输入 $4.00 / 缓存输入 $0.40 / 输出 $18.00。
gemini-3.5-flash
- 输入
- $1.50
- 缓存输入
- $0.15
- 输出
- $9.00
- 说明
- -
gemini-3.5-flash-lite
- 输入
- $0.30
- 缓存输入
- $0.03
- 输出
- $2.50
- 说明
- -
gemini-3.6-flash
- 输入
- $1.50
- 缓存输入
- $0.15
- 输出
- $7.50
- 说明
- -
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| mimo-v2-omni | $0.40 | $0.04 | $2.00 | 超过 256,000 tokens 后启用长上下文档位:输入 $0.80 / 缓存输入 $0.08 / 输出 $4.00。 |
| mimo-v2-pro | $1.00 | $0.10 | $3.00 | 超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。 |
| mimo-v2.5 | $0.40 | $0.04 | $2.00 | 超过 256,000 tokens 后启用长上下文档位:输入 $0.80 / 缓存输入 $0.08 / 输出 $4.00。 |
| mimo-v2.5-flash | $0.10 | $0.01 | $0.30 | 超过 256,000 tokens 后启用长上下文档位:输入 $0.20 / 缓存输入 $0.02 / 输出 $0.60。 |
| mimo-v2.5-pro | $1.00 | $0.10 | $3.00 | 超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。 |
mimo-v2-omni
- 输入
- $0.40
- 缓存输入
- $0.04
- 输出
- $2.00
- 说明
- 超过 256,000 tokens 后启用长上下文档位:输入 $0.80 / 缓存输入 $0.08 / 输出 $4.00。
mimo-v2-pro
- 输入
- $1.00
- 缓存输入
- $0.10
- 输出
- $3.00
- 说明
- 超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。
mimo-v2.5
- 输入
- $0.40
- 缓存输入
- $0.04
- 输出
- $2.00
- 说明
- 超过 256,000 tokens 后启用长上下文档位:输入 $0.80 / 缓存输入 $0.08 / 输出 $4.00。
mimo-v2.5-flash
- 输入
- $0.10
- 缓存输入
- $0.01
- 输出
- $0.30
- 说明
- 超过 256,000 tokens 后启用长上下文档位:输入 $0.20 / 缓存输入 $0.02 / 输出 $0.60。
mimo-v2.5-pro
- 输入
- $1.00
- 缓存输入
- $0.10
- 输出
- $3.00
- 说明
- 超过 256,000 tokens 后启用长上下文档位:输入 $2.00 / 缓存输入 $0.20 / 输出 $6.00。
| 模型 ID | 输入 | 缓存输入 | 输出 | 说明 |
|---|---|---|---|---|
| glm-4.7-flash | $0.06 | - | $0.40 | - |
| kimi-k2.6 | $0.95 | $0.16 | $4.00 | - |
| qwen3-30b | $0.051 | - | $0.335 | - |
glm-4.7-flash
- 输入
- $0.06
- 缓存输入
- -
- 输出
- $0.40
- 说明
- -
kimi-k2.6
- 输入
- $0.95
- 缓存输入
- $0.16
- 输出
- $4.00
- 说明
- -
qwen3-30b
- 输入
- $0.051
- 缓存输入
- -
- 输出
- $0.335
- 说明
- -
补充说明
这里只展示核心文本与多模态 token 价格,不包含音频、图片生成、Live API、Batch、Grounding 和工具调用等额外收费项。
价格于 2026-09-16 手动同步自各供应商官方页面,后续官方如有调整,请以官方最新公布为准。
如果控制台里的模型价格与本页不一致,最终计费以控制台配置为准。