PRICING

清晰透明的
按量计费。

所有价格均为每 1M tokens 的额度价格。1 元 = 1 额度,按实际输入与输出 token 分别计费。

当前已上线 6 个模型可直接调用,其余陆续接入中。

Google

6 个模型

gemini-pro

可调用

1,000,000 context

输入 / 1M$9.13
输出 / 1M$73

官方原价 $1.25 / $10

gemini-flash

可调用

1,000,000 context

输入 / 1M$2.19
输出 / 1M$18.25

官方原价 $0.30 / $2.50

gemini-flash-thinking

可调用

1,000,000 context

输入 / 1M$2.19
输出 / 1M$18.25

官方原价 $0.30 / $2.50

gemini-flash-lite

可调用

1,000,000 context

输入 / 1M$0.73
输出 / 1M$5.84

官方原价 $0.10 / $0.80

gemini-2.5-pro

可调用

1,000,000 context

输入 / 1M$9.13
输出 / 1M$73

官方原价 $1.25 / $10

gemini-2.5-flash

可调用

1,000,000 context

输入 / 1M$2.19
输出 / 1M$18.25

官方原价 $0.30 / $2.50

OpenAI

4 个模型

gpt-4o

即将上线

128,000 context

输入 / 1M$36.50
输出 / 1M$109.50

官方原价 $5 / $15

gpt-4o-mini

即将上线

128,000 context

输入 / 1M$1.10
输出 / 1M$4.38

官方原价 $0.15 / $0.60

o3

即将上线

200,000 context

输入 / 1M$73
输出 / 1M$292

官方原价 $10 / $40

o4-mini

即将上线

200,000 context

输入 / 1M$8.03
输出 / 1M$32.12

官方原价 $1.10 / $4.40

Anthropic

2 个模型

claude-sonnet-4

即将上线

200,000 context

输入 / 1M$21.90
输出 / 1M$109.50

官方原价 $3 / $15

claude-opus-4

即将上线

200,000 context

输入 / 1M$109.50
输出 / 1M$547.50

官方原价 $15 / $75

DeepSeek

2 个模型

deepseek-v3.2

即将上线

128,000 context

输入 / 1M$1.97
输出 / 1M$8.03

官方原价 $0.27 / $1.10

deepseek-r1

即将上线

128,000 context

输入 / 1M$4.02
输出 / 1M$15.99

官方原价 $0.55 / $2.19

xAI

2 个模型

grok-4

即将上线

256,000 context

输入 / 1M$21.90
输出 / 1M$109.50

官方原价 $3 / $15

grok-4-mini

即将上线

128,000 context

输入 / 1M$2.19
输出 / 1M$3.65

官方原价 $0.30 / $0.50

Moonshot

1 个模型

kimi-k2

即将上线

131,072 context

输入 / 1M$4.38
输出 / 1M$18.25

官方原价 $0.60 / $2.50

阿里

2 个模型

qwen3-235b

即将上线

131,072 context

输入 / 1M$5.84
输出 / 1M$17.52

官方原价 $0.80 / $2.40

qwen3-coder

即将上线

131,072 context

输入 / 1M$5.84
输出 / 1M$17.52

官方原价 $0.80 / $2.40

智谱

1 个模型

glm-4.6

即将上线

128,000 context

输入 / 1M$7.30
输出 / 1M$21.90

官方原价 $1 / $3

计费说明

采用额度制:1 元人民币 = 1 额度(页面以 $ 符号显示额度)。最终扣费 = 输入 token × 输入单价 + 输出 token × 输出单价,按每 1M tokens 单价折算。请求采用预扣 + 结算:先按预估扣减,完成后按真实用量多退少补。价格为官方原价换算后的售价,已包含汇率与服务成本。

底层由 new-api 计费:在「运营设置 / 模型倍率」中配置输入倍率、输出(补全)倍率与分组倍率。最终扣费 = 输入 token × 输入单价 × 输入倍率 + 输出 token × 输出单价 × 输出倍率,再应用分组倍率;渠道权重与优先级只影响路由,不参与计费。