跳到正文

价格说明

本页用于说明本站的计费方式、余额扣减规则,以及影响费用的常见因素,方便你在接入前快速了解成本结构。

计费方式

本站采用 官方模型价格 * 倍率 的方式进行计费。本站显示的 $ 代表积分,$1 约等于 1 元人民币。模型价格请参考下面官方模型价格表中的人民币价格。

为什么价格和官方会略有出入? 官方的价格调整不会实时反映到各云厂商,我们的企业版是和云厂商签的协议,价格以上游云厂商的为准。

本文档仅作为参考,请以系统实际计算为准。

官方模型价格

以下价格均按每 1M tokens 计算。当前已提供 Standard 模式价格;Batch、Flex 和 Fast mode 的价格待补充。

GPT 模型

价格单位:每 1M tokens。

模型短上下文长上下文
输入缓存输入缓存写入输出输入缓存输入缓存写入输出
gpt-6-astra$10.00
¥70
$1.00
¥7
$12.50
¥87.5
$50.00
¥350
$20.00
¥140
$2.00
¥14
$25.00
¥175
$75.00
¥525
gpt-6-sol$2.00
¥14
$0.20
¥1.4
$2.50
¥17.5
$10.00
¥70
$4.00
¥28
$0.40
¥2.8
$5.00
¥35
$15.00
¥105
gpt-6-luna$0.10
¥0.7
$0.01
¥0.07
$0.125
¥0.875
$0.50
¥3.5
$0.20
¥1.4
$0.02
¥0.14
$0.25
¥1.75
$0.75
¥5.25
gpt-5.6-sol$4.00
¥28
$0.40
¥2.8
$5.00
¥35
$20.00
¥140
$8.00
¥56
$0.80
¥5.6
$10.00
¥70
$30.00
¥210
gpt-5.6-terra$2.00
¥14
$0.20
¥1.4
$2.50
¥17.5
$12.00
¥84
$4.00
¥28
$0.40
¥2.8
$5.00
¥35
$18.00
¥126
gpt-5.6-luna$0.20
¥1.4
$0.02
¥0.14
$0.25
¥1.75
$1.20
¥8.4
$0.40
¥2.8
$0.04
¥0.28
$0.50
¥3.5
$1.80
¥12.6
gpt-5.5$5.00
¥35
$0.50
¥3.5
-$30.00
¥210
$10.00
¥70
$1.00
¥7
-$45.00
¥315
gpt-5.4$2.50
¥17.5
$0.25
¥1.75
-$15.00
¥105
$5.00
¥35
$0.50
¥3.5
-$22.50
¥157.5
gpt-5.4-mini$0.75
¥5.25
$0.075
¥0.525
-$4.50
¥31.5
$0.75
¥5.25
$0.075
¥0.525
-$4.50
¥31.5
gpt-5.4-nano$0.20
¥1.4
$0.02
¥0.14
-$1.25
¥8.75
$0.20
¥1.4
$0.02
¥0.14
-$1.25
¥8.75

GPT 图片模型

价格单位:每 1M tokens。

模型输入文本缓存输入文本输入图片缓存输入图片输出文本输出图片
gpt-image-2$5.00
¥35
$1.25
¥8.75
$8.00
¥56
$2.00
¥14
N/A$30.00
¥210

DeepSeek 模型

价格单位:每 1M tokens。

本站暂时不区分高峰时段和空闲时段,价格约为 deepseek v4 flash 闲时价格,所以在高峰时段使用是非常有性价比的。

模型输入输出缓存读取
DeepSeek-V4-Flash-0731$0.19
¥1.33
$0.51
¥3.57
$0.028
¥0.196

Grok 模型

价格单位:每 1M tokens。Grok-4.6 可能不支持长上下文,需自己验证;Grok-4-1-fast-non-reasoning 不支持长上下文。

模型短上下文长上下文
输入缓存输入缓存写入输出输入缓存输入缓存写入输出
grok-4.6$2.00
¥14
$0.50
¥3.5
-$6.00
¥42
$4.00
¥28
$1.00
¥7
-$12.00
¥84
grok-4-1-fast-non-reasoning$0.20
¥1.4
$0.05
¥0.35
-$0.50
¥3.5
----

Claude 模型

价格单位:每 1M tokens。

模型输入5 分钟缓存写入1 小时缓存写入缓存命中与刷新输出
claude-fable-5-1$10.00
¥70
$12.50
¥87.5
$20.00
¥140
$0.25
¥1.75
$50.00
¥350
claude-fable-5$10.00
¥70
$12.50
¥87.5
$20.00
¥140
$1.00
¥7
$50.00
¥350
claude-opus-5$5.00
¥35
$6.25
¥43.75
$10.00
¥70
$0.50
¥3.5
$25.00
¥175
claude-opus-5.5$4.00
¥28
$5.00
¥35
$8.00
¥56
$0.20
¥1.4
$20.00
¥140
claude-sonnet-5$2.00
¥14
$2.50
¥17.5
$4.00
¥28
$0.20
¥1.4
$10.00
¥70
claude-haiku-4-5$1.00
¥7
$1.25
¥8.75
$2.00
¥14
$0.10
¥0.7
$5.00
¥35

Kimi 模型

价格单位:每 1M tokens。

模型输入输出缓存读取
kimi-k2.7-code$0.95
¥6.65
$4.00
¥28
$0.19
¥1.33

Gemini 模型

价格单位:每 1M tokens。

文本模型

模型输入输出缓存读取
gemini-3.8-flash$0.75
¥5.25
$3.75
¥26.25
$0.075
¥0.525
gemini-3.5-flash$1.50
¥10.5
$9
¥63
$0.15
¥1.05
gemini-3.5-flash-lite$0.30
¥2.1
$2.50
¥17.5
$0.03
¥0.21
gemini-3.1-flash-lite$0.25
¥1.75
$1.50
¥10.5
$0.025
¥0.175

图片生成

模型图片输入文本输出图片输出
gemini-3.1-flash-image$0.50
¥3.5
$3
¥21
$60
¥420
gemini-3.1-flash-lite-image$0.25
¥1.75
$1.50
¥10.5
$30
¥210

联网搜索

  1. 服务端搜索 支持 tanvily 搜索和页面抓取。在聊天对话框左侧侧边栏设置中启用服务端搜索即可使用。

平台统一计费:¥0.06 / 次。

  1. 客户端搜索 支持用户配置自己的搜索服务和抓取服务,从用户配置的服务中扣费而不是本平台。在聊天对话框里的设置中配置客户端搜索并启用。

1M Tokens 有多少?

1M Tokens = 100万 Tokens,实际使用时,消耗速度与使用方法之间的关系很大。普通的对话消耗比较慢,编写代码以及 Agent 任务会快速消耗 Token。

什么会影响费用

以下情况通常会让费用上升:

  • 使用更高价位的模型,例如更强大的旗舰模型
  • 上下文更长,输入 Token 更多
  • 回复内容更长,输出 Token 更多
  • 同一个话题,每个问题开一个对话(导致无法命中缓存)

怎样节省费用?

根据使用频率以及质量要求来确定使用什么模型:

  1. 长对话 / 稳定项目(质量要求高),使用高价位模型,例如 gpt-6-astra、claude-opus-5.5、claude-fable-5-1 等。
  2. 短对话 / 快速迭代项目,使用中等价位模型,例如 gpt-6-sol、claude-sonnet-5 等。
  3. 大量的、轻量级的 agent 任务,可以使用 gpt-6-luna、claude-haiku-4-5。

为什么有很多分组,怎么选择?

本站为了同时兼顾可用性与价格,根据不同的需求,做了分组,方便用户选择。

  • 企业版:由超大型云厂商提供服务,可用性、稳定性、数据安全有保障,建议企业用户优先选择。

  • 个人版:由官方订阅账号提供服务,价格便宜,超载时可能临时不可用、数据安全遵循官方的隐私政策。

  • 体验版:由官方订阅账号提供服务,资源紧张时,可能使用第三方来源的模型。

除了基本功能所需,本站不会截留或存储用户的任何数据。对数据安全要求高的用户,不要使用体验版。在线聊天窗口中的对话记录会保存,需用户手动删除。

余额扣减规则

当请求完成后,系统会根据本次请求的实际 Token 消耗实时扣减余额。

为什么同样的请求费用不同?

不同模型的单价不同;另外,输入上下文长度、输出长度、缓存命中率等都会影响最终计费。

费用明细在哪里看?

请前往控制台查看 使用记录,即可查看每次请求的统计详情。