外观
价格说明
本页用于说明本站的计费方式、余额扣减规则,以及影响费用的常见因素,方便你在接入前快速了解成本结构。
计费方式
本站采用 官方模型价格 * 倍率 的方式进行计费。本站显示的 $ 代表积分,$1 约等于 1 元人民币。模型价格请参考下面官方模型价格表中的人民币价格。
为什么价格和官方会略有出入? 官方的价格调整不会实时反映到各云厂商,我们的企业版是和云厂商签的协议,价格以上游云厂商的为准。
本文档仅作为参考,请以系统实际计算为准。
官方模型价格
以下价格均按每 1M tokens 计算。当前已提供 Standard 模式价格;Batch、Flex 和 Fast mode 的价格待补充。
GPT 模型
价格单位:每 1M tokens。
| 模型 | 短上下文 | 长上下文 | ||||||
|---|---|---|---|---|---|---|---|---|
| 输入 | 缓存输入 | 缓存写入 | 输出 | 输入 | 缓存输入 | 缓存写入 | 输出 | |
| gpt-6-astra | $10.00 ¥70 | $1.00 ¥7 | $12.50 ¥87.5 | $50.00 ¥350 | $20.00 ¥140 | $2.00 ¥14 | $25.00 ¥175 | $75.00 ¥525 |
| gpt-6-sol | $2.00 ¥14 | $0.20 ¥1.4 | $2.50 ¥17.5 | $10.00 ¥70 | $4.00 ¥28 | $0.40 ¥2.8 | $5.00 ¥35 | $15.00 ¥105 |
| gpt-6-luna | $0.10 ¥0.7 | $0.01 ¥0.07 | $0.125 ¥0.875 | $0.50 ¥3.5 | $0.20 ¥1.4 | $0.02 ¥0.14 | $0.25 ¥1.75 | $0.75 ¥5.25 |
| gpt-5.6-sol | $4.00 ¥28 | $0.40 ¥2.8 | $5.00 ¥35 | $20.00 ¥140 | $8.00 ¥56 | $0.80 ¥5.6 | $10.00 ¥70 | $30.00 ¥210 |
| gpt-5.6-terra | $2.00 ¥14 | $0.20 ¥1.4 | $2.50 ¥17.5 | $12.00 ¥84 | $4.00 ¥28 | $0.40 ¥2.8 | $5.00 ¥35 | $18.00 ¥126 |
| gpt-5.6-luna | $0.20 ¥1.4 | $0.02 ¥0.14 | $0.25 ¥1.75 | $1.20 ¥8.4 | $0.40 ¥2.8 | $0.04 ¥0.28 | $0.50 ¥3.5 | $1.80 ¥12.6 |
| gpt-5.5 | $5.00 ¥35 | $0.50 ¥3.5 | - | $30.00 ¥210 | $10.00 ¥70 | $1.00 ¥7 | - | $45.00 ¥315 |
| $2.50 ¥17.5 | $0.25 ¥1.75 | - | $15.00 ¥105 | $5.00 ¥35 | $0.50 ¥3.5 | - | $22.50 ¥157.5 | |
| $0.75 ¥5.25 | $0.075 ¥0.525 | - | $4.50 ¥31.5 | $0.75 ¥5.25 | $0.075 ¥0.525 | - | $4.50 ¥31.5 | |
| $0.20 ¥1.4 | $0.02 ¥0.14 | - | $1.25 ¥8.75 | $0.20 ¥1.4 | $0.02 ¥0.14 | - | $1.25 ¥8.75 | |
GPT 图片模型
价格单位:每 1M tokens。
| 模型 | 输入文本 | 缓存输入文本 | 输入图片 | 缓存输入图片 | 输出文本 | 输出图片 |
|---|---|---|---|---|---|---|
| gpt-image-2 | $5.00 ¥35 | $1.25 ¥8.75 | $8.00 ¥56 | $2.00 ¥14 | N/A | $30.00 ¥210 |
DeepSeek 模型
价格单位:每 1M tokens。
本站暂时不区分高峰时段和空闲时段,价格约为 deepseek v4 flash 闲时价格,所以在高峰时段使用是非常有性价比的。
| 模型 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| DeepSeek-V4-Flash-0731 | $0.19 ¥1.33 | $0.51 ¥3.57 | $0.028 ¥0.196 |
Grok 模型
价格单位:每 1M tokens。Grok-4.6 可能不支持长上下文,需自己验证;Grok-4-1-fast-non-reasoning 不支持长上下文。
| 模型 | 短上下文 | 长上下文 | ||||||
|---|---|---|---|---|---|---|---|---|
| 输入 | 缓存输入 | 缓存写入 | 输出 | 输入 | 缓存输入 | 缓存写入 | 输出 | |
| grok-4.6 | $2.00 ¥14 | $0.50 ¥3.5 | - | $6.00 ¥42 | $4.00 ¥28 | $1.00 ¥7 | - | $12.00 ¥84 |
| grok-4-1-fast-non-reasoning | $0.20 ¥1.4 | $0.05 ¥0.35 | - | $0.50 ¥3.5 | - | - | - | - |
Claude 模型
价格单位:每 1M tokens。
| 模型 | 输入 | 5 分钟缓存写入 | 1 小时缓存写入 | 缓存命中与刷新 | 输出 |
|---|---|---|---|---|---|
| claude-fable-5-1 | $10.00 ¥70 | $12.50 ¥87.5 | $20.00 ¥140 | $0.25 ¥1.75 | $50.00 ¥350 |
| claude-fable-5 | $10.00 ¥70 | $12.50 ¥87.5 | $20.00 ¥140 | $1.00 ¥7 | $50.00 ¥350 |
| claude-opus-5 | $5.00 ¥35 | $6.25 ¥43.75 | $10.00 ¥70 | $0.50 ¥3.5 | $25.00 ¥175 |
| claude-opus-5.5 | $4.00 ¥28 | $5.00 ¥35 | $8.00 ¥56 | $0.20 ¥1.4 | $20.00 ¥140 |
| claude-sonnet-5 | $2.00 ¥14 | $2.50 ¥17.5 | $4.00 ¥28 | $0.20 ¥1.4 | $10.00 ¥70 |
| claude-haiku-4-5 | $1.00 ¥7 | $1.25 ¥8.75 | $2.00 ¥14 | $0.10 ¥0.7 | $5.00 ¥35 |
Kimi 模型
价格单位:每 1M tokens。
| 模型 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| kimi-k2.7-code | $0.95 ¥6.65 | $4.00 ¥28 | $0.19 ¥1.33 |
Gemini 模型
价格单位:每 1M tokens。
文本模型
| 模型 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| gemini-3.8-flash | $0.75 ¥5.25 | $3.75 ¥26.25 | $0.075 ¥0.525 |
| gemini-3.5-flash | $1.50 ¥10.5 | $9 ¥63 | $0.15 ¥1.05 |
| gemini-3.5-flash-lite | $0.30 ¥2.1 | $2.50 ¥17.5 | $0.03 ¥0.21 |
| gemini-3.1-flash-lite | $0.25 ¥1.75 | $1.50 ¥10.5 | $0.025 ¥0.175 |
图片生成
| 模型 | 图片输入 | 文本输出 | 图片输出 |
|---|---|---|---|
| gemini-3.1-flash-image | $0.50 ¥3.5 | $3 ¥21 | $60 ¥420 |
| gemini-3.1-flash-lite-image | $0.25 ¥1.75 | $1.50 ¥10.5 | $30 ¥210 |
联网搜索
- 服务端搜索 支持 tanvily 搜索和页面抓取。在聊天对话框左侧侧边栏设置中启用服务端搜索即可使用。
平台统一计费:¥0.06 / 次。
- 客户端搜索 支持用户配置自己的搜索服务和抓取服务,从用户配置的服务中扣费而不是本平台。在聊天对话框里的设置中配置客户端搜索并启用。
1M Tokens 有多少?
1M Tokens = 100万 Tokens,实际使用时,消耗速度与使用方法之间的关系很大。普通的对话消耗比较慢,编写代码以及 Agent 任务会快速消耗 Token。
什么会影响费用
以下情况通常会让费用上升:
- 使用更高价位的模型,例如更强大的旗舰模型
- 上下文更长,输入 Token 更多
- 回复内容更长,输出 Token 更多
- 同一个话题,每个问题开一个对话(导致无法命中缓存)
怎样节省费用?
根据使用频率以及质量要求来确定使用什么模型:
- 长对话 / 稳定项目(质量要求高),使用高价位模型,例如 gpt-6-astra、claude-opus-5.5、claude-fable-5-1 等。
- 短对话 / 快速迭代项目,使用中等价位模型,例如 gpt-6-sol、claude-sonnet-5 等。
- 大量的、轻量级的 agent 任务,可以使用 gpt-6-luna、claude-haiku-4-5。
为什么有很多分组,怎么选择?
本站为了同时兼顾可用性与价格,根据不同的需求,做了分组,方便用户选择。
企业版:由超大型云厂商提供服务,可用性、稳定性、数据安全有保障,建议企业用户优先选择。
个人版:由官方订阅账号提供服务,价格便宜,超载时可能临时不可用、数据安全遵循官方的隐私政策。
体验版:由官方订阅账号提供服务,资源紧张时,可能使用第三方来源的模型。
除了基本功能所需,本站不会截留或存储用户的任何数据。对数据安全要求高的用户,不要使用体验版。在线聊天窗口中的对话记录会保存,需用户手动删除。
余额扣减规则
当请求完成后,系统会根据本次请求的实际 Token 消耗实时扣减余额。
为什么同样的请求费用不同?
不同模型的单价不同;另外,输入上下文长度、输出长度、缓存命中率等都会影响最终计费。
费用明细在哪里看?
请前往控制台查看 使用记录,即可查看每次请求的统计详情。