计费说明
按实际调用量扣费。文本按 Token,图片按张,视频按秒或按 Token。
余额以 $(美元) 显示与扣费,充值 ¥1 = $1:充 ¥100 到账 $100,无需按汇率换汇。
文本模型:按 Token
一条请求通常包含四类用量:
- 输入 Token:提示词、系统指令、历史对话、工具定义;
- 输出 Token:模型生成的文本与推理内容;
- 缓存写入:把可复用前缀写入 Prompt Cache;
- 缓存读取:命中缓存时读取的 Token,单价远低于输入。
请求费用 = 输入 Token × 输入单价
+ 输出 Token × 输出单价
+ 缓存写入 × 写入单价
+ 缓存读取 × 读取单价
并非所有模型都支持缓存,也并非每次响应都同时返回四类用量。最终以控制台「用量日志」为准。
图片:按张
- 单价随尺寸档位变化,逐张计费(不按最大尺寸一刀切);
- 多图参考时第一张免费,第二张起按张计费;
- 部分模型的图层拆分单独计价,单价为普通生成的一半。
视频:按秒或按 Token
- 按秒:按成功生成视频的秒数与分辨率计价;
- 按 Token:用量取上游返回的
usage.total_tokens,单价随输出分辨率、是否含参考视频变化; - 只有成功的任务计费,失败或超时未进入终态的任务退还预扣金额;
- 异步任务为「先预扣、后结算,差额只退不补」。
充值方式
| 方式 | 说明 |
|---|---|
| USDT(TRC20 / BEP20) | 在控制台「钱包」选择金额与链,按提示转账 |
| 支付宝 / 微信 | 扫码支付,到账后余额即时更新 |
| 注册赠送 | 新用户注册即送 $10 体验金 |
查看用量
控制台「用量日志」可按时间核对:模型、Key、输入/输出/缓存用量、单次费用与汇总、HTTP 状态与耗时。
省钱建议
- 按任务选模型:分类、摘要、格式化不必用最贵的模型;
- 限制输出长度:合理设置
max_tokens; - 精简上下文:删除无关历史,避免每轮重复发送大文件;
- 利用缓存:稳定前缀尽量复用,命中缓存后读取价低得多;
- 拆分 Key:开发、生产、客户端各用一个 Key,便于归因;
- 限制自动重试:只对可重试错误做有限次退避,避免故障时重复消费。
常见问题
流式输出会更贵吗?
不会。相同内容的 Token 单价不变,但实际生成长度与客户端中断行为会影响最终费用。
请求失败会计费吗?
取决于失败阶段。认证、参数校验阶段通常没有模型用量;已进入模型推理后即使连接中断也可能产生实际用量,以用量日志为准。
为什么同样的提示词费用不同?
输出长度、历史上下文、缓存命中情况、工具调用与分组倍率都会影响费用,可在用量日志逐项对比。