🌸 Bloom AI · 文档

计费说明

按实际调用量扣费。文本按 Token,图片按张,视频按秒或按 Token。

余额以 $(美元) 显示与扣费,充值 ¥1 = $1:充 ¥100 到账 $100,无需按汇率换汇。

文本模型:按 Token

一条请求通常包含四类用量:

请求费用 = 输入 Token × 输入单价
         + 输出 Token × 输出单价
         + 缓存写入 × 写入单价
         + 缓存读取 × 读取单价

并非所有模型都支持缓存,也并非每次响应都同时返回四类用量。最终以控制台「用量日志」为准。

图片:按张

视频:按秒或按 Token

充值方式

方式说明
USDT(TRC20 / BEP20)在控制台「钱包」选择金额与链,按提示转账
支付宝 / 微信扫码支付,到账后余额即时更新
注册赠送新用户注册即送 $10 体验金

查看用量

控制台「用量日志」可按时间核对:模型、Key、输入/输出/缓存用量、单次费用与汇总、HTTP 状态与耗时。

省钱建议

  1. 按任务选模型:分类、摘要、格式化不必用最贵的模型;
  2. 限制输出长度:合理设置 max_tokens
  3. 精简上下文:删除无关历史,避免每轮重复发送大文件;
  4. 利用缓存:稳定前缀尽量复用,命中缓存后读取价低得多;
  5. 拆分 Key:开发、生产、客户端各用一个 Key,便于归因;
  6. 限制自动重试:只对可重试错误做有限次退避,避免故障时重复消费。

常见问题

流式输出会更贵吗?

不会。相同内容的 Token 单价不变,但实际生成长度与客户端中断行为会影响最终费用。

请求失败会计费吗?

取决于失败阶段。认证、参数校验阶段通常没有模型用量;已进入模型推理后即使连接中断也可能产生实际用量,以用量日志为准。

为什么同样的提示词费用不同?

输出长度、历史上下文、缓存命中情况、工具调用与分组倍率都会影响费用,可在用量日志逐项对比。