跳转到内容
主站 新闻 控制台

价格说明

4ALL API 采用预充值额度制:先充值获得额度,调用时按实际用量扣减。 所有模型的实时单价以控制台 模型广场 为准,本页只说明计费规则。

两种计费方式

方式适用模型规则
按量计费(按 token)对话、嵌入、识图等文本类模型按输入/输出 token 分别计价,输出通常高于输入
按次计费(按请求)图像生成、视频生成等媒体类模型每成功一次请求扣固定价格,与 token 无关

同一个模型只会命中其中一种方式;模型广场中每个模型的价格标签会注明是”按量”还是”按次”。

扣费流程

  1. 预扣:请求进入时,系统按该模型的上限用量预扣一笔额度;
  2. 结算:请求完成后按实际用量多退少补;
  3. 失败返还:请求失败(如上游错误、超时)不收费,预扣额度自动返还。 视频等异步任务在任务失败时同样返还。

令牌与分组

  • 一个账号可以创建多个 API 令牌,可为令牌单独设置额度上限与过期时间,便于按项目控制预算;
  • 令牌所属分组决定可用模型与倍率,例如 free 分组只能调用免费模型;
  • 当前余额可在控制台查看,也可以通过 余额查询 API 程序化获取。

常见疑问

  • 充值后额度多久到账? 支付成功即时到账。
  • 额度会过期吗? 账号额度不过期;令牌可以单独设置过期时间。
  • 如何估算成本? 用目标模型跑一批典型请求,在控制台”日志”里查看每次调用的实际扣费,再按业务量外推。

更多计费细节见 计费与额度 FAQ