价格说明
4ALL API 采用预充值额度制:先充值获得额度,调用时按实际用量扣减。 所有模型的实时单价以控制台 模型广场 为准,本页只说明计费规则。
两种计费方式
| 方式 | 适用模型 | 规则 |
|---|---|---|
| 按量计费(按 token) | 对话、嵌入、识图等文本类模型 | 按输入/输出 token 分别计价,输出通常高于输入 |
| 按次计费(按请求) | 图像生成、视频生成等媒体类模型 | 每成功一次请求扣固定价格,与 token 无关 |
同一个模型只会命中其中一种方式;模型广场中每个模型的价格标签会注明是”按量”还是”按次”。
扣费流程
- 预扣:请求进入时,系统按该模型的上限用量预扣一笔额度;
- 结算:请求完成后按实际用量多退少补;
- 失败返还:请求失败(如上游错误、超时)不收费,预扣额度自动返还。 视频等异步任务在任务失败时同样返还。
令牌与分组
- 一个账号可以创建多个 API 令牌,可为令牌单独设置额度上限与过期时间,便于按项目控制预算;
- 令牌所属分组决定可用模型与倍率,例如
free分组只能调用免费模型; - 当前余额可在控制台查看,也可以通过 余额查询 API 程序化获取。
常见疑问
- 充值后额度多久到账? 支付成功即时到账。
- 额度会过期吗? 账号额度不过期;令牌可以单独设置过期时间。
- 如何估算成本? 用目标模型跑一批典型请求,在控制台”日志”里查看每次调用的实际扣费,再按业务量外推。
更多计费细节见 计费与额度 FAQ。