响应数据处理
本页说明如何正确解析 4ALL API 返回的响应数据,适用于所有经 Chat Completions 调用的模型。
非流式响应结构
{ "id": "chatcmpl-xxx", "object": "chat.completion", "model": "gpt-5.5", "choices": [ { "index": 0, "message": { "role": "assistant", "content": "……" }, "finish_reason": "stop" } ], "usage": { "prompt_tokens": 12, "completion_tokens": 46, "total_tokens": 58 }}finish_reason 处理
| 值 | 含义 | 建议处理 |
|---|---|---|
stop | 正常结束 | 直接使用 |
length | 达到 max_tokens 上限被截断 | 提高 max_tokens 或分段续写 |
tool_calls | 模型请求调用函数 | 执行函数后回传结果,见 FC 函数调用 |
content_filter | 内容被上游安全策略拦截 | 调整提示词 |
usage 用量字段
usage是对账的依据:计费按prompt_tokens/completion_tokens分别计价;- 流式调用的最后一个数据块同样携带
usage(详见流式输出); - 命中提示词缓存时,
prompt_tokens_details.cached_tokens标注缓存部分, 按缓存倍率计费,见缓存计费。