请求前
选择账户内可用的模型 ID,并确认对应客户价格和余额。
客户价格以美元计价;输入、输出和模型支持的其他 token 类型可能采用不同单价,具体以登录后的价格页为准。
选择账户内可用的模型 ID,并确认对应客户价格和余额。
系统按实际记录的 token 用量结算,明细可在控制台查询。
邀请账户的用量余额仅用于 API 消耗,不是存款,也不可提现。
发起请求时账户至少需要 $0.027588 可用余额用于预留;结算后未使用部分释放。余额低于此值时,即使预计短请求更便宜,也会在发送前被拒绝。
客户端断开会向后端传播取消,但取消前已经生成并被计费记录确认的 token 仍可能计费。请在控制台按请求 ID 核对最终记录。
控制台逐请求展示输入、输出、缓存读写及系统单列的推理 token;未单列的推理明细会明确标为不可用,不以估算值冒充。
仅支持 POST /v1/chat/completions 纯文本请求;请求体最大 256 KiB,输出范围 16–4096 token,每个密钥最多 4 个并发请求。
不支持多模态输入,也不支持联网搜索。
不支持工具调用,不支持 Anthropic Messages API。
当前不提供 SLA;请为重要业务准备超时、重试和降级方案。