计费口径
单位与精度、计价公式、预扣与实结、零完成保险,以及在哪里核对。
按量计费,无月费与最低消费。本页说明账单的计算方式,目标是让你能够自行复算每一笔支出。
单位与精度#
- USD 是唯一记账货币。非美元支付在下单时锁定汇率换算入账。
- token 价按每百万 token 计(USD / 1M tokens)。
- 所有金额在 JSON 里是定长 8 位小数的字符串,例如
"0.01050000"。请按字符串或高精度小数处理:用浮点数接一次就可能把它变成0.010499999999999999。 - 展示价含模型倍率与供给折扣,不含用户等级折扣与活动折扣。
计价公式#
plain
有效单价 = 价格基线 × 模型倍率分项 = round8(有效单价 × token 数 ÷ 1,000,000)小计 = 各分项之和实扣 = round8(小计 × 供给折扣 × 等级折扣 × 活动折扣)- 部分线路按输入长度分档定价(阶梯价):本次单价取
prompt_tokens落进的那一档,输入、输出与缓存读写四个价都可能随档位变。 prompt_tokens含缓存读与缓存写部分;按标准输入价计费的是prompt_tokens − cache_read − cache_write(下界 0),缓存读写各按自己的单价计。completion_tokens不含思考 token;思考量单独按输出口径计费。- 倍率在模型详情中单独列出,便于你验算「单价 × 倍率 × 折扣 = 实际扣费」。
- 舍入是四舍五入(half away from zero),保留 8 位小数。
预扣与实结#
- 请求开始前会冻结一笔预扣,金额按本次请求的估算用量计算,并留出一定余量。
- 预扣不含用户等级折扣:宁可多冻结,实结时全额退回;冻结不足会导致透支。
- 传了
max_tokens的请求,冻结额会更贴近实际支出;不传时按模型的最大输出能力估算。 - 请求结束后按上游返回的真实用量实结,多退少补。
- 视频任务的预扣按估算的最终金额计算,并在任务结束前保持冻结。
- 因此流式请求进行中查余额会看到一笔冻结额,这是正常的,不是重复扣费。
零完成保险#
用量全为零时不计费:可见输出、思考、图片、视频秒数、音频秒数均为 0 即视为零产出,与失败原因无关。
只要有任一用量大于 0,就按实际产出计费(含中途断开)。参数非法、鉴权失败、限流、余额不足等未到上游的请求本身不会产生账单。
豁免时,非流式响应头 X-AiRouter-Insured 给出原因(empty_completion / upstream_error / content_filtered / client_abort);流式豁免记录见 调用日志。
视频计费#
视频按秒(per_second)或按 token(per_token,含/不含参考视频两档)计费,以模型详情页为准。含参考视频(不是静图)时走「含参考视频」单价。/v1/videos 与 /api/v3/contents/generations/tasks 计费相同;失败与取消不计费。详见 视频生成。
扣费顺序#
- 赠送额度优先消耗(不可提现、不可开票)。
- 其次是现金余额。
平台不会主动发起计费请求#
线路的可用率、延迟与熔断状态全部来自真实流量的被动统计,网关不会为了探活而额外发起计费请求。所以账单里的每一笔都对应你自己的一次调用——若发现无法对应的消耗,请在调用日志中按时间与 Key 检索。