AI API 价格、倍率与缓存计费说明
API 成本通常取决于模型、输入、输出、缓存和账户分组;不能只看一个倍率或单次请求金额。
区分输入和输出
长上下文会增加输入量,长回答会增加输出量。不同模型对两部分的计费关系可能不同,应在模型详情中分别核对。
理解缓存而不是假设缓存
只有满足上游和请求格式条件时才可能命中缓存。估算时同时保留命中与未命中两种情景,避免把理想缓存率当作保证。
用真实日志做预算
先运行一小批代表性请求,从用量日志统计平均值和高分位值,再乘以预计日请求量并预留错误重试空间。
价格可能变化,任何历史教程或截图都不能替代当前模型广场和购买页面。