万链 API

AI API 价格、倍率与缓存计费说明

API 成本通常取决于模型、输入、输出、缓存和账户分组;不能只看一个倍率或单次请求金额。

区分输入和输出

长上下文会增加输入量,长回答会增加输出量。不同模型对两部分的计费关系可能不同,应在模型详情中分别核对。

理解缓存而不是假设缓存

只有满足上游和请求格式条件时才可能命中缓存。估算时同时保留命中与未命中两种情景,避免把理想缓存率当作保证。

用真实日志做预算

先运行一小批代表性请求,从用量日志统计平均值和高分位值,再乘以预计日请求量并预留错误重试空间。

价格可能变化,任何历史教程或截图都不能替代当前模型广场和购买页面。