AI API 成本怎么算?便宜单价不等于便宜账单
看懂输入、输出、缓存与重复调用,估算真正的使用成本。
AI风向编辑整理 · 更新于 · 方法指南
先数清一次任务用了多少次调用
一条聊天消息可以只调用一次模型;一个处理文件的智能体可能先读文档、再调用工具、再修正结果。估算时填的是模型调用次数,而不是用户数量。先记录一小批真实任务的用量,再推算月成本。
输入和输出分开算
输入包括提示词、历史对话和文档上下文;输出包括模型生成的内容。不要把每百万输入 Token 的报价当成整段对话的价格。计算式是:每次输入量 × 输入单价 + 每次输出量 × 输出单价,再乘每日次数和 30 天,最后除以一百万。
算术示例:输入 2,000 Token、输出 1,000 Token,假设输入 ¥2 / 百万、输出 ¥8 / 百万,每次 ¥0.012。每天 1,000 次、30 天约 ¥360。这里的单价仅用于示例。
缓存折扣需要真的命中
重复上下文可能获得缓存输入折扣,但规则因厂商和模型而异。不要一开始就假设 100% 命中;先按 0% 估算,再用实际账单调整。我们的计算器对缺少缓存报价的模型采用普通输入价,不把未知折扣算进收益。
Token 账单之外还有什么
工具调用、联网搜索、图片和音频、缓存写入或存储,以及税费可能另行计费。推理模型的可计费输出也可能包含不可见的推理 Token。订阅套餐与 API 通常是不同的计费方式,开通订阅不意味着拥有同等 API 额度。
减少浪费的顺序
先减少无用上下文和重复请求,再限制不必要的长输出,最后比较不同模型。每次改变都用同一批真实任务检查质量;回答便宜但需要反复修正,未必节省总成本。