先确定真正的计费单位
每次 API 成本计算都应从实际推动成本的单位开始。传统数据 API 常按请求计费,AI API 常按 Token 计费,基础设施 API 还可能按事件、流量、分钟、图片或成功操作计费。
如果你的产品构建在其他供应商之上,应先按供应商的真实单位计算,再决定如何向客户简化展示。
分开计算变动成本与固定成本
变动成本随用量增加,固定成本即使没有流量也会发生。只有同时考虑两者,才能避免单次请求看似盈利、整个月却因服务器和客服支出而亏损。
| 成本类型 | 示例 | 计算方式 |
|---|---|---|
| 变动成本 | Token、请求、存储写入 | 乘以用量 |
| 单次固定成本 | 风控检查、队列任务 | 加入每请求成本 |
| 月度固定成本 | 服务器、监控、客服 | 分摊到客户 |
| 支付相关 | 手续费、退款、拒付 | 从收入中扣除 |
使用与 API 业务一致的公式
Token 计价的 AI API 应分别计算输入与输出,因为输出通常更贵。一个工作流调用多个模型时,也应逐个模型计算后再汇总。
总成本 = 输入 Token / 1,000,000 × 输入单价 + 输出 Token / 1,000,000 × 输出单价 + 单次固定成本 × 请求数 + 每月固定成本
成本计算示例
假设 API 每天处理 10,000 次请求,每月 30 天;每次平均输入 900 Token、输出 500 Token。输入每百万 2 美元,输出每百万 8 美元,服务器与监控每月 150 美元。
输入成本为 540 美元,输出成本为 1,200 美元,再加 150 美元固定成本,总月成本为 1,890 美元。
从成本推导销售价格
目标毛利率决定收入需要高出成本多少。如果成本为 1,890 美元、目标毛利率为 40%,所需收入是 1,890 / 0.60 = 3,150 美元。
- 为重试、提示词增长、滥用和支付失败预留缓冲。
- 客户超出配额前应明确公布超额规则。
- 模型单价或平均 Token 长度变化后重新测算。