LLM应用对话成本计算器
按每轮输入/输出token量与平均轮次估算单次对话成本,再按月度对话量折算月度和年度LLM应用运营成本。
免费在线工具
Loading…
使用说明
填写以下参数:
- 每轮平均输入/输出token数
- 单次对话平均轮次
- 月度对话总量
- 输入/输出单价(美元/1K token)
点击“计算成本”,工具会算出单次对话的输入/输出token量、单次对话成本、月度总成本、年度总成本,以及输入成本占总成本的比例。可点击“加载示例数据”查看一组预设参数(每轮500输入/200输出token、5轮对话、月10000次对话)的计算结果。
功能介绍
本工具用“每轮token量 × 平均轮次”估算单次对话的总token消耗,再乘以对应单价得到单次对话成本,并按月度对话量折算月度、年度总成本。计算结果包括:
- 单次对话输入/输出token数
- 单次对话成本(美元)
- 月度总成本、年度总成本
- 输入成本占总成本的比例
所有计算基于用户输入的固定单价在浏览器本地完成,不考虑Prompt缓存等降本手段(如需评估缓存降本效果,可配合“Prompt缓存能省多少钱的计算器”使用)。
使用场景
新功能上线前的成本预算
产品经理在评审一个新的AI对话功能时,用本工具按预估的月活对话量估算上线后的月度、年度API成本,作为预算和定价参考。
模型切换前的成本对比
技术团队在评估从一个LLM供应商切换到另一个(单价不同)时,分别输入两组单价,快速对比切换前后的月度成本差异。
常见问题
计算结果考虑Prompt缓存降本吗?
不考虑,本工具按标准单价估算基础成本。如果服务商支持Prompt缓存,实际成本会更低,可以用“Prompt缓存能省多少钱的计算器”单独评估缓存带来的节省。
支持多个模型/供应商同时对比吗?
当前版本按一组统一单价计算,如需对比多个模型,可以分别修改单价重复计算并记录结果。