Token计数与API成本计算器
估算文本 Token 数,对比主流模型 API 价格与本地推理成本
粘贴文本即可按主流分词器经验规则估算 Token 数量,内置 GPT、Claude、DeepSeek、Qwen 等模型的价格表(可编辑),一键计算单次与批量调用成本,并与本地显卡推理的电费成本对比。全部计算在浏览器本地完成。
输入文本
0
字符
0
词数(英文)
0
估算 Token
估算规则:中文/日文等 CJK 字符约 1 字 = 1 Token,英文及符号约 4 字符 = 1 Token,与 GPT/Claude 分词器的实际偏差通常在 ±15% 以内。
调用量
月成本按 30 天计算:输入 Token = 单次估算 × 次数。
API 成本对比
| 模型 | 输入价/1M | 输出价/1M | 单次成本 | 月成本(30天) |
|---|---|---|---|---|
| GPT-4o USD | $2.5 | $10 | $0.0050 | $0.50 |
| GPT-4o-mini USD | $0.15 | $0.6 | $0.0003 | $0.03 |
| Claude Sonnet USD | $3 | $15 | $0.0075 | $0.75 |
| Claude Haiku USD | $0.8 | $4 | $0.0020 | $0.20 |
| DeepSeek-V3 | ¥2 | ¥8 | ¥0.0040 | ¥0.40 |
| Qwen-Plus | ¥0.8 | ¥2 | ¥0.0010 | ¥0.10 |
| Qwen-Max | ¥2.4 | ¥9.6 | ¥0.0048 | ¥0.48 |
| 本地模型(开源) | ¥0 | ¥0 | 免费 | — |
价格为公开参考价(2025-2026),各厂商随时调整且常有缓存折扣,请以官方定价页为准;绿色为当前参数下最便宜。
本地推理成本(纯电费)
¥1.53
每 1M 输出 Token
解读:本地电费优势不明显(约 1/1),低频调用直接用 API 更省心,硬件折旧也需计入考虑。
本地推理没有 API 账单,但产出速度取决于硬件:没有独显的轻薄本建议跑 3B 以下量化模型(可用 GPU检测工具 评估);需要高质量长文本时,小模型本地跑 + 云端 API 兜底的混合方式通常最划算。
#关于Token计数与API成本计算
Token 是大语言模型处理文本的最小单位,API 按输入与输出的 Token 数分别计费。中文文本每个汉字约占 1 个 Token,英文约 4 个字符占 1 个 Token。估算 Token 数是控制 API 成本的第一步:系统提示词、历史对话、RAG 检索内容都会作为输入 Token 重复计费,长对话的累积成本远超直觉。
降低 API 成本的常用手段
- 精简系统提示词,删除重复的few-shot示例
- 历史对话做摘要压缩,而不是全量拼接
- 能用小模型的任务(分类、抽取)不用大模型
- 利用厂商的缓存定价(重复前缀大幅折扣)
- 高频、格式固定的任务交给本地小模型
常见问题
- 估算和官方返回的 usage 不一致?分词器各有差异,本工具为经验估算(±15%),精确数字以 API 响应中的 usage 字段为准。
- 价格数据会过期吗?会,所有价格可在表格内直接编辑,保存后按你的价格计算。
相关工具推荐
Spine动画编辑器
专业的Spine动画预览和编辑工具,支持多引擎导出
SQL查询优化器
分析SQL查询并提供优化建议
JVM启动参数配置
可视化配置Java虚拟机启动参数,支持内存、GC、性能等选项
代码片段转换
不同编程语言间代码片段转换(如Python↔JavaScript)
IP地址查询
查询IP地址的地理位置、运营商、ASN等信息,支持IPv4和IPv6
JSON转TypeScript接口
根据JSON数据自动生成TypeScript类型定义