Token计数与API成本计算器

估算文本 Token 数,对比主流模型 API 价格与本地推理成本

粘贴文本即可按主流分词器经验规则估算 Token 数量,内置 GPT、Claude、DeepSeek、Qwen 等模型的价格表(可编辑),一键计算单次与批量调用成本,并与本地显卡推理的电费成本对比。全部计算在浏览器本地完成。

输入文本

0

字符

0

词数(英文)

0

估算 Token

估算规则:中文/日文等 CJK 字符约 1 字 = 1 Token,英文及符号约 4 字符 = 1 Token,与 GPT/Claude 分词器的实际偏差通常在 ±15% 以内。

调用量

月成本按 30 天计算:输入 Token = 单次估算 × 次数。

API 成本对比

模型输入价/1M输出价/1M单次成本月成本(30天)
GPT-4o USD$2.5$10$0.0050$0.50
GPT-4o-mini USD$0.15$0.6$0.0003$0.03
Claude Sonnet USD$3$15$0.0075$0.75
Claude Haiku USD$0.8$4$0.0020$0.20
DeepSeek-V3 ¥2¥8¥0.0040¥0.40
Qwen-Plus ¥0.8¥2¥0.0010¥0.10
Qwen-Max ¥2.4¥9.6¥0.0048¥0.48
本地模型(开源) ¥0¥0免费—

价格为公开参考价(2025-2026),各厂商随时调整且常有缓存折扣,请以官方定价页为准;绿色为当前参数下最便宜。

本地推理成本(纯电费)

¥1.53

每 1M 输出 Token

解读:本地电费优势不明显(约 1/1),低频调用直接用 API 更省心,硬件折旧也需计入考虑。

本地推理没有 API 账单,但产出速度取决于硬件:没有独显的轻薄本建议跑 3B 以下量化模型(可用 GPU检测工具 评估);需要高质量长文本时,小模型本地跑 + 云端 API 兜底的混合方式通常最划算。

#关于Token计数与API成本计算

Token 是大语言模型处理文本的最小单位,API 按输入与输出的 Token 数分别计费。中文文本每个汉字约占 1 个 Token,英文约 4 个字符占 1 个 Token。估算 Token 数是控制 API 成本的第一步:系统提示词、历史对话、RAG 检索内容都会作为输入 Token 重复计费,长对话的累积成本远超直觉。

降低 API 成本的常用手段

  • 精简系统提示词,删除重复的few-shot示例
  • 历史对话做摘要压缩,而不是全量拼接
  • 能用小模型的任务(分类、抽取)不用大模型
  • 利用厂商的缓存定价(重复前缀大幅折扣)
  • 高频、格式固定的任务交给本地小模型

常见问题

  • 估算和官方返回的 usage 不一致?分词器各有差异,本工具为经验估算(±15%),精确数字以 API 响应中的 usage 字段为准。
  • 价格数据会过期吗?会,所有价格可在表格内直接编辑,保存后按你的价格计算。

相关工具推荐

Spine动画编辑器

专业的Spine动画预览和编辑工具,支持多引擎导出

热门 新品 本地

SQL查询优化器

分析SQL查询并提供优化建议

热门 新品 本地

JVM启动参数配置

可视化配置Java虚拟机启动参数,支持内存、GC、性能等选项

热门 新品 本地

代码片段转换

不同编程语言间代码片段转换(如Python↔JavaScript)

热门 新品 本地

IP地址查询

查询IP地址的地理位置、运营商、ASN等信息,支持IPv4和IPv6

热门 新品 本地

JSON转TypeScript接口

根据JSON数据自动生成TypeScript类型定义

热门 新品 本地