tbtoolbaba

大模型 Token 计算器与成本估算

算 token、看分词、估成本——GPT / Claude / Gemini / 国产大模型一站搞定

相关工具

使用说明

这个工具能做什么

大模型(LLM)按 token 而非字数计费和限制上下文长度。这个工具帮你在把文本发给模型之前,先在本地算清楚:

  • 这段文本是多少 token
  • 每个 token 是怎么切分的(分词可视化)
  • 会占用模型上下文窗口的多大比例
  • 按各家单价大概要花多少钱

全部在浏览器本地完成,文本不会上传服务器,适合处理含密钥、隐私的 prompt。

如何使用

  1. 在左侧输入框粘贴你的 prompt 或任意文本
  2. 在顶部选择目标模型(GPT-4o、Claude、Gemini、DeepSeek、通义、文心等)
  3. 右侧实时显示 token 数、字符/汉字/词数、上下文占用
  4. 在「API 成本估算」中填入预计输出 token 数,即可得到输入、输出与合计费用
  5. 输入/输出单价可直接修改,浏览器会按模型分别记住你填的价格;点「恢复默认价」可还原
  6. 下方「分词可视化」用不同颜色标出每个分词单元,帮助你直观感受分词粒度

关于计价货币

  • 国外模型(OpenAI、Claude、Gemini)按美元计价,单位为 $ / 100 万 token
  • 国产模型(DeepSeek、通义千问、文心一言、智谱 GLM)按人民币计价,单位为 ¥ / 100 万 token
  • 两种货币不做汇率换算——汇率一直在变动,直接用各家原生计价更准确,也避免误导

什么是 token

token 是模型处理文本的最小单位,由分词器(tokenizer)用 BPE 算法切出。它既不是字符也不是单词:一个常见英文词往往是 1 个 token,标点、空格也可能单独成 token。

为什么中文更费 token

主流分词器以英文语料为主训练,对中文的切分更细——一个汉字常占 1~2 个甚至更多 token。所以相同"字数"下,中文的 token 数和费用通常明显高于英文。这也是为什么中文 prompt 更容易触及上下文上限。

精确 vs 估算

  • OpenAI 系(GPT-4o、GPT-4、GPT-3.5 等):使用官方 tiktoken 词表(o200k_base / cl100k_base),结果精确
  • Claude、Gemini、DeepSeek、通义、文心、GLM 等:官方没有公开可在浏览器运行的分词器,本工具用 o200k_base 近似估算,界面会标注「估算值」。这些模型之间切换时 token 数相同(共用同一近似分词器),差异体现在价格与上下文窗口上;实际计费请以各厂商官方为准。

省 token 的小技巧

  • 精简系统提示与示例,去掉冗余客套
  • 用结构化格式(如紧凑 JSON、或 TOON)代替啰嗦的自然语言描述
  • 对长文档先做检索/摘要,只把相关片段放进上下文
  • 中文场景尤其注意:能用短表达就别堆砌修饰

隐私说明

分词与计算基于内置词表在你的浏览器本地运行,输入文本不会发送到任何服务器。

常见问题

我的 prompt 会上传到服务器吗?

不会。分词与计算全部在你的浏览器本地完成(基于 tiktoken 词表),文本不会离开你的设备,适合处理含敏感信息的 prompt。

为什么中文比英文更费 token?

主流大模型的分词器(BPE)以英文语料为主训练,一个英文单词常只占 1 个 token,而一个汉字往往要占 1~2 个甚至更多 token。所以同样字数下,中文的 token 数和调用成本通常明显高于英文。

Claude、Gemini、国产模型的 token 数准确吗?

OpenAI 系(GPT-4o、GPT-4 等)使用官方 tiktoken 词表,结果精确。Claude、Gemini、DeepSeek、通义、文心等没有公开的浏览器分词器,本工具用近似编码估算,界面会标注「估算值」,实际以各厂商官方计费为准。

成本估算的价格是最新的吗?可以自己改吗?

内置默认价会集中维护并标注更新月份,但大模型定价变动较快。你可以直接修改输入/输出单价,浏览器会按模型分别记住你填的价格,下次打开自动带出;点「恢复默认价」即可还原。填入预计输出 token 数后,工具会分别给出输入、输出与合计费用。

为什么有的模型显示美元、有的显示人民币?

国外模型(OpenAI、Claude、Gemini)按美元计价,国产模型(DeepSeek、通义千问、文心一言、智谱 GLM)按人民币计价,各自用官方原生货币。我们不做美元/人民币汇率换算——汇率一直在变,直接用原生计价更准确、也避免误导。

更新记录

  • 2026-07-02v1.0.0Token 计算器上线:多模型分词计数、分词可视化、上下文占用与 API 成本估算