走 API 路线,第一课不是学怎么调接口,而是搞懂计费单位:Token。

很多人第一次看到 API 账单是懵的:“我就问了几个问题,怎么就这么多 token?“看完这篇,你会自己算账。

Token 到底是什么

Token 是模型"阅读"文本的最小单位。它不是汉字,不是单词,而是一段文本被切分后的碎片。

比如英文 “unbelievable” 可能被切成 “un”、“believ”、“able” 三个 token;中文"你好"可能是一个或两个 token,具体看各家模型的分词器。关键结论:token 数量不等于字数,同一段话在不同模型下折算出的 token 数也不一样。

中英文各占多少 token

给你两个常见的经验估算(不同模型分词器有差异,精确数字以各家官方计费文档为准):

  • 英文:约 4 个字符折 1 个 token,约 100 个 token 对应 75 个英文单词左右。
  • 中文:1 个汉字约折 1–2 个 token。中文的信息密度比分词器"预期"的高,所以同样长度的内容,中文往往比英文更"贵”。

记住这是估算。真要精确,各家官方都提供 tokenizer 工具,把你的文本粘进去就能算出准确 token 数,动手前先用它量一量。

输入和输出分开计费

API 计费分两部分:你发给模型的(输入)和模型返回的(输出),分开算钱。

两条铁律:

  1. 输出通常比输入贵,贵的不是一点,是几倍。让模型写长文、一次吐几千字,账单涨得最快。
  2. 历史对话也会被重复计费。多轮对话时,之前的内容会作为上下文每次重新输入——聊得越长,单次请求的输入 token 越多。这就是为什么"让 AI 记住很长的对话"是个烧钱操作。

省钱的思路也从这两条来:提示词写精练,别让模型复述你已经给过的内容;不需要的长输出,明确要求"简短回答”。

为什么开发者用 API 而不是订阅

订阅是包月自助餐:一个人高频用,划算。API 是按碟点菜:调用一次结算一次。

开发者要的是成本和业务量挂钩:你的产品一天被调用 100 次,你就付 100 次的钱;半夜没人用,一分钱不花。订阅的包月模式是给人用的,不是给程序用的——你的服务器半夜三点可不会"下班"。

另外,API 给你的是模型能力本身:选模型、调参数、控成本,这些都是订阅界面不提供的。代价是你得自己写代码、自己算账——而算账的前提,就是这篇讲的 token。

动手算一笔账

假设(注意:以下数字纯属举例,不是任何一家的真实报价):

  • 你每天问 20 个问题
  • 每个问题输入约 500 token(含历史上下文),输出约 800 token
  • 一天就是 20 × (500 + 800) = 2.6 万 token
  • 一个月约 78 万 token

78 万 token 听起来吓人,但按量计费下这通常只是几块钱的事——具体多少,乘以你选的模型的单价就行。公式永远是:(输入 token × 输入单价)+(输出 token × 输出单价)。

自己动手算一遍,比看一百篇"贵不贵"的讨论都有用。

下一步

搞懂 token,你已经摸到了 API 路线的大门。完整的三条路线怎么选、你适合哪一条,回看这篇:《AI 工具选购指南:免费、订阅、API 三条路线怎么选(2026)》。