攻略

API 计费基础:Token 是什么

看不懂 "$x / 百万 tokens" 就没法比价。这篇把 Token、输入输出计费、成本估算一次讲清。

一、Token 是什么

Token 是模型处理文本的最小单位,不是"字"也不是"词":

以上为公开常识性换算;精确数量以各家官方 tokenizer 为准。

二、输入和输出分开计费

一次 API 调用产生两部分 token,分别计价:

所以"让模型少说废话"不只是体验问题,是真金白银。

三、计价单位:$/ 百万 tokens

常见写法如 "$1 / $3 per 1M tokens",意思是:每 100 万输入 token 收 $1,每 100 万输出 token 收 $3。

估算一次调用的成本

成本 = 输入token数 ÷ 1,000,000 × 输入单价 + 输出token数 ÷ 1,000,000 × 输出单价

举例:某模型 $1/M 输入、$3/M 输出,一次问答输入 2000 tokens、输出 500 tokens:

2000 ÷ 1e6 × 1 + 500 ÷ 1e6 × 3 = $0.0035(约 2 分钱)

单次很便宜,但乘以每天上万次调用,账就大了——这就是比价的意义。

四、省钱的四个习惯

  1. Prompt 写精简: system prompt 里删掉用不上的指令。
  2. 输出设上限:max_tokens 按需给,别让模型自由发挥。
  3. 选"够用就好"的模型:简单任务用小模型,单价差一个数量级。
  4. 缓存复用:多轮对话里不变的上下文,看服务商是否支持 prompt caching。
本页为通用计费知识科普;各家具体单价以其官网为准,可用本站比价工具对照。
最后更新:2026-10-10 · 数据来源:公开计费常识
← 返回首页