攻略
API 计费基础:Token 是什么
看不懂 "$x / 百万 tokens" 就没法比价。这篇把 Token、输入输出计费、成本估算一次讲清。
一、Token 是什么
Token 是模型处理文本的最小单位,不是"字"也不是"词":
- 英文:约 4 个字符 ≈ 1 个 token("hello world" 约 3 个 token)。
- 中文:约 1–2 个汉字 ≈ 1 个 token,具体因各家分词器而异。
- 标点、空格、换行也占 token,别忽略。
以上为公开常识性换算;精确数量以各家官方 tokenizer 为准。
二、输入和输出分开计费
一次 API 调用产生两部分 token,分别计价:
- Input tokens(输入):你发给模型的全部内容——系统提示词、对话历史、你的问题。
- Output tokens(输出):模型生成的回复。
- 输出单价通常比输入贵 2–4 倍(各家不同,以官网为准)。
所以"让模型少说废话"不只是体验问题,是真金白银。
三、计价单位:$/ 百万 tokens
常见写法如 "$1 / $3 per 1M tokens",意思是:每 100 万输入 token 收 $1,每 100 万输出 token 收 $3。
估算一次调用的成本
成本 = 输入token数 ÷ 1,000,000 × 输入单价 + 输出token数 ÷ 1,000,000 × 输出单价
举例:某模型 $1/M 输入、$3/M 输出,一次问答输入 2000 tokens、输出 500 tokens:
2000 ÷ 1e6 × 1 + 500 ÷ 1e6 × 3 = $0.0035(约 2 分钱)
单次很便宜,但乘以每天上万次调用,账就大了——这就是比价的意义。
四、省钱的四个习惯
- Prompt 写精简: system prompt 里删掉用不上的指令。
- 输出设上限:max_tokens 按需给,别让模型自由发挥。
- 选"够用就好"的模型:简单任务用小模型,单价差一个数量级。
- 缓存复用:多轮对话里不变的上下文,看服务商是否支持 prompt caching。
本页为通用计费知识科普;各家具体单价以其官网为准,可用本站比价工具对照。
最后更新:2026-10-10 · 数据来源:公开计费常识
← 返回首页