主题
Token 与计费
NovelAI 计费例外
下文的文本长度估算不适用于 NovelAI 绘图。Anlas 是 NovelAI 的点数单位;本站将每次生图的基础费用和实际点数换算成计费 Token,而不是统计提示词或图片编码的文本长度。输入固定为 100000 Token,输出为实际结算 Anlas 乘以 10000、最低 2 Token;因此 0 Anlas 仍收基础费用。
换算示例见 NovelAI 费用说明。如需限制单次消耗,请按所用入口的预算规则设置,不能套用文本模型的输出长度限制。
什么是 Token
Token 是大模型处理文本的基本单位。模型不直接读取文字——它先将文本切分为 Token,再逐个处理。
Token ≠ 字符,也 ≠ 单词:
- 英文中,1 个 Token ≈ 4 个字符 ≈ 0.75 个单词。
hello是 1 个 Token,unfortunately会被拆成多个 Token - 中文中,1 个汉字通常消耗 1 ~ 2 个 Token。常见字(如「的」「是」)通常 1 个 Token,生僻字可能 2 ~ 3 个
- 标点、空格、换行符也消耗 Token
- 代码中的缩进、括号、关键字都各自消耗 Token
输入 Token 与输出 Token
每次 API 调用涉及两部分 Token:
| 类型 | 来源 | 说明 |
|---|---|---|
| 输入 Token(Prompt Tokens) | 你发送给模型的全部内容 | 包括 system 提示词 + 所有历史消息 + 当前用户输入 |
| 输出 Token(Completion Tokens) | 模型生成的回复 | 模型实际输出的文本长度 |
多轮对话的 Token 增长
因为模型无状态,每轮对话都需要把完整历史塞进 messages。对话越长,输入 Token 越多,费用增长是累积的而非线性的。详见 请求体结构 - 多轮对话。
计费方式
本站支持两种计费模式,取决于具体模型:
- 按量计费:按实际消耗的 Token 数计费,输入和输出分别计价。大多数模型采用此方式
- 按次计费:每次请求固定价格,不论 Token 用量。部分特殊模型采用此方式
在主站「模型广场」中可查看每个模型的具体定价。
如何查看消费
- 余额与充值:主站「钱包管理」页面
- 调用记录:主站「控制台 → 使用日志」,每条记录包含模型名称、响应时间、消费金额、输入 Token 数和输出 Token 数
如何估算 Token 用量
几个粗略的经验值:
| 内容类型 | 大约 Token 数 |
|---|---|
| 1 个英文单词 | ~1.3 Token |
| 1 个中文汉字 | ~1.5 Token |
| 1000 个中文字 | ~1500 Token |
| 一段 500 字的中文文章 | ~750 Token |
精确计算可使用 OpenAI 官方的 Tokenizer 工具(基于 GPT 系列的 tokenizer,其他模型的切分规则略有不同,但数量级一致)。
省 Token 的实用建议
- 精简 system 提示词,去掉冗余描述
- 控制对话轮次,必要时截断早期历史
- 用
max_tokens限制输出长度,避免模型过度发挥
