Skip to content

Token 与计费

NovelAI 计费例外

下文的文本长度估算不适用于 NovelAI 绘图。Anlas 是 NovelAI 的点数单位;本站将每次生图的基础费用和实际点数换算成计费 Token,而不是统计提示词或图片编码的文本长度。输入固定为 100000 Token,输出为实际结算 Anlas 乘以 10000、最低 2 Token;因此 0 Anlas 仍收基础费用。

换算示例见 NovelAI 费用说明。如需限制单次消耗,请按所用入口的预算规则设置,不能套用文本模型的输出长度限制。

什么是 Token

Token 是大模型处理文本的基本单位。模型不直接读取文字——它先将文本切分为 Token,再逐个处理。

Token ≠ 字符,也 ≠ 单词

  • 英文中,1 个 Token ≈ 4 个字符 ≈ 0.75 个单词。hello 是 1 个 Token,unfortunately 会被拆成多个 Token
  • 中文中,1 个汉字通常消耗 1 ~ 2 个 Token。常见字(如「的」「是」)通常 1 个 Token,生僻字可能 2 ~ 3 个
  • 标点、空格、换行符也消耗 Token
  • 代码中的缩进、括号、关键字都各自消耗 Token

输入 Token 与输出 Token

每次 API 调用涉及两部分 Token:

类型来源说明
输入 Token(Prompt Tokens)你发送给模型的全部内容包括 system 提示词 + 所有历史消息 + 当前用户输入
输出 Token(Completion Tokens)模型生成的回复模型实际输出的文本长度

多轮对话的 Token 增长

因为模型无状态,每轮对话都需要把完整历史塞进 messages。对话越长,输入 Token 越多,费用增长是累积的而非线性的。详见 请求体结构 - 多轮对话

计费方式

本站支持两种计费模式,取决于具体模型:

  • 按量计费:按实际消耗的 Token 数计费,输入和输出分别计价。大多数模型采用此方式
  • 按次计费:每次请求固定价格,不论 Token 用量。部分特殊模型采用此方式

在主站「模型广场」中可查看每个模型的具体定价。

如何查看消费

  • 余额与充值:主站「钱包管理」页面
  • 调用记录:主站「控制台 → 使用日志」,每条记录包含模型名称、响应时间、消费金额、输入 Token 数和输出 Token 数

如何估算 Token 用量

几个粗略的经验值:

内容类型大约 Token 数
1 个英文单词~1.3 Token
1 个中文汉字~1.5 Token
1000 个中文字~1500 Token
一段 500 字的中文文章~750 Token

精确计算可使用 OpenAI 官方的 Tokenizer 工具(基于 GPT 系列的 tokenizer,其他模型的切分规则略有不同,但数量级一致)。

省 Token 的实用建议

  • 精简 system 提示词,去掉冗余描述
  • 控制对话轮次,必要时截断早期历史
  • max_tokens 限制输出长度,避免模型过度发挥