Skip to content

NovelAI 通用生成规则

本文说明本站 NovelAI 的模型能力、最终尺寸和计费规则。具体请求结构请查看 OpenAI 兼容 APINovelAI 原生 API;客户端和 MCP 的能力范围以各自页面为准。

支持的模型

表中“多角色”指为同一张图中的角色分别设置文字描述;Vibe Transfer(氛围转移)使用图片参考画面的风格与氛围;Precise Reference(精准参考)使用图片参考角色或风格;Variety+ 是增加生成多样性的选项。参考图数量不等于生成图片数量。

模型 ID多角色Vibe TransferPrecise ReferenceVariety+中文提示词
nai-diffusion-4-full最多 6 个最多 4 张不支持支持不支持
nai-diffusion-4-5-full最多 6 个最多 4 张最多 4 张支持不支持
nai-diffusion-4-5-curated最多 6 个最多 4 张最多 4 张支持不支持
nai-diffusion-5-full最多 6 个不支持不支持不支持部分支持
nai-diffusion-5-curated最多 6 个不支持不支持不支持部分支持

使用完整模型 ID,不转换大小写、不去除空白、不解析别名。上述五个模型均支持文生图、图生图(基于原图重绘整张图)和局部重绘(只修改遮罩指定区域)。Vibe Transfer 与 Precise Reference 不能在同一请求中使用。实际可用功能还取决于所用入口、请求权限和服务资源;各入口范围见功能与接入方式

生成数量与步数

每次请求生成 1 张图片;步数(生成过程的迭代次数)范围为 1~50

尺寸处理

最终图片必须同时满足:

  • 宽、高分别在 64~4096 之间,且均为 64 的倍数
  • 总像素不超过 3145728;例如 4096×4096 不合法。

本站 OpenAI 兼容接口和原生格式接口会保留合法尺寸;对不符合上述尺寸限制的请求,综合宽高偏差和宽高比偏差,选择最接近的合法尺寸,这一处理称为“尺寸归一化”。MCP 绘图工具则要求调用时直接提供合法尺寸。

用途合法尺寸示例
竖图832×1216
横图1216×832
方图1024×1024
大尺寸1024×15361536×20484096×768

图生图原图、局部重绘原图和遮罩必须与归一化后的最终尺寸一致。Chat 自定义请求不会自动缩放这些输入图;通过 OpenAI Images edits 上传原图时,另按该端点的缩放规则处理。为避免尺寸变化,建议直接提交满足全部限制的尺寸。

提示词限制

V5 支持英语、日语自然语言提示词,部分支持中文。中文提示词可以生效,但效果不如英语、日语;为获得最佳效果,建议正向、负向和角色提示词使用英语或日语。

V4 / V4.5 应使用英文标签或英文自然语言。本站对这些模型的提示词执行以下处理,其中 CJK 指中、日、韩文字,ASCII 指包含英文字母及半角标点的字符集:

  1. 常见全角标点规范化为 ASCII。
  2. 少于 10 个 CJK 字符时删除这些字符,不会自动翻译。
  3. 达到 10 个 CJK 字符时返回 HTTP 400。
  4. 正向提示词清洗后必须至少保留一个 ASCII 英文字母。

具体字段和校验错误见 Chat 自定义绘图参数

输出格式

最终图片为 PNG。各接口可能用 ZIP 压缩包、Base64 文本编码、Data URI(将图片内容嵌入地址形式的文本)或 MessagePack 二进制事件传递图片;这些是传递方式,不是图片格式。

点数费用与网关计费

Anlas 是 NovelAI 的点数单位。本站生图费用由每次生成的基础费用实际消耗点数对应的费用组成,不按提示词长度或图片编码后的文本长度计费。

查看使用日志或 OpenAI 响应的计费字段时,输入 Token 代表生图基本费用,每次固定为 100000;输出 Token 代表消耗的点数,值为 2 表示未消耗 Anlas。1 Anlas 对应 10000 输出 Token,例如消耗 5 Anlas 对应 50000 输出 Token。实际金额取决于模型和分组定价,以主站模型广场和使用日志为准。

更大的尺寸、更多步数以及参考图等会影响点数消耗。Vibe 的编码费与生成费分别计算,缓存命中时不额外收取编码费。独立 Vibe Encode 只进行参考图编码,每次成功编码消耗 2 Anlas,不收取生图基础费用。

请求预算

预算用于限制单次请求的额外点数消耗,不包含基础费用,也不是单次总金额上限。是否能设置预算取决于接入方式:

  • Chat Completions:支持额外点数预算;使用 Vibe Transfer 的请求不受该预算限制。参数、换算及例外条件见 Chat 点数费用上限
  • OpenAI Images:不提供单次费用上限设置。
  • 原生格式接口:不提供单次费用上限设置。
  • MCP 绘图工具:支持额外点数预算,设置方式见 MCP 模型与预算

Chat 预算不足时返回 HTTP 402 MAX_TOKENS_EXCEEDED,表示所需点数超过本次上限,不是文本长度超限。503 NO_PAID_CREDIT / NAI5_UNAVAILABLE 则表示服务暂时缺少可用点数或 V5 资源,不等于调用方钱包余额不足。

功能与接入方式

模型支持某项功能,不代表所有入口都能使用它:

  • TaleNai 网页:提供文生图、多角色、图生图、局部重绘和两种参考图模式的操作界面。
  • Chat 自定义绘图参数:通过请求参数使用上述功能。
  • 原生格式接口:使用原生协议,客户端需支持相应功能。
  • OpenAI Images:generations 提供基础文生图,edits 提供整图图生图,不提供局部重绘。
  • MCP 绘图工具:仅提供基础文生图,不提供多角色或参考图功能。