主题
NovelAI 通用生成规则
本文说明本站 NovelAI 的模型能力、最终尺寸和计费规则。具体请求结构请查看 OpenAI 兼容 API 或 NovelAI 原生 API;客户端和 MCP 的能力范围以各自页面为准。
支持的模型
表中“多角色”指为同一张图中的角色分别设置文字描述;Vibe Transfer(氛围转移)使用图片参考画面的风格与氛围;Precise Reference(精准参考)使用图片参考角色或风格;Variety+ 是增加生成多样性的选项。参考图数量不等于生成图片数量。
| 模型 ID | 多角色 | Vibe Transfer | Precise Reference | Variety+ | 中文提示词 |
|---|---|---|---|---|---|
nai-diffusion-4-full | 最多 6 个 | 最多 4 张 | 不支持 | 支持 | 不支持 |
nai-diffusion-4-5-full | 最多 6 个 | 最多 4 张 | 最多 4 张 | 支持 | 不支持 |
nai-diffusion-4-5-curated | 最多 6 个 | 最多 4 张 | 最多 4 张 | 支持 | 不支持 |
nai-diffusion-5-full | 最多 6 个 | 不支持 | 不支持 | 不支持 | 部分支持 |
nai-diffusion-5-curated | 最多 6 个 | 不支持 | 不支持 | 不支持 | 部分支持 |
使用完整模型 ID,不转换大小写、不去除空白、不解析别名。上述五个模型均支持文生图、图生图(基于原图重绘整张图)和局部重绘(只修改遮罩指定区域)。Vibe Transfer 与 Precise Reference 不能在同一请求中使用。实际可用功能还取决于所用入口、请求权限和服务资源;各入口范围见功能与接入方式。
生成数量与步数
每次请求生成 1 张图片;步数(生成过程的迭代次数)范围为 1~50。
尺寸处理
最终图片必须同时满足:
- 宽、高分别在 64~4096 之间,且均为 64 的倍数。
- 总像素不超过 3145728;例如
4096×4096不合法。
本站 OpenAI 兼容接口和原生格式接口会保留合法尺寸;对不符合上述尺寸限制的请求,综合宽高偏差和宽高比偏差,选择最接近的合法尺寸,这一处理称为“尺寸归一化”。MCP 绘图工具则要求调用时直接提供合法尺寸。
| 用途 | 合法尺寸示例 |
|---|---|
| 竖图 | 832×1216 |
| 横图 | 1216×832 |
| 方图 | 1024×1024 |
| 大尺寸 | 1024×1536、1536×2048、4096×768 |
图生图原图、局部重绘原图和遮罩必须与归一化后的最终尺寸一致。Chat 自定义请求不会自动缩放这些输入图;通过 OpenAI Images edits 上传原图时,另按该端点的缩放规则处理。为避免尺寸变化,建议直接提交满足全部限制的尺寸。
提示词限制
V5 支持英语、日语自然语言提示词,部分支持中文。中文提示词可以生效,但效果不如英语、日语;为获得最佳效果,建议正向、负向和角色提示词使用英语或日语。
V4 / V4.5 应使用英文标签或英文自然语言。本站对这些模型的提示词执行以下处理,其中 CJK 指中、日、韩文字,ASCII 指包含英文字母及半角标点的字符集:
- 常见全角标点规范化为 ASCII。
- 少于 10 个 CJK 字符时删除这些字符,不会自动翻译。
- 达到 10 个 CJK 字符时返回 HTTP 400。
- 正向提示词清洗后必须至少保留一个 ASCII 英文字母。
具体字段和校验错误见 Chat 自定义绘图参数。
输出格式
最终图片为 PNG。各接口可能用 ZIP 压缩包、Base64 文本编码、Data URI(将图片内容嵌入地址形式的文本)或 MessagePack 二进制事件传递图片;这些是传递方式,不是图片格式。
点数费用与网关计费
Anlas 是 NovelAI 的点数单位。本站生图费用由每次生成的基础费用和实际消耗点数对应的费用组成,不按提示词长度或图片编码后的文本长度计费。
查看使用日志或 OpenAI 响应的计费字段时,输入 Token 代表生图基本费用,每次固定为 100000;输出 Token 代表消耗的点数,值为 2 表示未消耗 Anlas。1 Anlas 对应 10000 输出 Token,例如消耗 5 Anlas 对应 50000 输出 Token。实际金额取决于模型和分组定价,以主站模型广场和使用日志为准。
更大的尺寸、更多步数以及参考图等会影响点数消耗。Vibe 的编码费与生成费分别计算,缓存命中时不额外收取编码费。独立 Vibe Encode 只进行参考图编码,每次成功编码消耗 2 Anlas,不收取生图基础费用。
请求预算
预算用于限制单次请求的额外点数消耗,不包含基础费用,也不是单次总金额上限。是否能设置预算取决于接入方式:
- Chat Completions:支持额外点数预算;使用 Vibe Transfer 的请求不受该预算限制。参数、换算及例外条件见 Chat 点数费用上限。
- OpenAI Images:不提供单次费用上限设置。
- 原生格式接口:不提供单次费用上限设置。
- MCP 绘图工具:支持额外点数预算,设置方式见 MCP 模型与预算。
Chat 预算不足时返回 HTTP 402 MAX_TOKENS_EXCEEDED,表示所需点数超过本次上限,不是文本长度超限。503 NO_PAID_CREDIT / NAI5_UNAVAILABLE 则表示服务暂时缺少可用点数或 V5 资源,不等于调用方钱包余额不足。
功能与接入方式
模型支持某项功能,不代表所有入口都能使用它:
- TaleNai 网页:提供文生图、多角色、图生图、局部重绘和两种参考图模式的操作界面。
- Chat 自定义绘图参数:通过请求参数使用上述功能。
- 原生格式接口:使用原生协议,客户端需支持相应功能。
- OpenAI Images:generations 提供基础文生图,edits 提供整图图生图,不提供局部重绘。
- MCP 绘图工具:仅提供基础文生图,不提供多角色或参考图功能。
