AI写小说一百万字大约消耗1000万输入token和200万输出token,同样一百万字不同模型的账单能差40倍。省钱的关键不是换便宜模型,而是别整本塞上下文:只召回用得上的部分能省三到六成,缓存省五到六成,模型分档能省七成。蛙趣拼文用一个模型管规划、一个管落地,实测成本能省一半到七成。
有个作者上个月跟我算账,说用 AI 写了30万字,API 账单四百多。他问我,AI写小说是不是注定这么烧钱。
我说不是。AI写小说费钱,关键不在你写了多少字,在你每次往里喂了多少字。
这两个数看着差不多,差出来的账单能到四十倍。
AI写小说一百万字吃掉多少 token
先算一笔总账。
先补个常识:中文一个字大概折合零点几个 token,各家切法不同,量级差不多。所以一百万字的小说,光正文输出就是两三百万 token,再加上反复喂进去的前文,破千万很轻松。
一部一百万字的长篇,整个创作过程里要反复输入大纲、角色卡、前文,综合下来大概消耗 1000 万输入 token 和 200 万输出 token。
这个量级下,不同模型的账单差得离谱。差多少?同样一百万字,用便宜的模型大概十四块,用贵的要五百七十几块。中间还夹着四百三的、十九块的。
四十倍的差距,不是优化出来的,是选出来的。
AI写小说整本塞进去有多烧钱
多数人用AI写小说烧钱的姿势都一样:每写新的一章,把前面所有章节一股脑塞进上下文。为什么这么干的人多?因为它最省事。开一个新对话,把前文复制进去,加一句继续写第八章,完事。代价是每一章都在为前面所有章节重复付费。
这么干有三个地方在漏钱。哪三个?
第一,输出比输入贵得多。贵多少?行业里普遍的定价是输出 token 单价是输入的三到六倍。你塞进去的前文全是输入,但模型为了处理它们要花更多算力,响应也变慢。有实测说上下文超过 32k 之后,推理时延增加 120% 以上。
第二,长上下文有隐性加价。怎么个隐性法?拿刚发布的 GPT-6 Astra 举例,单次请求输入超过 27.2 万 token,整单按双倍输入价、1.5 倍输出价算。注意是整单,不是只对超出的部分。它官方自己都提醒了,105 万是能力上限,不是让你填满的。
第三,缓存没吃上。这钱漏在哪?很多人的用法是每次都重新喂一遍相同的角色卡和世界观设定,这些重复内容本来是可以命中缓存的。缓存命中的输入能省六成以上,你不用,就等于每次都按原价买同样的东西。
四笔能省下来的钱
按省钱的多少排。做AI写小说这行的人,基本都在用这几招:
- 只喂用得上的部分:别整本塞,写新章时只召回跟这一章相关的那几千字。行业里把这条叫用检索替代大上下文,普遍能省三到六成
- 把重复内容放进缓存:角色卡、世界观、大纲这些固定的东西缓存起来,命中后只收零头,省五到六成
- 模型分档用:大纲和关键剧情用强的,日常扩写和润色用便宜的。这就是常说的漏斗型配法,综合成本能降七成
- 自带密钥:用平台打包的额度,价格里含了一层加价;自己拿官方的密钥接进去,能省四到七成
这四条里,第一条是根本,后面三条都是锦上添花。喂进去的东西少了,后面怎么优化都轻松;喂得多,再省也只是少亏一点。
四条叠起来是什么效果?总账单砍掉一半以上是常态。有做成本优化的机构给过区间,架构合理的调用能把开销压掉五到九成。
双模型怎么搭
上面第三条值得单独说,因为它不只是省钱。AI写小说分档用模型,好处不止在账面上。
我的配法是:贵的那个只干两件事,搭大纲和写高潮章节;便宜的那个负责日常扩写、环境描写、打斗戏这些吃字数的地方。预算大概是前者占一成,后者占九成。这么分够用吗?够,因为真正吃算力的章节本来就少。
蛙趣拼文走的就是这个思路,一个模型管规划、一个管落地,实测下来能省一半到七成。它不是靠降低模型档次省的钱,是靠把活分给对的人干。
这里有个前提要提醒:分档的前提是你有地方存前面的内容。模型换来换去,前文要是丢了,省下来的钱还不够你返工的。
有人担心分档会让文风不统一。其实反过来,正因为关键章节用了更强的模型,整体稳定性反而更好。AI写小说的日常扩写本来就是骨架上的肉,谁来填差别不大。
所以它配套的是另一套东西:写完一章就把角色状态、伏笔进度、世界规则单独存起来,换模型也不影响。实测写满 103 万字、47 条伏笔跨 263 章零遗忘,靠的就是这个。
常见问题
Q:是不是越便宜的模型越划算? A: 不是。便宜模型批量扩写很香,但你让它推大纲、理复杂的人物关系,返工两三次反而更贵。划算的是分档,不是一味图便宜。
Q:我只写十万字,需要算这么细吗? A: 不用。AI写小说在十万字以内,怎么折腾总价都有限。这笔账是给长篇和日更算的,量上去了,单价差一点都能差出一个月饭钱。
Q:缓存到底怎么用才有效? A: 把每次都一样的内容放最前面,比如系统提示词、角色卡、世界观。中间不要插变动的东西,一插就从断点重新开始计费了。
最后说一句
AI写小说这半年有个明显的变化:模型在两头分化,旗舰的越来越贵,轻量的越来越便宜。
这对长篇其实是好事。以前你只能选贵或差,现在可以选什么时候用贵的。
真正烧钱的从来不是写作本身,是那种"反正窗口大,全塞进去算了"的用法。窗口是给人兜底的,不是给人大水漫灌的。
下次看AI写小说的账单,先别急着换模型。看看你每次喂进去了多少字,那里面有一大半是可以不喂的。省下来的钱,够你多写十万字。