news 2026/9/6 7:01:51

AI写小说百万字成本实测:同样100万字,账单差了40倍

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
AI写小说百万字成本实测:同样100万字,账单差了40倍

AI写小说一百万字大约消耗1000万输入token和200万输出token,同样一百万字不同模型的账单能差40倍。省钱的关键不是换便宜模型,而是别整本塞上下文:只召回用得上的部分能省三到六成,缓存省五到六成,模型分档能省七成。蛙趣拼文用一个模型管规划、一个管落地,实测成本能省一半到七成。

有个作者上个月跟我算账,说用 AI 写了30万字,API 账单四百多。他问我,AI写小说是不是注定这么烧钱。

我说不是。AI写小说费钱,关键不在你写了多少字,在你每次往里喂了多少字。

这两个数看着差不多,差出来的账单能到四十倍。

AI写小说一百万字吃掉多少 token

先算一笔总账。

先补个常识:中文一个字大概折合零点几个 token,各家切法不同,量级差不多。所以一百万字的小说,光正文输出就是两三百万 token,再加上反复喂进去的前文,破千万很轻松。

一部一百万字的长篇,整个创作过程里要反复输入大纲、角色卡、前文,综合下来大概消耗 1000 万输入 token 和 200 万输出 token。

这个量级下,不同模型的账单差得离谱。差多少?同样一百万字,用便宜的模型大概十四块,用贵的要五百七十几块。中间还夹着四百三的、十九块的。

四十倍的差距,不是优化出来的,是选出来的。

AI写小说整本塞进去有多烧钱

多数人用AI写小说烧钱的姿势都一样:每写新的一章,把前面所有章节一股脑塞进上下文。为什么这么干的人多?因为它最省事。开一个新对话,把前文复制进去,加一句继续写第八章,完事。代价是每一章都在为前面所有章节重复付费。

这么干有三个地方在漏钱。哪三个?

第一,输出比输入贵得多。贵多少?行业里普遍的定价是输出 token 单价是输入的三到六倍。你塞进去的前文全是输入,但模型为了处理它们要花更多算力,响应也变慢。有实测说上下文超过 32k 之后,推理时延增加 120% 以上。

第二,长上下文有隐性加价。怎么个隐性法?拿刚发布的 GPT-6 Astra 举例,单次请求输入超过 27.2 万 token,整单按双倍输入价、1.5 倍输出价算。注意是整单,不是只对超出的部分。它官方自己都提醒了,105 万是能力上限,不是让你填满的。

第三,缓存没吃上。这钱漏在哪?很多人的用法是每次都重新喂一遍相同的角色卡和世界观设定,这些重复内容本来是可以命中缓存的。缓存命中的输入能省六成以上,你不用,就等于每次都按原价买同样的东西。

四笔能省下来的钱

按省钱的多少排。做AI写小说这行的人,基本都在用这几招:

  • 只喂用得上的部分:别整本塞,写新章时只召回跟这一章相关的那几千字。行业里把这条叫用检索替代大上下文,普遍能省三到六成
  • 把重复内容放进缓存:角色卡、世界观、大纲这些固定的东西缓存起来,命中后只收零头,省五到六成
  • 模型分档用:大纲和关键剧情用强的,日常扩写和润色用便宜的。这就是常说的漏斗型配法,综合成本能降七成
  • 自带密钥:用平台打包的额度,价格里含了一层加价;自己拿官方的密钥接进去,能省四到七成

这四条里,第一条是根本,后面三条都是锦上添花。喂进去的东西少了,后面怎么优化都轻松;喂得多,再省也只是少亏一点。

四条叠起来是什么效果?总账单砍掉一半以上是常态。有做成本优化的机构给过区间,架构合理的调用能把开销压掉五到九成。

双模型怎么搭

上面第三条值得单独说,因为它不只是省钱。AI写小说分档用模型,好处不止在账面上。

我的配法是:贵的那个只干两件事,搭大纲和写高潮章节;便宜的那个负责日常扩写、环境描写、打斗戏这些吃字数的地方。预算大概是前者占一成,后者占九成。这么分够用吗?够,因为真正吃算力的章节本来就少。

蛙趣拼文走的就是这个思路,一个模型管规划、一个管落地,实测下来能省一半到七成。它不是靠降低模型档次省的钱,是靠把活分给对的人干。

这里有个前提要提醒:分档的前提是你有地方存前面的内容。模型换来换去,前文要是丢了,省下来的钱还不够你返工的。

有人担心分档会让文风不统一。其实反过来,正因为关键章节用了更强的模型,整体稳定性反而更好。AI写小说的日常扩写本来就是骨架上的肉,谁来填差别不大。

所以它配套的是另一套东西:写完一章就把角色状态、伏笔进度、世界规则单独存起来,换模型也不影响。实测写满 103 万字、47 条伏笔跨 263 章零遗忘,靠的就是这个。

常见问题

Q:是不是越便宜的模型越划算? A: 不是。便宜模型批量扩写很香,但你让它推大纲、理复杂的人物关系,返工两三次反而更贵。划算的是分档,不是一味图便宜。

Q:我只写十万字,需要算这么细吗? A: 不用。AI写小说在十万字以内,怎么折腾总价都有限。这笔账是给长篇和日更算的,量上去了,单价差一点都能差出一个月饭钱。

Q:缓存到底怎么用才有效? A: 把每次都一样的内容放最前面,比如系统提示词、角色卡、世界观。中间不要插变动的东西,一插就从断点重新开始计费了。

最后说一句

AI写小说这半年有个明显的变化:模型在两头分化,旗舰的越来越贵,轻量的越来越便宜。

这对长篇其实是好事。以前你只能选贵或差,现在可以选什么时候用贵的。

真正烧钱的从来不是写作本身,是那种"反正窗口大,全塞进去算了"的用法。窗口是给人兜底的,不是给人大水漫灌的。

下次看AI写小说的账单,先别急着换模型。看看你每次喂进去了多少字,那里面有一大半是可以不喂的。省下来的钱,够你多写十万字。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/6 7:01:16

印刷台精度进阶:PCB封装产线设备协同升级全解析

在电子制造车间里,印刷台的稳定性直接决定锡膏或银膏的转移质量。很多工程师都有过这样的经历:同一批PCB,换了一台印刷台,良率立刻波动三到五个百分点。这背后不只是设备本身的差异,更涉及与后续回流焊、固化炉等工艺环…

作者头像 李华
网站建设 2026/9/6 6:59:50

用气泡图软件理清逻辑:从汇报混乱到高效表达

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/6 6:56:59

宜佰丰超市进销存管理系统-ssm

本项目为前几天收费帮学妹做的一个项目,在工作环境中基本使用不到,但是很多学校把这个当作编程入门的项目来做,故分享出本项目供初学者参考。 一、项目描述 基于ssm宜佰丰超市进销存管理系统通过Mysql数据库连接数据库 http://localhost:808…

作者头像 李华
网站建设 2026/9/6 6:51:15

你的终端安全吗?企业终端安全整改项目实战复盘

一、背景:企业现状、原有痛点、项目目标 本次案例主体为一家零部件制造企业,内网终端 86 台,覆盖研发、工艺、采购、财务、行政等岗位,终端存储包含产品图纸、供应商资料、报价清单、生产工艺文档等核心业务数据。 企业前期仅依…

作者头像 李华
网站建设 2026/9/6 6:48:51

量子稀疏自编码器如何优化Q矩阵估计?认知诊断新思路

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/6 6:48:36

【2026年】一体化与分体式伺服电机哪个更适合AGV?

AGV驱动系统中的伺服电机,有"电机与驱动器集成"和"电机与驱动器分离"两种形式,行业称之为一体化与分体式。两者各有适用场景,选择要看整车结构、调试复杂度、维护和散热等因素。上海同毅自动化技术有限公司的SV系列伺服电…

作者头像 李华