马良写作
教程指南2026-06-2213 分钟阅读

AI 写小说 token 暴涨、积分烧得快?智能上下文装配省 token 完全指南

一章没写几个字,积分却哗哗掉?本文讲透 token 暴涨的根因与"智能加载上下文"省 token 三步法:实时 token 估算、完整改仅名称、章纲卷纲按需开,附三套实战配比与超限保护机制说明。

马良写作团队

马良写作

你只是让 AI 续写一段两千字,积分却掉了一大截。问题往往不在"输出",而在"输入"——每次写作前,系统默认把整本书的架构、设定、角色、悬念全塞给了 AI,这部分"看资料"的开销,才是 token 暴涨的真凶。

好消息是:这部分完全可控。马良写作的"智能加载上下文"让你自己决定每次喂给 AI 多少资料。这一篇用三步法,教你把积分花在刀刃上。

核心要点

  • token 暴涨主要来自"输入端"——默认全量装配小说资料,而非 AI 的输出。
  • 智能加载上下文 = 按场景"按需装配",而不是每次"全量塞入"。
  • 马良写作发送前会实时估算这套装配的 token,并和默认上限 60,000 对比,飘红即提醒。
  • 省 token 三招:完整改"仅名称"、章纲卷纲按需开、关掉用不上的维度。

token 为什么会暴涨?

因为大模型的计费是按"输入 + 输出"总量算的,而输入端的小说资料往往远比你写的那几千字更占地方。 一本书的全套设定、角色、悬念、架构叠起来,轻松就是几万 token,每写一章都重复消耗一次。

很多人盯着"AI 写了多少字"省钱,方向错了。真正的大头是"AI 每次读了多少资料"。资料给得越全,AI 越不跑偏,但每一次生成的成本也越高——这是一个需要你主动权衡的天平。

实测观察: 在我们的内部测试里,把设定与角色从"完整"改成"仅名称",单次写作的上下文 token 通常能明显下降,而对日常章节的写作质量几乎没有可感知的影响。省钱的关键,是分清"哪些资料 AI 现在真的用得上"。

理解 AI 写作的整体成本结构,可参考马良写作免费版 vs 付费版

什么是"智能加载上下文"?

智能加载上下文,是把"喂给 AI 多少资料"这个开关交到你手里,按场景给量,而不是每次无脑全开。 它的反义词是"全量塞入"——不管写什么都把整本书的资料一股脑发出去。

核心思想很朴素:AI 写日常章节时,知道"有哪些角色、哪些设定存在"就够了,细节它会按需问;只有写关键转折时,才需要完整资料兜底。智能加载就是让你针对不同场景,给出刚好够用的信息量。

独家视角: 省 token 不等于"少给资料导致 AI 变笨"。恰恰相反——给得太多,关键信息反而被淹没,AI 抓不住重点。精准地"按需给",既省钱又常常写得更聚焦。

入口在 AI 助手栏点齿轮"AI 功能管理",切到"上下文"标签。完整说明见上下文装配教程

第一步:先看懂实时 token 估算

省钱的前提是先能"看见"花费。马良写作在你发送前就实时估算这套装配大概要花多少 token。 不用等扣了积分才后悔。

实时 token 估算与上限对比

面板顶部有一条"预计上下文 token"进度条,后面跟着默认上限 60,000。它实时统计你当前这套装配的开销,飘红就说明该精简了。再往下还有一行"所选模型可用上限",会带上你当前选的生成模型名字——有些模型窗口小,这里会提前告诉你"这套它装不下"。

记个简单口诀:上面那条比的是"平台默认上限",下面那行比的是"你选的模型能不能装下"。两条都不飘红,就放心发。

第二步:把"完整"换成"仅名称"

这是省 token 最立竿见影的一招。 滚到"装配维度",设定、角色、悬念每一项都有"完整"和"仅名称"两档。

装配维度:完整与仅名称两档

"完整"是把整条资料都给 AI,"仅名称"只给名字列表,让 AI 知道"有这些东西存在"但不展开细节。日常批量写正文时,设定和角色用"仅名称",AI 照样认得人、不跑偏,token 却能省下一大块。

每项后面的小数字(比如"设定 22""角色 16")是这本书当前的条目数量,方便你判断"全装进去会不会太多"。右上角还有个"总开关",关掉它就回退成最省的"精简装配",纯聊创意时很合适。

第三步:章纲卷纲按需开,别默认全装

章纲卷纲是 token 大户,默认是关的,开了能让 AI 严格按大纲写,但开销会明显上涨。 所以它是"按需开",不是"常开"。

章纲卷纲装配范围

它有三种装配范围:"本卷"只给当前这一卷的章纲、"最近 N 章"从最新往前数 N 章、"指定范围"手动填章节区间。下面还有"同时装配对应卷纲"的勾选。开关旁的小徽标会告诉你这次实际装配了多少章纲、多少卷纲。

省钱提醒: 平时扩写、写过渡章,章纲卷纲可以直接关掉;只在"让 AI 严格踩着大纲走"的关键章再开,且优先用"本卷"或"最近 N 章",别动不动全书都装。

三套省 token 实战配比

不用每次都从头调,按场景套用下面三套组合即可。 这是我们最常用的三档:

场景设定 / 角色悬念章纲卷纲适用
大批量写正文(最省)仅名称关闭本卷日常章节、过渡章
关键章节(求稳)完整完整最近 N 章 + 卷纲高潮、转折、揭晓
纯聊创意(最轻)关总开关关闭关闭头脑风暴、对话灵感

改完别忘了点底部"保存配置"——配置是按这本小说单独存的,一本书设一次,长期生效。

独家心得: 大多数章节其实都属于"日常",真正需要"完整"的高光章占比不高。把默认配比设成"最省",只在写关键章时临时升级,长期下来省下的积分相当可观。

token 超限会怎样?超限保护机制

如果你的装配把预计 token 顶过了默认上限,系统会主动保护,而不是默默扣钱。 进度条会变红,并弹出提示让你去聊天设置里打开"最大上下文"。

不打开"最大上下文"的话,超出的部分会被自动压缩,AI 可能"看不全"——这时候写出来的质量会打折。同理,如果超过了"所选模型可用上限",下面那行也会飘红。

遇到飘红有两个办法:要么按上面的配比精简维度(最省那套通常立刻就降下来了),要么换一个上下文更大的模型。怎么选模型,见AI 模型选择指南

还能怎么省?两个进阶招

第一招,用可见性给上下文"减负"。 把短期用不上的设定、还没到揭晓卷的伏笔设成"对 AI 隐藏"或"按卷渐进开放",它们就不会进上下文。这样即便你开着"设定完整",实际装配的也只是"当前该给的那部分",省钱又防剧透。具体见渐进式披露与设定可见性

第二招,选对模型。 同样的任务,不同模型的单价和上下文窗口差别很大。日常章节用性价比高的模型,关键章再切高阶模型,是更经济的搭配。

实战提醒: 省 token 是"组合拳":智能装配减少输入量,可见性砍掉不该给的条目,选模型优化单价。三招叠加,比单纯压缩任何一项都有效。把它放进你的长篇创作框架,长篇的成本才真正可控。

常见问题

Q:省 token 会不会让 AI 写得变差?
不会,前提是"按需给"而非"乱删"。日常章节用"仅名称",AI 知道有哪些人和设定就够了,细节会按需调用;只有写关键转折才需要"完整"。给得太多反而会淹没重点,精准给量常常写得更聚焦。

Q:默认上限 60,000 token 能改吗?超了一定要开"最大上下文"吗?
60,000 是平台默认上限。超了不开"最大上下文",超出部分会被自动压缩,AI 可能看不全;开了则按你选的模型窗口尽量装。建议先用最省配比把估算压回上限内,实在需要大上下文再开。

Q:怎么知道这次到底花了多少 token?
看面板顶部的"预计上下文 token"进度条,它在发送前就实时估算,并和默认上限对比。下面那行"所选模型可用上限"还会告诉你当前模型能不能装下。两条都不飘红就放心发。

Q:章纲卷纲到底要不要开?
按需开。它能让 AI 严格踩着大纲写,但是 token 大户。平时扩写、过渡章直接关;只在关键章开,且优先用"本卷"或"最近 N 章",不要全书都装。

Q:配置是全局的还是每本书单独的?
每本小说单独存。你给某本书设的省 token 配比只作用于这本书,换一本书要重新配。改完记得点"保存配置",否则下次进来又是默认的全量装配。

写在最后

AI 写作的积分,大头花在"读资料"上,而读多少资料,主动权在你手里。看懂 token 估算、把"完整"换成"仅名称"、章纲卷纲按需开——三步就能把成本压下来一大截。

再叠上可见性减负和选对模型,省 token 就成了一套可复用的组合拳。现在就去上下文装配教程按你的写作节奏设好默认配比,让每一分积分都花在真正需要的地方。

#节省token#智能加载上下文#上下文装配#token估算#AI写作省钱#积分#AI写小说

RELATED

相关阅读