本站判断 · 基于公开证据
写中文网文可先试 Kimi,文学润色和改稿优先 Claude,长篇设定管理再比较 Gemini;如果只选一个中文创作起点,本站当前建议 Kimi。
这是中等置信度的编辑建议,不是本站小说实测。公开小说基准仍少且版本偏旧;我们用中文叙事研究、长上下文能力和创作者常见选择来缩小候选。
DECISION SHORTLIST
不同场景直接选谁
先给默认选择,再说明在哪些条件下应该换模型。
Kimi 系列
中文叙事和长文本是优先验证方向,适合作为中文创作的第一候选;仍需用自己的题材做样章回放。
Claude Sonnet / Opus
更适合按编辑意见局部重写、统一语气和处理人物动机,但使用成本通常更高。
Gemini Pro
把它作为长上下文候选,重点验证人物设定召回和跨章节一致性,不把标称窗口等同于有效记忆。
PUBLIC EVIDENCE
结论依据什么
不同指标保持原单位,不合成为本站自定义总分。
中文固定样本横评
本站已有固定中文任务的表达、结构和产品可读性证据,但它不是小说专用基准。
上下文与模型版本
长篇写作需要核对具体模型上下文窗口,并通过连续章节任务验证有效保持能力。
生成成本与速度
大量改稿时,输出价格、生成速度和响应时间会直接影响工作流。
中文网文研究
WebNovelBench 使用中文网文语料评估模型叙事能力,为候选选择提供了比通用总榜更接近任务的证据。
小说写作应该测什么
小说不是一次性生成任务。应分别验证大纲规划、人物一致性、场景细节、语言风格、伏笔回收和多轮修改。
- 中文是否自然且风格稳定
- 角色设定能否跨章节保持
- 能否按编辑意见局部重写
- 长篇生成的成本和等待时间
用三段式样稿做选择
让候选模型先写一份大纲,再完成同一章节,最后根据编辑意见重写其中一段。对比的不是你最喜欢的一句,而是三步之间的一致性和可控性。
FAQ
常见问题
哪一个 AI 最适合写中文小说?
如果现在只选一个起点,本站建议先试 Kimi;如果重点是精修语言和反复改稿,再加入 Claude 对照。
通用模型排行榜能代表小说能力吗?
不能直接代表。通用能力可以帮助筛选候选,但文学表达、人物一致性和改稿可控性需要专门任务。
为什么页面叫排行却没有强行排 1 到 10?
因为现有证据不足以支持统一名次。页面提供的是证据分层和选择顺序,避免制造虚假精度。
本页路径:/rankings/ai-novel-writing-models/。模型和工具版本会变化,引用结论时请同时保留页面更新时间与原始来源。