NovelLint 实操教程

TXT 小说怎么自动识别章节?常见格式与识别失败处理

从文件编码确认、章节候选扫描到人工复核,了解 NovelLint 如何为 TXT 小说建立可靠目录,并处理特殊标题、误识别和漏识别。

自动识别章节,实际包含四个步骤

  1. 1. 确认文本编码

    先把 TXT 按 UTF-8、GB18030 / GBK 或 Big5 正确解码;文字没有读对,后续规则也无法可靠判断标题。

  2. 2. 扫描章节候选

    从独立文本行中寻找“第十二章”“12章”“序章”“番外”等标题结构,并保留上下文证据。

  3. 3. 检查编号序列

    把可解析的章节编号放进前后序列,辅助识别跳号、重复和可能的误判。

  4. 4. 人工确认目录

    在工作区逐项确认、排除或编辑候选;只有已确认或手动建立的标题才会作为最终目录来源。

自动识别输出的是“章节候选”,不是不可更改的最终答案。特殊排版、正文中提到“第 X 章”或目录页重复标题都可能需要人工复核。
NovelLint 选择 TXT 文件后显示编码识别和开始扫描按钮
扫描前先核对编码。若预览文字已经乱码,应切换编码后再开始识别,而不是继续用错误文本生成目录。

哪些章节格式更容易识别

类型示例
标准章节第十二章 初见
无“第”前缀12章 重逢
分卷标题第一卷 风起
特殊章节序章 / 楔子 / 番外

识别失败时怎么处理

  • 先确认 TXT 文字编码正确;乱码会同时破坏标题文本和编号识别。
  • 在左侧“待确认”和“重点复核”中寻找低置信度候选,不要只看已确认目录。
  • 标题被当成正文时,可在对应行手动建立章节或分卷标题。
  • 正文句子被误认成章节时,将候选排除;原文仍会保留。
  • 同一本书的标题风格混用时,先完成候选确认,再使用统一标题样式功能。
NovelLint 工作区显示章节候选、小说原文和结构异常
左侧审核章节候选,中间核对原文位置,右侧查看编号和边界异常;三者共同决定最终目录。

下一步:检查目录是否连续

章节识别完成后,不要只看目录数量。继续检查编号是否跳号、相邻章节是否重号,以及新卷开始时的编号重置是否合理。

阅读“小说缺章、重复章怎么检测”教程 →

用自己的小说检查一遍

TXT 解码、章节扫描、目录审核与 EPUB 生成默认都在当前浏览器本地完成。

打开 NovelLint