⭐ 觉得好用?收藏备用,下次直接打开
EPUB 转 TXT — 解析电子书 OPF / spine 结构,按阅读顺序提取正文纯文本,自动读取书名、作者、语言并保留章节目录;可选章节标题分隔、段落间距、简繁互转、Windows 记事本兼容(BOM + CRLF)。所有处理在浏览器本地完成,不上传
📖 拖入 .epub 文件(可多本),或 点击选择
单个 ≤ 100MB · 自动解析章节 · 多本一次打包 ZIP

EPUB 转 TXT 把电子书还原成纯文本。EPUB 本质是一个装着 XHTML 网页的 ZIP 包,本工具解析它的 OPF 清单和 spine 阅读顺序,按正确次序抽出每章正文、去掉 HTML 标签,输出干净的 TXT,并尽量保留书名、作者和章节目录。

输入输出
标准 EPUB 2 / EPUB 3 电子书纯文本 TXT(UTF-8,可选 BOM)
多本可一次拖入单本直接下载,多本打包 ZIP
自带 TOC / 正文标题保留章节标题与顺序

提取策略

  1. META-INF/container.xml 定位 OPF 入口;
  2. 解析 OPF 的 metadata(书名 / 作者 / 语言)、manifest(资源清单)、spine(阅读顺序);
  3. 按 spine 顺序逐个读取 XHTML 文档,用浏览器 DOM 解析后提取文字——块级元素(<p><div><h1~6><li> 等)和 <br> 产生换行,<script>/<style> 被忽略;
  4. 章节标题优先取 nav.xhtml / toc.ncx 目录,其次取正文首个标题;
  5. 空白页、纯封面页自动跳过。

输出控制

  • 顶部书名 / 作者 — 在文首加 《书名》作者:
  • 章节分隔 — 补齐标题 / 仅空行 / 不分隔三种;
  • 段落间空行 — 段落之间留一行空行,或紧凑单行;
  • 简繁转换 — 简↔繁互转(OpenCC);
  • BOM + 换行符 — 面向 Windows 记事本的兼容开关。

范围与限制

  • 单文件上限 100 MB
  • 纯文本导出,图片、插图会被丢弃,重排版书 / 漫画不适合;
  • DRM 加密(如从某些商店购买)的 EPUB 无法解析,请先用合法手段去除 DRM;
  • TXT 转 EPUB 互为逆向,可来回转换整理书库。

📍使用场景

  • 老设备 / 语音朗读要纯文本早期 MP3 阅读器、部分车机、TTS 朗读软件只认 TXT,把 EPUB 提取成纯文本即可导入。
  • 提取原文做检索 / 摘录想全文搜索、复制段落、喂给笔记或翻译工具时,纯文本比 EPUB 的压缩包结构更方便处理。
  • 简繁转换后再存档繁体 EPUB 一键转简体 TXT(或反向),配合书名作者头和章节目录整理个人书库。
  • 多本批量导出整理书架时一次拖入多本 EPUB,逐本或打包 ZIP 一并导出 TXT,无需逐个开阅读器复制。

常见问题

章节顺序会乱吗?

不会。工具严格按 EPUB 的 spine(阅读顺序) 读取每个文档,而不是按文件名排序,因此章节顺序与在阅读器里翻页的顺序一致。目录标题优先取 EPUB 自带的 TOC(nav.xhtml 或 toc.ncx),取不到时退回正文里的首个标题。

图片、公式、表格会怎么处理?

这是纯文本导出,图片和插图会被丢弃(TXT 无法承载图像)。表格会被拆成一行行文字,公式若是图片则丢失、若是文字则保留。以文字小说 / 文档为主的 EPUB 转换效果最好;重排版的技术书、漫画不适合转 TXT。

"补齐章节标题"是什么意思?

有些 EPUB 每章正文里并没有把标题写成可见文字(标题只存在于目录)。选补齐章节标题后,工具会在每章开头插入一行目录标题;若该章正文首行已经是这个标题则不重复插入。选"仅空行分隔"则只用空行断章、不补标题,"不分隔"则各章文字直接相连。

转出来在 Windows 记事本里挤成一行 / 是乱码?

勾选 UTF-8 BOM 让记事本正确识别编码,并把"换行符"切到 CRLF(Windows)——老版记事本只认 \r\n,用 LF 会让全文挤成一行。macOS、手机阅读器、VS Code 等用默认的 LF 即可。

简繁转换准确吗?

基于 OpenCC 字典逐字转换(如"電腦"→"电脑"),对正文和章节标题同时生效。适合原文字形单一的书;若原文简繁混排或含特定人名地名写法,可能个别字误转,转完建议抽查预览再下载。

文件会上传到服务器吗?

不会。EPUB 的解压、解析、文本提取全部在你的浏览器本地用 JavaScript 完成,文件不出本机,断网也能用。