← 返回工具箱

EBOOK TOOL

EPUB 转 TXT / HTML

读取 EPUB 的元数据、manifest 和 spine,按电子书规定的阅读顺序提取章节。整个过程在浏览器本地完成,不上传书籍文件。

文件

未选择

章节条目

0

已选章节

0

已选字符

0

CHAPTERS

章节与正文预览

0 章 · 0 字符 · 约 0 个中英文词元

上传 EPUB 后,会在这里显示经过安全清理的章节文本。

选择 EPUB 后,将按电子书定义的阅读顺序提取章节。

RELATED TOOLS

查看全部工具 →

USE & REVIEW

EPUB 转 TXT / HTML常见问题

查看全部工具指南 →

EPUB 文件会被上传或保存到服务器吗?

不会。JSZip 在当前浏览器打开 EPUB 容器,页面本地读取 container.xml、OPF、manifest、spine 和 XHTML 章节,再生成 TXT、HTML、JSON 或 ZIP。关闭页面前请下载结果,网站不会代为保存书籍。

为什么不能直接按 EPUB 里的文件名顺序提取?

EPUB 虽然是 ZIP 容器,但章节文件名可能是 chapter10、chapter2,也可能混有封面、目录和脚注。规范中的 container.xml 指向 OPF,OPF 的 spine 才定义默认阅读顺序;工具按这条链路解析,避免章节被文件名排序打乱。

受 DRM 保护的 EPUB 可以转换吗?

不可以。检测到加密正文时工具会停止,不尝试解密或绕过 DRM。部分 EPUB 只对嵌入字体做规范允许的混淆,这通常不影响纯文字提取,但原字体不会保留。请只转换自己有权处理的电子书。

图片、漫画、固定版式和 CSS 会保留吗?

TXT 只保留文字。独立 HTML 会保留常见标题、段落、列表、表格和强调标签,但会移除脚本、样式、内嵌媒体与危险属性。漫画、图册、数学公式、SVG 和固定版式电子书的视觉关系无法用纯文字准确还原。

TXT、独立 HTML、JSON 和逐章 ZIP 有什么用途?

TXT 适合全文搜索、阅读和语料整理;独立 HTML 适合在浏览器中保留基础章节结构;JSON 保存书籍元数据与逐章字段,方便程序处理;逐章 ZIP 则把每章单独输出,适合校对、翻译或分工。

为什么会出现目录重复、章节标题重复或空章节?

有些 EPUB 会把导航目录也放进 spine,章节自身又包含同名 h1;另一些章节主要由图片或 SVG 组成。工具尊重出版物定义的阅读顺序,不擅自删掉可能有意义的条目。导出前可在章节列表取消勾选目录、版权页或空章节。