Calibre 电子书格式转换实操手册:3 步搞定 30+ 格式互转
【免费下载链接】calibreThe official source code repository for the calibre ebook manager项目地址: https://gitcode.com/GitHub_Trending/ca/calibre
拿到一本 Kindle 打不开的 EPUB,或想把 PDF 变成手机上能正常排版的流式书籍?Calibre 的电子书格式转换引擎就是干这个的:EPUB、MOBI、AZW3、PDF、DOCX、HTMLZ 等 30 多种格式互相转换,源书进去,按你的目标设备调好参数,出来的是一份干净、可直接阅读的成品。
先给结论:按目标设备选输出格式
转换之前别纠结,按下面这张表定目标格式:
| 阅读场景 | 推荐输出格式 |
|---|---|
| 通用电子阅读器(手机 App、Kobo 等) | EPUB |
| Kindle 设备 | AZW3(MOBI 是旧格式,能选 AZW3 就选它) |
| 固定版式存档、打印 | |
| 完整保留资源、浏览器直接预览 | HTMLZ(HTML 压缩包) |
源格式也有讲究,优先级是EPUB > HTML > DOCX;PDF 是固定版式,转换难度最高,别指望它一步到位。
点下转换按钮后,这本书经历了什么
Calibre 的转换不是"读入 A 写 B",而是一条三阶段管线:输入插件先把源文件统一转成 XHTML,中间经过一堆变换处理(识别章节、缩放字体、清理 CSS),最后由输出插件把 XHTML 打包成目标格式。所以同一个中间环节出的问题,换什么输出格式都会复现。
每个格式都有独立的输入/输出插件,躺在src/calibre/ebooks/conversion/plugins/目录里,epub_input.py、mobi_output.py这类命名一目了然;你在界面上能调到的所有选项,都集中定义在src/calibre/ebooks/conversion/config.py。
排查技巧:转换对话框右下角的调试选项,会把各阶段产生的中间 XHTML 存到input、parsed、structure、processed四个子文件夹。对比哪一步开始"变坏",你就能判断问题出在输入解析、章节检测还是输出打包。
三个最高频场景的调法
PDF 转 EPUB:先检测,再手动收尾
PDF 是转换里的"硬骨头",推荐组合拳:
- 在"结构检测"里给章节标题设一条检测规则,让目录自动生成
- 勾选"解连字符"(dehyphenate),合并行尾被拆开的单词
- 勾选"线性化表格",把按表格排的版式摊平成正常段落
处理完仍有个别段落错位,就转成 EPUB 后用"编辑书籍"功能直接改——官方文档的建议也是如此:先转成 EPUB 精修,再拿它当源文件转其他格式。
MOBI 转 AZW3:重点核对元数据与目录
两者同属 Kindle 系,转换近乎无损。核对两件事:封面是否完整迁移、目录层级有没有塌成一级;如果源书嵌了字体,确认输出里字体仍然保留。
DOCX 转 EPUB:默认设置就够
DOCX 结构规整,默认管线出的结果通常就能用。只按口味调两项:"基础字号"和"行高",搞定收工。
🚨 转换翻车四大件,逐个对号入座
- 乱码:多半是编码猜错了。到"外观与排版"里把"字符编码"手动指定成 GBK 或 cp1252,再跑一遍
- 封面重复(书头多出一张图):勾选"移除第一个图像"(remove_first_image),并在元数据页确认"优先使用元数据封面"
- 表格排版散架:勾选"线性化表格"(linearize_tables),同时检查表格边框样式有没有被 CSS 规则干扰
- 字号忽大忽小:要么勾上"禁用字体重缩放"保留原样,要么调"基础字号"让整书按比例归一
一批书要转怎么办:预设 + 命令行
界面里每次重复调参数很烦,Calibre 允许把当前全部转换设置另存为预设,之后同批书直接套用,这就是批量转换的正解。
想要更强的可控性,用命令行版本。最小用法一条命令加一个选项:
ebook-convert input.pdf output.epub --linearize-tables配合脚本遍历文件夹,几百本书也能流水线跑完。
现在就可以动手:打开转换对话框,先把"结构检测"的章节规则填好,再勾上"移除第一个图像"和"线性化表格",拿最近最让你头疼的那本书试转一次。
【免费下载链接】calibreThe official source code repository for the calibre ebook manager项目地址: https://gitcode.com/GitHub_Trending/ca/calibre
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考