MOBI 转 PDF 工具
上传 Kindle 的 MOBI 电子书,一键转换为排版稳定的 PDF 文档
拖放 MOBI 文件到此处,或点击选择文件
支持 .mobi 格式(无 DRM 加密),最大 5MB
什么是 MOBI 转 PDF?
MOBI 转 PDF 是一款在线电子书格式转换工具,能够将 .mobi 电子书快速转换为 PDF(便携式文档格式)。MOBI 是 Mobipocket 公司(2005 年被亚马逊收购)开发的电子书格式,长期作为 Kindle 设备的主力格式之一;它的正文以压缩后的 HTML 片段形式存储在一个 Palm 数据库(PDB)容器里,文字会按屏幕尺寸重排。而 PDF 是固定版式的文档,每一页都有确定的尺寸和坐标,无论在什么设备上打开都长得一模一样。
把 MOBI 转成 PDF,本质上是把「会流动的文字」固化成「分好页的版面」。转换引擎会先解析 PDB 容器,读取其中的 PalmDOC 头和 MOBI 头,解压各条文本记录得到完整 HTML,再把封面、插图等图片记录抽取出来,最后按设定的页面大小、页边距和字号重新排版分页,渲染成 PDF。转换后的 PDF 适合打印、归档、在电脑上批注,或发给没有 Kindle 的人。整个流程在服务端完成,转换结束后原始 MOBI 会从服务器自动删除,不留副本。
常见的需求场景:手里有早期的 Kindle MOBI 书想打印几页、想把自制或公有领域的 MOBI 交付成固定版式的 PDF、学术资料需要固定页码方便引用,或者只是想在电脑上用 PDF 阅读器翻阅--这些都能用本工具三步搞定,无需安装 Calibre 等桌面软件。需要注意的是,亚马逊自 2022 年底起已停止通过「发送至 Kindle」接收 MOBI,MOBI 正逐步被 EPUB 取代,但存量 MOBI 文件仍可用本工具转换。
使用方法
使用方法
- 点击上传区域或将 MOBI 文件拖入,仅支持 .mobi 格式
- 点击「转换为 PDF」,服务器将在数秒内完成解析、解压与分页
- 处理完成后点击「下载 PDF」将文件保存到本地
- 需继续转换其他文件?点击「转换其他文件」重新开始
转换检查
- 转换质量取决于 MOBI 的编码、CSS 样式和图片资源是否完整;老版 MOBI 不支持嵌入字体,PDF 会用服务器标准字体重排。
- 下载后请翻阅 PDF 检查分页、目录和图片,尤其是含大量插图或表格的电子书。
使用场景
技术原理
MOBI 文件本质上是一个 Palm 数据库(PDB)二进制容器,遵循 PalmOS 的数据库格式规范。其开头是 78 字节的 PDB 头:包含数据库名(32 字节)、属性、版本号、创建/修改时间、类型标识(通常是 BOOKMOBI)、创建者标识(一般是 MOBI 或 TEXt)、记录总数,以及一张记录偏移表--表中每一项给出某条记录在文件中的字节偏移和属性。MOBI 的全部内容(文本、图片、索引)都被切成等长的小块(通常每块 4096 字节)作为一条条 PDB 记录顺序存放,记录 0 是头信息,其后是文本记录,再往后是图片记录。
记录 0 是解析 MOBI 的关键,它依次包含三段头信息。首先是 PalmDOC 头:给出压缩方式(1=不压缩,2=PalmDOC 字典压缩/Huffdic)、文本总长度、文本记录数、单条记录大小和加密类型。接着是 MOBI 头:以标识符 "MOBI" 开头,包含头长度、MOBI 类型、文本编码(CP1252 或 UTF-8)、唯一 ID、生成器版本、第一张图片记录的索引(firstImageIndex)、压缩字典相关字段,以及 EXTH 标志位。若 EXTH 标志置位,则紧随其后的是 EXTH 头:以 "EXTH" 开头,列出若干类型-长度-值记录,存放作者、书名、出版社、ISBN、ASIN、出版日期等元数据。
文本内容分散在记录 1 到 N 中,需要按 PalmDOC 头指示的压缩方式逐条解压后拼接,才能得到完整的 HTML 文档。PalmDOC 压缩是一种面向字节的 LZ77 变体:用一位标志区分「原样字节」和「回溯引用」,回溯引用以 (距离, 长度) 对表示,从已解压的输出缓冲区复制一段数据,从而压缩重复内容;Huffdic 则是 MOBI 自定义的 Huffman 方案。解压得到的 HTML 是一个受限子集(接近 HTML 3.2/4),CSS 支持有限,老版 MOBI 不支持 SVG、嵌套表格和嵌入字体(KF8/AZW3 才放宽这些限制)。图片通过 <img recindex="00001"> 引用,recindex 指向从 firstImageIndex 起的第几张图片记录。
MOBI 转 PDF 的流程因此分为四步:解析 PDB 容器拿到记录偏移 -> 读取记录 0 的 PalmDOC/MOBI/EXTH 头确定编码、压缩和元数据 -> 解压文本记录得到 HTML 并抽取图片记录 -> 按设定页面大小和页边距对 HTML 排版分页,渲染成 PDF(字体作为 TrueType 子集嵌入,图片重新编码为 JPEG/Flate,遵循 ISO 32000-1/2)。这一步与 EPUB 转 PDF 的分页渲染相同,因此常借助无头浏览器(headless Chromium)的 print-to-PDF 还原 CSS;Calibre 的 ebook-convert 自带 MOBI 输入插件和渲染管线,是命令行场景的事实标准,KindleUnpack 则可先把 MOBI 拆成 HTML 加图片再交给渲染器。本工具仅接受无 DRM 加密的 MOBI;带亚马逊 DRM 的正版书无法解析。.azw3/KF8 是 MOBI 的现代后继格式,结构更接近 EPUB,需用对应工具。
- PDB 容器结构:78 字节 Palm 数据库头(数据库名、类型 BOOKMOBI、创建者、记录数 + 偏移表),内容被切成约 4096 字节的记录顺序存放
- 记录 0 三段头:PalmDOC 头(压缩方式、文本长度、记录大小)-> MOBI 头(编码、firstImageIndex、EXTH 标志)-> EXTH 头(作者、书名、ISBN、ASIN 等元数据)
- 文本解压:记录 1 到 N 按 PalmDOC 头指示的压缩方式(不压缩 / PalmDOC LZ77 字典压缩 / Huffdic Huffman)逐条解压后拼接为完整 HTML
- HTML 子集与图片:MOBI 用受限 HTML(接近 HTML 3.2/4)、CSS 有限、老版不支持 SVG 和嵌入字体;图片以独立记录存放,用 <img recindex="00001"> 按索引引用
- 转换四步:解析 PDB -> 读头确定编码/压缩/元数据 -> 解压文本并抽图 -> 排版分页渲染为 PDF(字体子集嵌入,图片重编码,遵循 ISO 32000-1/2)
- 引擎与限制:常借助 headless Chromium print-to-PDF 还原 CSS,或 Calibre ebook-convert(自带 MOBI 输入插件);仅接受无 DRM 的 MOBI,.azw3/KF8 是其现代后继格式
- 格式现状:亚马逊 2022 年底起停止通过「发送至 Kindle」接收 MOBI,推荐改用 EPUB;存量 MOBI 仍可转换,但格式正在被淘汰
示例
打印 Kindle 旧书
把早年导入 Kindle 的 MOBI 小说转成 PDF,挑需要的几页打印出来做笔记学术资料归档
MOBI 教材转 PDF 后页码固定,写论文引用「第 47 页」指代明确电脑端阅读
没装 Kindle 客户端也没关系,MOBI 转 PDF 后直接用浏览器或 PDF 阅读器翻阅常见问题
我的 MOBI 文件会保留在本地设备吗?
不会。.mobi 文件会上传到我们的转换服务器,解析渲染成 PDF 后返回供你下载。请将上传内容视同已离开本地设备,避免上传未脱敏的敏感资料。转换完成后原始文件会从服务器自动删除。
支持哪些电子书格式?
本工具只接受 .mobi。.epub、.azw3、.pdf 等格式需用对应的转换工具;EPUB 可用本站的 EPUB 转 PDF 工具,.azw3/KF8 是 MOBI 的现代后继格式,结构不同,需另行处理。
可以转换带 DRM 加密的 MOBI 吗?
不可以。带亚马逊 DRM 加密的正版 Kindle 电子书无法被转换器解析。请使用在合规范围内获取的无加密 MOBI,例如自制电子书、公有领域书籍或已明确授权的文件。
字体和排版会被保留吗?
老版 MOBI 不支持嵌入字体,转换后会用服务器上的标准字体(含中文字体)排版,换行和分页可能与 Kindle 上的效果略有差异。KF8/AZW3 才支持嵌入字体,但那是另一种格式。章节结构、封面和插图会尽量保留。
转换后的 PDF 是固定页码吗?
是的。MOBI 是可重排的,没有固定页码;PDF 是固定版式,每一页都有确定的页码和坐标。转换时的页面大小、页边距和字号由转换引擎设定,因此 PDF 的页码与你用 Kindle 看 MOBI 时的位置没有对应关系。
图片、封面和目录会保留吗?
封面通常渲染为 PDF 第一页,正文图片(JPEG/GIF/BMP)会被重新编码嵌入。MOBI 的目录如果能从其内嵌索引或 HTML 锚点解析出来,会作为 PDF 书签保留;章节标题会按分页规则进入对应页面。
为什么 PDF 比原始 MOBI 大很多?
MOBI 的文本经过 PalmDOC/Huffdic 压缩,且 HTML 子集非常精简,体积很小;PDF 存储的是渲染后的固定页面,还要嵌入字体子集和重新编码后的图片。含大量插图的电子书转成 PDF 后体积往往会膨胀数倍,这是格式特性决定的正常现象。