Конвертер MOBI в PDF
Загрузите электронную книгу MOBI для Kindle и одним нажатием переведите её в PDF со стабильной вёрсткой
Перетащите файл MOBI сюда или нажмите для выбора
Поддерживается формат .mobi (без DRM), максимум 5 МБ
Что такое MOBI в PDF?
MOBI в PDF - это онлайн-инструмент конвертации электронных книг, превращающий файлы .mobi в PDF (Portable Document Format). MOBI - формат электронных книг, созданный компанией Mobipocket SA (в 2005 году поглощена Amazon) и долгое время служивший одним из основных форматов на устройствах Kindle. Его тело хранится как сжатые HTML-фрагменты внутри бинарного контейнера Palm Database (PDB), а текст перекомпоновывается под размер экрана. PDF, напротив, - формат с фиксированной вёрсткой, где у каждой страницы заданы размер и система координат, поэтому он выглядит одинаково на любом устройстве.
Конвертация MOBI в PDF означает замораживание перетекающего текста в разбитые на страницы полосы. Движок конвертации разбирает контейнер PDB, считывает заголовки PalmDOC и MOBI, распаковывает текстовые записи в полный HTML-документ, извлекает обложку и записи изображений, а затем заново разбивает содержимое на страницы согласно выбранному размеру страницы, полям и кеглю и отрисовывает PDF. Результат годится для печати, архивирования, аннотирования на компьютере или передачи тому, у кого нет Kindle. Весь процесс идёт на сервере, а исходный MOBI удаляется с сервера сразу после завершения конвертации - копия не сохраняется.
Типичные сценарии: распечатать несколько страниц старой книги MOBI с Kindle, передать самоизданную или общественную книгу в виде фиксированного PDF, получить стабильную постраничную копию академического текста для цитирования или просто читать на компьютере в просмотрщике PDF вместо Kindle. Три шага, без установки Calibre. С конца 2022 года Amazon перестал принимать MOBI через «Send to Kindle» в пользу EPUB, и MOBI постепенно выводится из обращения - но существующие файлы MOBI по-прежнему можно конвертировать этим инструментом.
Как использовать
Как использовать
- Нажмите на область загрузки или перетащите файл MOBI (поддерживается только .mobi)
- Нажмите «Конвертировать в PDF» - сервер за секунды выполнит разбор, распаковку и разбиение на страницы
- По завершении нажмите «Скачать PDF», чтобы сохранить файл на устройстве
- Нужно конвертировать ещё файлы? Нажмите «Конвертировать другой файл», чтобы начать заново
Проверка конвертации
- Качество конвертации зависит от кодировки MOBI, полноты стилей CSS и ресурсов изображений; старые MOBI не поддерживают встроенные шрифты, поэтому PDF перепагинируется стандартными серверными шрифтами.
- Откройте полученный PDF и проверьте разбивку на страницы, оглавление и изображения перед передачей - особенно для книг с обилием иллюстраций или таблиц.
Сценарии использования
Технический принцип
MOBI по сути - бинарный контейнер Palm Database (PDB), следующий формату баз данных PalmOS. Он открывается 78-байтовым заголовком PDB: имя базы (32 байта), атрибуты, версия, время создания/изменения, идентификатор типа (обычно BOOKMOBI), идентификатор создателя (как правило MOBI или TEXt), общее число записей и таблица смещений записей - по одной записи на элемент, указывающей её байтовое смещение и атрибуты в файле. Всё содержимое MOBI (текст, изображения, индексы) нарезано на равные блоки (обычно по 4096 байт), хранящиеся последовательно как записи PDB: запись 0 - заголовочная, за ней текстовые записи, затем записи изображений.
Запись 0 - ключ к разбору MOBI; она содержит три заголовка подряд. Первый - заголовок PalmDOC: он задаёт способ сжатия (1 = без сжатия, 2 = словарное сжатие PalmDOC/Huffdic), общую длину текста, число текстовых записей, размер одной записи и тип шифрования. Далее идёт заголовок MOBI, начинающийся с идентификатора "MOBI" и содержащий длину заголовка, тип MOBI, кодировку текста (CP1252 или UTF-8), уникальный ID, версию генератора, индекс первой записи изображения (firstImageIndex), поля таблицы Хаффмана и флаг EXTH. Если флаг EXTH установлен, за ним следует заголовок EXTH: он начинается с "EXTH" и содержит записи тип-длина-значение с метаданными - автором, названием, издателем, ISBN, ASIN, датой публикации и тому подобным.
Тело текста распределено по записям с 1 по N и должно распаковываться запись за записью согласно заголовку PalmDOC перед сцепкой в полный HTML-документ. Сжатие PalmDOC - байт-ориентированный вариант LZ77: флаговый бит отличает литеральные байты от обратных ссылок, где обратная ссылка - пара (расстояние, длина), копирующая отрезок из уже распакованного буфера вывода, чтобы сжимать повторяющееся содержимое; Huffdic - собственная схема Хаффмана, разработанная для MOBI. Получаемый HTML - ограниченное подмножество (близкое к HTML 3.2/4) с ограниченной поддержкой CSS: старые MOBI не поддерживают SVG, вложенные таблицы и встроенные шрифты (лишь KF8/AZW3 ослабил эти ограничения). Изображения ссылаются через <img recindex="00001">, где recindex указывает на n-ную запись изображения, начиная с firstImageIndex.
Конвертация MOBI в PDF распадается на четыре шага: разобрать контейнер PDB и получить смещения записей -> прочитать заголовки PalmDOC/MOBI/EXTH записи 0, чтобы определить кодировку, сжатие и метаданные -> распаковать текстовые записи в HTML и извлечь записи изображений -> сверстать и разбить HTML на страницы выбранного размера с заданными полями, затем отрисовать PDF (шрифты встраиваются как подмножества TrueType, изображения перекодируются в JPEG/Flate, согласно ISO 32000-1/2). Этот шаг пагинации идентичен EPUB-в-PDF, поэтому конвертеры часто используют проход print-to-PDF в headless-браузере (headless Chromium) для максимальной точности CSS; ebook-convert из Calibre поставляется со входным плагином MOBI и собственным конвейером рендеринга и является фактическим стандартом в командной строке, тогда как KindleUnpack может сначала разобрать MOBI на HTML и изображения для последующего рендерера. Этот инструмент принимает только MOBI без DRM; титулы, заблокированные DRM Amazon, не могут быть разобраны. .azw3/KF8 - современный преемник MOBI, структурно близкий к EPUB и требующий собственных инструментов.
- Структура контейнера PDB: 78-байтовый заголовок базы Palm (имя базы, тип BOOKMOBI, создатель, число записей + таблица смещений), содержимое нарезано на записи примерно по 4096 байт, хранящиеся последовательно
- Запись 0 содержит три заголовка: заголовок PalmDOC (способ сжатия, длина текста, размер записи) -> заголовок MOBI (кодировка, firstImageIndex, флаг EXTH) -> заголовок EXTH (автор, название, ISBN, ASIN и прочие метаданные)
- Распаковка текста: записи с 1 по N распаковываются согласно заголовку PalmDOC (без сжатия / словарное сжатие PalmDOC LZ77 / Huffdic Huffman) и сцепляются в полный HTML
- Подмножество HTML и изображения: MOBI использует ограниченный HTML (близкий к HTML 3.2/4) с ограниченным CSS и без SVG и встроенных шрифтов в старых версиях; изображения хранятся как отдельные записи и ссылаются через <img recindex="00001">
- Четыре шага конвертации: разобрать PDB -> прочитать заголовки для кодировки/сжатия/метаданных -> распаковать текст и извлечь изображения -> разбить на страницы и отрисовать PDF (подмножества шрифтов встроены, изображения перекодированы, ISO 32000-1/2)
- Движки и ограничения: часто headless Chromium print-to-PDF для точности CSS либо Calibre ebook-convert (со встроенным входным плагином MOBI); принимается только MOBI без DRM, а .azw3/KF8 - его современный преемник
- Статус формата: Amazon перестал принимать MOBI через «Send to Kindle» в конце 2022 года в пользу EPUB; существующие файлы MOBI по-прежнему можно конвертировать, но формат выводится из обращения
Примеры
Печать старой книги Kindle
Конвертируйте роман MOBI, загруженный на Kindle годы назад, в PDF и распечатайте только нужные страницы для конспектаАрхивация академического материала
Превратите учебник MOBI в PDF с фиксированными страницами, чтобы «страница 47» была однозначной при цитированииЧтение на компьютере
Нет клиента Kindle? Конвертируйте MOBI в PDF и листайте в браузере или просмотрщике PDFЧастые вопросы
Мой файл MOBI остаётся на моём устройстве?
Нет. Файл .mobi загружается на наш сервер конвертации, разбирается и отрисовывается в PDF, а затем возвращается для скачивания. Считайте, что всё загружаемое покидает ваше устройство, и избегайте отправки неотредактированных конфиденциальных материалов. Исходный файл удаляется с сервера автоматически после конвертации.
Какие форматы электронных книг поддерживаются?
Этот инструмент принимает только .mobi. Форматы .epub, .azw3, .pdf и другие требуют каждые своих инструментов конвертации; EPUB можно обработать нашим инструментом EPUB в PDF, а .azw3/KF8 - современный преемник MOBI с иной структурой, требующий отдельной обработки.
Можно ли конвертировать файлы MOBI, защищённые DRM?
Нет. Титулы Kindle, заблокированные DRM Amazon, не могут быть открыты конвертером. Используйте MOBI без DRM, полученный законным путём, - например, самостоятельно изданную книгу, титул общественного достояния или файл с явным разрешением на использование.
Сохранятся ли мои шрифты и вёрстка?
Старые MOBI не поддерживают встроенные шрифты, поэтому PDF набирается стандартными серверными шрифтами (включая шрифты CJK), а переносы строк и пагинация могут слегка отличаться от того, что вы видите на Kindle. Лишь KF8/AZW3 поддерживает встроенные шрифты - но это уже другой формат. Структура глав, обложка и иллюстрации сохраняются насколько возможно.
У сконвертированного PDF фиксированные номера страниц?
Да. MOBI перетекающий и не имеет фиксированных номеров страниц; PDF - формат с фиксированной вёрсткой, поэтому у каждой страницы определён номер и координаты. Размер страницы, поля и кегль задаются движком конвертации, так что номера страниц в PDF не соответствуют позициям при чтении MOBI на Kindle.
Сохраняются ли изображения, обложка и оглавление?
Обложка обычно отрисовывается как первая страница PDF, а встроенные изображения (JPEG/GIF/BMP) перекодируются и встраиваются. Если оглавление MOBI удаётся разобрать из встроенного индекса или HTML-якорей, оно сохраняется как закладки PDF; заголовки глав попадают на соответствующие страницы согласно правилам пагинации.
Почему мой PDF намного больше исходного MOBI?
Текст в MOBI сжат через PalmDOC/Huffdic, а HTML-подмножество очень компактно, поэтому файл невелик; PDF хранит отрисованные фиксированные страницы и дополнительно встраивает подмножества шрифтов и перекодированные изображения. Книги с обилием иллюстраций часто вырастают в несколько раз после конвертации - это нормальное следствие формата.