Как конвертировать PDF в FB2: рабочие способы и настройки

Конвертировать PDF в FB2 чаще всего требуется, когда книгу нужно читать на электронной читалке или в мобильном приложении, а исходник существует только в «застывшем» формате PDF. Проблема в том, что PDF хранит страницы как фиксированный макет, а FB2 — это XML-структура с главами, сносками и метаданными, поэтому прямое преобразование почти всегда требует ручной доработки результата.

Ниже разберём, какие инструменты справляются с задачей, чем отличается конвертация текстового PDF от сканированного, и как исправить типичные дефекты: слитные абзацы, потерянные переносы, «мусорные» символы и отсутствующую структуру глав.

Почему конвертация PDF в FB2 — нетривиальная задача

Формат PDF изначально создавался для печати: каждая страница описывает точное положение букв, картинок и линеек. Информации о том, где начинается глава, а где колонтитул, в файле просто нет. FB2 (FictionBook) устроен противоположным образом — это XML-документ, где текст размечен тегами <section>, <title>, <epigraph> и так далее.

Поэтому любой конвертер вынужден «угадывать» структуру: анализировать размер шрифта, отступы и разрывы страниц. С художественной книгой, набранной простым текстом, это обычно получается неплохо. А вот с научной литературой, многоколоночной вёрсткой или сканами результат требует серьёзной чистки.

Проверьте исходный PDF перед конвертацией

Прежде чем запускать конвертер, определите тип вашего PDF — от этого зависит выбор инструмента. Откройте файл и попробуйте выделить фрагмент текста мышкой.

  • 📄 Текстовый PDF — текст выделяется и копируется. Конвертируется напрямую любым инструментом.
  • 📷 Скан без OCR — текст не выделяется, страницы представляют собой картинки. Сначала потребуется распознавание текста.
  • 🔀 Смешанный PDF — часть страниц текстовая, часть — изображения. Возможны пропуски фрагментов в результате.
  • 🔒 Защищённый PDF — копирование запрещено правами DRM. Конвертеры могут отказаться его обрабатывать.
⚠️ Внимание: если PDF представляет собой скан, обычный конвертер выдаст пустой или почти пустой FB2. Скан сначала нужно пропустить через OCR-программу (например, FineReader или бесплатные аналоги с распознаванием), и только потом преобразовывать распознанный текст.
📊 Какой у вас исходный PDF?
Текстовый, выделяется мышкой
Скан, текст не выделяется
Смешанный
Не знаю, ещё не проверял

Конвертация через Calibre

Calibre — самый популярный бесплатный инструмент для работы с электронными книгами на Windows, macOS и Linux. Для конвертации добавьте PDF в библиотеку кнопкой Добавить книги, выделите его и нажмите Конвертировать книги. В правом верхнем углу окна выберите выходной формат FB2 и запустите процесс.

Обратите внимание на вкладку Определение структуры: там можно задать XPath-выражения для поиска глав. Если книга разбита на главы крупным шрифтом, Calibre попытается определить их автоматически, но для сложной вёрстки правило придётся настраивать вручную. Также полезна вкладка Поиск и замена — она позволяет регулярными выражениями удалить колонтитулы и номера страниц ещё на этапе конвертации.

☑️ Конвертация PDF в FB2 через Calibre

Выполнено: 0 / 5

Готовый файл появится в папке библиотеки Calibre — путь к ней можно увидеть в настройках программы. Откройте результат во встроенной читалке и пролистайте несколько страниц: так быстрее всего заметить слитные абзацы и остатки колонтитулов.

Онлайн-конвертеры: быстро, но с ограничениями

Если устанавливать программу не хочется, задачу решают онлайн-сервисы конвертации электронных книг. Принцип везде одинаковый: загружаете PDF, выбираете целевой формат FB2, скачиваете результат. Для небольшого текстового PDF этого достаточно.

Однако у онлайн-подхода есть объективные минусы, о которых стоит знать заранее.

  • 📦 Ограничение на размер загружаемого файла — тяжёлые книги с иллюстрациями могут не пройти.
  • 🔐 Файл передаётся на сторонний сервер, что нежелательно для конфиденциальных документов.
  • ⚙️ Минимум настроек: структуру глав и чистку колонтитулов обычно контролировать нельзя.

Сравнение инструментов конвертации

Выбор инструмента зависит от типа исходника и требований к результату. Ориентируйтесь на общую логику, а не на обещания «идеальной конвертации в один клик».

ИнструментТекстовый PDFСкан (OCR)Настройка структуры
CalibreДаНетГибкая, через XPath
Онлайн-конвертерыДаРедкоМинимальная
FineReader + редакторДаДаРучная разметка
Скрипты (pandoc и др.)ДаНетТребует навыков

Как видно, универсального решения нет. Для сканированных книг наиболее надёжна цепочка «OCR → правка текста → сборка FB2», а для обычных текстовых PDF проще всего справляется Calibre.

Чистка и доработка полученного FB2

Даже удачно сконвертированный файл редко бывает полностью чистым. Типичные дефекты — разрывы слов по переносам, номера страниц посреди абзацев, повторяющиеся колонтитулы, отсутствие разбиения на главы. Для исправления удобно открыть FB2 в специализированном редакторе, например FictionBook Editor или в том же Calibre через функцию Править книгу.

Массовые замены выполняйте регулярными выражениями: например, шаблон вида \n\d+\n помогает найти номера страниц на отдельных строках. Перед массовой заменой всегда проверяйте несколько совпадений вручную — иначе легко удалить нужные цифры внутри текста.

⚠️ Внимание: перед правкой сохраните копию исходного сконвертированного файла. Автоматические замены регулярными выражениями необратимы, и ошибочный шаблон может испортить весь текст.
Что делать, если текст в FB2 отображается иероглифами

Причина почти всегда в некорректной кодировке. FB2 должен быть сохранён в UTF-8, а в заголовке XML указано encoding="utf-8". Откройте файл в текстовом редакторе с поддержкой кодировок (например, Notepad++) и пересохраните его в UTF-8 без BOM. Если иероглифы были уже в PDF, проблема на стороне исходника — поможет только OCR или другой источник книги.

Типичные проблемы и их решения

Самая частая жалоба после конвертации — сплошная «простыня» текста без абзацев и глав. Это происходит, когда в PDF абзацы отделены только визуальным отступом, а не реальным разрывом строки. Решение — включить в Calibre эвристическую обработку на вкладке Обработка текста или разметить абзацы вручную в редакторе.

Вторая распространённая ситуация — потеря сносок и ссылок. PDF хранит сноски как обычный текст внизу страницы, и конвертер не всегда связывает их с основным повествованием. Полностью автоматического решения здесь нет: сноски придётся переносить в теги <a> с типом note вручную, если они критичны.

FAQ: частые вопросы о конвертации PDF в FB2

Можно ли конвертировать PDF в FB2 без потери форматирования?

Полностью — нет. FB2 не хранит точную вёрстку страницы, только логическую структуру. Шрифты, размеры и расположение элементов определяются программой-читалкой, а не файлом.

Почему после конвертации файл FB2 пустой?

Скорее всего, исходный PDF — это скан без текстового слоя. Проверьте, выделяется ли текст в исходном файле. Если нет, сначала выполните OCR-распознавание.

Какой инструмент лучше для большой книги со сканами?

Оптимальна связка: OCR-программа для распознавания текста, затем ручная вычитка и сборка FB2 в редакторе. Автоматические конвертеры со сканами не справляются.

Сохранится ли оглавление при конвертации?

Только если конвертер смог определить главы по стилю заголовков. В Calibre это настраивается на вкладке определения структуры; в онлайн-сервисах структура обычно теряется.

Легально ли конвертировать купленную книгу в другой формат?

Конвертация для личного использования на своих устройствах, как правило, допустима, но распространение полученного файла нарушает авторские права. Кроме того, книги с DRM-защитой могут быть технически заблокированы для конвертации.