Конвертировать PDF в FB2 чаще всего требуется, когда книгу нужно читать на электронной читалке или в мобильном приложении, а исходник существует только в «застывшем» формате PDF. Проблема в том, что PDF хранит страницы как фиксированный макет, а FB2 — это XML-структура с главами, сносками и метаданными, поэтому прямое преобразование почти всегда требует ручной доработки результата.
Ниже разберём, какие инструменты справляются с задачей, чем отличается конвертация текстового PDF от сканированного, и как исправить типичные дефекты: слитные абзацы, потерянные переносы, «мусорные» символы и отсутствующую структуру глав.
Почему конвертация PDF в FB2 — нетривиальная задача
Формат PDF изначально создавался для печати: каждая страница описывает точное положение букв, картинок и линеек. Информации о том, где начинается глава, а где колонтитул, в файле просто нет. FB2 (FictionBook) устроен противоположным образом — это XML-документ, где текст размечен тегами <section>, <title>, <epigraph> и так далее.
Поэтому любой конвертер вынужден «угадывать» структуру: анализировать размер шрифта, отступы и разрывы страниц. С художественной книгой, набранной простым текстом, это обычно получается неплохо. А вот с научной литературой, многоколоночной вёрсткой или сканами результат требует серьёзной чистки.
Проверьте исходный PDF перед конвертацией
Прежде чем запускать конвертер, определите тип вашего PDF — от этого зависит выбор инструмента. Откройте файл и попробуйте выделить фрагмент текста мышкой.
- 📄 Текстовый PDF — текст выделяется и копируется. Конвертируется напрямую любым инструментом.
- 📷 Скан без OCR — текст не выделяется, страницы представляют собой картинки. Сначала потребуется распознавание текста.
- 🔀 Смешанный PDF — часть страниц текстовая, часть — изображения. Возможны пропуски фрагментов в результате.
- 🔒 Защищённый PDF — копирование запрещено правами DRM. Конвертеры могут отказаться его обрабатывать.
⚠️ Внимание: если PDF представляет собой скан, обычный конвертер выдаст пустой или почти пустой FB2. Скан сначала нужно пропустить через OCR-программу (например, FineReader или бесплатные аналоги с распознаванием), и только потом преобразовывать распознанный текст.
Конвертация через Calibre
Calibre — самый популярный бесплатный инструмент для работы с электронными книгами на Windows, macOS и Linux. Для конвертации добавьте PDF в библиотеку кнопкой Добавить книги, выделите его и нажмите Конвертировать книги. В правом верхнем углу окна выберите выходной формат FB2 и запустите процесс.
Обратите внимание на вкладку Определение структуры: там можно задать XPath-выражения для поиска глав. Если книга разбита на главы крупным шрифтом, Calibre попытается определить их автоматически, но для сложной вёрстки правило придётся настраивать вручную. Также полезна вкладка Поиск и замена — она позволяет регулярными выражениями удалить колонтитулы и номера страниц ещё на этапе конвертации.
☑️ Конвертация PDF в FB2 через Calibre
Готовый файл появится в папке библиотеки Calibre — путь к ней можно увидеть в настройках программы. Откройте результат во встроенной читалке и пролистайте несколько страниц: так быстрее всего заметить слитные абзацы и остатки колонтитулов.
Онлайн-конвертеры: быстро, но с ограничениями
Если устанавливать программу не хочется, задачу решают онлайн-сервисы конвертации электронных книг. Принцип везде одинаковый: загружаете PDF, выбираете целевой формат FB2, скачиваете результат. Для небольшого текстового PDF этого достаточно.
Однако у онлайн-подхода есть объективные минусы, о которых стоит знать заранее.
- 📦 Ограничение на размер загружаемого файла — тяжёлые книги с иллюстрациями могут не пройти.
- 🔐 Файл передаётся на сторонний сервер, что нежелательно для конфиденциальных документов.
- ⚙️ Минимум настроек: структуру глав и чистку колонтитулов обычно контролировать нельзя.
Сравнение инструментов конвертации
Выбор инструмента зависит от типа исходника и требований к результату. Ориентируйтесь на общую логику, а не на обещания «идеальной конвертации в один клик».
| Инструмент | Текстовый PDF | Скан (OCR) | Настройка структуры |
|---|---|---|---|
| Calibre | Да | Нет | Гибкая, через XPath |
| Онлайн-конвертеры | Да | Редко | Минимальная |
| FineReader + редактор | Да | Да | Ручная разметка |
| Скрипты (pandoc и др.) | Да | Нет | Требует навыков |
Как видно, универсального решения нет. Для сканированных книг наиболее надёжна цепочка «OCR → правка текста → сборка FB2», а для обычных текстовых PDF проще всего справляется Calibre.
Чистка и доработка полученного FB2
Даже удачно сконвертированный файл редко бывает полностью чистым. Типичные дефекты — разрывы слов по переносам, номера страниц посреди абзацев, повторяющиеся колонтитулы, отсутствие разбиения на главы. Для исправления удобно открыть FB2 в специализированном редакторе, например FictionBook Editor или в том же Calibre через функцию Править книгу.
Массовые замены выполняйте регулярными выражениями: например, шаблон вида \n\d+\n помогает найти номера страниц на отдельных строках. Перед массовой заменой всегда проверяйте несколько совпадений вручную — иначе легко удалить нужные цифры внутри текста.
⚠️ Внимание: перед правкой сохраните копию исходного сконвертированного файла. Автоматические замены регулярными выражениями необратимы, и ошибочный шаблон может испортить весь текст.
Что делать, если текст в FB2 отображается иероглифами
Причина почти всегда в некорректной кодировке. FB2 должен быть сохранён в UTF-8, а в заголовке XML указано encoding="utf-8". Откройте файл в текстовом редакторе с поддержкой кодировок (например, Notepad++) и пересохраните его в UTF-8 без BOM. Если иероглифы были уже в PDF, проблема на стороне исходника — поможет только OCR или другой источник книги.
Типичные проблемы и их решения
Самая частая жалоба после конвертации — сплошная «простыня» текста без абзацев и глав. Это происходит, когда в PDF абзацы отделены только визуальным отступом, а не реальным разрывом строки. Решение — включить в Calibre эвристическую обработку на вкладке Обработка текста или разметить абзацы вручную в редакторе.
Вторая распространённая ситуация — потеря сносок и ссылок. PDF хранит сноски как обычный текст внизу страницы, и конвертер не всегда связывает их с основным повествованием. Полностью автоматического решения здесь нет: сноски придётся переносить в теги <a> с типом note вручную, если они критичны.
FAQ: частые вопросы о конвертации PDF в FB2
Можно ли конвертировать PDF в FB2 без потери форматирования?
Полностью — нет. FB2 не хранит точную вёрстку страницы, только логическую структуру. Шрифты, размеры и расположение элементов определяются программой-читалкой, а не файлом.
Почему после конвертации файл FB2 пустой?
Скорее всего, исходный PDF — это скан без текстового слоя. Проверьте, выделяется ли текст в исходном файле. Если нет, сначала выполните OCR-распознавание.
Какой инструмент лучше для большой книги со сканами?
Оптимальна связка: OCR-программа для распознавания текста, затем ручная вычитка и сборка FB2 в редакторе. Автоматические конвертеры со сканами не справляются.
Сохранится ли оглавление при конвертации?
Только если конвертер смог определить главы по стилю заголовков. В Calibre это настраивается на вкладке определения структуры; в онлайн-сервисах структура обычно теряется.
Легально ли конвертировать купленную книгу в другой формат?
Конвертация для личного использования на своих устройствах, как правило, допустима, но распространение полученного файла нарушает авторские права. Кроме того, книги с DRM-защитой могут быть технически заблокированы для конвертации.