Перейти к содержимому

Направление конвертации

Конвертация DJVU в PDF

Преобразование DJVU → PDF на сервере, без установки программ

.djvu.pdf

.djvu.pdf
  1. Загрузить
  2. Выбрать формат
  3. Скачать

Загрузка файлов

Область приёма файла

или

Файлы DJVU. До 5 МБ, до 20 файлов за раз. Изображение можно вставить из буфера обмена: Ctrl+V.

Оба формата хранят книгу постранично, поэтому вид разворотов не меняется. DJVU сжимает сканы эффективнее, так что PDF почти всегда получается крупнее исходника. Если нужен только текст, выберите DJVU → TXT.

Исходники и результаты хранятся 60 минут, затем стираются фоновым уборщиком. Предельный размер файла — 5 МБ, срок хранения — час.

DJVU и PDF: характеристики

Характеристики форматов DJVU и PDF рядом
Характеристика.djvuDJVU.pdfPDF
Полное названиеDjVu DocumentPortable Document Format
РазработчикAT&T Bell Labs (Ян Лекун, Леон Ботту, Патрик Хаффнер)Adobe
Год появления19961993
Расширения.djvu, .djvнет данных
MIME-типыimage/vnd.djvu, image/x-djvuapplication/pdf, application/x-pdf, application/acrobat
СодержимоеДвоичноеТекст, вектор, растр, формы
СжатиеС потеряминет данных
Несколько страниц в файлеПоддерживаетсяПоддерживается
НазначениеСканы книг и документовнет данных
СлоиМаска текста, фон и передний план — по отдельностинет данных
АлгоритмыJB2 для текста, IW44 для фонанет данных
Текстовый слойПоддерживается, поиск по книге работаетнет данных
РазмерВ 5–10 раз меньше сопоставимого PDFнет данных
Чем открытьDjView (DjVuLibre), WinDjView, STDU Viewer, SumatraPDF, OkularAdobe Acrobat Reader, Foxit Reader, SumatraPDF, Google Chrome, Microsoft Edge, Просмотр (macOS)
СпецификацияОписание форматаОписание формата
Расширениенет данных.pdf
Прозрачностьнет данныхПоддерживается
Стандартнет данныхISO 32000-2
Вёрстканет данныхФиксированная, не зависит от устройства
Шрифтынет данныхВстраиваются в файл
Защитанет данныхПароль, права доступа, подпись

Преобразование DJVU → PDF

DJVU разработан под сканы и разделяет страницу на слои: маска текста кодируется алгоритмом JB2 по словарю повторяющихся форм букв, фон и цветной слой — вейвлетным преобразованием IW44 с пониженным разрешением. PDF такой послойной модели не знает, поэтому страницы переносятся в него изображениями. Разворот выглядит точно так же, а файл становится крупнее.

Рост объёма в полтора-три раза — прямое следствие смены модели. JB2 находит в чёрно-белом скане повторяющиеся формы символов и хранит словарь плюс ссылки на него, а фон описывает вчетверо-вшестеро более грубой сеткой, чем текст. Ни того, ни другого в целевом контейнере нет: изображение страницы упаковывается обычным способом, и специализированная экономия теряется. Это свойство форматов, а не признак сбоя.

Качество сканов не улучшается и не ухудшается специально. Разрешение, контраст и перекос страницы переносятся как есть; автоматического выравнивания геометрии и подтяжки контраста не выполняется намеренно — на плохих сканах такая обработка портит мелкий текст чаще, чем спасает. Цветные развороты остаются цветными, чёрно-белые не разворачиваются в цвет без нужды.

Распознавания текста сервис не выполняет ни на одном направлении. Если в исходном DJVU был текстовый слой, добавленный при создании, проверьте поиск в готовом PDF отдельно: перенос слоя зависит от того, как он записан в исходнике. Когда из книги нужен только текст, короче маршрут DJVU → TXT, а для отдельных страниц — DJVU → JPG. Настроек у направления нет, на задание отводится 600 секунд.

Порядок преобразования DJVU → PDF

  1. Шаг 1

    Оценка исходника

    Посмотрите, работает ли поиск по тексту в самом DJVU. Это сразу показывает, есть ли в файле текстовый слой или перед вами чистый скан.

  2. Шаг 2

    Загрузка книг

    За задание принимается несколько файлов. Параметров у направления нет: цветность и разрешение берутся из исходника.

  3. Шаг 3

    Постраничный перенос

    Страницы декодируются из слоёв DJVU и укладываются в PDF изображениями. На книгу в несколько сотен разворотов уходит одна-две минуты.

  4. Шаг 4

    Проверка разворотов

    Пролистайте начало, середину и конец: убедитесь, что все страницы на месте и читаются. Рост объёма относительно DJVU ожидаем.

Вопросы по работе сервиса

Почему PDF получился в два раза больше?

DJVU кодирует текстовую маску алгоритмом JB2 по словарю повторяющихся форм, а фон хранит с пониженным разрешением — на чёрно-белых сканах это даёт выигрыш, который не воспроизводится в другом контейнере. При переносе страница становится обычным изображением, и экономия теряется. Рост в полтора-три раза — нормальный результат.

Будет ли работать поиск по тексту?

Только если текстовый слой уже был в исходном DJVU, и даже тогда его перенос стоит проверить в готовом файле. Собственного распознавания сервис не выполняет ни здесь, ни на других направлениях, поэтому из чистого скана получится PDF из изображений.

Улучшится ли читаемость плохого скана?

Нет. Страницы переносятся с исходным разрешением, контрастом и перекосом. Автоматическая правка геометрии и уровней не применяется сознательно: на малоконтрастных сканах она разрушает тонкие штрихи букв чаще, чем улучшает вид разворота.

Есть ли смысл конвертировать ради удобства чтения?

Смысл в доступности: программ, читающих DJVU, осталось немного, а PDF открывает любой браузер и просмотрщик документов. Если файл нужен только вам и он крупный, практичнее поставить читалку DJVU и сохранить исходный объём.