Направление конвертации
Конвертация DJVU в PDF
Преобразование DJVU → PDF на сервере, без установки программ
- Загрузить
- Выбрать формат
- Скачать
Загрузка файлов
Область приёма файла
или
Файлы DJVU. До 5 МБ, до 20 файлов за раз. Изображение можно вставить из буфера обмена: Ctrl+V.
Оба формата хранят книгу постранично, поэтому вид разворотов не меняется. DJVU сжимает сканы эффективнее, так что PDF почти всегда получается крупнее исходника. Если нужен только текст, выберите DJVU → TXT.
Исходники и результаты хранятся 60 минут, затем стираются фоновым уборщиком. Предельный размер файла — 5 МБ, срок хранения — час.
DJVU и PDF: характеристики
| Характеристика | .djvuDJVU | .pdfPDF |
|---|---|---|
| Полное название | DjVu Document | Portable Document Format |
| Разработчик | AT&T Bell Labs (Ян Лекун, Леон Ботту, Патрик Хаффнер) | Adobe |
| Год появления | 1996 | 1993 |
| Расширения | .djvu, .djv | нет данных |
| MIME-типы | image/vnd.djvu, image/x-djvu | application/pdf, application/x-pdf, application/acrobat |
| Содержимое | Двоичное | Текст, вектор, растр, формы |
| Сжатие | С потерями | нет данных |
| Несколько страниц в файле | Поддерживается | Поддерживается |
| Назначение | Сканы книг и документов | нет данных |
| Слои | Маска текста, фон и передний план — по отдельности | нет данных |
| Алгоритмы | JB2 для текста, IW44 для фона | нет данных |
| Текстовый слой | Поддерживается, поиск по книге работает | нет данных |
| Размер | В 5–10 раз меньше сопоставимого PDF | нет данных |
| Чем открыть | DjView (DjVuLibre), WinDjView, STDU Viewer, SumatraPDF, Okular | Adobe Acrobat Reader, Foxit Reader, SumatraPDF, Google Chrome, Microsoft Edge, Просмотр (macOS) |
| Спецификация | Описание формата | Описание формата |
| Расширение | нет данных | |
| Прозрачность | нет данных | Поддерживается |
| Стандарт | нет данных | ISO 32000-2 |
| Вёрстка | нет данных | Фиксированная, не зависит от устройства |
| Шрифты | нет данных | Встраиваются в файл |
| Защита | нет данных | Пароль, права доступа, подпись |
Преобразование DJVU → PDF
DJVU разработан под сканы и разделяет страницу на слои: маска текста кодируется алгоритмом JB2 по словарю повторяющихся форм букв, фон и цветной слой — вейвлетным преобразованием IW44 с пониженным разрешением. PDF такой послойной модели не знает, поэтому страницы переносятся в него изображениями. Разворот выглядит точно так же, а файл становится крупнее.
Рост объёма в полтора-три раза — прямое следствие смены модели. JB2 находит в чёрно-белом скане повторяющиеся формы символов и хранит словарь плюс ссылки на него, а фон описывает вчетверо-вшестеро более грубой сеткой, чем текст. Ни того, ни другого в целевом контейнере нет: изображение страницы упаковывается обычным способом, и специализированная экономия теряется. Это свойство форматов, а не признак сбоя.
Качество сканов не улучшается и не ухудшается специально. Разрешение, контраст и перекос страницы переносятся как есть; автоматического выравнивания геометрии и подтяжки контраста не выполняется намеренно — на плохих сканах такая обработка портит мелкий текст чаще, чем спасает. Цветные развороты остаются цветными, чёрно-белые не разворачиваются в цвет без нужды.
Распознавания текста сервис не выполняет ни на одном направлении. Если в исходном DJVU был текстовый слой, добавленный при создании, проверьте поиск в готовом PDF отдельно: перенос слоя зависит от того, как он записан в исходнике. Когда из книги нужен только текст, короче маршрут DJVU → TXT, а для отдельных страниц — DJVU → JPG. Настроек у направления нет, на задание отводится 600 секунд.
Порядок преобразования DJVU → PDF
Шаг 1
Оценка исходника
Посмотрите, работает ли поиск по тексту в самом DJVU. Это сразу показывает, есть ли в файле текстовый слой или перед вами чистый скан.
Шаг 2
Загрузка книг
За задание принимается несколько файлов. Параметров у направления нет: цветность и разрешение берутся из исходника.
Шаг 3
Постраничный перенос
Страницы декодируются из слоёв DJVU и укладываются в PDF изображениями. На книгу в несколько сотен разворотов уходит одна-две минуты.
Шаг 4
Проверка разворотов
Пролистайте начало, середину и конец: убедитесь, что все страницы на месте и читаются. Рост объёма относительно DJVU ожидаем.
Вопросы по работе сервиса
Почему PDF получился в два раза больше?
DJVU кодирует текстовую маску алгоритмом JB2 по словарю повторяющихся форм, а фон хранит с пониженным разрешением — на чёрно-белых сканах это даёт выигрыш, который не воспроизводится в другом контейнере. При переносе страница становится обычным изображением, и экономия теряется. Рост в полтора-три раза — нормальный результат.
Будет ли работать поиск по тексту?
Только если текстовый слой уже был в исходном DJVU, и даже тогда его перенос стоит проверить в готовом файле. Собственного распознавания сервис не выполняет ни здесь, ни на других направлениях, поэтому из чистого скана получится PDF из изображений.
Улучшится ли читаемость плохого скана?
Нет. Страницы переносятся с исходным разрешением, контрастом и перекосом. Автоматическая правка геометрии и уровней не применяется сознательно: на малоконтрастных сканах она разрушает тонкие штрихи букв чаще, чем улучшает вид разворота.
Есть ли смысл конвертировать ради удобства чтения?
Смысл в доступности: программ, читающих DJVU, осталось немного, а PDF открывает любой браузер и просмотрщик документов. Если файл нужен только вам и он крупный, практичнее поставить читалку DJVU и сохранить исходный объём.