Чтение онлайн

ЖАНРЫ

Создание электронных книг из сканов. DjVu или Pdf из бумажной книги легко и быстро
Шрифт:

О картинках.Если в книге встречаются фотографии, то самым простым, но не оптимальным по качеству способом является использование опять таки кромсатора ©. Во время просмотра результатов предварительного кромсания, выделите мышкой иллюстрацию и в контекстном меню (по правой кнопке мыши) выберите метод Exlude and Mark as dither regione.

3. Кодирование

Кодировать в djvu можно двумя способами.

Первый, использовать или свободно распространяемую программу Solo 3.1(в этой программе используется старый алгоритм кодирования) или Document Express Editorверсий от 4 до 6. Это делается

просто, запускаем программу, загружаем первую страницу (только одну!), добавляем к первой странице остальные, но не более 500 (обычно 200^300). Сохраняем с выбором профиля bitonal и с разрешением 600 dpi.

Второй, рекомендованный способ, это использовать Document Express Enterprise 5.1(доступна облегченная версия этого пакета, объемом около 20 мегабайт). Вначале создаем профиль для кодирования (делается это не часто, можно один раз), для этого запускаем Document Express Enterprise Configuration Managerиз этого же пакета, из списка выбираем профиль Bitonal (600),нажимаем на кнопку Advanced Settings …,в диалоговом окне Advanced Settingsвыбираем закладку Textи ставим Pages Per Dictionaryравным 1000 (конечно, это небольшой экстремизм, можно ограничиться значением 100^200). Сохраняем этот профиль под новым именем. Увеличение размера страниц на словарь, приводит к заметному уменьшению размера файла, до 25%.

Запускаем Document Express Enterprise Workflow Manager,загружаем все страницы зараз, в поле Job Nameпишем название книги, из списка Raster Profileвыбираем, подготовленный ранее профиль, переключаемся на закладку Outputи из списка Separate Document ( s ) byвыбираем One document only .Ставим галочку (с самого левого края под Enable )и ждем конца кодирования, следим или пока эта галка исчезнет или по закладке Log .

4. Создание текстового слоя

После того, как все уже сделано, остановится на этом просто себя не уважать, не говоря уж об остальных.

Для добавления распознанного текстового слоя в djvu книгу потребуется две программы. Первая это FineReader 7.0или 8.0версии. Вторая программа, это небольшая утилита DjvuOCR 2.1от болгарского камрада Gencho.

Загружаем все, обработанные в кромсаторе, тифы в FineReader,те из которых была сделана djvu книжка, и распознаем в пакетном режиме. После распознавания, ничего не правим, не вычитываем, просто сохраняем пакет на диск, желательно путь для того пакета надо выбирать попроще, у DjvuOCRмогут быть проблемы, если в названии пакета и/или пути будут кириллические символы. С FineReaderвсе. Ура, ура, ура, появилась новая версия этой утилиты 2.2, в которой сняты эти ограничения. Теперь можно редактировать текст после распознавания в ФР, соблюдая некоторые ограничения:

а) при редактировании сохранять некоторые символы оригинального текста (например интервалы), т.е. не переписывать

большие блоки;

б) желательно сохранять количество строк в параграфе (т.е. не стирать знаки конца строки).

Кстати, для наших целей вполне подойдет триальная версия FineReader,которую можно свободно скачать с официального сайта разработчика.

ЗапускаемDjvuOCR, жмем на кнопкуManual made OCR manager

< image l:href="#" />

Далее, тоже все просто:

FineReader Project directory– выбираем каталог с проектом.

Output OCR text file– это любой, пустой текстовой файл, помещенный в каталог с проектом.

Ставим галочку на Burn DJVU fileи выбираем djvu книжку.

Нажимаем Process.

Ждем несколько минут. И всё.

Добавление обложки

В добавлении обложки, если не преследовать сверхзадач, никаких особых хитростей нет. Сканируем обложку в цвете в 200 дпи, чистим ее по вкусу, слегка размываем ее и кодируем в djvu профилем Photo(300). Полученный файл добавляем в книгу, например с помощью Document Express Editor.

З.Ы. Поступают жалобы, что таким образом сделанная обложка имеет размер меньший, чем страницы книги, что выглядит не эстетично, поэтому делайте обложку, как Вам больше нравится, сохраняя размер в пределах разумного. Говорят, есть метода от Minorа по созданию сверх компактных обложек в 600 дпи, если не лень, поищите.

Оглавление

Знаете ли Вы, что в Вашу книгу можно вставить оглавление? А между прочим, благодаря уважаемому Shea,это поразительно просто! Для этого воспользуемся утилитой DjVu Hyperlinks Editor.

Добавляемкнигу, указываем, на каких страницах находится оглавление (нумерация с учетом обложки), выставляем смещение 1 (для компенсации обложки) и жмем Создать!

Конечно, без глюков пока не обходится, проверьте на всякий случай результат, вопиющие случаи можно и поправить в ручную (см. вставку оглавления ручным случаем чуть ниже).

Аналогично, с помощью этой программы, можно создать предметный указатель (Тип работы).

Подробнее, обо всех возможностях программы, можно почитать в сопроводительном файле.

В 5 и 6 версии Document Express Editorэто же можно сделать мышкой. Жмем на кнопку – прямоугольная гиперссылка, обводим пункт меню, выскакивает окно диалога – свойство гиперссылки, в котором выбираем линк на номер страницы и затем соответственно сам этот номер. Ну и так далее, пока рука не отсохнет. Только делаем это в самый последний момент, после добавления обложки, вкладок и пр., иначе ссылки сдвинутся.

7. Использованные программы и где их взять

IrfanViewwww.irfanview.com freeware

ScanKromsatorhttp://www.djvu-soft.narod.ru/ freeware

Solo 3.1http://www.djvu-soft.narod.ru/ freeware

Document Express Editorhttp://www.djvu-soft.narod.ru/?

Document Express Enterprisehttp://www.djvu-soft.narod.ru/?

Поделиться с друзьями: