|
|
|
Irbys27
  Стаж: 16 лет 5 месяцев Сообщений: 2454
|
Irbys27 ·
18-Мар-14 02:02
(12 лет 4 месяца назад)
$Shorox
Все эти манипулирования мало помогают. Finerider в неплохом качестве сохраняет текстовые, да и не только, страницы. А если выводить сканы страниц с dpi 400, то и размер исходного файла вполне приемлем.
|
|
|
|
$Shorox
 Стаж: 17 лет 5 месяцев Сообщений: 1673
|
$Shorox ·
18-Мар-14 04:37
(спустя 2 часа 35 мин.)
Irbys27
Эта разница хорошо видна в текстах при сканировании в 600 DPI.
Постепенно склоняюсь к мысли, что для текстовых страниц при хорошей печати достаточно сканировать в 300 DPI.
Никто не будет увеличивать буквы в полэкрана, чтобы прочитать. Разницу между 600 и 300 часто можно заметить только при большом увеличении
|
|
|
|
DjVu-Master
 Стаж: 16 лет 6 месяцев Сообщений: 6113
|
DjVu-Master ·
18-Мар-14 11:00
(спустя 6 часов)
$Shorox писал(а):
63323955Постепенно склоняюсь к мысли, что для текстовых страниц при хорошей печати достаточно сканировать в 300 DPI.
В 400DPI самое то.
|
|
|
|
karl_karlsson
 Стаж: 19 лет 11 месяцев Сообщений: 378
|
karl_karlsson ·
18-Мар-14 20:02
(спустя 9 часов)
Irbys27 писал(а):
63231956
Цитата:
Q: Почему не остановиться на djvu, полученном при помощи Finereader?
A: Значительно хуже качество кодирования
Скажите, пожалуйста, существуют какие-нибудь особенные настройки для улучшения кодирования в программе Djvu small? При настройках по умолчанию никаких существенных различий в качестве кодирования от варианта Finereader не увидел (имеется в виду простой текст, а не картинки), кроме более сжатого выходного файла.
Кодирование в DjVu всегда ухудшает качество, и только если у вас lossless, то только тогда качество остается в точности какое было до кодирования.
Меняя настроек, в точности Text quality и Pages per dict вы только сделаете файлик меньше. Ну можно в 2-3 раза меньше, но соответственно качество будет хуже. Чем лучше качество оригинала, тем заметнее будет это.
FineReader ухудшает качество до кодирования в DjVu.
$Shorox писал(а):
63323955Irbys27
Эта разница хорошо видна в текстах при сканировании в 600 DPI.
Постепенно склоняюсь к мысли, что для текстовых страниц при хорошей печати достаточно сканировать в 300 DPI.
Никто не будет увеличивать буквы в полэкрана, чтобы прочитать. Разницу между 600 и 300 часто можно заметить только при большом увеличении
Попробуйте что нибудь типа iPad Mini с ретиной, где разрешение экрана на самом деле и составляет ~325 dpi.
Там вся эта разница сразу видна. Уже существуют смартфоны с разрешением ~600 dpi, скоро будут и такие планшеты. Недалеко и время, когда и мониторы такие появятся.
Ну для монитора ниже 150 dpi вам и те же самые 150 dpi хватают. Была у меня книжка с Google Books в 85 dpi и читается...
DjVu-Master писал(а):
В 400DPI самое то. 
Большинство сканеров 400 dpi не поддерживают, либо если поддерживает, то получается оно путем интерполяции (где то продвинутая, чаще очень даже плохая) с те же самые 300 dpi. Если у вас скорость в 400 dpi равняется скорости в 300 dpi там точно интерполяция.
Обычно 400 dpi поддерживают сканеры, у которых физическое разрешение составляет 800 dpi. Это либо напрямую указывается, либо там сказали 1200 dpi, которые на самом деле получается путем интерполяции с 800 dpi.
Я во общем то уже писал - практически все руководства по сканированию и обработки содержат большое число напрямую неверных утверждении, слишком большие не проверенные обобщения, либо отсутствуют, точны ответы, проверенные опытным путем, на самые важные и часто встречающиеся вопросы.
|
|
|
|
DjVu-Master
 Стаж: 16 лет 6 месяцев Сообщений: 6113
|
DjVu-Master ·
18-Мар-14 21:47
(спустя 1 час 45 мин., ред. 18-Мар-14 21:47)
karl_karlsson писал(а):
63331356Если у вас скорость в 400 dpi равняется скорости в 300 dpi там точно интерполяция.
Да вроде чуток дольше идет сканирование при 400 dpi на моем Mustek Be@rPaw 2448CU Pro.
|
|
|
|
$Shorox
 Стаж: 17 лет 5 месяцев Сообщений: 1673
|
$Shorox ·
19-Мар-14 04:27
(спустя 6 часов)
DjVu-Master
Мысль перейти от в 600 DPI на меньшее в основном из-за скоростей. Сканирование + обработка в 2-3 раза дольше.
|
|
|
|
Capricornia
  Стаж: 15 лет 5 месяцев Сообщений: 201
|
Capricornia ·
14-Апр-14 09:54
(спустя 26 дней)
Спасибо за тему! сейчас тоже в процессе экспериментов с форматами и чисткой сканов
|
|
|
|
SI{AY
 Стаж: 18 лет 4 месяца Сообщений: 1510
|
SI{AY ·
14-Апр-14 10:48
(спустя 54 мин., ред. 14-Апр-14 10:48)
$Shorox, от сканера и драйверов зависит скорость сканирования. К примеру, мой сканер в линухе в цвете 600dpi сканирует быстрее и тише чем в винде оттенки серого 600dpi
|
|
|
|
---lll
 Стаж: 12 лет 6 месяцев Сообщений: 685
|
---lll ·
14-Апр-14 21:57
(спустя 11 часов)
Irbys27 писал(а):
62471233Есть какой-нибудь способ быстро очистить сканы от мелкого мусора (спеклов)?
$Shorox писал(а):
63323955Постепенно склоняюсь к мысли, что для текстовых страниц при хорошей печати достаточно сканировать в 300 DPI.
Никто не будет увеличивать буквы в полэкрана, чтобы прочитать. Разницу между 600 и 300 часто можно заметить только при большом увеличении
Смотря где.
Растровая форма хранения книг особенно часто применяется для книг с формулами. В этом случае сканирование с разрешением 600dpi обязательно, иначе трудно будет разобрать индексы в формулах, отличить похожие буквы, например "омега" и w. А ведь в математике нередки вложенные индексы (индекс индекса). Там при сканировании с разрешением 300dpi вообще трудно что-либо разобрать, тем более распечатать. Вот смотрите:
DjVu-Master писал(а):
63325883В 400DPI самое то. 
Да.
|
|
|
|
Flo2010
 Стаж: 16 лет 6 месяцев Сообщений: 86
|
Flo2010 ·
17-Апр-14 16:23
(спустя 2 дня 18 часов, ред. 17-Апр-14 16:23)
tlotr11, по вашей инструкции с предыдушего листа треда переделала тот же файл.
Большое спасибо за разбор, у меня начинает получаться!
Получилось так:
1) Первичные сканы "как есть", в Tiff (400 dpi) В целой книге было бы около 300 разворотов, тестила на 20 разворотах.
2) По инструкции из головного поста вся пачка полученных Тифов прогоняется через Scan Tailor.
Все оказалось совсем не страшно. Получились вот такие аккуратные нарезанные надвое развороты. Хотя выровнять некоторые скосы букв на заломе страниц (на скриншоте заметно) все же не удалось. Но читаемость от этого все равно не страдает.
3) Программой DjVu Small - эта пачка обработанных страниц собирается в DjVu. Но без распознавания.
4) Создать ORC-слой. Тут некоторая загвоздка. Все-таки делаю это в FR 11. Хотя и медленно (прокачивает файлы долго). fr11DTLcrutch - говорит, что "отсутствует текстовой слой, созданный в ФР".
DjvuOCR По инструкции отсюда https://rutr.life/forum/viewtopic.php?t=3148329 Я не вижу, в чем разница между предыдущим пунктом (распознать текстовой слой в ФР и сохранить его прямо оттуда в формат DjVu, и прохождение всех этапов инструкции по этой ссылке? Итого: в целом, все получилось, по инструкции. И итоговый файл выглядит достаточно аккуратно, на "4+". С расстановкой оглавлений внутри документа пока не игралась. Где остались сомнения:
1) извлечение текстового слоя. ФР это умеет, пользуюсь им, но это медленно.
2) при распознавании через ФР книги с дореформенной орфографией некорректно считываются яти и подобные им буквы. Это реально как-то поправить, или проще смириться? )
|
|
|
|
tlotr11
 Стаж: 18 лет 2 месяца Сообщений: 527
|
tlotr11 ·
17-Апр-14 18:25
(спустя 2 часа 1 мин., ред. 18-Апр-14 09:56)
Flo2010 писал(а):
63634242tlotr11, по вашей инструкции с предыдушего листа треда переделала тот же файл.
Большое спасибо за разбор, у меня начинает получаться!
Рад, что смог убедить пересмотреть технологию.  Готов ответить на вопросы по пунктам.
Flo2010 писал(а):
63634242Получились вот такие аккуратные нарезанные надвое развороты. Хотя выровнять некоторые скосы букв на заломе страниц (на скриншоте заметно) все же не удалось.
Это легко исправляется на вкладке "Исправление кривизны строк" в том же Scan Tailor Featured (на стадии вывода справа есть вкладки). Если не забуду, сделаю скриншот интерфейса программы в это сообщение чуть позже. Updated: Не забыл:
Принцип простой: ставите и двигаете красные точки, добиваясь изменения сетки сообразно искривлению строк.
Flo2010 писал(а):
636342424) Создать ORC-слой. Тут некоторая загвоздка. Все-таки делаю это в FR 11. Хотя и медленно (прокачивает файлы долго).
Да, именно так. Распознавание производится в FR11
Flo2010 писал(а):
63634242fr11DTLcrutch - говорит, что "отсутствует текстовой слой, созданный в ФР".
Предположу, что вам не вполне понятна роль данной утилиты: она нужна для того, чтобы перенести текстовый слой из одного djvu файла в другой. То есть, ей скармливается файл, сохранённый FR11 в формате djvu, а в качестве выходного указывается тот, что получен при помощи Djvu Small. Таким образом получаем файл, собранный Djvu Small, но с текстом OCR.
Flo2010 писал(а):
63634242DjvuOCR По инструкции отсюда https://rutr.life/forum/viewtopic.php?t=3148329 Я не вижу, в чем разница между предыдущим пунктом (распознать текстовой слой в ФР и сохранить его прямо оттуда в формат DjVu, и прохождение всех этапов инструкции по этой ссылке?
Он корректно работает, насколько я помню, лишь с проектами FR ранних версий (что-то вроде седьмой). Сейчас данная утилита уже не нужна, так как FR11 умеет сохранять djvu-файлы, а fr11DTLcrutch переносить полезное содержимое в другой djvu-файл.
Flo2010 писал(а):
63634242Итого: в целом, все получилось, по инструкции. И итоговый файл выглядит достаточно аккуратно, на "4+". С расстановкой оглавлений внутри документа пока не игралась.
А это очень увлекательно! Можно ведь сделать:
- Оглавление,
- Гиперссылки внутри текста, придав строчке вроде "рассматривается на странице 284" возможность сразу и перенести на данную страницу
- Всплывающие подсказки
- Раскрасить чёрный текст в другие цвета (воссоздав оригинальное оформление книги)
- ... что-то ещё, наверняка, о чём я забыл
Например, вот в раздаче 57223441 есть скриншот с некоторыми наворотами:
. Правда сама книга - это один из моих самых позорных по качеству "первых блинов", который уже год как пытаюсь найти время переделать в соответствии с наработанным опытом.
Flo2010 писал(а):
63634242Где остались сомнения:
1) извлечение текстового слоя. ФР это умеет, пользуюсь им, но это медленно.
Наиболее качественно на данный момент.
Flo2010 писал(а):
636342422) при распознавании через ФР книги с дореформенной орфографией некорректно считываются яти и подобные им буквы. Это реально как-то поправить, или проще смириться? )
А подключён ли словарь со старой орфографией " Русский (старая орфография)" в настройках? Может быть, дело просто в этом?
Надеюсь, что эти пункты вас больше никогда не будут беспокоить:
первый блин
-
Flo2010 писал(а):
62976866В ACDSee или ином аналоге кропом обрезать лишние куску странниц, оставшиеся при сканировании черные поля и т.д. Стараться, чтобы размер кропа был одинаковым на всем листах.
-
Flo2010 писал(а):
62976866По желанию вручную подчистить в Фотошопе различные мелкие дефекты картинки.
-
Flo2010 писал(а):
62976866...с вычищенными тенями от корешка и автоматической подгонкой наклона-кропа (а не в ACD-See, как это делала я)
Если что, обращайтесь! Дорогу осилит идущий.
|
|
|
|
SI{AY
 Стаж: 18 лет 4 месяца Сообщений: 1510
|
SI{AY ·
17-Апр-14 19:46
(спустя 1 час 21 мин.)
словарь со старой орфографией почти никакой. где то был в интернете пользовательский )находил его года 3 назад случайно) но и там крайне много ошибок. лучше уж без ocr . на форумн файнридера все обещают обещают нормальный словарь сделать, но увы
|
|
|
|
---lll
 Стаж: 12 лет 6 месяцев Сообщений: 685
|
---lll ·
17-Апр-14 21:02
(спустя 1 час 15 мин.)
SI{AY писал(а):
63636546словарь со старой орфографией почти никакой. где то был в интернете пользовательский )находил его года 3 назад случайно) но и там крайне много ошибок. лучше уж без ocr .
Если речь идёт о словаре от Павла Черникова то лучше Вы вряд ли найдёте. Так что настоятельно советую посмотреть с чего начиналась Родина, по ссылке внизу.
Цитата:
на форумн файнридера все обещают обещают нормальный словарь сделать, но увы
В ABBYY FineReader 12 это реализовано.
|
|
|
|
SI{AY
 Стаж: 18 лет 4 месяца Сообщений: 1510
|
SI{AY ·
18-Апр-14 03:38
(спустя 6 часов)
а Вы проверяли эту реализацию? я вот положительных отщывов не нашел)
|
|
|
|
---lll
 Стаж: 12 лет 6 месяцев Сообщений: 685
|
---lll ·
18-Апр-14 07:37
(спустя 3 часа)
SI{AY писал(а):
63640183а Вы проверяли эту реализацию?
Проверял.
Прогнал через последний FR11 со словарём некоторый текст, потом через FR12, поставив "птичку" возле необходимого языка. Отличий - доли процента. На чём спотыкается словарь так это на том что в нём нет сочетаний типа - "нетъ -ли", "онъ -же" и т.д. А так как таких сочетаний катастрофически мало в тексте, да и внести их можно в словарь, считаю последний - довольно хорошим подспорьем в оцифровке книг и журналов в дореформенной орфографии.
Как только вылечат и оптимизируют FR12, пересяду на него.
Цитата:
я вот положительных отщывов не нашел)
Настоятельно Вам рекомендую сложить своё мнение о продукте и его функциональности, тем более что повторить вышеприведённый несложный трюк может всякий желающий.
|
|
|
|
SI{AY
 Стаж: 18 лет 4 месяца Сообщений: 1510
|
SI{AY ·
18-Апр-14 08:28
(спустя 51 мин.)
у меня в планах сейчас нет ничего со старо-русской орфографией. поэтому в данном случае я просто то что на форумах видел то и говорю. если теперь хорошо распознается - отлично)
|
|
|
|
Irbys27
  Стаж: 16 лет 5 месяцев Сообщений: 2454
|
Irbys27 ·
19-Апр-14 02:17
(спустя 17 часов)
---lll писал(а):
63607263
Irbys27 писал(а):
62471233Есть какой-нибудь способ быстро очистить сканы от мелкого мусора (спеклов)?
Это в какой версии программы есть продвинутые параметры кодирования? Подскажите, плиз.
|
|
|
|
---lll
 Стаж: 12 лет 6 месяцев Сообщений: 685
|
---lll ·
19-Апр-14 13:03
(спустя 10 часов)
Irbys27 писал(а):
Это в какой версии программы есть продвинутые параметры кодирования? Подскажите, плиз.
Пользуюсь последней на данный момент версией - DjVu Small Mod v.0.6.5
Хочу прояснить некоторые моменты. DjVu Small Mod добавил сюда как ещё один вариант к ...
Вообще, советую не изобретать велосипед а использовать Book Restorer, он есть и на рутрекере но я брал отсюда (только русский язык сверху не накатывайте).
Сюда же можно добавить и плагин для PS Reprint Master от Евгения Трефилова да и в GIMP'е тоже есть функция "удаления пятен". Это если Вы знакомы с одним из или с обеими редакторами. Если нет то, BookRestorer Вам в руки.
Как-то так.
|
|
|
|
rioter11
  Стаж: 19 лет Сообщений: 1648
|
rioter11 ·
08-Май-14 07:48
(спустя 18 дней)
Цитата:
Book Restorer, он есть и на рутрекере но я брал отсюда (только русский язык сверху не накатывайте).
У меня Book Restorer очень часто вылетает. Просто может закрыться на ровном месте после любой операции с потерей результатов работы.
Это из-за русификации?
|
|
|
|
$Shorox
 Стаж: 17 лет 5 месяцев Сообщений: 1673
|
$Shorox ·
08-Май-14 08:11
(спустя 22 мин.)
rioter11
Русифицированный Book Restorer удалил, потому что часть функций вообще не работала.
|
|
|
|
---lll
 Стаж: 12 лет 6 месяцев Сообщений: 685
|
---lll ·
08-Май-14 13:01
(спустя 4 часа)
rioter11 писал(а):
63860240У меня Book Restorer очень часто вылетает. <...>
Это из-за русификации?
народ так говорит.
|
|
|
|
<Ra>
 Стаж: 17 лет 4 месяца Сообщений: 169
|
<Ra> ·
27-Май-14 21:18
(спустя 19 дней, ред. 27-Май-14 21:18)
Здравствуйте!
Я пытаюсь распознать метод пособие по музыке и столкнулся с проблемой.
Там есть ноты (единичные, а не вырезки целых фрагментов из произведений). Я их распознаю шрифтом Maestro. В настройках ФР8 выставляю "использовать системные шрифты" и ставлю галочку "встраивать шрифты". Но ФР при сохранении в пдф отказывается встраивать шрифт Maestro (вместо нот там либо крякозябры, либо буквы, либо вообще не сохраняет в пдф). Можете мне подсказать как сделать, чтобы шрифт встраивался? И будут ли ноты потом при copy-paste считываться (maestro ведь системный шрифт)?
И еще...
Как извлечь текстовый слой из пдф (я распознал в ФР уже) и потом подшить его в уже готовую пдфку?
В интернете нашел только как извлекать просто текст или как распознавать документ.
Столкнулся еще с такой проблемой. Текст после подшивки в djvu выделяется не по порядку, а в разнобой. Понял, что это из-за того, что ФР распознал блоки текста в разном порядке (скрин):
Скажите, как можно исправить это? Очень не хочется заново всю книгу распознавать и вычитывать...
|
|
|
|
tlotr11
 Стаж: 18 лет 2 месяца Сообщений: 527
|
tlotr11 ·
28-Май-14 01:58
(спустя 4 часа, ред. 28-Май-14 01:58)
<Ra> писал(а):
64070044Столкнулся еще с такой проблемой. Текст после подшивки в djvu выделяется не по порядку, а в разнобой. Понял, что это из-за того, что ФР распознал блоки текста в разном порядке (скрин):
Скажите, как можно исправить это? Очень не хочется заново всю книгу распознавать и вычитывать...
По первым проблемам не подскажу, я специализируюсь на djvu. Что касается последнего вопроса, то в свойствах области (у меня FR11) можно принудительно задать номер области.
Вопрос лишь в том, ЗАЧЕМ вам это. Какое-то значение это может иметь, если вы расчитываете переводить книгу, скажем, в формат MS Word. Тогда копирование таких областей даст на выходе месиво текста, это да. Если же 99% использования тестового слоя будет использоваться для ПОИСКА текста, то даже думать забудьте о расстановке блоков вручную. Потратите десятки часов на ненужную работу. Произведённая вами вычитка уже приблизила книгу к идеалу. Лучше за это время сделайте ещё пару книг! Сами подумайте: если, скажем, мне даже потребуется скопировать несколько абзацев теста, то я сразу увижу, что скопировалось неправильно и скопирую текст меньшими блоками - по абзацу, по предложению в конце-концов. У любого на это уйдут считанные минуты, а вы готовы тратить часы.
Если хочется ещё "повылизывать" своё детище, то добавьте в книгу оглавление, гиперссылки, почистите от возможного мусора, исправьте найденные при вычитке опечатки в тексте...
|
|
|
|
<Ra>
 Стаж: 17 лет 4 месяца Сообщений: 169
|
<Ra> ·
28-Май-14 10:08
(спустя 8 часов)
Цитата:
Лучше за это время сделайте ещё пару книг!
Думаю Вы правы)))
|
|
|
|
папаВлад
  Стаж: 15 лет 7 месяцев Сообщений: 2587
|
папаВлад ·
25-Июн-14 22:35
(спустя 28 дней)
DjVu-Master
Чуть добавлю некоторые моменты, возможно будет понятно только имеющим опыт.
На мой взгляд версия Scan Tailor "Enhanced" несколько функциональнее чем "Featured" от уважаемого monday2000,
но по ней и инструкцию по пользованию придёться дополнять. Хотя, для начинающих и "Featured" будет достаточен, лишь бы освоили с меньшими времязатратами.
-
Ещё у Вас то ли ошибка, или какое недопонимание, но почему Вы предлагаете на Выводе в Scan Tailor-е ставить 300 DPI? Не соглашусь, обычно для книг на 600, и в редких случаях 300, когда все страницы сохраняются в цвете, типа журналы, да и их тоже можно выводить в 600, а при сжатии подбирать оптимальный вариант, по вкусу.
-
Тем более странно выглядит предложение сканировать на 400 или 600, чтобы потом убавить до 300.
Кстати, действительно, был когда-то UMAX, правильно понимающий 400, более таких сканеров не встречал.
-
Старые оцифровщики знают, что можно сканировать на 600, но долго, либо сканировать быстро на 300, а на выводе увеличивать до 600, при этом размеры картинки автоувеличиваются в 2 раза, так будет чуть хуже результат, зато намного шустрее. Можно, где крупный шрифт и обложки сканить на 300, а где мелкий текст попадается, такие на 600, а на Выводе в Scan Tailor-е выставляем 600, все страницы выйдут в одном размере с одинаковым DPI.
Ещё предложу свой проверенный способ, но пригодный только для pdf со сжатием ClearScan. Эта технология, как и в djvu, создаёт некий словарь похожих символов/букв, но в djvu этот словарь создаётся заново каждые 10-50 страниц (точно не помню), а в pdf набор словаря не меняется до конца книги. Соответственно, если сканирование начала книги будет наиболее чётким, то и в последующем похожие символы будут браться из первых страниц. Потому я сканирую начало книги на 600, порядка 20-50 страниц, а далее хоть тысячу можно смело на 300, если шрифт не меняется. Если внутри книги идёт смена шрифта, то опять немного на 600, далее 300. Также повышаю, если текст совсем мелкий, обычно в конце книги примечания, оглавления и прочее.
Да, набор сырых сканов разнобойный по DPI и размеру сторон, но они выравниваются на Выводе 600 в единые цифры Scan Tailor-ом. Ну, а после сжатия с ClearScan, где тоже в настройках вывода ставлю 600, выходит шрифт в начале, середине и конце книги одинаково идеальные, а обложки можно потом вставить с меньшим DPI, по вкусу.
-
Не надо бы так навязчиво предлагать использование для сканирования IrfanView, он подойдёт не всем, последние Plustek-и имеют конфликты со сторонними программами, и даже VueScan отказался работать. При этом своё окно сканирования не настолько плохо, чтобы его менять, надеюсь и другие производители улучшают функционал на родных драйверах. Думаю, стоит попробовать IrfanView, если родная программа совсем неудачная.
-
Scan Tailor, Вывод, Зона заливки - не увидел в инструкции пояснения по этому пункту, а ведь там есть очень нужная функция. Основная - это удаление различного мусора, типа пятен, штампов, записей ручкой... А также можно дорисовать нехватающие элементы, к примеру плохопропечатанные буквы, строки таблиц, в общем всё то, что Вы считаете нужным поправить, в любом цвете, присутствующем на странице. Допустим, вижу букву "с", при этом уверен, что здесь должна быть "е", нет кусочка, его можно тут же дорисовать, выделяю контур, далее жму ПКМ по выделению, вижу меню с выбором цвета.
|
|
|
|
DjVu-Master
 Стаж: 16 лет 6 месяцев Сообщений: 6113
|
DjVu-Master ·
25-Июн-14 23:21
(спустя 45 мин., ред. 27-Июн-14 09:32)
папаВлад
Цитата:
Ещё у Вас то ли ошибка, или какое недопонимание, но почему Вы предлагаете на Выводе в Scan Tailor-е ставить 300 DPI?
-
Тем более странно выглядит предложение сканировать на 400 или 600, чтобы потом убавить до 300.
Да не исправил. облом было рыться в коде сообщения.
Цитата:
Не соглашусь, обычно для книг на 600, и в редких случаях 300, когда все страницы сохраняются в цвете, типа журналы, да и их тоже можно выводить в 600, а при сжатии подбирать оптимальный вариант, по вкусу.
Я сейчас сканю стандартно в 400 и вывожу в 400. Есть у меня старые сканы людей в 300дпи - я их вывожу тоже в 400. Да, если мелкий текст то сканить нужно в 600 и выводить в 600. Все зависит от содержания страниц. Уже это обсуждали где-то на трекере.
Цитата:
Кстати, действительно, был когда-то UMAX, правильно понимающий 400, более таких сканеров не встречал.
-
Мой сканер дольше сканит в режиме 400 чем при 300 дпи. Логично что он понимает 400.
Цитата:
Не надо бы так навязчиво предлагать использование для сканирования IrfanView, он подойдёт не всем, последние Plustek-и имеют конфликты со сторонними программами, и даже VueScan отказался работать. При этом своё окно сканирования не настолько плохо, чтобы его менять, надеюсь и другие производители улучшают функционал на родных драйверах. Думаю, стоит попробовать IrfanView, если родная программа совсем неудачная.
Я предложил самый быстрый , простой и проверенный способ сканирования. И вообще этот способ я вычитал из какого-то фака. До этого я долго и нудно сканил фанстоном / первые свои книжки.
Цитата:
Ещё предложу свой проверенный способ, но пригодный только для pdf со сжатием ClearScan. Эта технология, как и в djvu, создаёт некий словарь похожих символов/букв, но в djvu этот словарь создаётся заново каждые 10-50 страниц (точно не помню), а в pdf набор словаря не меняется до конца книги. Соответственно, если сканирование начала книги будет наиболее чётким, то и в последующем похожие символы будут браться из первых страниц. Потому я сканирую начало книги на 600, порядка 20-50 страниц, а далее хоть тысячу можно смело на 300, если шрифт не меняется. Если внутри книги идёт смена шрифта, то опять немного на 600, далее 300. Также повышаю, если текст совсем мелкий, обычно в конце книги примечания, оглавления и прочее.
Да, набор сырых сканов разнобойный по DPI и размеру сторон, но они выравниваются на Выводе 600 в единые цифры Scan Tailor-ом. Ну, а после сжатия с ClearScan, где тоже в настройках вывода ставлю 600, выходит шрифт в начале, середине и конце книги одинаково идеальные, а обложки можно потом вставить с меньшим DPI, по вкусу.
Предлагайте в ЛС кодом. В фак добавлю.
Цитата:
Scan Tailor, Вывод, Зона заливки - не увидел в инструкции пояснения по этому пункту
Вы были не внимательны. На скрины понажимайте.
FAQ по сборке (созданию) DjVu книги из сырых сканов писал(а):
Также при выводе можно очищать страницы от мусора.
Автоматически:
Можно выбрать 3 уровня автоматической очистки.
То что не убирается автоматом можно убрать вручную:
P.S. Про мелкий текст я тоже писал:
Цитата:
Сканировать нужно в 300 DPI ( где текст очень мелкий, то в 600 DPI). Если текст очень мелкий и вы выведите сканы в ч/б режиме 300 Dpi, то может появиться ошибка Инь.
Update/ Я пришлел к выводу что нужно сканить в 400 DPI вместо 300 DPI. 
|
|
|
|
---lll
 Стаж: 12 лет 6 месяцев Сообщений: 685
|
---lll ·
26-Июн-14 21:24
(спустя 22 часа)
папаВлад писал(а):
64369942На мой взгляд версия Scan Tailor "Enhanced" несколько функциональнее чем "Featured" <...>
По точнее, пожалуйста.
Цитата:
Да, набор сырых сканов разнобойный по DPI и размеру сторон, но они выравниваются на Выводе 600 в единые цифры Scan Tailor-ом.
Это что, шутка такая? Если "набор сырых сканов разнобойный по DPI и размеру сторон" то это свидетельствует только об одном - о криворукости оцифровщика.
Править разрешение сканов STF можно конечно, только не понятно зачем заведомо создавать себе такие трудности
|
|
|
|
DjVu-Master
 Стаж: 16 лет 6 месяцев Сообщений: 6113
|
DjVu-Master ·
27-Июн-14 09:48
(спустя 12 часов, ред. 27-Июн-14 09:48)
---lll писал(а):
64378090только не понятно зачем заведомо создавать себе такие трудности

Бывает как насканят с разными дпи, а потом просят собери джвю. То мудохаешся пол дня.
|
|
|
|
папаВлад
  Стаж: 15 лет 7 месяцев Сообщений: 2587
|
папаВлад ·
28-Июн-14 00:01
(спустя 14 часов)
---lll писал(а):
64378090
папаВлад писал(а):
64369942На мой взгляд версия Scan Tailor "Enhanced" несколько функциональнее чем "Featured" <...>
По точнее, пожалуйста.
Вам это никогда не понадобится, иначе хотя бы заглянули.
---lll писал(а):
64378090
папаВлад писал(а):
64369942Да, набор сырых сканов разнобойный по DPI и размеру сторон, но они выравниваются на Выводе 600 в единые цифры Scan Tailor-ом.
Это что, шутка такая? Если "набор сырых сканов разнобойный по DPI и размеру сторон" то это свидетельствует только об одном - о криворукости оцифровщика.
Править разрешение сканов STF можно конечно, только не понятно зачем заведомо создавать себе такие трудности 
Если есть под рукой сканер, то насканируйте для пробы все возможные варианты по DPI, любой сканер сможет минимум 3 варианта, на 150, 300 и 600. Затем попросите у DjVu-Master-а прислать Вам файл на 400, может где-нибудь разыщите на 1200. Вот уже приличный набор, теперь всё в одну папку и в СТ, на Выводе поставьте 600, затем загляните в итоговые значения, там у всех файлов будет 600 и стороны одинаковые. Как это произошло объяснять не буду, пусть это останется тайной, типа фокус-покус.
DjVu-Master писал(а):
64381418
---lll писал(а):
64378090только не понятно зачем заведомо создавать себе такие трудности

Бывает как насканят с разными дпи, а потом просят собери джвю. То мудохаешся пол дня. 
Вариант раз - не править DPI, подсказка выше.
Вариант два - IrfanView - жмите в латинице "T", появились Миниатюры, ищите нужную папку и выделяйте нужные файлы, затем в латинице "B", посмотрите на досуге, там много интересного против мудохания.
Вариант три - ничего не пробовать, самая короткая дорога та, которую хорошо знаешь.
|
|
|
|
DjVu-Master
 Стаж: 16 лет 6 месяцев Сообщений: 6113
|
DjVu-Master ·
28-Июн-14 00:26
(спустя 25 мин., ред. 28-Июн-14 00:26)
папаВлад
Покажите мне для примера собраную вами джвю из сканов с разными DPI и размером сторон. Из одной книги пару страниц подряд.
|
|
|
|