Вы здесьПроблемы и приемы OCR: dewarp
Опубликовано ср, 06/05/2009 - 04:06 пользователем Ulenspiegel
Если при сканировании книжка не прижата плотно к предметному стеклу, участки строк, находящиеся вблизи разворота, искривляются. При сильном искривлении (заползание на уровень соседней строки) программы распознавания приходят от таких червячков в недоумение. Не знает ли всемогущий All алгоритмов и (что еще лучше) готовых программ для борьбы с таким безобразием ?
|
Вход на сайтПоиск по блогам и форумамUser menuПоследние комментарии
sem14 RE:Серия "Символы времени" издательства "Аграф" 1 день
sem14 RE:Собираем серию: "Азбука-триллер", издательство "Азбука-Терра" 1 день sem14 RE:«Юмористическая серия» 1 день Океана RE:Подайте бедному копеечку на книжку с литреса... 3 дня larin RE:Оплатил. Абонемент не отображается 4 дня larin RE:Оплатил, но абонемент не отображается 1 неделя nehug@cheaphub.net RE:DNS 1 неделя alexk RE:Багрепорт - 2 2 недели sem14 RE:Книжная серия "Жизнь в искусстве" издательство "Искусство"... 3 недели Isais RE:Семейственность в литературе 3 недели Violontan RE:Жан Батист Мольер воскрешенный 3 недели sem14 RE:Гонкуровская премия 4 недели Dead_Space RE:Беженцы с Флибусты 1 месяц Саша из Киева RE:Приключения белочки Рыжки 1 месяц alex-from RE:Оплатил два раза, но абонемента нет 1 месяц Kiesza RE:На 78-м году жизни скончался советский и российский... 1 месяц Paul von Sokolovski RE:Бушков умер. 1 месяц lemma7 RE:Серия «Интеллектуальный детектив» изд-ва АСТ 1 месяц Впечатления о книгах
Никос Костакис про Гор: Шаровая молния 3 (Попаданцы, Самиздат, сетевая литература)
20 12 «напитались» реалиями Незалёжной первых лет XXI века. __________________ Незалёжной? Такого слова в украинском языке нет. В русском тоже. Тогда по-каковски это, а?
alexk про Кош: Лакомство для вампира [СИ] (Городское фэнтези, Мистика, Самиздат, сетевая литература)
20 12 ..ать! Ну на хрена портить все ссылки? Удали ты их вообще, если они тебе мешают. Что за гомосятина?
Sello про Гече: Библейские истории (Критика, Религия)
20 12 Такие книги бессиысленно комментировать. Автор, кстати, занят не столько тем, что "раскрывает несостоятельность представлений о "богодухновенности" библейских сказаний, сколько, анализом, поисками точек соприкосновения историчности ………
Олег Макаров. про Прягин: Даль-цвет. Том 1. Охра (Фэнтези, Попаданцы, Самиздат, сетевая литература)
19 12 Давно не было у меня такого, чтобы дочитать том и «а-а-а! теперь же неизвестно сколько ждать следующего!!!» Отлично. С огромным удовольствием от первой до последней страницы. Оценка: отлично!
Олег Макаров. про Денисов: Извлекатели. Группа «Сибирь» [СИ] (Боевая фантастика, Самиздат, сетевая литература)
19 12 Совершенно долбанутая вещь: люди из “прекрасной России настоящего” в параллельном мире - России, где "Путин не пришёл ко власти и всё разваливается, страну разворовывают либералы”... Оценка: нечитаемо
Дей про Хлеб наемника
18 12 В общем, первые две книги это один ГГ, а остальные - совсем другой, хоть и тот же Артакс. В остальных он уже ленивый, потолстевший, забросивший тренировки. Периодически о нём кто-то вспоминает и выдаёт квест. Автор частенько ………
Никос Костакис про Гор: Шаровая молния [СИ] (Попаданцы, Самиздат, сетевая литература)
17 12 Как там у еще не родившегося Ивасюка? Повсюду буйно квитна черемшина..." ______________________ Ага. "Почему я не сокол?" (с)
decim про Осояну: Дети Великого Шторма [сборник litres] (Героическая фантастика, Фэнтези, Морские приключения)
16 12 Очень похоже на "Дитя приливов" Р.Дж. Баркера. В дамском изводе, т.е. с постоянным и многословным выяснением отношений. Ладно хоть, что не отношенек. Ещё напомнило эпопею Суржикова. Воды налито немало, и если бы подсушить ………
Oleg68 про Кобен: Убегай! [Run Away ru] (Триллер, Детективы: прочее)
16 12 Классная книга. Неожиданный конец. Оценка: отлично!
petr1464587 про Вязовский: Пепел на губах [СИ] (Фэнтези, Попаданцы, Самиздат, сетевая литература)
16 12 Это неудачный черновик? Кто эту дрянь выложил? Оценка: нечитаемо |
Комментарии
Отв: Проблемы и приемы OCR: dewarp
Насчет алгоритмов не знаю (хотя Файнридер вроде что то делает) но как вариант решения за $500 смотри тут: http://lib.rus.ec/node/131676
Отв: Проблемы и приемы OCR: dewarp
Э нет, кривой скан в данном случае - уже данность :( В смысле - готовый DJVU
Отв: Проблемы и приемы OCR: dewarp
В FineReader 8, которым я пользуюсь, в настройках "1. Сканировать/открыть" есть опция "Устранить искажение строк". Очень даже помогает.
В 9-й версии наверняка тоже есть.
Отв: Проблемы и приемы OCR: dewarp
Есть , "streighten lines" и "desкew" - кто из них кто уже не помню за ненадобностью.
можно на страницу провести операцию а можно применить ко всем , но я бы советовал постранично ибо некоторые страницы наоборот как раз портит.
Отв: Проблемы и приемы OCR: dewarp
Да вы чего, издеваетесь, панове ?! deskew - есть, это исправление перекоса (когда книжку положили непараллельно границам окна),
Отв: Проблемы и приемы OCR: dewarp
deskew - это совсем из другой оперы.
Возьмите ложку. Положите ее на стол под уголм 45градусов к краю. Исправьте положение ложки. А теперь СОГНИТЕ ложку поплам и попрубуйте исправить перекос относительно края тем же способом
Отв: Проблемы и приемы OCR: dewarp
В моем случае ложка выглядит примерно так: Я думал, что это именно warp
Отв: Проблемы и приемы OCR: dewarp
Я не издеваюсь , я же сказал что не помню, значит не deskew а второй - staighten text lines:
Отв: Проблемы и приемы OCR: dewarp
Теоретически в 8 и 9 Файнридерах имеется встроенный механизм коррекции:
На практике, выработанной на 4м ещё файнридере, лучшим удалителем искажений в зоне разворота служит левая рука, прижимающая книгу к сканеру в момент сканирования... :)
...Каких либо отдельных программ, позволяющих выпрямлять строки я никогда не встречал. Теоретически это можно проделать в фотошопе, но... страницу, пусть две. А сотню? Сомневаюсь.
Отв: Проблемы и приемы OCR: dewarp
АААА!!!! Спасибо, Jolly Roger - ака, и вправду есть! Они его спрятали неочевидным образом.
Если кто-нибудь еще на эти грабли наступит, тулза работает и выглядит вот так:
Отв: Проблемы и приемы OCR: dewarp
Дык а я о чем ?
Отв: Проблемы и приемы OCR: dewarp
Виноват, подумал, что она в опциях сканирования сидит.
Отв: Проблемы и приемы OCR: dewarp
Вроде бы именно такие искривления исправляет Book Restorer. Подробности на ru-board.
Отв: Спасибо!
Век живи - век учись... Действительно, есть и отдельная программа под задачу:
http://djvu-soft.narod.ru/scan/curved_text.htm
...как я понимаю, у неё настроек побогаче будет. Видимо, для сложных случаев может оказаться предпочтительней.
Отв: Проблемы и приемы OCR: dewarp
На сорсфорже была утилитка unpaper - она, кажется, умела автоматически делать обработку сканированных страниц, выравнивая картинки, зачищая поля и выравнивая интенсивность фона. Заодно резала на страницы, если сканировался разворот.
Отв: Проблемы и приемы OCR: dewarp
http://unpaper.berlios.de
А строки, AFAIK, не ровняет.
Но вобщем ничего, пользуюсь периодически.
Отв: Проблемы и приемы OCR: dewarp
Если нужно подготовить скан для создания дежавю, то лучше выпрямить строки программой BookRestorer. Там же можно сделать все остальное (чистка, обрезка и т. д.)
Отв: Проблемы и приемы OCR: dewarp
Покажите, плз, мне нормально выпрямленные букресторером строки
Я пробовал это делалать, у меня не получилось. У моих знакомых по ру-боарду тоже.
Отв: Проблемы и приемы OCR: dewarp
Показать в буквальном смысле не могу, т. к. не сохраняю исходники во-первых, и не помню какие именно строки были выпрямленыв во-вторых. Но этой функцией пользовался не раз и не два. Настройки дефолтные. Правда, изгиб касался максимум 3-4 строк внизу страницы. Обычно все же стараюсь прижимать книгу к сканеру :) Совсем уж бракованный скан проще переснять, чем маяться с ним.