Depository of News

Вверх ногами: как научить OCR понимать, что документ перевернут

newsdepo.com · world

<img src="https://habrastorage.org/getpro/habr/upload_files/0cc/e25/0ad/0cce250adb93e51f5d3a77e70237335d.jpg" /><p>Всем привет!&nbsp;</p><p>В своих постах мы часто пишем о разных этапах систем распознавания документов (например, <a href="https://habr.com/ru/companies/smartengines/articles/1060224/">тут</a> и <a href="https://habr.com/ru/companies/smartengines/articles/1069750/">тут</a>). Настало время рассказать о еще одной задаче (и нашем решении для нее), которая часто опускается из подробного рассмотрения.</p><p>Наверняка каждый из вас хоть раз клал лист в сканер перевернутым (ну или вы очень везучи). Человек в случае такой оказии может повернуть изображение в редакторе или немного повертеть головой, а что делать системе распознавания?&nbsp;</p><p>Просто взять и проигнорировать перевернутые изображения нельзя, ведь при обработке больших объемов данных, например, цифровизации архивов, таких изображений может быть множество. При этом попытки запустить OCR-модели на перевернутых строках обычно заканчиваются плачевно – мы получаем случайные последовательности символов.</p><p>Давайте разбираться по порядку!</p> <a href="https://habr.com/ru/articles/1077714/?utm_source=habrahabr&amp;utm_medium=rss&amp;utm_campaign=1077714#habracut">Читать далее</a>

Read full article →