|
||||||||
Распознавание просканированных документовПосле сканирования документов с текстом мы получаем растровую картинку в графическом формате, из которой нельзя напрямую скопировать текст, редактировать его и использовать в качестве текстового документа. Для формирования редактируемого документа потребуется процедура автоматического распознавания. Иногда используется англоязычная аббревиатура OCR – Optical Character Recognition – технология оптического распознавания символов. В настоящее время есть несколько программных решений для распознавания текста, мы для этой цели используем Fine Reader. Он дает хорошие результаты для текстов на русском, английском и других языках, включая восточные, такие как китайский и корейский. После автоматизированного распознавания получается редактируемый документ, который можно ограниченно использовать в дальнейшем. Ограничения возникают из-за создания сложно изменяемой структуры распознанного документа, основанной на стилях и шаблонах. Визуально документ может выглядеть очень похожим на оригинал, но при верстке и попытке что-либо поменять в его структуре могут появиться сложности с отображением. Если в распознанных документах необходимо в дальнейшем работать, верстать, переводить текст, вставлять новые объекты, то для этих целей мы применяем распознавание с ручным контролем и обучением. Это удлиняет срок и повышает расходы на распознавание, но документ на выходе можно использовать более широко и утилитарно. Процедура распознавания текста сама по себе не дорогая и не сложная. Стоимость услуги приведена в таблице ниже.
Однако если исходный документ плохого качества, имеет сгибы, просканирован на низком разрешении или сфотографирован под углом, то процедура распознавания текста даст результат со множеством ошибок и неточностей: пропущенные или искаженные символы, слова, цифры. Часть "мусора" с бумажной страницы может быть воспринята программой в качестве графических элементов, символов или цифр, и все эти искажения приходится исправлять вручную. По этой причине мы предлагаем клиентам услугу ручного распознавания текста и ручной набор текста, не поддающегося автоматической обработке. В предельном случае эта услуга нужна для набора рукописного текста, который ни одна программа не может распознать с достаточной степенью качества, приемлемого для дальнейшей обработки. Обращайтесь в нашу компанию, где вам предложат услуги квалифицированных редакторов и верстальщиков текстов на всех основных языках мира. Отправить запрос | info@desktop-publishing.ru | +7 925 504-71-35 |
||||||||
| ||||||||
![]() |
||||||||