ох))) ну попробую расписать процесс целиком (почти))
Итак, берем мы к примеру журнал, сканируем его, получается документ в формате "жпег")) далее через прогу файнридер это изображение распознается, становится текстовым документом, но распознается с ошибками естественно. Вот именно МОЯ работа заключается в том, чтоб ошибки исправить и полученный текст отформатировать в соответствии с нормами и требованиями другой программы, в которой потом текст будет проходить дальнейшую обработку (но это уже не мое дело - дальнейшая обработка то есть))