Пакет Tesseract-ocr - это командная строка. Если вы хотите программу с графическим интерфейсом, я использую «gscan2pdf», и вы можете найти ее в Центре программного обеспечения Ubuntu.
В gscan2pdf все, что вам нужно сделать, это щелкнуть маленькую иконку сканирования вверху. Я думаю, это дает вам два или три варианта, GOCR, который не очень хорош, и Tesseract, который работает превосходно. Выберите Tesseract, и с этого момента вам нужно щелкнуть соответствующую вкладку, чтобы вы могли найти настройки разрешения. Ваш лучший выбор - 300 или даже 600, а Tesseract преуспеет.
Плохо отсканированные, кривые или старые документы плохо конвертируются. Удачи!
PS .. Я продолжаю читать, что Tesseract может читать только изображения TIFF. Это не случай для меня. Я могу импортировать JPG или PNG тоже.
PPS ... извините за изменения! Вы также можете попробовать OCRFeeder в программном центре. Мне еще предстоит попробовать.