OCR с двухстраничным макетом
Я пытаюсь сделать OCR в pdf с двухстраничным макетом - на странице PDF с альбомной ориентацией левая половина - это одна страница (книжная ориентация), правая половина - следующая (книжная ориентация) страница. Иногда макет портит tesseract. Могу ли я рассказать о макете или эффективно склеить исходный PDF-файл, прежде чем запускать его через tesseract?