- При помощи pytesseract извлекаются только печатные тексты или тексты, нааписанные идеальными печатными буквами. Рукописные не извлекаются (файл img-get-text.ipynb, https://www.kaggle.com/code/olgatasenko/img-get-text).
- При помощи библиотеки PyPDF2 и pdfminer удалось считать текст в pdf (файл read-as-pdf.ipynb, https://www.kaggle.com/code/olgatasenko/read-as-pdf).
Folders and files
| Name | Name | Last commit date | ||
|---|---|---|---|---|