Releases: Timur99/PDF2Text
Release list
PDF2Text 0.1.0
Первая сборка PDF2Text — приложения, которое достаёт текст из PDF и фотографий
прямо на вашем компьютере. Ничего никуда не отправляется.
Главное отличие от привычных OCR-инструментов: распознавание запускается не
сразу. Сначала документ проверяется на наличие текстового слоя, и страницы, где
текст уже есть, забираются напрямую — быстро и без потерь. OCR достаётся только
остатку. На типичной лекции из 22 страниц распознавание понадобилось для одной.
Требования
- Mac на Apple Silicon — M1 и новее. Сборка только
arm64, на Intel-маках
не запустится. - macOS 13 Ventura или новее.
Ставить Python не нужно, всё внутри.
Первый запуск
Приложение не подписано сертификатом Apple, поэтому macOS остановит его при
первом открытии. Это не поломка и не вирус — так система ведёт себя с любым
приложением без подписки разработчика.
- Откройте
.dmgи перетащите PDF2Text в «Программы». - Запустите двойным кликом. Появится окно «macOS не удалось проверить, нет ли
в приложении вредоносного ПО». Нажмите «Отмена» — не «Переместить в
Корзину». - Откройте Системные настройки → Конфиденциальность и безопасность,
пролистайте вниз. Там будет строка про заблокированное приложение и кнопка
«Всё равно открыть». - Подтвердите. Дальше приложение запускается обычным двойным кликом.
Старый способ — Control-click по значку и «Открыть» — Apple убрал в macOS 15
Sequoia. Инструкции из интернета, написанные до 2024 года, показывают путь,
которого больше нет.
Первое окно откроется секунд через десять — macOS однократно проверяет
незнакомое приложение. Дальше запуск занимает доли секунды.
Проверка целостности
shasum -a 256 PDF2Text-0.1.0.dmg
4fa05dde65ede50d2ab55254a5724493e972ccbde9617a2173631323f8fe715b
Что умеет
- PDF, JPG, PNG, WEBP, TIFF, BMP.
- Три пути обработки, и приложение всегда показывает, какой сработал: текст взят
напрямую, распознан или собран из того и другого. - Карта страниц: видно, какие именно страницы потребовали OCR, каждую можно
открыть отдельно. - Экспорт в Markdown и TXT, удаление задачи вместе с исходником.
- Русский и английский.
Движок распознавания — Apple Vision, встроенный в macOS. Он ничего не весит
и на замере из восьми страниц оказался в 16 раз быстрее PaddleOCR при лучшем
порядке чтения на многоколоночных страницах.
Ограничения этой версии
- Нет подписи Apple — отсюда пляска с первым запуском выше.
- Только Apple Silicon, сборки для Intel нет.
- История задач не переживает перезапуск приложения. Сами файлы результатов
остаются на диске, но список в боковой панели очищается. - Нельзя отменить уже запущенную обработку, только дождаться.
- Тип файла определяется по расширению, а не по содержимому.
- PaddleOCR в сборку не входит — он нужен как запасной движок и ставится
отдельно черезpip.
Приватность
Сервер слушает только 127.0.0.1. Документы не покидают компьютер: и проверка
документа, и распознавание работают локально. Содержимое документов не пишется в
логи. Телеметрии нет.
Командная строка
В образ не входит. Ставится из исходников:
pip install -e ".[vision]"
pdf2text scan.pdf > out.md