Skip to content

Releases: Timur99/PDF2Text

Release list

PDF2Text 0.1.0

Choose a tag to compare

@Timur99 Timur99 released this 13 Sep 14:35
518579e

Первая сборка PDF2Text — приложения, которое достаёт текст из PDF и фотографий
прямо на вашем компьютере. Ничего никуда не отправляется.

Главное отличие от привычных OCR-инструментов: распознавание запускается не
сразу. Сначала документ проверяется на наличие текстового слоя, и страницы, где
текст уже есть, забираются напрямую — быстро и без потерь. OCR достаётся только
остатку. На типичной лекции из 22 страниц распознавание понадобилось для одной.

Требования

  • Mac на Apple Silicon — M1 и новее. Сборка только arm64, на Intel-маках
    не запустится.
  • macOS 13 Ventura или новее.

Ставить Python не нужно, всё внутри.

Первый запуск

Приложение не подписано сертификатом Apple, поэтому macOS остановит его при
первом открытии. Это не поломка и не вирус — так система ведёт себя с любым
приложением без подписки разработчика.

  1. Откройте .dmg и перетащите PDF2Text в «Программы».
  2. Запустите двойным кликом. Появится окно «macOS не удалось проверить, нет ли
    в приложении вредоносного ПО». Нажмите «Отмена» — не «Переместить в
    Корзину».
  3. Откройте Системные настройки → Конфиденциальность и безопасность,
    пролистайте вниз. Там будет строка про заблокированное приложение и кнопка
    «Всё равно открыть».
  4. Подтвердите. Дальше приложение запускается обычным двойным кликом.

Старый способ — Control-click по значку и «Открыть» — Apple убрал в macOS 15
Sequoia. Инструкции из интернета, написанные до 2024 года, показывают путь,
которого больше нет.

Первое окно откроется секунд через десять — macOS однократно проверяет
незнакомое приложение. Дальше запуск занимает доли секунды.

Проверка целостности

shasum -a 256 PDF2Text-0.1.0.dmg
4fa05dde65ede50d2ab55254a5724493e972ccbde9617a2173631323f8fe715b

Что умеет

  • PDF, JPG, PNG, WEBP, TIFF, BMP.
  • Три пути обработки, и приложение всегда показывает, какой сработал: текст взят
    напрямую, распознан или собран из того и другого.
  • Карта страниц: видно, какие именно страницы потребовали OCR, каждую можно
    открыть отдельно.
  • Экспорт в Markdown и TXT, удаление задачи вместе с исходником.
  • Русский и английский.

Движок распознавания — Apple Vision, встроенный в macOS. Он ничего не весит
и на замере из восьми страниц оказался в 16 раз быстрее PaddleOCR при лучшем
порядке чтения на многоколоночных страницах.

Ограничения этой версии

  • Нет подписи Apple — отсюда пляска с первым запуском выше.
  • Только Apple Silicon, сборки для Intel нет.
  • История задач не переживает перезапуск приложения. Сами файлы результатов
    остаются на диске, но список в боковой панели очищается.
  • Нельзя отменить уже запущенную обработку, только дождаться.
  • Тип файла определяется по расширению, а не по содержимому.
  • PaddleOCR в сборку не входит — он нужен как запасной движок и ставится
    отдельно через pip.

Приватность

Сервер слушает только 127.0.0.1. Документы не покидают компьютер: и проверка
документа, и распознавание работают локально. Содержимое документов не пишется в
логи. Телеметрии нет.

Командная строка

В образ не входит. Ставится из исходников:

pip install -e ".[vision]"
pdf2text scan.pdf > out.md