Skip to content

Repository files navigation

文档内容提取器

批量识别文档(图片、PDF)中的信息并保存到Excel的桌面工具。

功能特性

  • 可视化桌面界面,操作简单
  • 支持PDF和图片(JPG/PNG)批量处理
  • PDF多页自动合并为1条记录
  • 内置发票识别提示词
  • 支持自定义提示词提取其他类型文档
  • 处理过程实时显示
  • 中间文件自动清理

环境要求

  • Python 3.8+
  • Windows/macOS/Linux

安装依赖

pip install -r requirements.txt

运行

python main.py

使用方法

  1. 选择文件夹 - 点击"浏览"按钮,选择包含PDF或图片文件的文件夹
  2. 配置API - 输入您的API Key(支持阿里云DashScope等OpenAI兼容接口)
  3. 选择文档类型 - 选择"发票"使用内置提示词,或选择"其他"输入自定义提示词
  4. 开始处理 - 点击"开始处理"按钮,等待处理完成

配置说明

配置文件 config.json 包含以下设置:

  • api.key - API密钥
  • api.base_url - API地址(默认:阿里云DashScope)
  • api.model - 使用的模型(默认:qwen3.5-plus)
  • last_used.* - 上次使用的配置(自动保存)

项目结构

文档提取工具/
├── main.py              # 主入口
├── config.json          # 配置文件
├── requirements.txt     # 依赖
├── ui/                  # 界面模块
│   └── main_window.py
├── core/                # 核心模块
│   ├── config_manager.py
│   ├── file_processor.py
│   ├── api_client.py
│   └── result_aggregator.py
├── presets/             # 内置提示词
│   └── __init__.py
└── __temp__/           # 临时文件目录

注意事项

  • API Key不会在界面上显示完整,请妥善保管
  • 配置文件保存在程序目录
  • 处理结果保存在源文件目录
  • 临时文件处理完成后自动删除

About

No description, website, or topics provided.

Resources

Stars

1 star

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages