批量识别文档(图片、PDF)中的信息并保存到Excel的桌面工具。
- 可视化桌面界面,操作简单
- 支持PDF和图片(JPG/PNG)批量处理
- PDF多页自动合并为1条记录
- 内置发票识别提示词
- 支持自定义提示词提取其他类型文档
- 处理过程实时显示
- 中间文件自动清理
- Python 3.8+
- Windows/macOS/Linux
pip install -r requirements.txtpython main.py- 选择文件夹 - 点击"浏览"按钮,选择包含PDF或图片文件的文件夹
- 配置API - 输入您的API Key(支持阿里云DashScope等OpenAI兼容接口)
- 选择文档类型 - 选择"发票"使用内置提示词,或选择"其他"输入自定义提示词
- 开始处理 - 点击"开始处理"按钮,等待处理完成
配置文件 config.json 包含以下设置:
api.key- API密钥api.base_url- API地址(默认:阿里云DashScope)api.model- 使用的模型(默认:qwen3.5-plus)last_used.*- 上次使用的配置(自动保存)
文档提取工具/
├── main.py # 主入口
├── config.json # 配置文件
├── requirements.txt # 依赖
├── ui/ # 界面模块
│ └── main_window.py
├── core/ # 核心模块
│ ├── config_manager.py
│ ├── file_processor.py
│ ├── api_client.py
│ └── result_aggregator.py
├── presets/ # 内置提示词
│ └── __init__.py
└── __temp__/ # 临时文件目录
- API Key不会在界面上显示完整,请妥善保管
- 配置文件保存在程序目录
- 处理结果保存在源文件目录
- 临时文件处理完成后自动删除