API REST para conversão de documentos e imagens para Markdown usando OCR e processamento inteligente.
- 📝 Conversão de documentos (PDF, DOCX, XLSX, PPTX) para Markdown
- 🖼️ OCR de imagens (JPG, PNG, GIF, BMP, TIFF) com suporte a texto manuscrito
- 🌐 API REST simples e intuitiva
- 🐳 Deploy com Docker (Docker Compose e Swarm)
- ☁️ Pronto para deploy em Easypanel/CapRover
- Python 3.11 - Backend
- Flask - Framework web
- MarkItDown - Conversão de documentos
- OCR.space API - Reconhecimento óptico de caracteres
- Docker - Containerização
- Docker e Docker Compose
- Chave de API do OCR.space (gratuita)
# Clone o repositório
git clone https://github.com/MaikRodriguess/docmd.git
cd docmd
# Configure as variáveis de ambiente
cp .env.example .env
# Edite o .env e adicione sua chave de API
# Suba o container
docker-compose up -dA API estará disponível em http://localhost.
Envie um arquivo via requisição POST:
curl -X POST http://localhost/convert \
-H "Content-Type: image/png" \
--data-binary @imagem.pngResposta:
{
"content": "# Texto Extraído via OCR\n\nConteúdo do documento..."
}- Conecte com seu repositório GitHub
- Configure a variável de ambiente:
OCR_SPACE_API_KEY - Build automático via Dockerfile
- Porta do container:
5000
docker swarm init
docker build -t docmd:latest .
docker stack deploy -c stack.yml docmd| Variável | Descrição | Obrigatória |
|---|---|---|
OCR_SPACE_API_KEY |
Chave de API do OCR.space | Sim |
MIT License - veja LICENSE para mais detalhes.
Desenvolvido por Maik Rodrigues