-
Notifications
You must be signed in to change notification settings - Fork 1
Publicacao dos Dados
O projeto publica dois tipos de artefato: um banco enxuto para consumo e um backup completo para continuidade operacional.
A release fixa latest-data publica somente:
cotacoes.sqlite.xz
Esse arquivo contem o SQLite pronto para consumo. Ele nao inclui raws, cache de
PDF, relatorios nem outros arquivos da pasta data/.
Use esse artefato quando o objetivo for consultar os dados consolidados.
Quando configurado, o OneDrive guarda o pacote completo:
ceasa-data-full-latest.tar.xz
Esse pacote inclui:
- raws HTML e PDF;
- cache de texto dos PDFs;
- relatorios;
- SQLite;
- demais arquivos gerados dentro de
data/.
O workflow salva uma copia fixa em latest/ e uma copia historica em
history/, com timestamp e GITHUB_RUN_ID.
- Restaurar o pacote completo do OneDrive quando disponivel.
- Usar
cotacoes.sqlite.xzda release como fallback. - Falhar antes do scraper se nenhum dado anterior for restaurado.
- Executar
docker compose run --rm tudo. - Compactar e enviar o pacote completo ao OneDrive, quando habilitado.
- Compactar o SQLite em
cotacoes.sqlite.xz. - Publicar o banco na release fixa
latest-data. - Remover pacotes completos legados da release.
- Registrar restauracao, salvamento e metricas no ultimo relatorio.
Para restaurar localmente o banco publicado:
docker compose run --rm --entrypoint python app scripts/cotacoes.py descompactar-banco --arquivo cotacoes.sqlite.xzO comando valida o SQLite antes de substituir data/cotacoes.sqlite.
- Nao use o pacote completo do OneDrive como artefato publico principal.
- Nao publique raws na release fixa.
- Nao crie novos artefatos
.gz; gzip fica apenas como compatibilidade de restauracao legada.
O SQLite publicado na release e o artefato principal. A sincronizacao com Supabase existe, mas esta fora do fluxo operacional principal enquanto o tamanho da base nao couber bem na infraestrutura avaliada.
Documentacao operacional do cotacoes-ceasa-scraper.