APSIDEMonitor del data lake
OPERACIÓN
Última corrida del pipeline:
← Panel de Gestión
Vista operativa, no el panel de indicadores: de dónde entra cada dato al lake y qué trajo la última corrida de run_pipeline.py.
1 · Catálogo

¿Por dónde entra cada dato?

Cada fuente con su tipo, el archivo/objeto de origen (con link a Drive cuando aplica), la convención de nombre a la que debe migrar para actualizarse sola, qué se lee y con qué credencial entra. Dato, no prosa: viene de marts.catalogo_fuentes (seed seed_catalogo_fuentes.csv) — cambiar una fila es editar el CSV, no este HTML.

Fuente: GET /catalogo sobre marts.catalogo_fuentes.

2 · Última corrida

¿Qué trajo el pipeline la última vez?

En vivo desde staging.carga_log: la última fila cargada por fuente. El pipeline registra ahí cada corrida (no se borra, solo se agrega).

FuenteAlimentaFilasÚltima cargaEstado

Fuente: GET /fuentes sobre staging.carga_log.

3 · Resultados de ejecución

Histórico de corridas

Cada corrida de run_pipeline.py queda agrupada por corrida_id en staging.carga_log (retención: últimas 30). Una corrida en rojo se abortó por un guardrail — el de Postgres (fuente clave vacía o caída >50%) o el del dossier (una serie del JSON publicado perdió cobertura); un loader que lanzó una excepción también queda registrado con resultado error en vez de desaparecer sin rastro. La fila "histórico sin sello" agrupa todo lo cargado antes de esta unidad (sin frontera de corrida reconstruible).

CorridaFechaFuentes ok FilasΔ vs anteriorResultado

Fuente: GET /corridas sobre staging.carga_log.