Define el resultado antes de transformar
Un proceso ETL se puede revisar cuando cada entrada tiene un ID de origen y un ID de lote estables. Registra el archivo o la captura API, el prefijo de objetos si aplica, la hoja o el rango y la forma esperada de filas y campos. El original debe permanecer intacto para poder repetir una corrección de normalización.
Normaliza antes de unir
Aterriza primero las páginas API o los lotes del almacenamiento y después resuelve codificación y delimitadores CSV. El divisor de hojas y el extractor de rangos evitan mezclar notas y totales con datos. El mapeador fija nombres y orden; unpivot convierte columnas por mes en observaciones cuando el destino es largo. Une solo contratos compatibles y guarda el cursor incremental en la procedencia.
Revisa el contrato de salida
El JSON Schema generado es una propuesta basada en ejemplos. Compárala con el plan de migración, la clave de negocio, la nulabilidad y el dialecto SQL antes de aceptar los INSERT. Estas herramientas preparan artefactos, pero no sustituyen una transacción de base de datos ni una decisión sobre cambios de tipo.
Concilia y entrega
Antes de exportar, reconcilia filas de entrada, aceptadas, duplicadas, rechazadas y finales. Revisa campos, tipos, unicidad y deriva de schema. Parquet y NDJSON sirven para analítica; un paquete CSV con manifest facilita revisar cada hoja. Ante un fallo, aísla la rama y conserva su procedencia en vez de publicar un resultado parcial como completo.