Voltar ao portfólioBack to portfolio

Pipeline DatabricksDatabricks Pipeline

Ingestão e transformação de dados em escala.Data ingestion and transformation at scale.

ProblemaProblem

Dados espalhados em sistemas diferentes, sem padronização, dificultavam qualquer análise cruzada.Data scattered across different systems, without standardization, made any cross-analysis difficult.

SoluçãoSolution

Pipeline automatizado com jobs agendados, versionamento de schema e camadas de qualidade progressiva.Automated pipeline with scheduled jobs, schema versioning and progressive data-quality layers.

TecnologiasTechnologies

DatabricksPySparkDelta Lake
RepositórioRepository