Voltar ao portfólioBack to portfolio RepositórioRepository
Pipeline DatabricksDatabricks Pipeline
Ingestão e transformação de dados em escala.Data ingestion and transformation at scale.
ProblemaProblem
Dados espalhados em sistemas diferentes, sem padronização, dificultavam qualquer análise cruzada.Data scattered across different systems, without standardization, made any cross-analysis difficult.
SoluçãoSolution
Pipeline automatizado com jobs agendados, versionamento de schema e camadas de qualidade progressiva.Automated pipeline with scheduled jobs, schema versioning and progressive data-quality layers.
TecnologiasTechnologies
DatabricksPySparkDelta Lake