Sobre o projeto

O projeto Delta Lake fornece uma camada de armazenamento unificada que preenche a lacuna entre os paradigmas de data lake e data warehouse. Em sua essência, o Delta Lake implementa transações ACID, viagem no tempo e evolução de esquema para garantir a consistência e a confiabilidade dos dados. Ele suporta múltiplos mecanismos de computação — Apache Spark, PrestoDB, Flink, Trino e Hive — além de APIs nativas para Scala, Java, Rust, Ruby e Python. Esses mecanismos possibilitam cargas de trabalho diversas, desde análises em lote até consultas interativas. O framework também inclui recursos avançados, como compactação automática de dados, leituras sem cópia e serialização eficiente. Com amplas integrações de ecossistema e documentação abrangente, o Delta Lake simplifica a construção de plataformas de dados modernas e acelera a adoção de arquiteturas lakehouse nas empresas.