Об этом проекте
Проект Delta Lake предоставляет унифицированный слой хранения, который устраняет разрыв между парадигмами озера данных и хранилища данных. В своей основе Delta Lake реализует ACID-транзакции, путешествие во времени и эволюцию схемы для обеспечения согласованности и надёжности данных. Он поддерживает несколько вычислительных движков — Apache Spark, PrestoDB, Flink, Trino и Hive — наряду с нативными API для Scala, Java, Rust, Ruby и Python. Эти движки обеспечивают выполнение разнообразных рабочих нагрузок: от пакетной аналитики до интерактивных запросов. Фреймворк также включает такие продвинутые функции, как автоматическое уплотнение данных, чтение с нулевым копированием и эффективная сериализация. Благодаря обширным интеграциям с экосистемой и всесторонней документации Delta Lake упрощает построение современных платформ данных и ускоряет внедрение архитектур lakehouse на предприятиях.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.