Sobre el proyecto
Este repositorio es una lista seleccionada exhaustiva de herramientas y recursos de ingeniería de datos, organizada en secciones claras. Cubre una amplia gama de temas, incluidas bases de datos relacionales, de clave-valor, columnares, de documentos, de grafos, distribuidas y de series temporales; herramientas de comparación de datos; frameworks de ingesta de datos como Kafka, Airbyte, Meltano y dlt; sistemas de archivos como HDFS, S3, Alluxio y JuiceFS; formatos de serialización como Avro, Parquet, ORC y Protobuf; herramientas de procesamiento de flujos y por lotes; gráficos y paneles; orquestación de flujos de trabajo; gestión de data lakes; la pila ELK; Docker; conjuntos de datos; monitoreo con Prometheus; perfilado de datos; gestión de esquemas; pruebas; y recursos comunitarios, incluidos foros, conferencias, podcasts y libros. Cada entrada incluye una breve descripción y un enlace al proyecto, lo que la convierte en una referencia práctica para desarrolladores que construyen canalizaciones de datos y gestionan infraestructura de datos.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.