Prefect es un marco de orquestación de flujos de trabajo basado en Python, diseñado para construir, automatizar y monitorear tuberías de datos resilientes con funciones de programación y reintentos.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONKestra es una plataforma de orquestación de código abierto y orientada a eventos, diseñada para flujos de trabajo de datos, IA e infraestructura, utilizando una interfaz declarativa de YAML.
Taipy es un framework de Python diseñado para que científicos de datos e ingenieros de ML creen y desplieguen aplicaciones web de datos e IA listas para producción sin necesidad de aprender lenguajes front-end.
Great Expectations (GX Core) es una biblioteca de Python de código abierto para la calidad de los datos, que proporciona un marco para crear pruebas unitarias de datos para garantizar la coherencia y la fiabilidad.
Biblioteca ligera de Python para pipelines de ejecución que usa el decorador @action para definir tareas, admite reintentos, ejecución paralela, observabilidad y despliegue con un clic a más de 34 plataformas en la nube como AWS Lambda, GCP Cloud Run y Kubernetes.
StormByte-Buffer es una biblioteca de C++26 que proporciona FIFO, SharedFIFO, buffers de anillo y herramientas de pipeline para la suite StormByte. Incluye buffers seguros e inseguros para hilos, patrones productor/consumidor y etapas de pipeline configurables.
marimo es un cuaderno de Python reactivo que garantiza la coherencia entre el código y los resultados, almacenados como archivos Python puros para facilitar el uso de git y la implementación.
Tekton Pipelines es un proyecto de código abierto que ofrece recursos nativos de Kubernetes para declarar pipelines de CI/CD. Es cloud-native, desacoplado y tipado, usando contenedores como bloques de construcción, con tareas ejecutables de forma aislada y recursos intercambiables.
nf-core/fastqrepair is a bioinformatics pipeline for recovering corrupted FASTQ.gz files, fixing uncompliant reads, removing unpaired reads, and re-pairing disordered reads. It outputs clean FASTQ files and QC reports.