OPEN SOURCE, OPEN TO EVERYONE

Código abierto. Nuevas posibilidades.

Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.

Selección editorial · Descubre buen código abierto4109descubiertos

Un poco de curiosidad. Un mundo de código abierto.

THE FIRST COLLECTION
Topic: data-science清除
cudfNVIDIA
NUEVO

NVIDIA cuDF es una biblioteca de DataFrames acelerada por GPU para procesamiento de datos tabulares, parte del conjunto CUDA-X. Ofrece API compatibles con pandas, un motor GPU para Polars y un backend Dask para manipulación de datos de alto rendimiento.

DatosAnalytics & BI
go-flowetl-madness
NUEVO

Flow es un motor ETL y orquestador de flujo de trabajo de alto rendimiento, escrito en Go, con un único binario. Cuenta con un constructor web visual integrado, pipelines XML declarativos, compatibilidad entre bases de datos y telemetría de auditoría integrada.

DatosAutomatizaciónData integration
NUEVO

Un repositorio educativo que enseña aprendizaje automático supervisado desde los principios básicos utilizando Python, cubriendo fundamentos matemáticos e implementaciones prácticas.

IADatosTraining & evaluation

Currículo gratuito de ciencia de datos de Microsoft para principiantes, con 20 lecciones, proyectos prácticos, cuestionarios y traducciones en más de 50 idiomas.

DatosIAAnalytics & BI
fiftyonevoxel51
NUEVO

FiftyOne es una herramienta de código abierto para crear conjuntos de datos de alta calidad y modelos de visión por computadora. Permite a los usuarios visualizar, etiquetar, evaluar y curar datos de inteligencia artificial visual.

IADatosTraining & evaluation
OpenRefineOpenRefine
NUEVO

OpenRefine es una herramienta de código abierto basada en Java diseñada para limpiar, transformar y conciliar datos desordenados a través de una interfaz de navegador web.

DatosProductividadData integration
NUEVO

Great Expectations (GX Core) es una biblioteca de Python de código abierto para la calidad de los datos, que proporciona un marco para crear pruebas unitarias de datos para garantizar la coherencia y la fiabilidad.

DatosDesarrolloData integration
vectorbtpolakowo
NUEVO

VectorBT es una biblioteca de backtesting de Python de código abierto que vectoriza la investigación de estrategias: empaqueta miles de combinaciones de parámetros en arrays de NumPy y los acelera con Numba y un motor Rust opcional, además de análisis de cartera y visualización interactiva con Plotly.

DatosDesarrolloAnalytics & BI
data-research-analysis-platformData-Research-Analysis
NUEVO

Una plataforma de investigación y análisis de datos que permite a los usuarios importar conjuntos de datos personalizados para su visualización y análisis.

DatosAnalytics & BI
evidenceevidence-dev
NUEVO

Evidence es una alternativa de código abierto y basada en código a las herramientas de BI de arrastrar y soltar: cree informes rápidos e interactivos con SQL y markdown, y luego publíquelos o alójelos.

DatosAnalytics & BI
supersetapache
NUEVO

Apache Superset es una aplicación web de inteligencia de negocios moderna y preparada para empresas, utilizada para la exploración y visualización de datos.

DatosAnalytics & BI
tsfreshblue-yonder
NUEVO

tsfresh es un paquete de Python para la extracción y selección automática de características de series temporales, combinando estadística, procesamiento de señales y pruebas de hipótesis.

DatosIAAnalytics & BI
ipythonipython
NUEVO

IPython es una potente shell de comandos interactiva para la computación en múltiples lenguajes de programación, principalmente Python, que ofrece una introspección y shell integration mejoradas.

DesarrolloDatosCLI & terminal
pandaspandas-dev
NUEVO

pandas es una potente biblioteca de Python que proporciona estructuras de datos rápidas, flexibles y expresivas diseñadas para trabajar con datos relacionales o etiquetados.

DatosData integration
airflowapache
NUEVO

Apache Airflow es una plataforma para crear, programar y monitorear flujos de trabajo mediante código, utilizada comúnmente para tuberías de datos y orquestación de AI/ML.

AutomatizaciónDatosWorkflow automation
trinotrinodb
NUEVO

Trino es un motor de consultas SQL distribuido y rápido diseñado para el análisis de big data, anteriormente conocido como PrestoSQL.

DatosRelational databases
myclidbcli
NUEVO

Un cliente de terminal enriquecido para MySQL con autocompletado, resaltado de sintaxis e integración de dataframes.

DesarrolloDatosCLI & terminal
marimomarimo-team
NUEVO

marimo es un cuaderno de Python reactivo que garantiza la coherencia entre el código y los resultados, almacenados como archivos Python puros para facilitar el uso de git y la implementación.

DesarrolloDatosEditors & IDEs
statsmodelsstatsmodels
NUEVO

Statsmodels es una biblioteca de Python para modelado estadístico, econometría y análisis de datos. Soporta regresión, series temporales, análisis de supervivencia y más.

DatosDesarrolloAnalytics & BI
NUEVO

Una biblioteca de Python para enriquecer DataFrames de pandas mediante la adición de nuevas columnas generadas por modelos de IA basados en instrucciones en lenguaje natural.

DatosIAData integration