Ray es un marco unificado para escalar aplicaciones de IA y Python, desde una sola computadora portátil hasta un clúster distribuido.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTION深入系列是一个包含统计、机器学习、经济学和计算机工程领域的技术笔记、计算实验和文章汇编。该收藏品强调了清晰、实用的复杂主题解释,旨在让读者对复杂的学科更加简单和可达目标。涵盖的主题包括抽样、概率分析、因果推断、深度学习架构、MLOps流水图、状态空间模型和Python内部。内容涵盖多个领域,同时强调实用性和清晰。通过与 GitHub Pages网站相关的交互式项目集,所有材料为教育和个人研究用途共享。
NVIDIA cuDF es una biblioteca de DataFrames acelerada por GPU para procesamiento de datos tabulares, parte del conjunto CUDA-X. Ofrece API compatibles con pandas, un motor GPU para Polars y un backend Dask para manipulación de datos de alto rendimiento.
Darts es una biblioteca de Python para pronóstico de series temporales y detección de anomalías, que combina modelos estadísticos y neuronales, pronósticos probabilísticos, covariables, backtesting, reconciliación y puntuación basada en PyOD.
Proyecto de código abierto para predecir peleas de UFC: calificaciones Elo, un conjunto de gradient boosting y una red neuronal multitarea combinados en un único puntuador calibrado, evaluado mediante validación walk-forward de ventana en expansión de 2018 a 2026, con un explorador de enfrentamientos en Streamlit y una canalización de datos que se actualiza automáticamente cada semana.
Flow es un motor ETL y orquestador de flujo de trabajo de alto rendimiento, escrito en Go, con un único binario. Cuenta con un constructor web visual integrado, pipelines XML declarativos, compatibilidad entre bases de datos y telemetría de auditoría integrada.
Un repositorio educativo que enseña aprendizaje automático supervisado desde los principios básicos utilizando Python, cubriendo fundamentos matemáticos e implementaciones prácticas.
Prefect es un marco de orquestación de flujos de trabajo basado en Python, diseñado para construir, automatizar y monitorear tuberías de datos resilientes con funciones de programación y reintentos.
Reflex es una biblioteca para crear aplicaciones web full-stack utilizando Python puro, eliminando la necesidad de JavaScript para el desarrollo del frontend.
Made With ML es un curso y código abierto que enseña cómo diseñar, desarrollar, desplegar e iterar en aplicaciones de aprendizaje automático de grado productivo, cubriendo MLOps, pruebas, servicio, CI/CD y aprendizaje continuo.
Currículo gratuito de ciencia de datos de Microsoft para principiantes, con 20 lecciones, proyectos prácticos, cuestionarios y traducciones en más de 50 idiomas.
FiftyOne es una herramienta de código abierto para crear conjuntos de datos de alta calidad y modelos de visión por computadora. Permite a los usuarios visualizar, etiquetar, evaluar y curar datos de inteligencia artificial visual.
OpenRefine es una herramienta de código abierto basada en Java diseñada para limpiar, transformar y conciliar datos desordenados a través de una interfaz de navegador web.
Un curso introductorio de Python centrado en computación numérica y visualización de datos para analistas empresariales y traders.
Great Expectations (GX Core) es una biblioteca de Python de código abierto para la calidad de los datos, que proporciona un marco para crear pruebas unitarias de datos para garantizar la coherencia y la fiabilidad.
VectorBT es una biblioteca de backtesting de Python de código abierto que vectoriza la investigación de estrategias: empaqueta miles de combinaciones de parámetros en arrays de NumPy y los acelera con Numba y un motor Rust opcional, además de análisis de cartera y visualización interactiva con Plotly.
Keras 3 es un marco de aprendizaje profundo multi-backend que permite a los usuarios construir y entrenar modelos utilizando JAX, TensorFlow, PyTorch u OpenVINO.
scikit-learn es un módulo integral de Python para el aprendizaje automático, construido sobre SciPy y distribuido bajo la licencia BSD de 3 cláusulas.
Una plataforma de investigación y análisis de datos que permite a los usuarios importar conjuntos de datos personalizados para su visualización y análisis.
Gradio es una biblioteca de Python de código abierto para crear y compartir rápidamente aplicaciones web para modelos de machine learning, APIs o cualquier función de Python sin requerir experiencia en desarrollo web.