NVIDIA cuDF es una biblioteca de DataFrames acelerada por GPU para procesamiento de datos tabulares, parte del conjunto CUDA-X. Ofrece API compatibles con pandas, un motor GPU para Polars y un backend Dask para manipulación de datos de alto rendimiento.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONOneFlow es un marco de aprendizaje profundo fácil de usar, escalable y eficiente, con API similar a PyTorch, Tensor Global para ejecución paralela n-dimensional y compilador de grafos para acelerar e implementar modelos.
SGLang es un marco de servicio de alto rendimiento para modelos de lenguaje extensos (LLM) y modelos multimodales, diseñado para una inferencia de baja latencia y alto rendimiento.
Proyecto educativo para entrenar un modelo GPT (≈540M parámetros) desde cero en laptop de consumidor, con preentrenamiento en Fineweb-edu y ajuste de chat.
Cog empaqueta modelos de aprendizaje automático en contenedores Docker listos para producción, gestiona compatibilidad CUDA y genera una API HTTP de inferencia desde tipos de Python.
Colección completa de ejemplos de CUDA que demuestran funciones de programación de GPU, con muestras en C++ y Python organizadas en categorías como introducción, utilidades, conceptos, bibliotecas, aplicaciones específicas y plataformas.
vLLM es una biblioteca de alto rendimiento y eficiencia de memoria diseñada para la inferencia y el servicio de modelos de lenguaje extensos (LLM).
Voicebox es un estudio de voz de IA de código abierto y ejecución local que clona voces, genera voz, ofrece dictado global y permite que agentes de IA hablen mediante herramientas MCP.
Un runtime residente en GPU para modelos de video image-to-image de TensorRT, que permite el escalado de video de alto rendimiento manteniendo los fotogramas brutos en la GPU desde la decodificación hasta la codificación.
CatBoost es una biblioteca de gradient boosting de código abierto de Yandex para clasificación, regresión y ranking. Ofrece soporte nativo para características categóricas, entrenamiento en CPU/GPU, entrenamiento distribuido mediante Apache Spark y APIs para Python, R, Java y C++.
Una herramienta de edición automática de video impulsada por IA que utiliza Whisper y Gemini, compatible con tailandés e inglés, con corte de segmentos clave y subtitulado, 3-4 veces más rápida mediante GPU y Docker.