Un pipeline automatizado que extrae datos de GitHub Trending, los enriquece mediante la API de GitHub, genera resúmenes y análisis mediante LLM, y publica informes en Markdown y datos JSON a través de un sitio de Docusaurus desplegado por GitHub Actions.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONPython and MCP example for an Apify actor that returns US House and Senate congressional stock trades and financial disclosures as structured JSON, with filters for member, ticker, and date range.
Taipy es un framework de Python diseñado para que científicos de datos e ingenieros de ML creen y desplieguen aplicaciones web de datos e IA listas para producción sin necesidad de aprender lenguajes front-end.
Luigi es un paquete de Python para construir pipelines complejos de trabajos por lotes, gestionando la resolución de dependencias, la gestión de flujos de trabajo, la visualización, el manejo de fallos y la integración de línea de comandos, con soporte Hadoop incorporado.
Currículo gratuito de ciencia de datos de Microsoft para principiantes, con 20 lecciones, proyectos prácticos, cuestionarios y traducciones en más de 50 idiomas.
LEANN es una base de datos vectorial ligera diseñada para aplicaciones RAG personales, que reduce los requisitos de almacenamiento hasta un 97% mediante recomputación selectiva basada en grafos.
deck.gl es un marco de visualización impulsado por GPU diseñado para el renderizado de alto rendimiento de conjuntos de datos a gran escala utilizando WebGL2 y WebGPU.
CocoIndex es un framework de indexación incremental de código abierto que ofrece a agentes de IA y aplicaciones LLM contexto siempre actualizado reprocesando solo los datos modificados.
FiftyOne es una herramienta de código abierto para crear conjuntos de datos de alta calidad y modelos de visión por computadora. Permite a los usuarios visualizar, etiquetar, evaluar y curar datos de inteligencia artificial visual.
Servidor MCP de datos ESG para empresas cotizadas en Corea, creado por un analista. Permite consultar calificaciones de 5 agencias, indicadores de gobernanza y emisiones de GEI en agentes de IA como Claude y ChatGPT mediante 12 herramientas sin necesidad de API keys.
Apache Spark es un motor de análisis unificado diseñado para el procesamiento de datos a gran escala, que ofrece APIs de alto nivel y un motor optimizado para grafos de computación general.
newspaper3k es una biblioteca de Python 3 diseñada para extraer y curar artículos de noticias web, proporcionando herramientas para extracción de texto completo y metadatos.
Deck Lab es un espacio de trabajo en Python/Flask para construir, investigar y simular goldfish mazos competitivos de Commander (MTG), con contratos de datos versionados, QA aislado y lanzamientos de contenedores verificados. body:
Un panel de control local y de solo lectura que visualiza el uso de Claude Code (conteo de tokens, costos, sesiones, herramientas, habilidades, proyectos y patrones de actividad) escaneando ~/.claude/projects/ y sirviendo una interfaz basada en FastAPI.
PyMC es un paquete de Python para modelado estadístico bayesiano que ofrece algoritmos avanzados de inferencia MCMC y variacional, con sintaxis intuitiva y soporte para modelos probabilísticos complejos.
Servidor MCP que expone datos geográficos federales suizos (mapas, elevación, geocodificación, STAC, WMTS, OEREB) mediante 20 herramientas sin autenticación para asistentes de IA.
Perspective es un motor de visualización de datos de alto rendimiento para conjuntos de datos de streaming a gran escala.
Una herramienta de CLI para procesar datos de restricciones de velocidad ferroviaria desde hojas de cálculo y visualizarlos en mapas HTML.
plotly.py es una biblioteca de gráficos interactiva, de código abierto y basada en el navegador para Python, construida sobre plotly.js. Ofrece más de 30 tipos de gráficos y cuenta con licencia MIT.
Licitarium es un programa para Windows que replica los datos públicos del PNCP, permitiendo consultar contrataciones, contratos, atas, PCA y precios de forma offline y permanente en una base SQLite local.