ML Imagery IO es una biblioteca de E/S de imágenes geoespaciales de alto rendimiento que lee y escribe NITF, GeoTIFF, JPEG 2000, DTED y otros formatos. Implementada en Rust con enlaces para Python, ofrece acceso nativo a la nube vía Zarr y APIs sencillas para lectura/escritura.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONSearXNG es un motor de metabúsqueda gratuito que respeta la privacidad, el cual agrega resultados de múltiples servicios de búsqueda y bases de datos sin rastrear ni crear perfiles de los usuarios.
Un cliente asíncrono de Python para la API de la Plataforma de Datos Abiertos de Estocolmo. Actualmente recupera ubicaciones de estacionamiento para personas con discapacidad, requiere una clave API y es extensible.
Paquete de herramientas de datos para acciones A, con arquitectura de 12 capas, 60 endpoints, 22 fuentes de datos y sin autenticación, que proporciona capacidades de obtención de datos de acciones A listas para usar para asistentes de programación de IA.
SQLModel es una biblioteca para interactuar con bases de datos SQL en Python, diseñada para reducir la duplicación de código al combinar SQLAlchemy y Pydantic.
Un repositorio educativo que enseña aprendizaje automático supervisado desde los principios básicos utilizando Python, cubriendo fundamentos matemáticos e implementaciones prácticas.
J.A.R.V.I.S is a local-first OSINT platform that uses AI and web scraping to build comprehensive intelligence dossiers on individuals while ensuring data privacy.
rrHog es una plataforma open-source, auto-alojada de análisis web y grabación de sesiones basada en rrweb, utilizando FastAPI, NATS JetStream, ClickHouse, Postgres y Next.js para ingestión asíncrona confiable y consultas rápidas.
Maigret is an OSINT command-line tool that builds a dossier on a person from a username alone, checking 3000+ sites, extracting profile data, and exporting reports in HTML, PDF, JSON, CSV and graph formats.
Un pipeline automatizado que extrae datos de GitHub Trending, los enriquece mediante la API de GitHub, genera resúmenes y análisis mediante LLM, y publica informes en Markdown y datos JSON a través de un sitio de Docusaurus desplegado por GitHub Actions.
Python and MCP example for an Apify actor that returns US House and Senate congressional stock trades and financial disclosures as structured JSON, with filters for member, ticker, and date range.
Taipy es un framework de Python diseñado para que científicos de datos e ingenieros de ML creen y desplieguen aplicaciones web de datos e IA listas para producción sin necesidad de aprender lenguajes front-end.
Luigi es un paquete de Python para construir pipelines complejos de trabajos por lotes, gestionando la resolución de dependencias, la gestión de flujos de trabajo, la visualización, el manejo de fallos y la integración de línea de comandos, con soporte Hadoop incorporado.
Currículo gratuito de ciencia de datos de Microsoft para principiantes, con 20 lecciones, proyectos prácticos, cuestionarios y traducciones en más de 50 idiomas.
LEANN es una base de datos vectorial ligera diseñada para aplicaciones RAG personales, que reduce los requisitos de almacenamiento hasta un 97% mediante recomputación selectiva basada en grafos.
deck.gl es un marco de visualización impulsado por GPU diseñado para el renderizado de alto rendimiento de conjuntos de datos a gran escala utilizando WebGL2 y WebGPU.
CocoIndex es un framework de indexación incremental de código abierto que ofrece a agentes de IA y aplicaciones LLM contexto siempre actualizado reprocesando solo los datos modificados.
FiftyOne es una herramienta de código abierto para crear conjuntos de datos de alta calidad y modelos de visión por computadora. Permite a los usuarios visualizar, etiquetar, evaluar y curar datos de inteligencia artificial visual.
Servidor MCP de datos ESG para empresas cotizadas en Corea, creado por un analista. Permite consultar calificaciones de 5 agencias, indicadores de gobernanza y emisiones de GEI en agentes de IA como Claude y ChatGPT mediante 12 herramientas sin necesidad de API keys.
Apache Spark es un motor de análisis unificado diseñado para el procesamiento de datos a gran escala, que ofrece APIs de alto nivel y un motor optimizado para grafos de computación general.