FairMind es una plataforma de gobernanza ética de IA de código abierto que ofrece evaluación con grado de evidencia, detección de sesgos, pruebas de equidad y seguimiento de cumplimiento para modelos ML, LLM y sistemas multimodales.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONGreat Expectations (GX Core) es una biblioteca de Python de código abierto para la calidad de los datos, que proporciona un marco para crear pruebas unitarias de datos para garantizar la coherencia y la fiabilidad.
MLflow es una plataforma de ingeniería de IA de código abierto diseñada para gestionar el ciclo de vida de agentes, LLM y modelos de ML tradicionales, centrándose en la observabilidad, evaluación y despliegue.
NovaFabric es una CLI autohospedada de código abierto que captura cualquier ejecución de IA o HPC —ya sea un script, agente o llamada a modelo— como una cápsula de evidencia portátil, reproducible y con secretos redactados, sin requerir cambios en el código.
Label Studio es una herramienta de etiquetado de datos de código abierto y múltiples tipos que admite audio, texto, imágenes, video y series temporales, con una interfaz sencilla y exportación a varios formatos de modelos.
Dagster es un orquestador de pipelines de datos nativo de la nube diseñado para el desarrollo, la producción y la observación de activos de datos a lo largo de todo su ciclo de vida.
Apache Airflow es una plataforma para crear, programar y monitorear flujos de trabajo mediante código, utilizada comúnmente para tuberías de datos y orquestación de AI/ML.
PyCaret 4.0 es una plataforma AutoML de código abierto y autoalojada para Python: un motor basado en sklearn, un plano de control FastAPI y una interfaz React, ejecutable localmente con un solo comando docker compose.
Deep Lake es una base de datos multimodal serverless para IA que combina búsqueda vectorial con almacenamiento de embeddings, imágenes, video, audio y documentos. Transmite datos directamente desde almacenamiento en la nube a PyTorch/TensorFlow, soporta versionado y se integra con LangChain, LlamaIndex y Weights & Biases.
Qdrant es un motor de búsqueda de similitud vectorial y base de datos de alto rendimiento escrito en Rust, diseñado para aplicaciones de IA que requieren búsqueda semántica y gestión de vectores a gran escala.
Made With ML es un curso y código abierto que enseña cómo diseñar, desarrollar, desplegar e iterar en aplicaciones de aprendizaje automático de grado productivo, cubriendo MLOps, pruebas, servicio, CI/CD y aprendizaje continuo.
Argo Workflows es un motor de flujo de trabajo nativo de contenedores para orquestar trabajos paralelos en Kubernetes, implementado como una Definición de Recurso Personalizado (CRD).
Taipy es un framework de Python diseñado para que científicos de datos e ingenieros de ML creen y desplieguen aplicaciones web de datos e IA listas para producción sin necesidad de aprender lenguajes front-end.
Recotem es un sistema de recomendación basado en recetas, construido sobre irspack. Un YAML define datos, entrenamiento y salida; train produce un artefacto firmado, serve lo monta como API REST con intercambio en caliente. Binario único, sin base de datos.