OPEN SOURCE, OPEN TO EVERYONE

Código abierto. Nuevas posibilidades.

Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.

Selección editorial · Descubre buen código abierto4109descubiertos

Un poco de curiosidad. Un mundo de código abierto.

THE FIRST COLLECTION
Topic: llm-evaluation清除
sachncssachncs
NUEVO

README del perfil de GitHub de Sachin, arquitecto e ingeniero de IA aplicada. Presenta proyectos de código abierto sobre agentes, RAG y fiabilidad, además de sus habilidades y términos de contacto.

IADesarrolloAI agents
agentleakyagobski
NUEVO

AgentLeak es una herramienta open-source de pruebas de privacidad para agentes de IA. Detecta fugas de datos en llamadas a herramientas, memoria y registros mediante SDK, CLI y herramientas MCP locales, ofreciendo informes redactados y puertas de CI sin dependencias en la nube.

DesarrolloIATesting & debugging
mlflowmlflow
NUEVO

MLflow es una plataforma de ingeniería de IA de código abierto diseñada para gestionar el ciclo de vida de agentes, LLM y modelos de ML tradicionales, centrándose en la observabilidad, evaluación y despliegue.

Cine, vídeo y mediosVideo editing
sumOtotaO
NUEVO

SUM es una herramienta de código abierto para verificar transformaciones de texto de IA con recibos criptográficos. Comprueba qué cambió, qué se conservó y qué se perdió cuando la IA reescribe texto, con firmas Ed25519 entre runtimes y verificación sin conexión.

IADesarrolloAI assistants
garakNVIDIA
NUEVO

garak es un escáner de vulnerabilidades de LLM de código abierto de NVIDIA que sondea modelos de IA generativa en busca de alucinaciones, fugas de datos, inyección de prompts, toxicidad, jailbreaks y otras debilidades, similar en espíritu a nmap o Metasploit, pero para LLMs.

IADesarrolloTraining & evaluation
ifixaiifixai-ai
NUEVO

iFixAi es una herramienta de auditoría independiente para agentes de IA que evalúa si un agente cumple con KPIs empresariales y estructuras organizativas mediante un sistema de puntuación estructurado.

IATraining & evaluation
deepevalconfident-ai
NUEVO

DeepEval es un marco de trabajo de código abierto para la evaluación de LLM, diseñado para realizar pruebas unitarias en aplicaciones de IA, incluyendo tuberías RAG, agentes y chatbots.

IADesarrolloTraining & evaluation
NUEVO

Benchmark abierto de alucinación de LLMs sobre la BNCC (Base Nacional Comum Curricular de Brasil). Mide cuánto inventan los modelos códigos y textos oficiales, con metodología, datos brutos y CI auditables.

IATraining & evaluation