Código abierto. Nuevas posibilidades.

Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.

Topic: swe-bench清除
self-benchmupt-ai
NUEVO

SelfBench crea benchmarks privados de agentes de programación a partir de las solicitudes de extracción fusionadas de un repositorio, convirtiendo cada PR en una tarea con formato Harbor con pruebas ocultas y una solución de referencia, y luego permite ejecutar modelos y harnesses y comparar precisión frente a coste.

IADesarrolloTraining & evaluation
NUEVO

Benchmark de código abierto en vivo que compara agentes de IA para programar en problemas reales de GitHub, actualizado automáticamente cada 15 minutos con una tabla de clasificación pública.

IADesarrolloTraining & evaluation
continuumCambrianTech
NUEVO

Continuum es un sustrato de IA de código abierto y local-first para "ciudadanos" persistentes y encarnados que se ejecutan en hardware personal. Ofrece salas compartidas, uso real de herramientas, memoria a largo plazo y un pipeline de Academia que convierte la experiencia en adaptaciones LoRA evaluadas, usando un núcleo en Rust y un fork de llama.cpp.

IAAutoalojamientoAI agents