Sobre el proyecto
# LLM Wiki
LLM Wiki es una aplicación de escritorio multiplataforma que transforma tus documentos en una base de conocimiento organizada e interconectada de forma automática. En lugar del RAG tradicional (recuperar y responder desde cero cada vez), el LLM construye y mantiene de forma incremental un wiki persistente a partir de tus fuentes. El conocimiento se compila una vez y se mantiene actualizado, no se vuelve a derivar en cada consulta.
Este proyecto se basa en el [patrón LLM Wiki de Karpathy](https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f): una metodología para construir bases de conocimiento personales usando LLMs.
## Características principales
### Ingesta de cadena de pensamiento en dos pasos
- El LLM analiza primero y luego genera páginas wiki con trazabilidad de fuentes y caché incremental
- Caché incremental SHA256: los archivos sin cambios se omiten automáticamente, ahorrando tokens y tiempo
- Las tareas fallidas se reintentan automáticamente hasta 3 veces
- Generación sensible al idioma (inglés o chino)
### Ingesta de imágenes multimodal
- Extrae imágenes incrustadas de PDFs
- Genera pies de foto factuales con un LLM de visión
- Muestra imágenes en resultados de búsqueda sensibles a imágenes con vista previa tipo lightbox y salto a la fuente
### Parseo de documentos en múltiples formatos
- PDF, documentos de Office, EPUB/MOBI, modo Org, imágenes, medios, clips web y lotes de URL
- Procesamiento de PDF integrado, en la nube o local con MinerU
- DOCX mediante docx-rs: encabezados, negrita/cursiva, listas, tablas → Markdown estructurado
- Clips web mediante Readability.js + Turndown.js → Markdown limpio
### Configuración flexible de modelos
- Configura modelos por proyecto
- Enruta Chat e Ingesta de forma independiente
- Gestiona proveedores personalizados, cabeceras y salida en streaming
- Soporte multi-proveedor: OpenAI, Anthropic, Google, Ollama, Personalizado
### Recuperación basada en fuentes
- Modo Leer solo fuentes para responder exclusivamente a partir del material importado original
- Grafo de conocimiento de 4 señales: modelo de relevancia con enlaces directos, solapamiento de fuentes, Adamic-Adar y afinidad de tipos
- Detección de comunidades de Louvain: descubrimiento automático de clústeres de conocimiento con puntuación de cohesión
- Información del grafo: conexiones sorprendentes y vacíos de conocimiento con investigación profunda en un clic
### Búsqueda semántica vectorial (opcional)
- Recuperación basada en embeddings mediante LanceDB
- Compatible con cualquier endpoint compatible con OpenAI
- Deshabilitada por defecto; se habilita en Ajustes con endpoint, clave API y configuración de modelo independientes
- Benchmark: la recuperación general mejoró del 58,2% al 71,4% con la búsqueda vectorial habilitada
### Agente de chat con backend en Rust
- Runtime de agente con uso de herramientas y recuperación wiki/fuente/grafo/web
- Generación de archivos en el espacio de trabajo, aprobación de shell, cancelación y eventos de herramientas en streaming
- Habilidades del agente: escanea y habilita carpetas locales `SKILL.md`, selecciona habilidades con `/skill`
- Las salidas generadas en el espacio de trabajo aparecen como vistas previas con acceso rápido a la carpeta
- Modelo de ejecución más seguro: los comandos del espacio de trabajo del proyecto pueden continuar sin problemas, mientras que los comandos de shell externos requieren aprobación explícita
### Investigación profunda
- Búsqueda web mediante Tavily, SerpApi o SearXNG con extracción completa de contenido
- Múltiples consultas de búsqueda por tema, generadas por el LLM en el momento de la ingesta
- Diálogo de confirmación del usuario: tema editable y consultas de búsqueda mostradas para revisión
- Panel de investigación con altura dinámica y progreso de streaming en tiempo real
### Gestión de proyectos
- Exporta e importa archivos de proyecto completos entre dispositivos
- Reconstruye el índice wiki a partir de páginas existentes
- Importación de carpetas preservando la estructura de directorios
- Eliminar archivos de origen elimina su página de resumen wiki
- Método de coincidencia de 3 vías para encontrar páginas wiki relacionadas
### Compatibilidad con Obsidian
- El directorio wiki funciona como una bóveda de Obsidian
- Directorio `.obsidian/` autogenerado con ajustes recomendados
### Características adicionales
- Diseño de tres columnas: Árbol de conocimiento / Árbol de archivos (izquierda) + Chat (centro) + Vista previa (derecha)
- Panel de actividad con estado de procesamiento en tiempo real
- Plantillas de escenario: Investigación, Lectura, Crecimiento personal, Negocios, General
- Sesiones de chat independientes con persistencia por conversación
- Panel de referencias citadas con secciones plegables
- Renderizado Markdown con matemáticas KaTeX y diagramas Mermaid
- Deslizador de tamaño de contexto de 4K a 1M de tokens
- Extensión Chrome Web Clipper con vista previa sin conexión
- API HTTP local + Servidor MCP + Habilidad de agente de IA
- i18n: interfaz en inglés y chino
- CI/CD con GitHub Actions para macOS, Windows y Linux
## Arquitectura
La aplicación utiliza un backend en Rust para el agente de chat y la búsqueda vectorial, con un frontend basado en Tauri. La estructura del directorio wiki sigue el diseño de Karpathy con archivos purpose.md, schema.md, index.md, log.md y overview.md.
## Primeros pasos
1. Instala la aplicación para tu plataforma (macOS ARM/Intel, Windows .msi, Linux .deb/.AppImage)
2. Configura tu proveedor de LLM (OpenAI, Anthropic, Google, Ollama o personalizado)
3. Importa documentos o carpetas
4. Deja que el LLM construya tu wiki automáticamente
5. Explora el grafo de conocimiento, chatea con tus datos y realiza investigaciones profundas
## Licencia
Software de código abierto licenciado bajo la licencia MIT.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.