Sobre el proyecto

# LLM Wiki LLM Wiki es una aplicación de escritorio multiplataforma que transforma tus documentos en una base de conocimiento organizada e interconectada de forma automática. En lugar del RAG tradicional (recuperar y responder desde cero cada vez), el LLM construye y mantiene de forma incremental un wiki persistente a partir de tus fuentes. El conocimiento se compila una vez y se mantiene actualizado, no se vuelve a derivar en cada consulta. Este proyecto se basa en el [patrón LLM Wiki de Karpathy](https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f): una metodología para construir bases de conocimiento personales usando LLMs. ## Características principales ### Ingesta de cadena de pensamiento en dos pasos - El LLM analiza primero y luego genera páginas wiki con trazabilidad de fuentes y caché incremental - Caché incremental SHA256: los archivos sin cambios se omiten automáticamente, ahorrando tokens y tiempo - Las tareas fallidas se reintentan automáticamente hasta 3 veces - Generación sensible al idioma (inglés o chino) ### Ingesta de imágenes multimodal - Extrae imágenes incrustadas de PDFs - Genera pies de foto factuales con un LLM de visión - Muestra imágenes en resultados de búsqueda sensibles a imágenes con vista previa tipo lightbox y salto a la fuente ### Parseo de documentos en múltiples formatos - PDF, documentos de Office, EPUB/MOBI, modo Org, imágenes, medios, clips web y lotes de URL - Procesamiento de PDF integrado, en la nube o local con MinerU - DOCX mediante docx-rs: encabezados, negrita/cursiva, listas, tablas → Markdown estructurado - Clips web mediante Readability.js + Turndown.js → Markdown limpio ### Configuración flexible de modelos - Configura modelos por proyecto - Enruta Chat e Ingesta de forma independiente - Gestiona proveedores personalizados, cabeceras y salida en streaming - Soporte multi-proveedor: OpenAI, Anthropic, Google, Ollama, Personalizado ### Recuperación basada en fuentes - Modo Leer solo fuentes para responder exclusivamente a partir del material importado original - Grafo de conocimiento de 4 señales: modelo de relevancia con enlaces directos, solapamiento de fuentes, Adamic-Adar y afinidad de tipos - Detección de comunidades de Louvain: descubrimiento automático de clústeres de conocimiento con puntuación de cohesión - Información del grafo: conexiones sorprendentes y vacíos de conocimiento con investigación profunda en un clic ### Búsqueda semántica vectorial (opcional) - Recuperación basada en embeddings mediante LanceDB - Compatible con cualquier endpoint compatible con OpenAI - Deshabilitada por defecto; se habilita en Ajustes con endpoint, clave API y configuración de modelo independientes - Benchmark: la recuperación general mejoró del 58,2% al 71,4% con la búsqueda vectorial habilitada ### Agente de chat con backend en Rust - Runtime de agente con uso de herramientas y recuperación wiki/fuente/grafo/web - Generación de archivos en el espacio de trabajo, aprobación de shell, cancelación y eventos de herramientas en streaming - Habilidades del agente: escanea y habilita carpetas locales `SKILL.md`, selecciona habilidades con `/skill` - Las salidas generadas en el espacio de trabajo aparecen como vistas previas con acceso rápido a la carpeta - Modelo de ejecución más seguro: los comandos del espacio de trabajo del proyecto pueden continuar sin problemas, mientras que los comandos de shell externos requieren aprobación explícita ### Investigación profunda - Búsqueda web mediante Tavily, SerpApi o SearXNG con extracción completa de contenido - Múltiples consultas de búsqueda por tema, generadas por el LLM en el momento de la ingesta - Diálogo de confirmación del usuario: tema editable y consultas de búsqueda mostradas para revisión - Panel de investigación con altura dinámica y progreso de streaming en tiempo real ### Gestión de proyectos - Exporta e importa archivos de proyecto completos entre dispositivos - Reconstruye el índice wiki a partir de páginas existentes - Importación de carpetas preservando la estructura de directorios - Eliminar archivos de origen elimina su página de resumen wiki - Método de coincidencia de 3 vías para encontrar páginas wiki relacionadas ### Compatibilidad con Obsidian - El directorio wiki funciona como una bóveda de Obsidian - Directorio `.obsidian/` autogenerado con ajustes recomendados ### Características adicionales - Diseño de tres columnas: Árbol de conocimiento / Árbol de archivos (izquierda) + Chat (centro) + Vista previa (derecha) - Panel de actividad con estado de procesamiento en tiempo real - Plantillas de escenario: Investigación, Lectura, Crecimiento personal, Negocios, General - Sesiones de chat independientes con persistencia por conversación - Panel de referencias citadas con secciones plegables - Renderizado Markdown con matemáticas KaTeX y diagramas Mermaid - Deslizador de tamaño de contexto de 4K a 1M de tokens - Extensión Chrome Web Clipper con vista previa sin conexión - API HTTP local + Servidor MCP + Habilidad de agente de IA - i18n: interfaz en inglés y chino - CI/CD con GitHub Actions para macOS, Windows y Linux ## Arquitectura La aplicación utiliza un backend en Rust para el agente de chat y la búsqueda vectorial, con un frontend basado en Tauri. La estructura del directorio wiki sigue el diseño de Karpathy con archivos purpose.md, schema.md, index.md, log.md y overview.md. ## Primeros pasos 1. Instala la aplicación para tu plataforma (macOS ARM/Intel, Windows .msi, Linux .deb/.AppImage) 2. Configura tu proveedor de LLM (OpenAI, Anthropic, Google, Ollama o personalizado) 3. Importa documentos o carpetas 4. Deja que el LLM construya tu wiki automáticamente 5. Explora el grafo de conocimiento, chatea con tus datos y realiza investigaciones profundas ## Licencia Software de código abierto licenciado bajo la licencia MIT.