Sobre o projeto

# LLM Wiki LLM Wiki é um aplicativo de desktop multiplataforma que transforma seus documentos em uma base de conhecimento organizada e interligada automaticamente. Em vez de RAG tradicional (recuperar e responder do zero a cada vez), o LLM constrói e mantém incrementalmente um wiki persistente a partir de suas fontes. O conhecimento é compilado uma vez e mantido atualizado, não rederivado a cada consulta. Este projeto é baseado no [padrão LLM Wiki de Karpathy](https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f) — uma metodologia para construir bases de conhecimento pessoais usando LLMs. ## Principais Recursos ### Ingestão em Duas Etapas com Cadeia de Pensamento - O LLM analisa primeiro, depois gera páginas de wiki com rastreabilidade de fonte e cache incremental - Cache incremental SHA256 — arquivos inalterados são ignorados automaticamente, economizando tokens e tempo - Tarefas com falha são repetidas automaticamente até 3 vezes - Geração consciente de idioma (inglês ou chinês) ### Ingestão Multimodal de Imagens - Extrai imagens incorporadas de PDFs - Gera legendas factuais com um LLM de visão - Exibe imagens em resultados de busca com reconhecimento de imagem, com pré-visualização em lightbox e salto para a fonte ### Análise de Documentos em Múltiplos Formatos - PDF, documentos Office, EPUB/MOBI, modo Org, imagens, mídia, clipes web e lotes de URLs - Processamento de PDF integrado, em nuvem ou local via MinerU - DOCX via docx-rs — cabeçalhos, negrito/itálico, listas, tabelas → Markdown estruturado - Clipes web via Readability.js + Turndown.js → Markdown limpo ### Configuração Flexível de Modelos - Configure modelos por projeto - Roteie Chat e Ingestão de forma independente - Gerencie provedores personalizados, cabeçalhos e saída em streaming - Suporte a múltiplos provedores: OpenAI, Anthropic, Google, Ollama, Personalizado ### Recuperação Fundamentada na Fonte - Modo Ler Somente Fontes para responder exclusivamente a partir do material importado original - Grafo de Conhecimento de 4 Sinais: modelo de relevância com links diretos, sobreposição de fontes, Adamic-Adar e afinidade de tipo - Detecção de Comunidades Louvain — descoberta automática de clusters de conhecimento com pontuação de coesão - Insights do Grafo — conexões surpreendentes e lacunas de conhecimento com Pesquisa Profunda em um clique ### Busca Semântica Vetorial (Opcional) - Recuperação baseada em embeddings via LanceDB - Suporta qualquer endpoint compatível com OpenAI - Desativada por padrão; ativada nas Configurações com endpoint, chave de API e configuração de modelo independentes - Benchmark: recall geral melhorou de 58,2% para 71,4% com busca vetorial ativada ### Agente de Chat com Backend Rust - Runtime de Agente com uso de ferramentas para recuperação de wiki/fonte/grafo/web - Geração de arquivos no workspace, aprovação de shell, cancelamento e eventos de ferramentas em streaming - Habilidades do Agente — escaneie e ative pastas locais `SKILL.md`, selecione habilidades com `/skill` - Saídas geradas no workspace aparecem como pré-visualizações com acesso rápido à pasta - Modelo de execução mais seguro — comandos do workspace do projeto podem continuar suavemente, enquanto comandos de shell externos exigem aprovação explícita ### Pesquisa Profunda - Busca web via Tavily, SerpApi ou SearXNG com extração completa de conteúdo - Múltiplas consultas de busca por tópico, geradas por LLM no momento da ingestão - Diálogo de confirmação do usuário — tópico e consultas de busca editáveis mostrados para revisão - Painel de Pesquisa com altura dinâmica e progresso em streaming em tempo real ### Gerenciamento de Projetos - Exporte e importe arquivos completos de projeto entre dispositivos - Reconstrua o índice do Wiki a partir de páginas existentes - Importação de pastas preservando a estrutura de diretórios - Excluir arquivos de fonte remove sua página de resumo no wiki - Método de correspondência em 3 etapas encontra páginas de wiki relacionadas ### Compatibilidade com Obsidian - O diretório do wiki funciona como um cofre Obsidian - Diretório `.obsidian/` gerado automaticamente com configurações recomendadas ### Recursos Adicionais - Layout de três colunas: Árvore de Conhecimento / Árvore de Arquivos (esquerda) + Chat (centro) + Pré-visualização (direita) - Painel de atividade com status de processamento em tempo real - Modelos de cenário: Pesquisa, Leitura, Crescimento Pessoal, Negócios, Geral - Sessões de chat independentes com persistência por conversa - Painel de referências citadas com seções recolhíveis - Renderização Markdown com matemática KaTeX e diagramas Mermaid - Controle deslizante de tamanho de contexto de 4K a 1M tokens - Extensão Chrome Web Clipper com pré-visualização offline - API HTTP local + Servidor MCP + Habilidade de Agente de IA - i18n — interface em inglês + chinês - CI/CD com GitHub Actions para macOS, Windows, Linux ## Arquitetura O aplicativo usa um backend Rust para o agente de chat e busca vetorial, com frontend baseado em Tauri. A estrutura do diretório do wiki segue o design de Karpathy com arquivos purpose.md, schema.md, index.md, log.md e overview.md. ## Começando 1. Instale o aplicativo para sua plataforma (macOS ARM/Intel, Windows .msi, Linux .deb/.AppImage) 2. Configure seu provedor de LLM (OpenAI, Anthropic, Google, Ollama ou personalizado) 3. Importe documentos ou pastas 4. Deixe o LLM construir seu wiki automaticamente 5. Explore o grafo de conhecimento, converse com seus dados e execute pesquisa profunda ## Licença Software de código aberto licenciado sob a licença MIT.