Sobre o projeto
# LLM Wiki
LLM Wiki é um aplicativo de desktop multiplataforma que transforma seus documentos em uma base de conhecimento organizada e interligada automaticamente. Em vez de RAG tradicional (recuperar e responder do zero a cada vez), o LLM constrói e mantém incrementalmente um wiki persistente a partir de suas fontes. O conhecimento é compilado uma vez e mantido atualizado, não rederivado a cada consulta.
Este projeto é baseado no [padrão LLM Wiki de Karpathy](https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f) — uma metodologia para construir bases de conhecimento pessoais usando LLMs.
## Principais Recursos
### Ingestão em Duas Etapas com Cadeia de Pensamento
- O LLM analisa primeiro, depois gera páginas de wiki com rastreabilidade de fonte e cache incremental
- Cache incremental SHA256 — arquivos inalterados são ignorados automaticamente, economizando tokens e tempo
- Tarefas com falha são repetidas automaticamente até 3 vezes
- Geração consciente de idioma (inglês ou chinês)
### Ingestão Multimodal de Imagens
- Extrai imagens incorporadas de PDFs
- Gera legendas factuais com um LLM de visão
- Exibe imagens em resultados de busca com reconhecimento de imagem, com pré-visualização em lightbox e salto para a fonte
### Análise de Documentos em Múltiplos Formatos
- PDF, documentos Office, EPUB/MOBI, modo Org, imagens, mídia, clipes web e lotes de URLs
- Processamento de PDF integrado, em nuvem ou local via MinerU
- DOCX via docx-rs — cabeçalhos, negrito/itálico, listas, tabelas → Markdown estruturado
- Clipes web via Readability.js + Turndown.js → Markdown limpo
### Configuração Flexível de Modelos
- Configure modelos por projeto
- Roteie Chat e Ingestão de forma independente
- Gerencie provedores personalizados, cabeçalhos e saída em streaming
- Suporte a múltiplos provedores: OpenAI, Anthropic, Google, Ollama, Personalizado
### Recuperação Fundamentada na Fonte
- Modo Ler Somente Fontes para responder exclusivamente a partir do material importado original
- Grafo de Conhecimento de 4 Sinais: modelo de relevância com links diretos, sobreposição de fontes, Adamic-Adar e afinidade de tipo
- Detecção de Comunidades Louvain — descoberta automática de clusters de conhecimento com pontuação de coesão
- Insights do Grafo — conexões surpreendentes e lacunas de conhecimento com Pesquisa Profunda em um clique
### Busca Semântica Vetorial (Opcional)
- Recuperação baseada em embeddings via LanceDB
- Suporta qualquer endpoint compatível com OpenAI
- Desativada por padrão; ativada nas Configurações com endpoint, chave de API e configuração de modelo independentes
- Benchmark: recall geral melhorou de 58,2% para 71,4% com busca vetorial ativada
### Agente de Chat com Backend Rust
- Runtime de Agente com uso de ferramentas para recuperação de wiki/fonte/grafo/web
- Geração de arquivos no workspace, aprovação de shell, cancelamento e eventos de ferramentas em streaming
- Habilidades do Agente — escaneie e ative pastas locais `SKILL.md`, selecione habilidades com `/skill`
- Saídas geradas no workspace aparecem como pré-visualizações com acesso rápido à pasta
- Modelo de execução mais seguro — comandos do workspace do projeto podem continuar suavemente, enquanto comandos de shell externos exigem aprovação explícita
### Pesquisa Profunda
- Busca web via Tavily, SerpApi ou SearXNG com extração completa de conteúdo
- Múltiplas consultas de busca por tópico, geradas por LLM no momento da ingestão
- Diálogo de confirmação do usuário — tópico e consultas de busca editáveis mostrados para revisão
- Painel de Pesquisa com altura dinâmica e progresso em streaming em tempo real
### Gerenciamento de Projetos
- Exporte e importe arquivos completos de projeto entre dispositivos
- Reconstrua o índice do Wiki a partir de páginas existentes
- Importação de pastas preservando a estrutura de diretórios
- Excluir arquivos de fonte remove sua página de resumo no wiki
- Método de correspondência em 3 etapas encontra páginas de wiki relacionadas
### Compatibilidade com Obsidian
- O diretório do wiki funciona como um cofre Obsidian
- Diretório `.obsidian/` gerado automaticamente com configurações recomendadas
### Recursos Adicionais
- Layout de três colunas: Árvore de Conhecimento / Árvore de Arquivos (esquerda) + Chat (centro) + Pré-visualização (direita)
- Painel de atividade com status de processamento em tempo real
- Modelos de cenário: Pesquisa, Leitura, Crescimento Pessoal, Negócios, Geral
- Sessões de chat independentes com persistência por conversa
- Painel de referências citadas com seções recolhíveis
- Renderização Markdown com matemática KaTeX e diagramas Mermaid
- Controle deslizante de tamanho de contexto de 4K a 1M tokens
- Extensão Chrome Web Clipper com pré-visualização offline
- API HTTP local + Servidor MCP + Habilidade de Agente de IA
- i18n — interface em inglês + chinês
- CI/CD com GitHub Actions para macOS, Windows, Linux
## Arquitetura
O aplicativo usa um backend Rust para o agente de chat e busca vetorial, com frontend baseado em Tauri. A estrutura do diretório do wiki segue o design de Karpathy com arquivos purpose.md, schema.md, index.md, log.md e overview.md.
## Começando
1. Instale o aplicativo para sua plataforma (macOS ARM/Intel, Windows .msi, Linux .deb/.AppImage)
2. Configure seu provedor de LLM (OpenAI, Anthropic, Google, Ollama ou personalizado)
3. Importe documentos ou pastas
4. Deixe o LLM construir seu wiki automaticamente
5. Explore o grafo de conhecimento, converse com seus dados e execute pesquisa profunda
## Licença
Software de código aberto licenciado sob a licença MIT.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.