Sobre o projeto
ClioForge é um IDE de pesquisa open-source e self-hosted projetado para historiadores, pesquisadores de humanidades e agentes de IA. Ele reúne documentos originais, notas de leitura, evidências e tarefas de pesquisa, visando manter as interpretações conectadas ao material de origem e sujeitas a revisão humana. O projeto é um experimento pessoal open-source; não há serviço hospedado, e os usuários o executam em seu próprio computador ou implantam em sua própria conta Cloudflare.
As principais capacidades incluem a importação de PDFs, imagens e texto ou a seleção de arquivos do Google Drive, com originais privados e versões de transcrição preservadas. Os usuários podem ler, destacar e anotar páginas, transformando passagens em evidências com referências estáveis de fonte, versão e página. Um editor rico suporta tabelas, desenhos e LaTeX; as versões podem ser comparadas e a escrita exportada com citações. Alegações e evidências revisadas podem ser transformadas em um rascunho de manuscrito delimitado com progresso de capítulos, referências de fonte, verificações de cobertura e revisão humana final. Perguntas de pesquisa, interpretações concorrentes e evidências podem ser organizadas com um quadro de tarefas arrastável e resultados de assistente revisáveis. Fluxos de trabalho de extração, comparação e pesquisa delimitados funcionam usando chaves de API de modelos fornecidas pelo usuário, rastreando a execução, dependências e gastos estimados. Um fluxo de trabalho de dossiê de pesquisa em segundo plano suporta leitura por fonte, crítica cruzada e síntese vinculada à fonte, terminando na revisão humana. Os recursos de colaboração incluem convites de projeto, funções e discussões de tarefas, além de exportação e restauração de backup do projeto. A interface está disponível em inglês e chinês, com temas claro e escuro.
Status: Alpha self-hosted. Testes automatizados e exercícios de pesquisa end-to-end selecionados cobrem fluxos de trabalho importantes, mas não estabelecem confiabilidade para todos os arquivos, modelos ou instituições. A pesquisa semântica cobre texto, não similaridade de imagem. A importação do Zotero não é uma sincronização contínua. O monitoramento de literatura agendado verifica um conjunto delimitado de metadados do Crossref. Os controles de gastos usam estimativas, não limites de faturamento do provedor. Rascunhos de recuperação local são específicos do navegador. A integração com Google, e-mail e chamadas de modelo requerem configuração separada.
A execução local requer Git e Node.js 22.19 ou superior. D1, R2 e Queues locais são emulados; nenhuma conta Cloudflare é necessária. A configuração envolve clonar o repositório, instalar dependências, configurar segredos, executar migrações e iniciar o servidor de desenvolvimento. O runtime local é apenas loopback e não é um servidor público endurecido. Para hospedagem persistente, um guia de self-hosting é fornecido; um backend de produção genérico Docker/VPS não é fornecido atualmente.
Arquitetura: A UI e a API HTTP usam React, Vinext e Cloudflare Workers. A autenticação usa Better Auth com registros no D1. Projetos, versões, referências e jobs usam D1/SQLite com migrações Drizzle. Arquivos originais são armazenados em R2 privado e servidos através de APIs autenticadas. Pesquisa em segundo plano e monitoramento usam Queues, um Worker separado e Cron Triggers. E-mail transacional usa Cloudflare Email Sending. O acesso ao modelo usa credenciais de API fornecidas pelo usuário e criptografadas em repouso. O código da aplicação registra a proveniência, impõe o acesso, rastreia versões e separa resultados pendentes de pesquisas aceitas.
Licença: O código original da aplicação é AGPL-3.0-only, com componentes de terceiros licenciados separadamente. O projeto é independente e não inclui nem depende do código Prove2Me.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.