DocsGPT est une plateforme d'IA open-source pour créer des agents et assistants intelligents, proposant l'analyse de documents, le support multi-modèles et des capacités de recherche d'entreprise.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONUne bibliothèque Python et un outil CLI pour rechercher dans le SLB Energy Glossary en anglais et en espagnol, proposant le scraping du site en direct, une mise en cache SQLite locale et des capacités de recherche sémantique.
txtai est un framework AI tout-en-un pour la recherche sémantique, l'orchestration de LLM et la création de workflows complexes.
Apache Doris est une base de données open-source d'analyse et de recherche en temps réel basée sur l'architecture MPP, offrant des analyses SQL rapides et des capacités de recherche hybride.
PaperQA2 est un framework RAG haute précision pour répondre à des questions issues de documents scientifiques avec citations, prenant en charge PDF, fichiers Office et code, avec workflows agentiques et support multi-fournisseurs LLM.
Une API de moteur de recherche ultra-rapide offrant une recherche hybride optimisée par l'IA, une tolérance aux fautes de frappe et des fonctionnalités de recherche instantanée pour sites et applications.
Qdrant est un moteur de recherche de similarité vectorielle et une base de données haute performance écrite en Rust, conçue pour les applications d'IA nécessitant une recherche sémantique et une gestion de vecteurs à grande échelle.
GPT Researcher est un agent autonome open-source qui effectue des recherches approfondies via le web et des documents locaux, générant des rapports détaillés avec citations et s'intégrant à Claude via MCP.
PixelRAG est un système RAG visuel open-source qui convertit les documents en captures d'écran et les récupère directement, préservant les structures visuelles comme les tableaux et graphiques que le texte perd. Inclut un index Wikipédia hébergé de 8,28 millions de pages, des outils CLI et une intégration Claude Code.