À propos du projet

Nexus Orchestrator agit comme une couche d'acheminement intelligente pour les grands modèles de langage (LLM), permettant aux utilisateurs de combiner des fournisseurs locaux (comme Ollama) avec des API cloud (compatibles OpenAI) au sein d'une seule interface. Il utilise un modèle d'acheminement léger pour classifier l'intention des invites en catégories telles que CODING, REASONING, CREATIVE, VISION et SECURITY, en redistribuant automatiquement la requête vers le pool de modèles désigné pour cette catégorie. Les capacités clés incluent : - Orchestration hybride : passer sans couture entre des modèles locaux et cloud par catégorie. - Intégration d'outils : prend en charge les serveurs Model Context Protocol (MCP) et s'intègre à SearXNG auto-hébergé pour la recherche web et la récupération d'URL via appel d'outil. - Gestion multi-utilisateurs : comprend des configurations de fournisseur par utilisateur, des mappages par catégorie et la gestion de projets avec un tableau de bord administrateur. - Support LLM avancé : gère les téléchargements de vision et de documents, et offre un commutateur « Réflexion » dédié pour afficher les chaînes de raisonnement (par exemple pour DeepSeek R1) dans une section d'interface réductible. - Sécurité et confidentialité : conçu pour un fonctionnement axé sur la confidentialité avec des options d'acheminement 100 % local, incluant CORS intégré, limitation du débit et protection SSRF pour la récupération d'URL.