À propos du projet
New API est une passerelle et un système de gestion auto-hébergés pour les API de grands modèles de langage, présenté comme le successeur de nouvelle génération du projet One API. Il agrège de nombreux fournisseurs de modèles en amont derrière un point de terminaison unique et normalise leurs formats de requête/réponse différents, afin que les clients puissent communiquer avec une seule interface API pendant que la passerelle gère la traduction.
Capacités principales décrites dans le README :
- Conversion de format : OpenAI-compatible ⇄ Claude Messages, OpenAI-compatible → Google Gemini, et Gemini → OpenAI-compatible (texte uniquement, l'appel de fonctions n'est pas encore pris en charge). La conversion OpenAI Responses est indiquée comme en développement. Une fonctionnalité « thinking-to-content » est également mentionnée.
- Couverture d'interfaces : chat completions, Responses, images, audio, vidéo, embeddings, rerank (Cohere, Jina), sessions temps réel (y compris Azure), Claude Messages et chat Google Gemini. Midjourney-Proxy, Suno API et Dify ChatFlow sont également répertoriés comme types en amont pris en charge, ainsi que des points de terminaison personnalisés configurables.
- Routage et fiabilité : sélection aléatoire pondérée des canaux, nouvelle tentative automatique en cas d'échec et limitation du débit des modèles au niveau de l'utilisateur.
- Contrôles de l'effort de raisonnement : suffixes de nom de modèle tels que -high/-medium/-low pour les séries o d'OpenAI et GPT-5, une variante -thinking pour Claude, et des suffixes thinking/nothinking ainsi que budget pour les modèles Gemini.
- Comptes et accès : regroupement de jetons, restrictions de modèles, gestion des utilisateurs et connexion par autorisation via Discord, LinuxDO, Telegram et OIDC. Un outil compagnon de requête de quotas de clés est référencé.
- Comptabilité : rechargement interne et allocation de quotas via EPay et Stripe, comptabilité des coûts par requête et à l'usage, et statistiques de facturation des hits de cache pour des fournisseurs tels qu'OpenAI, Azure, DeepSeek, Claude et Qwen.
- Opérations : tableau de bord visuel avec statistiques, interface multilingue (chinois simplifié/traditionnel, anglais, français, japonais) et compatibilité de base de données avec le schéma original de One API.
Le déploiement est centré sur Docker : un fichier docker-compose est fourni, et les exécutions en conteneur unique sont documentées pour SQLite (par défaut, nécessite le montage de /data) ou MySQL. PostgreSQL ≥ 9.6 et MySQL ≥ 5.7.8 sont pris en charge comme bases de données distantes ; seuls les systèmes 64 bits amd64/arm64 sont pris en charge. Une installation en un clic via le panneau BaoTa est également documentée. Les configurations multi-nœuds nécessitent une base de données principale partagée et un SESSION_SECRET identique, et les nœuds partageant Redis doivent également partager CRYPTO_SECRET. Le README détaille la gestion des sessions entre les topologies Redis partagé, Redis par nœud et sans Redis, y compris les fenêtres de péremption et le comportement des limites de débit dans chaque cas. De nombreuses variables d'environnement sont documentées pour les délais d'attente, les limites de corps de requête, la mise en mémoire tampon des flux, les proxys de confiance, les limites de session et le profilage Pyroscope.
Le projet est sous licence AGPLv3 avec des conditions supplémentaires de la Section 7 exigeant la préservation d'un avis d'attribution et d'un lien visible vers le dépôt d'origine dans les versions modifiées. Il est dérivé de One API (MIT). Le README souligne que l'utilisation est destinée à des scénarios légaux et autorisés de passerelle, de gestion multi-modèles, d'analyse et de déploiement privé, et que les opérateurs offrant des services publics d'IA générative doivent satisfaire aux obligations applicables en matière de déclaration, de licence, de sécurité du contenu et autres obligations connexes.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.