À propos du projet

Pezzo est une plateforme LLMOps open-source et cloud-native destinée aux équipes travaillant avec de grands modèles de langage. Selon son README, elle est conçue pour rationaliser la conception de prompts, la gestion des versions, la livraison instantanée, la collaboration, le dépannage et l'observabilité. Principales capacités décrites dans le dépôt : - Gestion des prompts : créer, versionner et gérer les prompts en un seul endroit, avec livraison instantanée des modifications. - Observabilité : observer et surveiller les opérations d'IA et résoudre les problèmes. - Cache : le README indique que le cache peut aider à économiser sur les coûts et la latence. - Collaboration : gérer les prompts et les changements d'IA en collaboration. Les clients pris en charge listés dans le README incluent Node.js (@pezzo/client sur npm), Python (sur PyPI) et LangChain. La matrice des fonctionnalités montre la gestion des prompts, l'observabilité et le cache pris en charge sur ces clients. Le projet invite à soumettre des issues pour demander des clients supplémentaires. Architecture et déploiement : Pezzo est décrit comme entièrement cloud-native et repose sur des technologies open-source, notamment PostgreSQL, ClickHouse, Redis et Supertokens. Une configuration Docker Compose est documentée pour exécuter la pile complète localement, et un mode de développement est décrit utilisant Node.js 18+, Docker, Nx, les migrations Prisma et la génération de code GraphQL. Le serveur expose un endpoint de santé, et la console Pezzo s'exécute comme une application web distincte. La documentation, les tutoriels et les recettes pour divers cas d'utilisation et fournisseurs de LLM sont disponibles sur le site officiel de documentation. Le projet accueille les contributions de la communauté via des pull requests et des issues, avec un fichier CONTRIBUTING.md et un code de conduite basé sur le Contributor Covenant. Le code source est publié sous licence Apache 2.0.