عن المشروع

يعمل Busbar كحدود إنفاذ يديرها العميل لأنظمة الذكاء الاصطناعي، بدلاً من كونه وكيلاً عكسيًا عامًا. يقع في مسار الطلب بين تطبيقات ووكلاء الذكاء الاصطناعي، والوجهات النهائية بما في ذلك مزودو LLM وأدوات MCP ووكلاء A2A، مما يسمح للمشغلين بالتحقق من استدعاءات النماذج واستخدام الأدوات وتفويض الوكلاء وحكمها وتوجيهها وتسجيلها قبل وصول الطلبات إلى الوجهات المعتمدة. المشروع مستضاف ذاتيًا بالكامل، دون خدمة مستضافة مُدارة، ودون تسجيل مطلوب، ودون سلوك اتصال خارجي؛ تبقى جميع بيانات اعتماد المزودين داخل البنية التحتية للمشغل عند حدود الإنفاذ. يوفر دعمًا من الدرجة الأولى لستة بروتوكولات اتصال LLM على كل من الدخول والخروج: OpenAI، وOpenAI Responses، وAnthropic، وGemini، وCohere، وBedrock Converse، مما يغطي جميع أزواج البروتوكولات الستة والثلاثين الممكنة من الدخول إلى المنبع. تعيد المسارات ذات البروتوكول نفسه توجيه بايتات الطلب الأصلية مباشرة، مما يوفر تطابقًا بايتًا ببايت مع استدعاءات المزود المباشرة، بينما تترجم المسارات متعددة البروتوكولات حقول الطلب لتتوافق مع التنسيق الأصلي للمزود الهدف. يتطلب تكامل العميل فقط تغيير عنوان URL الأساسي ومفتاح API للإشارة إلى نسخة Busbar، دون تغييرات في تدفقات SDK الأصلية الحالية. صُمم النشر لتقليل العبء التشغيلي إلى الحد الأدنى: يُوزع Busbar كملف Rust ثنائي ثابت واحد لا يتطلب مفسرًا منفصلاً أو قاعدة بيانات أو sidecar، أو كصورة حاوية مضغوطة صغيرة. يُعرَّف التكوين في ملف YAML واحد، مع أمر تحقق مدمج من التكوين يعمل دون وصول إلى الشبكة أو خادم قيد التشغيل، ومناسب للإدراج في خطوط أنابيب CI. تُوفر مخططات Helm الرسمية لنشر Kubernetes، مع إعدادات أمان افتراضية مُحصَّنة تشمل التشغيل بدون صلاحيات root، ونظام ملفات جذر للقراءة فقط، وإسقاط قدرات Linux غير الضرورية. تشمل القدرات التشغيلية الأساسية مجموعات نماذج موزونة بحدود تزامن لكل مسار، وقواطع دوائر منسوبة الأعطال، وتحويل احتياطي أثناء التنفيذ يبدّل المزودين قبل وصول أول بايت من الاستجابة إلى العميل، حتى لطلبات البث. تشمل ضوابط الحوكمة المدمجة مفاتيح API افتراضية، وميزانيات وتتبع إنفاق على مستوى المجموعة، ودعم TLS وmTLS الأصلي، وقياس عن بعد Prometheus وOTLP، وخطافات ويب للتدقيق لكل طلب. يوسع نموذج حدود التنفيذ الأوسع للمشروع نمط الإنفاذ نفسه ليشمل حوكمة أدوات MCP (منح المتصل، والمخططات المعتمدة، وإنفاذ الميزانية، والحجر عند الانحراف) وثقة وكلاء A2A (التحقق، والتثبيت، وضبط الخروج، وبيانات الاعتماد المرتبطة بالهدف). ينشر المشروع قياسات معيارية لتنفيذه الخاص، بما في ذلك زمن استجابة إضافي عند p50 قدره 73 ميكروثانية، و67,837 طلبًا مستدامًا في الثانية دون أي فشل، و7.3 ميبي بايت من الذاكرة المقيمة في وضع الخمول، وصورة حاوية مضغوطة بحجم 5.74 ميبي بايت، مع مقارنات عامة مع أدوات بوابة الذكاء الاصطناعي الشائعة الأخرى وبوابات API العامة. يُصدر المشروع تحت ترخيص Apache 2.0، مع عقد مستقر وفق SemVer لواجهة HTTP لمستوى البيانات وعقود بروتوكولات الاتصال المدعومة عبر الإصدارات الرئيسية.