عن المشروع
AutoAgent، من Third Layer، هو إطار عمل مفتوح المصدر للهندسة المستقلة لوكيل التشغيل: بدلاً من التحرير اليدوي لرمز وكيل الذكاء الاصطناعي، تترك وكيل ميتا (وكيل البرمجة الخاص بك) يقوم ببناء وتكرار وكيل التشغيل، باتباع نفس حلقة التجربة المتمثلة في الاحتفاظ أو التجاهل التي شاع استخدامها بواسطة autoresearch.
كيفية العمل:
- يوجد وكيل التشغيل قيد الاختبار في ملف واحد، agent.py، يحتوي على التكوين وتعريفات الأدوات وسجل الوكيل والتوجيه/التنسيق وحدود محول Harbor. يتم تمييز قسم المحول صراحةً كثابت؛ والباقي هو سطح التحرير الأساسي لوكيل ميتا.
- لا يقوم الإنسان بتحرير لغة Python. بدلاً من ذلك، تقوم بتحرير program.md، وهو ملف Markdown يوفر تعليمات وكيل ميتا بالإضافة إلى التوجيه الذي يصف نوع الوكيل الذي سيتم بناؤه.
- توجد مهام التقييم في tasks/ باستخدام تنسيق مهام Harbor: تكوين task.toml، ومطالبة instruction.md، واختبارات (test.sh/test.py، حتمية أو LLM-as-judge) تكتب درجة من 0.0 إلى 1.0، وملف Dockerfile لكل مهمة بناءً على الصورة الأساسية، وملفات مرجعية محملة. يتم شحن المستودع بدون مهام؛ وتقوم بإضافة مهامك الخاصة، وقد تظهر حمولات المعيار في فروع خاصة بالمعيار.
- الحلقة: يقرأ وكيل ميتا التوجيه، ويفحص وكيل التشغيل الحالي، ويشغل المعيار، ويشخص الفشل، ويعدل agent.py، ويتحقق من الدرجة الإجمالية التي تنتجها مجموعات اختبار المهام، ويحتفظ بالتغيير أو يتجاهله - متسلقًا نحو الأفضل بناءً على الدرجة. يتم تسجيل التجارب في results.tsv، وتذهب مخرجات مهام Harbor إلى jobs/.
المتطلبات والاستخدام: Docker، وPython 3.10+، وuv، وأي بيانات اعتماد لمزود النموذج يحتاجها وكيل التشغيل الخاص بك (مثل OPENAI_API_KEY في .env). تقوم ببناء الصورة الأساسية باستخدام Dockerfile.base، وإضافة المهام، ثم تشغيل مهمة واحدة أو جميع المهام بالتوازي عبر واجهة سطر أوامر harbor مع مسار استيراد الوكيل agent:AutoAgent. لبدء تجربة، توجه وكيل البرمجة الخاص بك إلى المستودع وتطالبه بقراءة program.md.
خيارات التصميم المذكورة في README: برمجة وكيل ميتا بدلاً من برمجة وكيل التشغيل مباشرة؛ الاحتفاظ بوكيل التشغيل في ملف واحد ولكن مدفوعًا بالسجل بحيث يمكنه التطور بشكل نظيف؛ تشغيل الوكيل في عزل Docker حتى لا يتمكن من إتلاف المضيف؛ جعل كل تجربة مدفوعة بالدرجة؛ واستخدام مهام متوافقة مع Harbor بحيث يمكن تقييم نفس وكيل التشغيل على مجموعات بيانات مختلفة.
يقترح README أيضًا تجهيز الوكيل بمهارات هندسة السياق (مثل Agent Skills for Context Engineering و context7) لتحسين الأداء، ويوفر أوامر تنظيف لصور Docker والحاويات وذاكرة التخزين المؤقت لمهام Harbor، والتي تتراكم عبر التشغيلات. مرخص بموجب MIT. يشير القائمون على الصيانة إلى منتج قادم حول الوكلاء ذوي التكوين الذاتي وأنهم يقومون بالتوظيف.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.