প্রকল্প সম্পর্কে

SkillOpt একটি প্রাকৃতিক-ভাষার দক্ষতা ডকুমেন্টকে একটি অন্যথায় হিমায়িত LLM এজেন্টের প্রশিক্ষণযোগ্য অবস্থা হিসেবে বিবেচনা করে। একটি পৃথক অপ্টিমাইজার মডেল স্কোর করা এজেন্ট ট্র্যাজেক্টরি পর্যালোচনা করে এবং একটি একক মার্কডাউন দক্ষতা ফাইলে সীমিত যোগ, মুছে ফেলা এবং প্রতিস্থাপন সম্পাদনার প্রস্তাব দেয়। ডিফল্ট পেপার-স্টাইল ওয়ার্কফ্লোতে, ক্যান্ডিডেটগুলি কেবল তখনই গ্রহণ করা হয় যখন তারা একটি আলাদা ভ্যালিডেশন স্কোর উন্নত করে। ফ্রেমওয়ার্কটি একটি টেক্সচুয়াল লার্নিং-রেট বাজেট, একটি প্রত্যাখ্যাত-এডিট বাফার এবং ইপোক-স্তরের ধীর বা মেটা আপডেটও সরবরাহ করে যা সংশোধনকে আরও স্থিতিশীল করার উদ্দেশ্যে তৈরি। আউটপুটটি একটি পুনঃব্যবহারযোগ্য best_skill.md আর্টিফ্যাক্ট, যা সাধারণত কম্প্যাক্ট হিসাবে বর্ণিত হয়, যা অপরিবর্তিত টার্গেট মডেল এবং অতিরিক্ত ইনফারেন্স-টাইম অপ্টিমাইজার কল ছাড়াই ডিপ্লয় করা যেতে পারে। প্রশিক্ষণ লুপটি রোলআউট, রিফ্লেকশন, অ্যাগ্রিগেশন, সিলেকশন, আপডেট এবং ইভালুয়েশন কভার করে। প্যাকেজটি একাধিক চ্যাট এবং এক্সিকিউশন ব্যাকএন্ড সমর্থন করে, যার মধ্যে রয়েছে OpenAI, Azure, Claude, Qwen, MiniMax, OpenAI-সামঞ্জস্যপূর্ণ পরিষেবা, Codex, Claude Code, Copilot এবং Cursor টার্গেট। এতে ছয়টি বিল্ট-ইন বেঞ্চমার্ক রয়েছে এবং নতুন ব্যাকএন্ড এবং বেঞ্চমার্ক পরিবেশ যোগ করার জন্য অ্যাডাপ্টার প্যাটার্ন সংজ্ঞায়িত করে। একটি ঐচ্ছিক WebUI একটি মনিটরিং ড্যাশবোর্ড সরবরাহ করে, যখন প্রধান টুলিং পাইথন এবং CLI-এর মাধ্যমে উপলব্ধ। সংস্করণ 0.2.0 SkillOpt-Sleep চালু করে, একটি রাতারাতি অফলাইন স্ব-বিবর্তন প্রবাহ যা অতীতের সেশনগুলি সংগ্রহ করে, পুনরাবৃত্ত কাজগুলি খনন করে, সেগুলি পুনরায় চালায় এবং একটি আলাদা গেটের পিছনে বৈধ দক্ষতা একত্রিত করে। রিপোজিটরিটিতে Claude Code, Codex, Copilot এবং Devin-এর জন্য ইন্টিগ্রেশন শেল রয়েছে, পাশাপাশি একটি OpenClaw রেফারেন্স অ্যাডাপ্টেশন রয়েছে; এই ইন্টিগ্রেশন ফাইলগুলির কিছু PyPI হুইলের বাইরে থাকে। SkillOpt-এর জন্য Python 3.10 বা তার পরবর্তী সংস্করণ প্রয়োজন এবং এটি PyPI থেকে ইনস্টল করা হয়। ডকুমেন্টেশন সেটআপ, ডেটা প্রস্তুতি, প্রশিক্ষণ এবং মূল্যায়ন কমান্ড, কনফিগারেশন, ব্যাকএন্ড চুক্তি, বেঞ্চমার্ক অ্যাডাপ্টার এবং ফ্রেমওয়ার্ক অভ্যন্তরীণ কভার করে।