বৃহৎ আকারের চীনা প্রাকৃতিক ভাষা প্রক্রিয়াকরণ কর্পাস, যা উইকিপিডিয়া, সংবাদ কর্পাস, বৈকি প্রশ্নোত্তর, কমিউনিটি প্রশ্নোত্তর এবং চীনা-ইংরেজি অনুবাদ কর্পাস সহ একাধিক উচ্চমানের ডেটাসেট অন্তর্ভুক্ত করে, চীনা NLP ক্ষেত্রের বিকাশ এবং বৃহৎ মডেল প্রি-ট্রেনিং উন্নয়নে সহায়তা করার লক্ষ্যে।
OPEN SOURCE, OPEN TO EVERYONE
ওপেন সোর্স। নতুন সম্ভাবনা।
মানসম্মত ওপেন-সোর্স প্রজেক্ট আবিষ্কার করুন, বেনামে প্রজেক্ট জমা দিন এবং নিজের প্রজেক্ট দাবি করে সম্পাদনা করুন।
✳সম্পাদকের পছন্দ · ভালো ওপেন সোর্স খুঁজুন4109আবিষ্কৃত
কৌতূহল নিয়ে ওপেন সোর্স আবিষ্কার করুন।
THE FIRST COLLECTIONTopic: dataset清除
nlp_chinese_corpusbrightmart
নতুনpublic-apispublic-apis
নতুনএকটি সম্প্রদায়-পরিচালিত বিনামূল্যে পাবলিক API-এর তালিকা, যা বিভাগ অনুযায়ী সাজানো এবং ডেভেলপারদের প্রকল্পের জন্য উপযোগী এন্ডপয়েন্ট খুঁজে পেতে সহায়তা করে।
datapulse-myr3dz4r
নতুনDataPulse হলো মালয়েশিয়ার পাবলিক ডেটার জন্য একটি ওপেন, রিড-অনলি ট্রাস্ট এবং ভেরিফিকেশন লেয়ার। এটি ৪১৮টি অফিসিয়াল ডেটাসেট পর্যবেক্ষণ করে এবং ফ্রেশনেস, লাইসেন্স ও প্রোভেন্যান্সের মেশিন-রিডেবল প্রমাণ প্রদান করে, যা একটি ১৯-টুল MCP সার্ভারের মাধ্যমে AI এজেন্টদের জন্য উন্মুক্ত।
fakerjoke2k
নতুনFaker হলো একটি Python প্যাকেজ যা ডাটাবেস বুটস্ট্র্যাপিং, স্ট্রেস টেস্টিং এবং ডাটা অ্যানোনিমাইজেশনের জন্য সিন্থেটিক ডাটা তৈরি করতে ব্যবহৃত হয়।