Flow হল একটি একক-বাইনারি, উচ্চ-পারফরম্যান্স ETL ইঞ্জিন এবং ওয়ার্কফ্লো অর্কেস্ট্রেটর, যা Go-তে লেখা হয়েছে। এটি একটি এমবেডেড ভিজ্যুয়াল ওয়েব বিল্ডার, ডিক্লারেটিভ XML পাইপলাইন, ক্রস-ডেটাবেস সমর্থন, এবং বিল্ট-ইন অডিট টেলিমেট্রি বৈশিষ্ট্যযুক্ত।
ওপেন সোর্স। নতুন সম্ভাবনা।
মানসম্মত ওপেন-সোর্স প্রজেক্ট আবিষ্কার করুন, বেনামে প্রজেক্ট জমা দিন এবং নিজের প্রজেক্ট দাবি করে সম্পাদনা করুন।
কৌতূহল নিয়ে ওপেন সোর্স আবিষ্কার করুন।
THE FIRST COLLECTIONএকটি শিক্ষামূলক রিপোজিটরি যা পাইথন ব্যবহার করে মৌলিক নীতি থেকে সুপারভাইজড মেশিন লার্নিং শেখায়, যেখানে গাণিতিক ভিত্তি এবং ব্যবহারিক বাস্তবায়নের ওপর গুরুত্ব দেওয়া হয়েছে।
মাইক্রোসফটের দাতা বিজ্ঞান শুরুতকারীদের জন্য একটি বিনামূল্যের, প্রকল্প-ভিত্তিক কারিকুলাম। এটি ১০ সপ্তাহ এবং ২০ পাঠ নিয়ে গঠিত, যা ডেটা সংজ্ঞা থেকে শুরু করে ক্লাউড-ভিত্তিক কর্মপ্রবাহ পর্যন্ত সবকিছু কভার করে।
FiftyOne হল উন্মুক্ত-স্রোত টুল যা উচ্চ মানের ডেটাসেট এবং কম্পিউটার দৃষ্টি মডেল তৈরি করতে সাহায্য করে। এটি বিষয়বস্তু আইএম ডেটা ভিজ্যুয়ালাইজ করতে, লেবেল করতে, মূল্যায়ন করতে এবং সংগ্রহ করতে সক্ষম করে।
OpenRefine হলো একটি Java-ভিত্তিক ওপেন-সোর্স পাওয়ার টুল, যা ওয়েব ব্রাউজার ইন্টারফেসের মাধ্যমে অগোছালো ডেটা পরিষ্কার, রূপান্তর এবং রিকনসাইল করার জন্য ডিজাইন করা হয়েছে।
Great Expectations (GX Core) হলো ডেটা কোয়ালিটির জন্য একটি ওপেন-সোর্স Python লাইব্রেরি, যা ডেটার ধারাবাহিকতা এবং নির্ভরযোগ্যতা নিশ্চিত করতে ইউনিট টেস্ট তৈরির একটি ফ্রেমওয়ার্ক প্রদান করে।
VectorBT একটি ওপেন-সোর্স পাইথন ব্যাকটেস্টিং লাইব্রেরি যা স্ট্র্যাটেজি গবেষণাকে ভেক্টরাইজ করে: এটি হাজার হাজার প্যারামিটার কম্বিনেশনকে NumPy অ্যারেতে প্যাক করে এবং Numba ও ঐচ্ছিক Rust ইঞ্জিন দিয়ে ত্বরান্বিত করে, সাথে পোর্টফোলিও অ্যানালিটিক্স এবং ইন্টারঅ্যাকটিভ Plotly ভিজ্যুয়ালাইজেশন।
একটি ডেটা গবেষণা এবং বিশ্লেষণ প্ল্যাটফর্ম যা ব্যবহারকারীদের ভিজ্যুয়ালাইজেশন এবং বিশ্লেষণের জন্য কাস্টম ডেটাসেট ইম্পোর্ট করার সুযোগ দেয়।
Evidence হলো ড্র্যাগ-অ্যান্ড-ড্রপ BI টুলের একটি ওপেন-সোর্স, কোড-ভিত্তিক বিকল্প: SQL এবং markdown ব্যবহার করে দ্রুত, ইন্টারঅ্যাক্টিভ রিপোর্ট তৈরি করুন এবং জেনারেট করা স্ট্যাটিক সাইটটি পাবলিশ বা সেলফ-হোস্ট করুন।
Apache Superset হলো একটি আধুনিক, এন্টারপ্রাইজ-রেডি বিজনেস ইন্টেলিজেন্স ওয়েব অ্যাপ্লিকেশন যা ডেটা এক্সপ্লোরেশন এবং ভিজ্যুয়ালাইজেশনের জন্য ব্যবহৃত হয়।
tsfresh হল একটি পাইথন প্যাকেজ যা স্বয়ংক্রিয়ভাবে টাইম-সিরিজ ফিচার নিষ্কাশন এবং নির্বাচন করে, পরিসংখ্যান, সিগন্যাল প্রসেসিং এবং অনুমান পরীক্ষা একত্রিত করে মেশিন লার্নিং-এর জন্য শতাধিক প্রাসঙ্গিক ফিচার তৈরি করে।
IPython হলো একাধিক প্রোগ্রামিং ভাষায় (প্রধানত Python) কম্পিউটিং করার জন্য একটি শক্তিশালী ইন্টারঅ্যাক্টিভ কমান্ড শেল, যা উন্নত ইন্ট্রোস্পেকশন এবং শেল ইন্টিগ্রেশন প্রদান করে।
pandas হলো একটি শক্তিশালী Python লাইব্রেরি যা রিলেশনাল বা লেবেলযুক্ত ডেটা নিয়ে কাজ করার জন্য দ্রুত, নমনীয় এবং প্রকাশভঙ্গি সমৃদ্ধ ডেটা স্ট্রাকচার প্রদান করে।
Apache Airflow হলো কোড হিসেবে ওয়ার্কফ্লো তৈরি, শিডিউল এবং মনিটর করার একটি প্ল্যাটফর্ম, যা সাধারণত ডেটা পাইপলাইন এবং AI/ML অর্কেস্ট্রেশনের জন্য ব্যবহৃত হয়।
Trino হলো বিগ ডেটা অ্যানালিটিক্সের জন্য ডিজাইন করা একটি দ্রুত ডিস্ট্রিবিউটেড SQL কুয়েরি ইঞ্জিন, যা আগে PrestoSQL নামে পরিচিত ছিল।
একটি সমৃদ্ধ MySQL টার্মিনাল ক্লায়েন্ট যাতে অটো-কমপ্লিশন, সিনট্যাক্স হাইলাইটিং এবং ডেটাফ্রেম ইন্টিগ্রেশনের সুবিধা রয়েছে।
marimo হলো একটি রিঅ্যাক্টিভ Python নোটবুক যা কোড এবং আউটপুটের মধ্যে সামঞ্জস্য নিশ্চিত করে এবং git-বান্ধব ও ডেপ্লয়যোগ্য করার জন্য বিশুদ্ধ Python ফাইল হিসেবে সংরক্ষিত হয়।
Statsmodels একটি Python লাইব্রেরি যা পরিসংখ্যানিক মডেলিং, অর্থমিতি এবং ডেটা বিশ্লেষণের জন্য ডিজাইন করা হয়েছে। এটি রিগ্রেশন, টাইম সিরিজ, সার্ভাইভাল বিশ্লেষণ এবং আরও অনেক কিছু সমর্থন করে।
একটি Python লাইব্রেরি যা ন্যাচারাল ল্যাঙ্গুয়েজ নির্দেশনার ভিত্তিতে AI মডেল ব্যবহার করে pandas DataFrames-এ নতুন কলাম যুক্ত করার মাধ্যমে ডেটাকে সমৃদ্ধ করে।
NVIDIA cuDF হল একটি GPU-ত্বরান্বিত DataFrame লাইব্রেরি, যা ট্যাবুলার ডেটা প্রক্রিয়াকরণের জন্য ব্যবহৃত হয়। এটি pandas-সামঞ্জস্যপূর্ণ API, Polars GPU ইঞ্জিন এবং Dask ব্যাকএন্ড প্রদান করে। CUDA-X স্যুটের অংশ হিসেবে এটি উচ্চ-কার্যক্ষমতা সম্পন্ন ডেটা ম্যানিপুলেশন সক্ষম করে। এটি Apache 2.0 লাইসেন্সের অধীনে প্রকাশিত।