VectorBT ایک اوپن سورس Python بیک ٹیسٹنگ لائبریری ہے جو حکمت عملی کی تحقیق کو ویکٹرائز کرتی ہے: یہ ہزاروں پیرامیٹر امتزاج کو NumPy arrays میں پیک کرتی ہے اور Numba اور ایک اختیاری Rust انجن سے تیز کرتی ہے، ساتھ ہی پورٹ فولیو تجزیات اور متعامل Plotly بصری نمائش۔
اوپن سورس۔ نئے امکانات۔
معیاری اوپن سورس پروجیکٹس دریافت کریں، گمنام طور پر پروجیکٹس جمع کریں، اور اپنے پروجیکٹ کا دعویٰ کرکے اسے ایڈٹ کریں۔
تجسس کے ساتھ اوپن سورس کی دنیا دریافت کریں۔
THE FIRST COLLECTIONایک ڈیٹا ریسرچ اور تجزیاتی پلیٹ فارم جو صارفین کو ویژولائزیشن اور تجزیے کے لیے کسٹم ڈیٹا سیٹس امپورٹ کرنے کی سہولت فراہم کرتا ہے۔
Evidence ایک اوپن سورس، کوڈ پر مبنی BI ٹول ہے جو ڈریگ اینڈ ڈراپ ٹولز کا متبادل ہے: SQL اور markdown کے ذریعے تیز رفتار، انٹرایکٹو رپورٹس بنائیں اور انہیں پبلش یا سیلف ہوسٹ کریں۔
Apache Superset ایک جدید، انٹرپرائز کے لیے تیار بزنس انٹیلیجنس ویب ایپلی کیشن ہے جو ڈیٹا کی تلاش اور بصری نمائش (visualization) کے لیے استعمال ہوتی ہے۔
tsfresh ایک Python پیکیج ہے جو وقت کی سیریز کے ڈیٹا سے خودکار طور پر خصوصیات نکالنے اور منتخب کرنے کے لیے استعمال ہوتا ہے، جس میں شماریات، سگنل پروسیسنگ، اور مفروضے کی جانچ شامل ہوتی ہے تاکہ مشین لرننگ کے لیے سینکڑوں متعلقہ خصوصیات تیار کی جا سکیں۔
IPython متعدد پروگرامنگ زبانوں، خاص طور پر Python میں کمپیوٹنگ کے لیے ایک طاقتور انٹرایکٹو کمانڈ شیل ہے، جو بہتر introspection اور شیل انٹیگریشن فراہم کرتا ہے۔
pandas ایک طاقتور Python لائبریری ہے جو تیز، لچکدار اور واضح ڈیٹا اسٹرکچرز فراہم کرتی ہے، جسے ریلیشنل یا لیبل شدہ ڈیٹا کے ساتھ کام کرنے کے لیے ڈیزائن کیا گیا ہے۔
Apache Airflow ایک ایسا پلیٹ فارم ہے جس کے ذریعے ورک فلو کو کوڈ کے طور پر پروگرامmatically تیار، شیڈول اور مانیٹر کیا جاتا ہے، جو عام طور پر ڈیٹا پائپ لائنز اور AI/ML آرکیسٹریشن کے لیے استعمال ہوتا ہے۔
Trino بگ ڈیٹا اینالٹکس کے لیے ڈیزائن کیا گیا ایک تیز رفتار ڈسٹری بیوٹڈ SQL کوئری انجن ہے، جسے پہلے PrestoSQL کے نام سے جانا جاتا تھا۔
ایک بھرپور MySQL ٹرمینل کلائنٹ جس میں آٹو کمپلیشن، سنٹیکس ہائی لائٹنگ اور ڈیٹا فریم انٹیگریشن کی خصوصیات موجود ہیں۔
marimo ایک ری ایکٹو Python نوٹ بک ہے جو کوڈ اور آؤٹ پٹ کے درمیان ہم آہنگی کو یقینی بناتی ہے، اور اسے git-دوستی اور تعیناتی کے لیے خالص Python فائلوں کے طور پر محفوظ کیا جاتا ہے۔
Statsmodels ایک پایتھون لائبریری ہے جو شماریاتی ماڈلنگ، معیشتیات اور ڈیٹا تجزیے کے لیے استعمال ہوتی ہے۔ یہ ریگریشن، ٹائم سیریز، سپر وائیول اینالیسس وغیرہ کو سپورٹ کرتی ہے۔
pandas DataFrames میں نیچرل لینگویج ہدایات کی بنیاد پر AI ماڈلز سے جنریٹ کردہ نئے کالمز شامل کرنے کے لیے ایک پائی تھن لائبریری۔
NVIDIA cuDF ایک GPU سے تیز رفتار ڈیٹا فریم لائبریری ہے جو جدولی ڈیٹا پروسیسنگ کے لیے ہے، CUDA-X سوٹ کا حصہ ہے۔ یہ pandas سے مطابقت رکھنے والی APIs، Polars GPU انجن، اور Dask بیک اینڈ فراہم کرتی ہے۔
Flow ایک واحد-بائنری، اعلیٰ کارکردگی کا ETL انجن اور ورکفلو آرکیسٹریٹر ہے جو Go میں لکھا گیا ہے۔ اس میں ایک ایمبیڈڈ بصری ویب بلڈر، ڈیکلریٹیو XML پائپ لائنز، کراس-ڈیٹا بیس سپورٹ، اور بلٹ-ان آڈٹ ٹیلیمیٹری شامل ہیں۔
ایک تعلیمی ریپوزٹری جو Python کے ذریعے بنیادی اصولوں سے supervised machine learning سکھاتی ہے، جس میں ریاضی کی بنیادیں اور عملی نفاذ شامل ہیں۔
مائیکروسوفٹ کا 10 ہفتے، 20 سیکوں کا بیگنرز کے لیے ڈیٹا سائنس کِریکیولم، پروجیکٹ-بیسڈ سیکوں، کویز اور 50+ زبانوں کی ترجمہ کے ساتھ۔
FiftyOne ایک اوپن سورس ٹول ہے جو اعلیٰ معیار کے ڈیٹا سیٹ اور کمپیوٹر ویژن ماڈلز کی تعمیر کے لیے استعمال ہوتا ہے۔ یہ صارفین کو بصری AI ڈیٹا کا تصور، لیبلنگ، جائزہ، اور ترتیب دینے کی اجازت دیتا ہے۔
OpenRefine ایک Java پر مبنی اوپن سورس پاور ٹول ہے جسے ویب براؤزر انٹرفیس کے ذریعے بے ترتیب ڈیٹا کی صفائی، تبدیلی اور مفاہمت کے لیے ڈیزائن کیا گیا ہے۔
Great Expectations (GX Core) ڈیٹا کوالٹی کے لیے ایک اوپن سورس Python لائبریری ہے، جو ڈیٹا کے لیے یونٹ ٹیسٹ بنانے کا فریم ورک فراہم کرتی ہے تاکہ مستقل مزاجی اور قابل اعتماد ہونے کو یقینی بنایا جا سکے۔