عن المشروع
Kedro هو إطار عمل بايثون مفتوح المصدر لبناء خطوط أنابيب هندسة البيانات وعلوم البيانات الجاهزة للإنتاج. ويطبّق ممارسات هندسة البرمجيات لمساعدة الفرق على إنشاء خطوط أنابيب قابلة لإعادة الإنتاج وقابلة للصيانة ومعيارية. يستضيف المشروع مؤسسة LF AI & Data ويُصدر بموجب ترخيص Apache 2.0.
أبرز الميزات الموصوفة في README:
- قالب المشروع: قالب مشروع قياسي وقابل للتعديل مبني على Cookiecutter Data Science.
- كتالوج البيانات: موصلات بيانات خفيفة لحفظ وتحميل البيانات عبر العديد من صيغ الملفات وأنظمة الملفات، بما في ذلك أنظمة الملفات المحلية والشبكية ومخازن الكائنات السحابية وHDFS. كما يتضمن إصدارات البيانات والنماذج للأنظمة المعتمدة على الملفات.
- تجريد خطوط الأنابيب: حل تلقائي للاعتماديات بين دوال بايثون النقية، مع تصور خطوط الأنابيب عبر Kedro-Viz.
- معايير البرمجة: تطوير قائم على الاختبار باستخدام pytest، وتوثيق باستخدام Sphinx، ودعم الفحص البرمجي لـ ruff، واستخدام مكتبة تسجيل بايثون القياسية.
- نشر مرن: نشر على جهاز واحد أو موزع، مع دعم إضافي لـ Argo وPrefect وKubeflow وAWS Batch وDatabricks.
يتوفر التثبيت من PyPI (uv pip install kedro) أو conda-forge، ويمكن تثبيت أحدث إصدار غير صادر من الفرع الرئيسي. يربط README إلى دليل البدء، وبرنامج تعليمي spaceflights، ووثائق العمل مع دفاتر Jupyter، ومرجع API.
يذكر المشروع أنه أُنشئ لمعالجة أوجه القصور في دفاتر Jupyter والنصوص البرمجية لمرة واحدة وكود الربط، ولتحسين تعاون الفرق التي يمتلك أعضاؤها خبرات متفاوتة في هندسة البرمجيات، ولتشجيع كود التحليلات القابل لإعادة الاستخدام من خلال المعيارية وفصل الاهتمامات.
يدعم Kedro إصدارات بايثون التي تُصان بنشاط؛ ويُسقط الدعم عندما يصل إصدار بايثون إلى نهاية عمره. وتتبع حزمة kedro-datasets المنفصلة سياسة NEP 29 وتُسقط إصدارات بايثون عادةً في وقت أبكر. تشمل موارد المجتمع Slack وأرشيف Linen والأسئلة الشائعة التقنية ومستودع awesome-kedro وجلسة Kedro Coffee Chat العامة المتكررة.
Comments
0 people shared their preference · Deer Point appears after 10 participants
Sign in to join the discussion.