عن المشروع

FlowCraft هو أداة مفتوحة المصدر لبناء سير العمل البصري مصممة لتوليد المحتوى بالذكاء الاصطناعي باستخدام نماذج Gemini من Google. تمكن المستخدمين من إنشاء سير عمل معقدة ومتعددة الوسائط من خلال ربط أنواع مختلفة من العقد عبر واجهة سحب وإفلات بديهية، مما يولد في النهاية النصوص والصور والفيديوهات. **القدرات الأساسية** تتميز المنصة بمُنشئ سير عمل بصري مدعوم بـ @xyflow/react، مما يسمح للمستخدمين بتصميم سير عمل ذكاء اصطناعي قابلة للتوسع دون كتابة كود. توفر تكاملًا من الدرجة الأولى مع نماذج التوليد من Google بما في ذلك Gemini 3 Pro و3 Flash لتوليد النصوص، وNano Banana Pro (Gemini 3 Pro Image Preview) وGemini 2.5 Flash Image لتوليد الصور، وVeo 3.1 لتوليد الفيديو. يمكن تنفيذ سير العمل في الوقت الفعلي مع ملاحظات بصرية وتتبع للتقدم، ويقوم محرك المعالجة المتوازية تلقائيًا بحل التبعيات وتحديد مسارات التنفيذ الذكية. **أنواع العقد المدمجة** يأتي FlowCraft مع مجموعة شاملة من العقد المدمجة: - **عقدة LLM (الوكيل)**: توليد نص مدعوم بـ Gemini يدعم إدخال النصوص والملفات، وأدوات قابلة للتكوين، وتعليمات النظام، وإخراج JSON صارم، ومُنشئ مخطط بصري. - **عقدة الصورة**: تولد الصور باستخدام Gemini 3 Pro Image Preview أو Gemini 2.5 Flash Image مع نسب أبعاد ومراجع ودقة قابلة للتكوين. - **عقدة الفيديو**: مدعومة بـ Veo 3.1 (نماذج Fast وPro)، تولد فيديوهات بمدة 4 أو 6 أو 8 ثوانٍ من مطالبات نصية، مع إمكانية استخدام الإطارات الأولى/الأخيرة أو الصور المرجعية من العقد المتصلة. - **عقدة الملف**: تدير وتعرض الملفات بما في ذلك PDF والصور والفيديوهات، ويمكن ربطها بعقد LLM والرؤية عبر URIs من Google Cloud Storage. - **عقدة النص**: إدخال نص بسيط متعدد الأسطر للمطالبات والتعليمات. - **عقدة الرفع**: ترفع دقة الصور المولدة حتى 4x باستخدام Imagen 4.0. - **عقدة تغيير الحجم**: تغير حجم الصور أو تقصها بذكاء إلى نسب أبعاد جديدة. - **عقدة سير العمل المخصص**: تدمج التدفقات المحفوظة سابقًا كعقد مخصصة معيارية وقابلة لإعادة الاستخدام. - **عقد الإدخال/الإخراج**: تحدد حدود البيانات لسير العمل المخصص. **الميزات المتقدمة** يتعامل محرك سير العمل (workflow-engine.ts) مع رسوم التنفيذ بشكل تكراري مع معالجة متوازية. تسمح لوحة التكوين الديناميكية للمستخدمين بضبط المعلمات مثل نموذج التوليد وتعليمات النظام ومدة الفيديو ودقة الوسائط في الوقت الفعلي من الشريط الجانبي. يستخدم المصادقة المدمجة Google OAuth عبر next-auth، ويتيح عارض الوسائط مراجعة الأصول المولدة مباشرة داخل الرسم البياني. **حزمة التقنيات** الواجهة الأمامية: Next.js 16.1 (App Router)، React 19، TypeScript، Tailwind CSS 4.1.18، @xyflow/react 12.10، shadcn/ui (Radix UI + Tailwind)، وZustand لإدارة الحالة على جانب العميل. الواجهة الخلفية: Node.js مع دوال serverless من Next.js، وGoogle GenAI SDK للتفاعلات مع Vertex AI، وTerraform للبنية التحتية ككود، وGoogle Cloud Run للاستضافة الحاوية، وGoogle Cloud Storage لتخزين الأصول، وGoogle Cloud Firestore لقاعدة بيانات NoSQL في الوقت الفعلي، وWinston للتسجيل الموحد. **نماذج الذكاء الاصطناعي المدعومة** - النصوص: gemini-3.1-pro-preview، gemini-3.5-flash، gemini-3.1-flash-lite - الصور: imagen-4.0-upscale-preview، gemini-2.5-flash-image، gemini-3-pro-image، gemini-3.1-flash-image، gemini-3.1-flash-lite-image - الفيديو: veo-3.1-lite-generate-001، veo-3.1-fast-generate-001، veo-3.1-generate-001، gemini-omni-flash-preview **النشر** يستخدم المشروع Terraform لتوفير وإدارة البنية التحتية على Google Cloud. يقوم سكربت النشر (scripts/deploy.sh) بتنسيق تهيئة Terraform وتخطيط البناء وتطبيقه لتوفير موارد GCP، وبناء صور Docker عبر Cloud Build، والنشر إلى Cloud Run. تشمل المتطلبات الأساسية Node.js 18+، ومشروع Google Cloud مع تفعيل Vertex AI، وقاعدة بيانات Firebase/Firestore، ودلو GCS. **حالات الاستخدام** يدعم FlowCraft سير عمل معقدة متعددة الوسائط مثل ربط وكيل عصف ذهني نصي من Gemini في كتلة توليد صور من Imagen 4.0، أو تغيير حجم صورة من 16:9 إلى 9:16 لتطبيق TikTok وتمريرها كإطار أول إلى توليد فيديو Veo 3.1، أو توفير PDF طويل لعقدة ملخص مخصصة تنفذ داخليًا تدفقات فرعية بنمط map-reduce. المشروع مرخص تحت Apache 2.0 ويرحب بالمساهمات عبر سير العمل القياسي fork-branch-commit-PR.