منصوبے کے بارے میں
LanPaint ایک ComfyUI ایکسٹینشن ہے جو mask-constrained inpainting اور مقامی ایڈیٹنگ کے لیے تربیت سے پاک partial conditional sampler فراہم کرتا ہے۔ یہ pretrained diffusion اور rectified-flow ماڈلز کے ساتھ بغیر fine-tuning یا backpropagation کے کام کرتا ہے۔ یہ پروجیکٹ TMLR 2025 کے مقالے "LanPaint: Training-Free Diffusion Inpainting with Asymptotically Exact and Fast Conditional Sampling" پر مبنی ہے۔
اہم صلاحیتوں میں image inpainting، outpainting اور generative fill، mask-constrained مقامی ایڈیٹنگ، متن کی رہنمائی کے ساتھ آبجیکٹ یا علاقے کی تبدیلی، کردار کے مطابق مقامی تخلیق، video inpainting اور مقامی ویڈیو ایڈیٹنگ، اور ویڈیو کے ساتھ آڈیو کی masked تخلیق شامل ہیں۔ README میں Ideogram4، Krea2، Z-image، Z-image-base، Hunyuan، Wan 2.2، Qwen Image/Edit، Anima، HiDream، SD 3.5، Flux-series، SDXL، SD 1.5، اور حسب ضرورت LoRAs جیسے ماڈلز کے ساتھ مطابقت درج ہے۔
LanPaint sampling کے زمرے میں ComfyUI نوڈس شامل کرتا ہے، جن میں ایک بنیادی sampler اور tuning کے اختیارات کے ساتھ ایک advanced sampler شامل ہیں۔ یہ ویڈیو کے لیے ایک video mask editor بھی فراہم کرتا ہے جو keyframes کے درمیان interpolation کے ساتھ فی فریم masks پینٹ کرنے دیتا ہے، اور ایک MiniMax H3 AV pipeline جو ویڈیو اور آڈیو کو ایک nested latent میں encode کر کے مشترکہ inpainting کرتا ہے۔ ایڈیٹر masks کو اصل فائل میں تبدیلی کیے بغیر mp4 metadata میں export کر سکتا ہے۔
ریپوزٹری میں before/after موازنے کے ساتھ بہت سے مثال workflows، ماڈل ڈاؤن لوڈ لنکس، اور ویڈیو پروسیسنگ کے لیے resource consumption tables شامل ہیں۔ تنصیب ComfyUI-Manager کے ذریعے یا ریپوزٹری کو ComfyUI/custom_nodes میں clone کر کے دستیاب ہے۔ README میں Flux.dev جیسے distillation ماڈلز پر کارکردگی میں کمی کا ذکر ہے اور اسے کم کرنے کے لیے کم flux guidance کی سفارش کی گئی ہے۔
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.