इस प्रोजेक्ट के बारे में

LanPaint एक ComfyUI एक्सटेंशन है जो मास्क-प्रतिबंधित इनपेंटिंग और स्थानीय संपादन के लिए प्रशिक्षण-मुक्त आंशिक सशर्त सैंपलर प्रदान करता है। यह बिना फाइन-ट्यूनिंग या बैकप्रोपेगेशन के पूर्व-प्रशिक्षित डिफ्यूजन और रेक्टिफाइड-फ्लो मॉडलों के साथ काम करता है। यह प्रोजेक्ट TMLR 2025 पेपर "LanPaint: Training-Free Diffusion Inpainting with Asymptotically Exact and Fast Conditional Sampling" पर आधारित है। मुख्य क्षमताओं में इमेज इनपेंटिंग, आउटपेंटिंग और जनरेटिव फिल, मास्क-प्रतिबंधित स्थानीय संपादन, टेक्स्ट मार्गदर्शन के साथ ऑब्जेक्ट या क्षेत्र प्रतिस्थापन, कैरेक्टर-संगत स्थानीय जनरेशन, वीडियो इनपेंटिंग और स्थानीय वीडियो संपादन, तथा वीडियो प्लस ऑडियो मास्क्ड जनरेशन शामिल हैं। README में Ideogram4, Krea2, Z-image, Z-image-base, Hunyuan, Wan 2.2, Qwen Image/Edit, Anima, HiDream, SD 3.5, Flux-सीरीज़, SDXL, SD 1.5, और कस्टम LoRAs जैसे मॉडलों के साथ संगतता सूचीबद्ध है। LanPaint सैंपलिंग श्रेणी के अंतर्गत ComfyUI नोड्स जोड़ता है, जिनमें एक बेसिक सैंपलर और ट्यूनिंग विकल्पों वाला एक एडवांस्ड सैंपलर शामिल है। यह वीडियो पर प्रति-फ्रेम मास्क पेंट करने के लिए एक वीडियो मास्क एडिटर भी प्रदान करता है, जिसमें कीफ्रेम्स के बीच इंटरपोलेशन होता है, और एक MiniMax H3 AV पाइपलाइन जो संयुक्त इनपेंटिंग के लिए वीडियो और ऑडियो को नेस्टेड लेटेंट में एन्कोड करती है। एडिटर मूल फ़ाइल को संशोधित किए बिना मास्क को mp4 मेटाडेटा में निर्यात कर सकता है। रिपॉज़िटरी में पहले/बाद की तुलना, मॉडल डाउनलोड लिंक, और वीडियो प्रोसेसिंग के लिए संसाधन खपत तालिकाओं सहित कई उदाहरण वर्कफ़्लो शामिल हैं। इंस्टॉलेशन ComfyUI-Manager के माध्यम से या रिपॉज़िटरी को ComfyUI/custom_nodes में क्लोन करके उपलब्ध है। README Flux.dev जैसे डिस्टिलेशन मॉडलों पर खराब प्रदर्शन का उल्लेख करता है और इसे कम करने के लिए कम flux guidance की सिफारिश करता है।