프로젝트 소개
Fooocus는 Stable Diffusion XL 아키텍처를 기반으로 하며 Gradio 웹 인터페이스를 통해 제공되는 오프라인 오픈소스 이미지 생성 애플리케이션입니다. 명시된 설계 목표는 Midjourney와 같은 호스팅 서비스와 유사하게 사용자가 수동 매개변수 조정보다는 프롬프트와 이미지에 집중할 수 있게 하는 것입니다. 이 프로젝트는 오프라인 GPT-2 기반 프롬프트 처리 엔진과 짧거나 긴 프롬프트에서 좋은 결과를 얻기 위한 샘플링 개선 사항을 설명합니다.
README에 설명된 주요 기능으로는 텍스트-이미지 생성, 입력 이미지의 업스케일링 및 변형, 인페인팅 및 아웃페인팅(위/아래/왼쪽/오른쪽 이동), 이미지 프롬프트, InsightFace를 통한 얼굴 교체, 이미지 설명, 스타일 프리셋, 네거티브 프롬프트, 종횡비 선택, A1111 스타일 재가중치를 사용한 프롬프트 가중치가 포함됩니다. 또한 자체 인페인트 알고리즘과 인페인트 모델, 단일 k-샘플러 내부의 네이티브 리파이너 교체, 네거티브 ADM 가이던스, 셀프 어텐션 가이던스의 변형에 대해서도 문서화합니다.
설치는 Windows의 경우 다운로드 가능한 패키지와 run.bat을 통해, Linux의 경우 Anaconda, Python venv 또는 네이티브 Python 3.10을 통해, AMD GPU의 경우 ROCm 또는 DirectML(베타로 설명됨)을 통해, Mac의 경우 PyTorch MPS를 통해, 그리고 Docker를 통해 제공됩니다. Colab 노트북도 제공됩니다. README는 최소 요구 사항으로 4GB Nvidia VRAM과 8GB 시스템 RAM을 명시하며 시스템 스왑이 필요하고, CPU 전용 작업에는 32GB RAM이 필요하다고 언급합니다. 기본/일반, 사실적, 애니메이션의 세 가지 프리셋이 있으며 각각 다른 기본 모델과 구성을 가집니다. UI는 --listen으로 로컬에 노출하거나 --share로 공유할 수 있으며, auth.json 파일을 통해 기본 인증을 추가할 수 있습니다.
이 프로젝트는 버그 수정만 제공되는 제한적인 장기 지원 상태로 설명되며, 현재 최신 모델 아키텍처로의 마이그레이션 계획은 없습니다. README는 가짜 웹사이트가 많이 존재하며 이 저장소가 유일한 공식 소스라고 경고합니다.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.