프로젝트 소개
OpenVideo는 로컬 비디오 생성을 자체 하드웨어에서 가능하게 하는 오픈소스 프로젝트로, 스스로를 "비디오 모델을 위한 Ollama"라고 포지셔닝합니다. 익숙한 `install · pull · run` 워크플로를 따르는 간단한 명령줄 인터페이스(CLI)를 제공하여, 사용자가 NVIDIA GPU에서 MiniMax H3 비디오 모델을 로컬로 다운로드하고 실행할 수 있게 합니다. 이 프로젝트에는 코딩 에이전트(Claude Code, Cursor, Codex, OpenCode 등)가 공식 H3 프롬프트를 작성하고 엄격한 제약 조건에 대해 검증하여 고품질 비디오를 생성할 수 있게 하는 스킬 하네스도 포함되어 있습니다.
v0.1.0의 주요 기능은 다음과 같습니다:
- **로컬 생성**: 자체 GPU에서 ComfyUI를 통해 MiniMax H3를 실행하며, VRAM에 따라 다양한 양자화 등급(INT8, W4, NF4)을 지원합니다.
- **CLI**: `open-video pull h3`, `open-video status`, `open-video run` 같은 명령이 Ollama와 유사한 경험을 제공합니다.
- **에이전트 스킬**: `skill/h3-video/SKILL.md` 파일은 모든 에이전트 호스트가 프롬프트 문법과 검증을 내장한 채로 비디오를 엔드투엔드로 생성할 수 있게 합니다.
- **판정 루프**: 선택적 VLM 기반 판정기가 낮은 점수의 샷을 자동으로 개선할 수 있으며, VLM이 구성되지 않은 경우 정직한 `SKIPPED` 폴백을 제공합니다.
- **플러그인 아키텍처**: 확장 가능하도록 설계되었으며, 새로운 모델, 엔진, 판정기를 위한 백엔드를 갖추고 있습니다.
OpenVideo는 그 자체로 파운데이션 모델이 아니며, 런타임 엔진으로 ComfyUI와 통합됩니다. 코드는 Apache-2.0 라이선스이지만, MiniMax H3 모델 가중치는 지역 및 상업적 사용 제한이 있는 별도의 커뮤니티 라이선스의 적용을 받습니다. 이 프로젝트는 현재 초기 개발 단계(v0.1.0)이며 단일 클립에 초점을 맞추고 있고, 멀티샷 영화 기획은 실험적입니다.
Comments
0 people shared their preference · Deer Point appears after 10 participants
Sign in to join the discussion.