프로젝트 소개

FrameWright는 촬영 후 편집을 에디터 시작점으로 진행하는 로컬 우선 동영상 파이프라인입니다. 동영상 하나를 촬영 폴더에 놓기만 하면, 음성 인식(whisper.cpp), 무음 감지(ffmpeg), LLM에 의한 의미적인 컷 안 및 챕터 생성, 인간의 승인, 최종 렌더링까지 일관되게 수행할 수 있습니다. 주요 흐름은, 프로젝트를 에디터에서 열기 → 필요에 따라 음성 인식과 무음 감지를 자동 실행 → LLM에 의한 컷 안을 제안(plan) → 편집자가 GUI 또는 JSON 직접 편집으로 조정 → 미리보기로 확인 → 승인 게이트를 통과 → ffmpeg와 독자 합성 엔진(WebCodecs + WebGPU)으로 풀 HD 출력. 주요 특징: - 완전 로컬 처리: 음성 인식과 무음 감지는 오프라인에서 동작. LLM에 전달되는 것은 음성 인식 텍스트뿐이며, 영상·음성은 외부로 전송되지 않습니다. - 다양한 캔버스 지원: 16:9, 9:16, 1:1 등. 파생 프로젝트 기능으로 원본 동영상을 공유하면서 다른 크기의 출력도 가능. - 확장 캔버스: 화면과 카메라를 하나의 파일로 녹화하고 오른쪽 아래 위프 합성을 하는 발전된 워크플로. - 자동 오디오 처리: 마이크와 시스템 음성의 자동 믹스, -14 LUFS로 라우드니스 정규화, BGM의 자동 더킹 및 루프. - 인간 승인 게이트: AI에 의한 자동 편집은 승인되지 않으면 최종 렌더링으로 진행할 수 없으며, 설계상 AI가 승인을 대행할 수 없습니다. - 에이전트 연동: MCP 서버로서 Claude Desktop 등에 내장되어 안전한 편집 도구를 제공(승인·렌더는 불가). 설치는 macOS, Node.js 23.6+, Homebrew, ffmpeg, whisper-cpp를 설치하고 npm install로 완료. doctor 명령으로 환경 점검이 가능. 샘플 프로젝트로 바로 시도해 볼 수 있습니다. FrameWright는 화면 데모+설명 촬영부터 YouTube 공개까지의 단일 워크플로에 특화된 의견이 강한 도구이며, 범용 NLE의 대체가 아니라 1차 편집의 자동화와 마무리 효율화를 목적으로 합니다.