このプロジェクトについて
FireRed-OpenStorylineは、複雑な動画制作を自然で直感的な会話に変える。本システムは、スマートなメディア検索・整理(一致する画像・動画クリップの自動検索とダウンロード)、特定のトーン(製品レビュー、Vlogなど)のための少数ショットスタイル転移によるインテリジェントな脚本生成、ビート同期を伴う音楽・ナレーション・フォントのインテリジェント推薦、自然言語による迅速な編集のための会話的リファインメント、そして完全なワークフローを再利用可能なスキルとして保存・再生する編集スキルアーカイブを組み合わせている。
最近の追加機能には、AIトランジション生成(フレーム記述からのトランジションショット作成)、音声動画向けASRベースのラフカットスキル(フィラー語や言い淀みの除去)、Agent Skillsを介したOpenClawおよびClaude Codeとの統合によるインストールと使用の自動化が含まれる。
アーキテクチャは、Model Context Protocol(MCP)サーバー、動画処理ノード、エージェントスキルライブラリ、エージェントメモリストレージを使用する。MoviePy、FFmpeg、LangChain上に構築されている。インストールはLinux/macOS(build_env.shによる自動化)、Windows(手動リソースダウンロード)、Dockerに対応する。WebインターフェースはFastAPI上で動作し、CLIの代替手段もある。設定にはconfig.tomlにAPIキーが必要である。
デモでは、Zhongcao、Humorous、Product Picks、Artistic、Unboxing、Talking Pet、Travel Vlog、Year-in-Reviewなど複数のスタイルを紹介している。本プロジェクトはApache 2.0ライセンスの下で提供され、ナレーション編集、音声クローン、追加エフェクト、生成機能、GPUアクセラレーションを含むロードマップに沿って活発に開発されている。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.