このプロジェクトについて
Pixelle-Video はオープンソースの AI 完全自動ショート動画生成エンジンである。ユーザーがテーマを1つ入力するだけで、システムが自動的に動画脚本の作成、AI による画像または動画の生成、音声解説の合成、バックグラウンドミュージックの追加、そして最終的な動画の合成までを一括で完了させる。動画編集の経験は不要だ。
コア機能は以下の通り:
- AI インテリジェント脚本生成:GPT、通義千問(Qwen)、DeepSeek、Ollama など多種多様な大規模言語モデルをサポート。
- AI 画像および動画生成:ComfyUI や RunningHub のワークフロー経由、または DashScope、OpenAI、Seedream、Seedance、Kling など複数のモデルベンダー API に直接接続可能。
- 音声合成:Edge-TTS、Index-TTS などの方式および声紋クローンをサポート。
- バックグラウンドミュージックの追加、多様なビジュアルスタイルテンプレート、縦向き・横向きなど複数の動画サイズに対応。
- 拡張モジュールにより、デジタルヒューマンの口パク再生、画像から動画への生成、モーション移行などの機能を実現。
- モジュラー設計により、各工程(画像、動画、TTS、VLM)を必要に応じて交換・柔軟に組み合わせ可能。
本プロジェクトは Windows 向けワンクリック統合パッケージを提供するほか、ソースからのインストールも可能。その場合は Python パッケージマネージャーの uv および ffmpeg の設定が必要。Streamlit ベースの Web UI で操作し、システム設定画面で LLM API Key および画像/動画生成サービスのアドレスを登録するだけで利用を開始できる。Ollama ローカル LLM + ComfyUI ローカル展開といった、完全無料での運用プランもサポートしている。本プロジェクトは Apache 2.0 ライセンスの下で公開されている。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.