Duix.Avatarはオフラインで動画生成とアバタークローンに対応するオープンソースのAIデジタルヒューマンツールキット。テキスト・音声駆動型合成と多言語対応を備える。
オープンソース。新しい可能性。
優れたオープンソースプロジェクトを見つけ、匿名でプロジェクトを投稿し、自分のプロジェクトを申請して編集できます。
好奇心とともに、オープンソースの世界へ。
THE FIRST COLLECTIONCogVideoXは清穎 originatedのオープンソース動画生成モデルシリーズ。Text-to-video、image-to-video、動画継続の3タスクに対応し、DiffusersとSAT推論フレームワークをサポートする。
ViMaxは、コンセプトから完成動画までを自動化するエージェント型動画生成フレームワーク。脚本作成、ストーリーボード、キャラクターの一貫性管理、最終編集までを統合する。
ToonflowはオープンソースのワンストップAI短劇創作ワークベンチで、小説導入から脚本改編、インテリジェントなストーリーボード、動画生成までの全工程をカバーし、無制限キャンバス編成と3層Agent協働体系をサポート。
Pixelle-VideoはAIによる自動ショート動画生成エンジン。テーマを入力するだけで脚本作成、AI画像・動画生成、音声合成、BGM追加、動画合成を自動で行い、複数のAIモデルやワークフローを柔軟に組み合わせ可能。
OpenMontageは、AIコーディングアシスタントをフル機能のビデオスタジオに変えるオープンソースのエージェント型ビデオ制作システムであり、リサーチから最終レンダリングまでのエンドツーエンドのパイプラインをサポートします。
LivePortraitは、効率的な肖像アニメーションのためのオープンソースのPyTorch実装であり、人間、猫、犬に対応しています。画像・ビデオ駆動モード、ステッチングとリターゲティング制御、モーションテンプレート、Gradioインターフェース、事前学習済みウェイトを提供します。
HunyuanVideoはTencentが開発したオープンソースの大規模テキストからビデオへの生成モデルで、統一された画像・ビデオアーキテクチャ、3D VAE、プロンプトリライト機能を備えています。
Wan2.2は、Wan-AIが開発したオープンソースの動画生成モデルスイートです。MoEアーキテクチャを動画拡散モデルに導入し、テキスト・画像・音声からの動画生成やキャラクターアニメーション、人物置き換えに対応。720P出力や消費級GPUでの推進も可能です。
SANAは、高解像度の画像・動画生成に向けたNVIDIAのオープンソース高効率拡散モデル群であり、学習・推論コード、線形アテンション、DC-AE圧縮、4ビット展開を備える。