SANAは、高解像度の画像・動画生成に向けたNVIDIAのオープンソース高効率拡散モデル群であり、学習・推論コード、線形アテンション、DC-AE圧縮、4ビット展開を備える。
オープンソース。新しい可能性。
優れたオープンソースプロジェクトを見つけ、匿名でプロジェクトを投稿し、自分のプロジェクトを申請して編集できます。
好奇心とともに、オープンソースの世界へ。
THE FIRST COLLECTIONvosは、ビデオを時間の決定論的な関数として扱うオープンなプログラム的ビデオエンジンであり、解像度に依存しないレンダリングとデータ駆動型の編集を可能にします。
Duix.Avatarはオフラインで動画生成とアバタークローンに対応するオープンソースのAIデジタルヒューマンツールキット。テキスト・音声駆動型合成と多言語対応を備える。
EncodeXは、FFmpegにモダンなデスクトップインターフェースを提供するクロスプラットフォームのマルチメディア変換ツールであり、ビデオ・オーディオの変換、カット、および画像圧縮をサポートしています。
CogVideoXは清穎 originatedのオープンソース動画生成モデルシリーズ。Text-to-video、image-to-video、動画継続の3タスクに対応し、DiffusersとSAT推論フレームワークをサポートする。
Y.A.W.Nは、Ableton Liveにインスパイアされたクロスプラットフォームのデジタルオーディオワークステーション(DAW)であり、セッションビューとアレンジメントビュー、VST3ホスティング、統合AIオーディオツールを特徴としています。
ViMaxは、コンセプトから完成動画までを自動化するエージェント型動画生成フレームワーク。脚本作成、ストーリーボード、キャラクターの一貫性管理、最終編集までを統合する。
Sonder Editorは、ComfyUI向けのタイムラインベースのビデオエディタで、長尺の反復生成に設計されており、ノードグラフワークフロー内でシーン、クリップ、プロンプトを配置できます。
ToonflowはオープンソースのワンストップAI短劇創作ワークベンチで、小説導入から脚本改編、インテリジェントなストーリーボード、動画生成までの全工程をカバーし、無制限キャンバス編成と3層Agent協働体系をサポート。
Pixelle-VideoはAIによる自動ショート動画生成エンジン。テーマを入力するだけで脚本作成、AI画像・動画生成、音声合成、BGM追加、動画合成を自動で行い、複数のAIモデルやワークフローを柔軟に組み合わせ可能。
Velo AI Studioは、スクリプト、音声、AI生成ビジュアルアセットからナレーション付きビデオを組み立てるために設計されたオープンソースのブラウザベースのビデオ作成ツールです。
bili_add_onは、Bilibiliの弾幕を動画にオーバーレイするためのコマンドラインツールです。Bilibiliの動画IDから弾幕XMLを自動取得するか、ローカルのXMLファイルを読み込むことができ、ハードウェアアクセラレーションによるエンコードにも対応しています。
OpenMontageは、AIコーディングアシスタントをフル機能のビデオスタジオに変えるオープンソースのエージェント型ビデオ制作システムであり、リサーチから最終レンダリングまでのエンドツーエンドのパイプラインをサポートします。
LivePortraitは、効率的な肖像アニメーションのためのオープンソースのPyTorch実装であり、人間、猫、犬に対応しています。画像・ビデオ駆動モード、ステッチングとリターゲティング制御、モーションテンプレート、Gradioインターフェース、事前学習済みウェイトを提供します。
HunyuanVideoはTencentが開発したオープンソースの大規模テキストからビデオへの生成モデルで、統一された画像・ビデオアーキテクチャ、3D VAE、プロンプトリライト機能を備えています。
Wan2.2は、Wan-AIが開発したオープンソースの動画生成モデルスイートです。MoEアーキテクチャを動画拡散モデルに導入し、テキスト・画像・音声からの動画生成やキャラクターアニメーション、人物置き換えに対応。720P出力や消費級GPUでの推進も可能です。