このプロジェクトについて
FaceSwapは、深層学習を使用して写真や動画の顔を置き換えるオープンソースのPythonアプリケーションです。ソース素材から顔を検出し、ペアになった顔データでニューラルネットワークモデルをトレーニングし、学習済みモデルを使って対象メディアを変換するというマルチステージパイプラインを実装しています。
このプロジェクトはコマンドラインインタフェース(CLI)とグラフィカルユーザインタフェース(GUI)の両方をサポートしています。最適なパフォーマンスを得るにはCUDA対応の現代のGPUが必須であり、Linux環境ではAMD GPUもROCmを介してサポートされています。ワークフローとしては、画像から顔を抽出してExtractionフォルダに保存し、2つの顔ソースごとに別々のモデルをトレーニングし、その後学習した変換を適用して置換出力を生成します。
主な機能としては、複数のサポート済みモデルアーキテクチャ(Villain、Phaze-A、DFL-H128、Unbalanced、OHR)、動画変換ツール、FANによる顔アライメントとMTCNNによる顔検出、そしてトレーニング加速のための事前トレーニング済みモデルの再利用などがあります。コミュニティはDiscordと専用フォーラムで活発に活動しており、ドキュメンテーションはReadTheDocsで入手可能です。開発陣はこのツールの倫理的利用を強調し、学習・実験・社会的批評・映画製作・合法的なクリエイティブ目的での使用を意図していると述べています。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.