ユーザーのニーズに応じたビジュアルコンテンツを合成することは、生成されたオブジェクトのポーズ、形状、表情、およびレイアウトの柔軟かつ正確な制御を必要とすることがよくあります。既存のアプローチでは、生成的対抗ネットワーク(GAN)の制御可能性を、手動で注釈付けされたトレーニングデータや事前の3Dモデルを介して獲得していますが、これらはしばしば柔軟性、精度、一般性に欠けています。この研究では、GANを制御するための強力かつあまり探求されていない方法を検討しています。

あなたのGANを引っ張る:生成画像多様体上のインタラクティブなポイントベースの操作

紹介

DragGANとは何ですか?

DragGANは生成画像多様体上での対話型ポイントベースの操作において強力なツールです。これにより、ユーザーは画像の任意のポイントを「ドラッグ」して、ユーザーインタラクティブな方法で目標ポイントに正確に到達することができます。

DragGANはどのように機能しますか?

DragGANには2つの主要なコンポーネントがあります。1) ハンドルポイントを目標位置に移動させる特徴ベースのモーション監督、および2) ハンドルポイントの位置を継続的に特定するために識別的GAN特徴を活用する新しいポイントトラッキングアプローチが含まれています。

DragGANの特徴

  • ピクセルの移動先を正確に制御できるため、動物、車両、人物、風景などの様々なカテゴリのポーズ、形状、表情、レイアウトを操作できます。
  • オクルージョンされたコンテンツの幻想化や、オブジェクトの剛性に一貫して従う形状の変形など、難しいシナリオでもリアルな出力で画像を変形できます。
  • 画像操作やポイントトラッキングのタスクに使用できます。

価格

論文とコードは無料で提供されており、サイト上の画像、テキスト、ビデオファイルは、クリエイティブ・コモンズCC BY-NC 4.0ライセンスのもとで非営利目的で自由に利用できます。

あなたのGANを引っ張る:生成画像多様体上のインタラクティブなポイントベースの操作 - 代替案

Midjourney SREFコードライブラリー - ユニークなスタイルを探索する

100を超えるユニークなmidJourney srefコードスタイルを見つけ、最も人気のある推奨事項を見つけて、簡単にあなたの完璧なMidJourney srefコード効果を見つけてください。

99.5 K
AiHub

無料でニューラルネットワークにアクセスを取得してください!

--
AI写真生成 | フォトAI™

AIを使用して人々の写真を写実的に生成します。AIフォトグラファーで人々の見事な写真を撮影しましょう!写真や動画コンテンツを生成します...

251.6 K
Face Swapper AI

Faceswapper.ai:当社のフェイススワッパーAIテクノロジーを使用して、写真や動画で顔を簡単に交換できます。無料のオンラインリフェイストゥールを使用して、服を変えたり、ビデオの顔交換や複数の顔交換などが可能です。

1.8 M
に関するその他のタグ: あなたのGANを引っ張る:生成画像多様体上のインタラクティブなポイントベースの操作