ユーザーのニーズに応じたビジュアルコンテンツを合成することは、生成されたオブジェクトのポーズ、形状、表情、およびレイアウトの柔軟かつ正確な制御を必要とすることがよくあります。既存のアプローチでは、生成的対抗ネットワーク(GAN)の制御可能性を、手動で注釈付けされたトレーニングデータや事前の3Dモデルを介して獲得していますが、これらはしばしば柔軟性、精度、一般性に欠けています。この研究では、GANを制御するための強力かつあまり探求されていない方法を検討しています。

あなたのGANを引っ張る:生成画像多様体上のインタラクティブなポイントベースの操作

紹介

DragGANとは何ですか?

DragGANは生成画像多様体上での対話型ポイントベースの操作において強力なツールです。これにより、ユーザーは画像の任意のポイントを「ドラッグ」して、ユーザーインタラクティブな方法で目標ポイントに正確に到達することができます。

DragGANはどのように機能しますか?

DragGANには2つの主要なコンポーネントがあります。1) ハンドルポイントを目標位置に移動させる特徴ベースのモーション監督、および2) ハンドルポイントの位置を継続的に特定するために識別的GAN特徴を活用する新しいポイントトラッキングアプローチが含まれています。

DragGANの特徴

  • ピクセルの移動先を正確に制御できるため、動物、車両、人物、風景などの様々なカテゴリのポーズ、形状、表情、レイアウトを操作できます。
  • オクルージョンされたコンテンツの幻想化や、オブジェクトの剛性に一貫して従う形状の変形など、難しいシナリオでもリアルな出力で画像を変形できます。
  • 画像操作やポイントトラッキングのタスクに使用できます。

価格

論文とコードは無料で提供されており、サイト上の画像、テキスト、ビデオファイルは、クリエイティブ・コモンズCC BY-NC 4.0ライセンスのもとで非営利目的で自由に利用できます。

あなたのGANを引っ張る:生成画像多様体上のインタラクティブなポイントベースの操作 - 代替案

Haiper AI

ハイパーAI:ハイパーAIを発見してください。自動化ソリューションのためのスマート技術に特化したAI技術のリーディングプロバイダーです。当社の革新的なソフトウェアは、動画制作を革新し、ユーザーがAIの力を活用してシームレスで効率的なコンテンツ制作を実現できるようにします。ハイパーAIがどのようにあなたの動画制作体験を変革できるか、ぜひ今日ご覧ください!

4.3 M
[公式] HitPaw Photo AI:最高のAIフォトエディター

HitPaw Photo AIは、写真のエンハンサー、画像ジェネレーター、オブジェクトおよび背景除去ツールとしてのオールインワンAI写真エディターです。1つのツールで見事な写真を作成できます。

3.3 M
新しい福

高度なAI技術で服装を変更します。

10.1 K
に関するその他のタグ: あなたのGANを引っ張る:生成画像多様体上のインタラクティブなポイントベースの操作