タグ
#Diffusion Transformerの記事一覧
1件の記事があります。
画像・動画生成
Representation Autoencodersとは?VAEに頼らずDiffusion Transformerの潜在空間を高品質化する画像生成技術
Representation Autoencodersは、DINOv2などの事前学習済み表現エンコーダを画像生成用の潜在空間として使い、Diffusion Transformerの収束速度と生成品質を改善する技術です。仕組み、実験結果、AI開発への応用を解説します。
参照論文:Diffusion Transformers with Representation Autoencoders