論文の概要: Enhanced Low-Density Region Exploration in Classifier-Guided Diffusion Models Through Modified Reverse Diffusion Sampling
- arxiv url: http://arxiv.org/abs/2606.13347v1
- Date: Thu, 11 Jun 2026 13:35:53 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-12 15:55:27.82179
- Title: Enhanced Low-Density Region Exploration in Classifier-Guided Diffusion Models Through Modified Reverse Diffusion Sampling
- Title(参考訳): 修正逆拡散サンプリングによる分類器誘導拡散モデルの低密度領域探索
- Abstract要約: 本研究では,条件付き拡散モデルのサンプリング時間,密度を考慮した拡張を提案する。
我々は、低信頼領域に向けて軌道を操り、ガイドされた逆ダイナミクスを修正した。
提案手法は,64x64の解像度でADMモデルリコールを継続的に改善し,FIDを同等に維持することを示す。
- 参考スコア(独自算出の注目度): 5.191572579366909
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Diffusion models have emerged as state-of-the-art generative models for high-fidelity image synthesis, particularly in their classifier-free guided and classifier-guided forms. However, standard classifier guidance concentrates probability mass around high-density class mean, leading to poor coverage of rare samples in the tails of the class-conditional distributions. Recent work on diffusion-based tail sampling mitigates this by training an additional low-density-seeking classifier with a synthetic-vs-real discriminator, at the cost of additional networks and training. In parallel, a number of samplers and distillation techniques accelerate or refine diffusion sampling, but do not explicitly address long-tail coverage. We propose a purely sampling-time, density-aware extension of classifier-guided conditional diffusion model that targets low-density regions without any additional training. We have applied guidance at noisy images not on predicted noise like most diffusion models. Starting from a pretrained conditional diffusion model and classifier on ImageNet, we modify the guided reverse dynamics by steering trajectories toward low-confidence regions via the modified classifier gradient, and at each time step, we also guide the sampling process toward the predicted real image. 1st guidance helps explore low-probability samples, and 2nd guidance helps to generate samples to be close to the real data manifold. The proposed sampler consistently improves ADM model recall at 64x64 resolution while maintaining a comparable FID, and with a 256x256 ADM model, we showed the results visually with different combinations of both guidance. We also showed that standard ADM classifier guidance, combined with predicted real image guidance, helps generate high perceptual quality samples with a 256x256 ADM model on ImageNet.
- Abstract(参考訳): 拡散モデルは、高忠実度画像合成のための最先端の生成モデルとして登場し、特に分類器フリーガイドおよび分類器誘導形式において顕著である。
しかし、標準分類器ガイダンスは、高密度のクラスの平均値に確率質量を集中させ、クラス条件分布の尾部における希少なサンプルのカバレッジを低下させる。
拡散型テールサンプリングの最近の研究は、新たなネットワークとトレーニングを犠牲にして、合成vs-実判別器を付加した低密度探索分類器を訓練することによって、これを緩和する。
平行して、多くのサンプリング器と蒸留技術は拡散サンプリングを加速または精製するが、ロングテールカバレッジには明示的に対応していない。
そこで本研究では,低密度領域を対象にした分類器誘導条件拡散モデルのサンプリング時間・密度対応拡張を提案する。
我々は,ほとんどの拡散モデルのような予測ノイズには依存せず,ノイズの多い画像にガイダンスを適用した。
予め訓練された条件付き拡散モデルとImageNetの分類器から、修正された分類器勾配によって軌道を低信頼領域に向けることで、ガイドされた逆ダイナミクスを修正し、各ステップで、予測された実画像に向けてサンプリングプロセスもガイドする。
第1のガイダンスは、低確率サンプルの探索に役立ち、第2のガイダンスは、実際のデータ多様体に近いサンプルを生成するのに役立ちます。
提案手法は,64x64のFIDを維持しながらADMモデルのリコールを常に改善し,256x256のADMモデルを用いて,両手法の異なる組み合わせで結果を視覚的に示す。
また,イメージネット上で256x256のADMモデルを用いて,標準のADM分類器ガイダンスと予測された実画像ガイダンスを組み合わせることで,高い知覚品質のADMサンプルを生成することを実証した。
関連論文リスト
- Enhancing Diffusion Model Guidance through Calibration and Regularization [9.22066257345387]
本稿では,この問題に対処するための2つの補完的貢献を紹介する。
まず,Smooth expected Error(Smooth ECE)に基づく微分可能なキャリブレーション目標を提案する。
第2に,再訓練を必要とせず,市販の分類器で動作可能なサンプリング誘導手法を開発した。
論文 参考訳(メタデータ) (2025-11-08T04:23:42Z) - Learning Robust Diffusion Models from Imprecise Supervision [75.53546939251146]
DMISは、Imrecise Supervisionから堅牢な条件拡散モデルをトレーニングするための統一されたフレームワークである。
我々のフレームワークは、可能性から派生し、その目的を生成的および分類的構成要素に分解する。
画像生成、弱教師付き学習、データセットの凝縮をカバーし、様々な形の不正確な監視実験を行い、DMISが常に高品質でクラス差別的なサンプルを生成することを示した。
論文 参考訳(メタデータ) (2025-10-03T14:00:32Z) - Boosting Diffusion Models with Moving Average Sampling in Frequency Domain [101.43824674873508]
拡散モデルは、現在のサンプルに頼って次のサンプルをノイズ化し、おそらく不安定化を引き起こす。
本稿では,反復的復調過程をモデル最適化として再解釈し,移動平均機構を利用して全ての先行サンプルをアンサンブルする。
周波数領域における平均サンプリング(MASF)の動作」という完全なアプローチを命名する。
論文 参考訳(メタデータ) (2024-03-26T16:57:55Z) - CADS: Unleashing the Diversity of Diffusion Models through Condition-Annealed Sampling [27.795088366122297]
Condition-Annealed Diffusion Sampler (CADS) は任意の事前学習モデルとサンプリングアルゴリズムで使用することができる。
本研究では,様々な条件生成タスクにおける拡散モデルの多様性を向上することを示す。
論文 参考訳(メタデータ) (2023-10-26T12:27:56Z) - Diff-Instruct: A Universal Approach for Transferring Knowledge From
Pre-trained Diffusion Models [77.83923746319498]
本稿では,任意の生成モデルの学習を指導するDiff-Instructというフレームワークを提案する。
Diff-Instructは、最先端の単一ステップ拡散モデルであることを示す。
GANモデルの精製実験により、Diff-InstructはGANモデルの事前訓練されたジェネレータを一貫して改善できることが示されている。
論文 参考訳(メタデータ) (2023-05-29T04:22:57Z) - Towards Controllable Diffusion Models via Reward-Guided Exploration [15.857464051475294]
強化学習(RL)による拡散モデルの学習段階を導く新しい枠組みを提案する。
RLは、政策そのものではなく、指数スケールの報酬に比例したペイオフ分布からのサンプルによる政策勾配を計算することができる。
3次元形状と分子生成タスクの実験は、既存の条件拡散モデルよりも大幅に改善されている。
論文 参考訳(メタデータ) (2023-04-14T13:51:26Z) - Reflected Diffusion Models [93.26107023470979]
本稿では,データのサポートに基づいて進化する反射微分方程式を逆転する反射拡散モデルを提案する。
提案手法は,一般化されたスコアマッチング損失を用いてスコア関数を学習し,標準拡散モデルの主要成分を拡張する。
論文 参考訳(メタデータ) (2023-04-10T17:54:38Z) - Your Diffusion Model is Secretly a Zero-Shot Classifier [90.40799216880342]
大規模テキスト・画像拡散モデルからの密度推定をゼロショット分類に活用できることを示す。
分類に対する我々の生成的アプローチは、様々なベンチマークで強い結果が得られる。
我々の結果は、下流タスクにおける差別的モデルよりも生成的な利用に向けての一歩である。
論文 参考訳(メタデータ) (2023-03-28T17:59:56Z) - Fast Inference in Denoising Diffusion Models via MMD Finetuning [23.779985842891705]
拡散モデルの高速サンプリング法であるMDD-DDMを提案する。
我々のアプローチは、学習した分布を所定の予算のタイムステップで微調整するために、最大平均離散性(MMD)を使用するという考え方に基づいている。
提案手法は,広範に普及した拡散モデルで要求されるわずかな時間で高品質なサンプルを生成できることが示唆された。
論文 参考訳(メタデータ) (2023-01-19T09:48:07Z) - On Distillation of Guided Diffusion Models [94.95228078141626]
そこで本研究では,分類器を含まない誘導拡散モデルから抽出し易いモデルへ抽出する手法を提案する。
画素空間上で訓練された標準拡散モデルに対して,本手法は元のモデルに匹敵する画像を生成することができる。
遅延空間で訓練された拡散モデル(例えば、安定拡散)に対して、我々の手法は1から4段階のデノナイジングステップで高忠実度画像を生成することができる。
論文 参考訳(メタデータ) (2022-10-06T18:03:56Z) - Learning Fast Samplers for Diffusion Models by Differentiating Through
Sample Quality [44.37533757879762]
差分拡散サンプリングサーチ(DDSS)は,任意の事前学習拡散モデルに対して高速サンプリングを最適化する手法である。
また、拡散モデルのためのフレキシブルな非マルコフ型サンプルモデルのファミリーである一般化ガウス拡散モデル(GGDM)を提示する。
本手法は, 微調整や再学習の必要なく, 事前学習した拡散モデルと互換性がある。
論文 参考訳(メタデータ) (2022-02-11T18:53:18Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。