論文の概要: A Concept is More Than a Word: Diversified Unlearning in Text-to-Image Diffusion Models
- arxiv url: http://arxiv.org/abs/2603.18767v1
- Date: Thu, 19 Mar 2026 11:20:40 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-20 17:19:06.111537
- Title: A Concept is More Than a Word: Diversified Unlearning in Text-to-Image Diffusion Models
- Title(参考訳): 概念は言葉以上のもの:テキストと画像の拡散モデルにおける未学習の多様化
- Abstract要約: 概念アンラーニングは、テキスト・ツー・イメージ拡散モデルにおける有害なコンテンツ生成のリスクを低減するための有望な方向である。
既存のアプローチは通常、未学習のターゲット概念を特定するためにキーワードに依存している。
本稿では、文脈的に多様なプロンプトの集合を通して概念を表現する分散フレームワークであるDiversified Unlearningを提案する。
- 参考スコア(独自算出の注目度): 2.124297073085513
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Concept unlearning has emerged as a promising direction for reducing the risks of harmful content generation in text-to-image diffusion models by selectively erasing undesirable concepts from a model's parameters. Existing approaches typically rely on keywords to identify the target concept to be unlearned. However, we show that this keyword-based formulation is inherently limited: a visual concept is multi-dimensional, can be expressed in diverse textual forms, and often overlap with related concepts in the latent space, making keyword-only unlearning, which imprecisely indicate the target concept is brittle and prone to over-forgetting. This occurs because a single keyword represents only a narrow point estimate of the concept, failing to cover its full semantic distribution and entangled variations in the latent space. To address this limitation, we propose Diversified Unlearning, a distributional framework that represents a concept through a set of contextually diverse prompts rather than a single keyword. This richer representation enables more precise and robust unlearning. Through extensive experiments across multiple benchmarks and state-of-the-art baselines, we demonstrate that integrating Diversified Unlearning as an add-on component into existing unlearning pipelines consistently achieves stronger erasure, better retention of unrelated concepts, and improved robustness against adversarial recovery attacks.
- Abstract(参考訳): テキストから画像への拡散モデルにおいて、望ましくない概念をモデルパラメータから選択的に消去することで、有害なコンテンツ生成のリスクを低減するための有望な方向として、概念アンラーニングが登場した。
既存のアプローチは通常、未学習のターゲット概念を特定するためにキーワードに依存している。
しかし、このキーワードに基づく定式化は本質的に制限されている: 視覚概念は多次元であり、多様なテキスト形式で表現でき、しばしば潜在空間における関連する概念と重なり合うことがあり、キーワードのみのアンラーニングが不正確にターゲット概念が脆く、過剰に鍛造される傾向がある。
これは、単一のキーワードが概念の狭い点の推定しか表現せず、その完全な意味分布と潜在空間の絡み合ったバリエーションをカバーできないためである。
この制限に対処するために,単一キーワードではなく,文脈的に多様なプロンプトのセットを通じて概念を表現する分散フレームワークであるDiversified Unlearningを提案する。
このリッチな表現は、より正確で堅牢なアンラーニングを可能にします。
複数のベンチマークと最先端のベースラインにわたる広範な実験を通じて、Diversified Unlearningを既存の未学習パイプラインにアドオンコンポーネントとして統合することで、より強力な消去、無関係な概念の維持、敵のリカバリ攻撃に対する堅牢性の向上が一貫して達成されていることを実証した。
関連論文リスト
- Interpreting Object-Dependent Concept Brittleness in Text-to-Image Diffusion Models [105.53190946111586]
我々はこの現象をオブジェクト依存概念の脆さと呼ぶ。
これらの障害を監査し、最小限に修正する、解釈可能性指向のフレームワークを提案する。
複数の拡散バックボーンにまたがるスタイルと属性の故障事例について,提案手法の評価を行った。
論文 参考訳(メタデータ) (2026-09-09T09:07:40Z) - ICED: Concept-level Machine Unlearning via Interpretable Concept Decomposition [44.733160260712054]
視覚言語モデル(VLM)のための解釈可能な概念レベルのアンラーニングフレームワークを提案する。
提案手法は,非学習を概念レベルの最適化として定式化し,対象概念を選択的に抑制し,非目標セマンティクスとグローバルなクロスモーダル知識を保存する。
論文 参考訳(メタデータ) (2026-05-14T03:22:12Z) - Beyond Heuristic Prompting: A Concept-Guided Bayesian Framework for Zero-Shot Image Recognition [81.2779530670268]
VLM(Vision-Language Models)は、ゼロショット画像認識を著しく進歩させたモデルである。
本稿では、クラス固有の概念を取り入れることで、プロンプトを強化する。
我々の手法は一貫して最先端の手法より優れている。
論文 参考訳(メタデータ) (2026-03-09T03:11:11Z) - ACE: Attentional Concept Erasure in Diffusion Models [0.0]
Attentional Concept Erasureは、クローズドフォームのアテンション操作と軽量な微調整を統合している。
ACEは最先端の概念の除去とロバスト性を実現する。
従来の方法と比較して、ACEは一般性(概念と関連する用語)と特異性(無関係なコンテンツを保存する)のバランスが良い。
論文 参考訳(メタデータ) (2025-04-16T08:16:28Z) - Fine-Grained Erasure in Text-to-Image Diffusion-based Foundation Models [56.35484513848296]
FADE(Fine grained Attenuation for Diffusion Erasure)は、テキストから画像への生成モデルのための非学習アルゴリズムである。
関連する概念に最小限の影響で目標概念を排除し、最先端の手法よりも保持性能が12%向上した。
論文 参考訳(メタデータ) (2025-03-25T15:49:48Z) - CRCE: Coreference-Retention Concept Erasure in Text-to-Image Diffusion Models [19.205261933636645]
本稿では,新しい概念消去フレームワークCRCEを紹介する。
コアフェルデンシャルと保持概念を意味的に明示的にモデル化することにより、CRCEはより正確な概念除去を可能にする。
実験により、CRCEは様々な消去タスクにおいて既存の手法よりも優れていることが示された。
論文 参考訳(メタデータ) (2025-03-18T13:09:01Z) - OmniPrism: Learning Disentangled Visual Concept for Image Generation [57.21097864811521]
創造的な視覚概念の生成は、しばしば関連する結果を生み出すために参照イメージ内の特定の概念からインスピレーションを引き出す。
我々は,創造的画像生成のための視覚的概念分離手法であるOmniPrismを提案する。
提案手法は,自然言語で案内される不整合概念表現を学習し,これらの概念を組み込むために拡散モデルを訓練する。
論文 参考訳(メタデータ) (2024-12-16T18:59:52Z) - Unlearning Concepts in Diffusion Model via Concept Domain Correction and Concept Preserving Gradient [20.698305103879232]
我々はtextbfDoCo (textbfDomaintextbfCorrection) という新しい概念領域補正フレームワークを提案する。
本手法は, 対象概念の包括的未学習を保証し, 先進的学習を通して, センシティブな概念とアンカーの概念の出力領域を整合させることにより, 対象概念の包括的未学習を確実にする。
また、矛盾する勾配成分を緩和し、特定の概念を学習しながらモデルの実用性を維持するための概念保存的勾配手術手法も導入する。
論文 参考訳(メタデータ) (2024-05-24T07:47:36Z) - Separable Multi-Concept Erasure from Diffusion Models [52.51972530398691]
大規模拡散モデルから安全でない概念を排除するために,分離可能なマルチコンセプト消去器(SepME)を提案する。
後者は最適化可能なモデルウェイトを分離し、各ウェイトインクリメントは特定の概念の消去に対応する。
広範囲にわたる実験は, 概念の排除, モデル性能の保存, 各種概念の消去・回復における柔軟性の確保に, アプローチの有効性を示すものである。
論文 参考訳(メタデータ) (2024-02-03T11:10:57Z) - Implicit Concept Removal of Diffusion Models [92.55152501707995]
テキスト・ツー・イメージ(T2I)拡散モデルはしばしば、透かしや安全でない画像のような望ましくない概念を不注意に生成する。
幾何学駆動制御に基づく新しい概念除去手法であるGeom-Erasingを提案する。
論文 参考訳(メタデータ) (2023-10-09T17:13:10Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。