論文の概要: Wavelet-Guided Semantic Signal Compensation for Inversion-Free Image Editing
- arxiv url: http://arxiv.org/abs/2607.02421v1
- Date: Thu, 02 Jul 2026 16:50:26 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-03 19:45:08.934363
- Title: Wavelet-Guided Semantic Signal Compensation for Inversion-Free Image Editing
- Title(参考訳): インバージョンフリー画像編集のためのウェーブレット誘導セマンティック信号補償
- Authors: Anqi Tang, Wenhao Sun, Zhaoqiang Liu,
- Abstract要約: テキスト誘導画像編集は、背景を保存しながら、ターゲットプロンプトに従って視覚内容を変更することを目的としている。
FlowEditのような最近のインバージョンフリーな画像編集フレームワークは、インバージョンを必要としない強力な編集機能を示している。
生成初期において有効な信号を強化するために,インバージョンフリーで周波数対応のセマンティック補償戦略を提案する。
- 参考スコア(独自算出の注目度): 12.036164124605248
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Text-guided image editing aims to modify visual content according to a target prompt while preserving the background. Recent inversion-free image editing frameworks such as FlowEdit have demonstrated strong editing capability without requiring inversion. Empirically, FlowEdit can achieve substantial semantic changes under appropriate hyperparameter settings. However, we observe that under certain global attribute shifts, the editing trajectory may not effectively move away from the source distribution in the early timesteps. Our analysis suggests that in the high-noise regime, the dominant manifold-seeking flow toward the data manifold can reduce the influence of the text-conditioned direction, leading to limited global modification while background structures remain only moderately preserved. Inspired by this observation, we propose an inversion-free, frequency-aware semantic compensation strategy that strengthens the effective signal in the early stage of generation, while maintaining structural consistency in the background. The proposed method improves global editing capacity without sacrificing background fidelity.
- Abstract(参考訳): テキスト誘導画像編集は、背景を保存しながら、ターゲットプロンプトに従って視覚内容を変更することを目的としている。
FlowEditのような最近のインバージョンフリーな画像編集フレームワークは、インバージョンを必要としない強力な編集機能を示している。
経験的に、FlowEditは適切なハイパーパラメータ設定の下で、実質的なセマンティックな変更を達成できる。
しかし、あるグローバル属性シフトの下では、編集軌跡が早期にソース分布から効果的に逸脱することはない。
分析の結果,高雑音環境下では,データ多様体に対する支配的な多様体探索流は,テキスト条件の影響を低減し,背景構造が適度に保たれる一方で,大域的な変化が限定されることが示唆された。
この観測に触発されて、我々は、背景の構造的整合性を維持しつつ、生成の初期段階において有効信号を強化する、インバージョンフリーで周波数対応のセマンティック補償戦略を提案する。
提案手法は,背景の忠実さを犠牲にすることなく,グローバルな編集能力を向上させる。
関連論文リスト
- DirectEdit: Step-Level Accurate Inversion for Flow-Based Image Editing [51.56484100374058]
我々は、事前訓練されたテキスト・ツー・イメージ(T2I)モデルのトレーニング不要な編集方法であるDirectEditを提案する。
DirectEditは、追加の神経機能評価(NFE)を導入することなく、固有の再構成エラーを除去する
実験により、DirectEditは効率よく正確な画像編集を実現し、最先端の手法よりも優れたパフォーマンスを提供することが示された。
論文 参考訳(メタデータ) (2026-05-04T10:09:18Z) - Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control [52.87568958372421]
Follow-Your-Shapeは、トレーニング不要でマスクなしのフレームワークで、オブジェクト形状の正確かつ制御可能な編集をサポートする。
インバージョンとデノナイジングパスのトークン単位の速度差を比較することで,TDM(Torjectory Divergence Map)を算出する。
本手法は、特に大規模な形状変更を必要とするタスクにおいて、優れた編集性と視覚的忠実性を実現する。
論文 参考訳(メタデータ) (2025-08-11T16:10:00Z) - LORE: Latent Optimization for Precise Semantic Control in Rectified Flow-based Image Editing [0.276240219662896]
トレーニング不要で効率的な画像編集手法であるLOREを紹介する。
LOREは逆ノイズを直接最適化し、既存のアプローチの一般化と制御可能性の限界に対処する。
実験の結果,LOREはセマンティックアライメント,画像品質,背景忠実度において,強いベースラインを著しく上回ることがわかった。
論文 参考訳(メタデータ) (2025-08-05T06:45:04Z) - FlowAlign: Trajectory-Regularized, Inversion-Free Flow-based Image Editing [47.908940130654535]
FlowAlignは、最適な制御ベースの軌道制御による一貫した画像編集のためのインバージョンフリーなフローベースフレームワークである。
我々の終点正規化は、編集プロンプトとのセマンティックアライメントのバランスと、軌道に沿ったソース画像との構造的整合性を示す。
FlowAlignは、ソース保存と編集の制御性の両方において、既存のメソッドよりも優れています。
論文 参考訳(メタデータ) (2025-05-29T06:33:16Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。