論文の概要: FUMO: Prior-Modulated Diffusion for Single Image Reflection Removal
- arxiv url: http://arxiv.org/abs/2603.19036v1
- Date: Thu, 19 Mar 2026 15:33:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-20 17:19:06.231815
- Title: FUMO: Prior-Modulated Diffusion for Single Image Reflection Removal
- Title(参考訳): FUMO:シングルイメージリフレクション除去のための事前変調拡散
- Abstract要約: 本稿では、空間制御性と構造忠実性を改善するために、明示的な誘導信号を導入した事前変調フレームワーク(FUMO)を用いた拡散モデルを提案する。
標準ベンチマークと野生での挑戦的な画像の両方で実施された実験は、競争力のある定量的結果を示し、知覚品質を継続的に改善した。
- 参考スコア(独自算出の注目度): 51.98991734660274
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Single image reflection removal (SIRR) is challenging in real scenes, where reflection strength varies spatially and reflection patterns are tightly entangled with transmission structures. This paper presents a diffusion model with prior modulation framework (FUMO) that introduces explicit guidance signals to improve spatial controllability and structural faithfulness. Two priors are extracted directly from the mixed image, an intensity prior that estimates spatial reflection severity and a high-frequency prior that captures detail-sensitive responses via multi-scale residual aggregation. We propose a coarse-to-fine training paradigm. In the first stage, these cues are combined to gate the conditional residual injections, focusing the conditioning on regions that are both reflection-dominant and structure-sensitive. In the second stage, a fine-grained refinement network corrects local misalignment and sharpens fine details in the image space. Experiments conducted on both standard benchmarks and challenging images in the wild demonstrate competitive quantitative results and consistently improved perceptual quality. The code is released at https://github.com/Lucious-Desmon/FUMO.
- Abstract(参考訳): 反射強度は空間的に変化し、反射パターンは透過構造と密接な絡み合っている現実のシーンでは、SIRRは困難である。
本稿では、空間制御性と構造忠実性を改善するために、明示的な誘導信号を導入した事前変調フレームワーク(FUMO)を用いた拡散モデルを提案する。
混合画像から直接2つの先行情報を抽出し、空間反射の重大度を推定する前の強度と、マルチスケールの残留アグリゲーションを介して詳細感度の応答をキャプチャする高周波前の強度を推定する。
粗大な訓練パラダイムを提案する。
第一段階では、これらのキューを組み合わせ、条件付き残留注入をゲートし、反射優位性と構造感受性の両方の領域に条件付けを集中させる。
第2段階では、きめ細かい精細化ネットワークが局所的な不整合を補正し、画像空間の細部を絞り込む。
標準ベンチマークと野生での挑戦的な画像の両方で実施された実験は、競争力のある定量的結果を示し、知覚品質を継続的に改善した。
コードはhttps://github.com/Lucious-Desmon/FUMOで公開されている。
関連論文リスト
- Rarity-Aware Discrete Diffusion with Spatially Consistent Decoding for Photo-Realistic Image Super-Resolution [80.28905986756685]
DiMOO-SRは光リアル画像超解法のための多モード離散拡散フレームワークである。
広く使われている実世界のSRベンチマークの実験では、DiMOO-SRはいくつかの並列デコードステップで競合する知覚品質を達成する。
論文 参考訳(メタデータ) (2026-07-20T07:01:01Z) - PRISM: Latent Composition Consistency for Single-Image Reflection Removal [8.368543987898734]
単一像反射除去(SIRR)は、反射によって劣化した混合物から透過層を回収する。
既存の手法はピクセル空間で動作し、非線形sRGB生成モデルは2つの層を絡み合わせる。
我々は、SIRRを潜在線形分離問題として再解釈するtextbfPRISM(Pretrained-latent Reflection Image separation Model)を提案する。
論文 参考訳(メタデータ) (2026-06-30T11:28:02Z) - RefLSM: Linearized Structural-Prior Reflectance Model for Medical Image Segmentation and Bias-Field Correction [10.716406019360441]
医用画像セグメンテーションのための新しい変動反射型レベルセットモデル(RefLSM)を提案する。
RefLSMはRetinexにインスパイアされた反射率分解をセグメンテーションフレームワークに明示的に統合する。
RefLSMは,最先端レベル設定法と比較して,セグメンテーション精度,ロバスト性,計算効率が優れていることを示す。
論文 参考訳(メタデータ) (2025-12-08T06:06:29Z) - Unlocking the Potential of Diffusion Priors in Blind Face Restoration [63.419272650578165]
本研究では、2つのモードを切り替えて特定のギャップを解消する統合ネットワークFLIPNETを提案する。
復元モードでは、モデルは徐々にBFR指向の特徴とLQ画像からの顔埋め込みを統合し、真正かつ忠実な顔復元を実現する。
劣化モードでは、実際の劣化データセットから学んだ知識に基づいて、劣化した画像のような現実世界を合成する。
論文 参考訳(メタデータ) (2025-08-12T01:50:55Z) - Dereflection Any Image with Diffusion Priors and Diversified Data [86.15504914121226]
本稿では、効率的なデータ準備パイプラインと、頑健な反射除去のための一般化可能なモデルを備えた包括的解を提案する。
まず、ターゲットシーンでランダムに回転する反射媒体によって生成された横反射除去(DRR)というデータセットを紹介する。
第2に、決定論的出力と高速推論のための1ステップ拡散を伴う拡散に基づくフレームワークを提案する。
論文 参考訳(メタデータ) (2025-03-21T17:48:14Z) - Latent Diffusion, Implicit Amplification: Efficient Continuous-Scale Super-Resolution for Remote Sensing Images [7.920423405957888]
E$2$DiffSRは、最先端のSR手法と比較して、客観的な指標と視覚的品質を達成する。
拡散に基づくSR法の推論時間を非拡散法と同程度のレベルに短縮する。
論文 参考訳(メタデータ) (2024-10-30T09:14:13Z) - Timestep-Aware Diffusion Model for Extreme Image Rescaling [47.89362819768323]
本稿では,時間認識拡散モデル(TADM)と呼ばれる,画像再スケーリングのための新しいフレームワークを提案する。
TADMは、事前訓練されたオートエンコーダの潜在空間で再スケーリング操作を行う。
これは、事前訓練されたテキスト・ツー・イメージ拡散モデルによって学習された強力な自然画像の先行を効果的に活用する。
論文 参考訳(メタデータ) (2024-08-17T09:51:42Z) - Iterative Token Evaluation and Refinement for Real-World
Super-Resolution [77.74289677520508]
実世界の画像超解像(RWSR)は、低品質(LQ)画像が複雑で未同定の劣化を起こすため、長年にわたる問題である。
本稿では,RWSRのための反復的トークン評価・リファインメントフレームワークを提案する。
ITERはGAN(Generative Adversarial Networks)よりも訓練が容易であり,連続拡散モデルよりも効率的であることを示す。
論文 参考訳(メタデータ) (2023-12-09T17:07:32Z) - Deep Equilibrium Diffusion Restoration with Parallel Sampling [120.15039525209106]
拡散モデルに基づく画像復元(IR)は、拡散モデルを用いて劣化した画像から高品質な(本社)画像を復元し、有望な性能を達成することを目的としている。
既存のほとんどの手法では、HQイメージをステップバイステップで復元するために長いシリアルサンプリングチェーンが必要であるため、高価なサンプリング時間と高い計算コストがかかる。
本研究では,拡散モデルに基づくIRモデルを異なる視点,すなわちDeqIRと呼ばれるDeQ(Deep equilibrium)固定点系で再考することを目的とする。
論文 参考訳(メタデータ) (2023-11-20T08:27:56Z) - DiffBIR: Towards Blind Image Restoration with Generative Diffusion Prior [70.46245698746874]
DiffBIRは、視覚の異なる画像復元タスクを処理できる一般的な修復パイプラインである。
DiffBIRは, ブラインド画像復元問題を, 1) 劣化除去: 画像に依存しない内容の除去; 2) 情報再生: 失われた画像内容の生成の2段階に分離する。
第1段階では, 修復モジュールを用いて劣化を除去し, 高忠実度復元結果を得る。
第2段階では、潜伏拡散モデルの生成能力を活用して現実的な詳細を生成するIRControlNetを提案する。
論文 参考訳(メタデータ) (2023-08-29T07:11:52Z) - Two-Stage Single Image Reflection Removal with Reflection-Aware Guidance [78.34235841168031]
シングルイメージリフレクション除去(SIRR)のためのリフレクション・アウェア・ガイダンス(RAGNet)を用いた新しい2段階ネットワークを提案する。
RAGは、(i)観測からの反射の効果を緩和するために、(ii)線形結合仮説から逸脱する効果を緩和するための部分畳み込みにおいてマスクを生成するために用いられる。
5つの一般的なデータセットの実験は、最先端のSIRR法と比較して、RAGNetの量的および質的な優位性を実証している。
論文 参考訳(メタデータ) (2020-12-02T03:14:57Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。