Fugu-MT 論文翻訳(概要): Unlocking Fine-Grained Details with Wavelet-based High-Frequency Enhancement in Transformers

論文の概要: Unlocking Fine-Grained Details with Wavelet-based High-Frequency Enhancement in Transformers

arxiv url: http://arxiv.org/abs/2308.13442v2
Date: Tue, 12 Sep 2023 18:41:16 GMT
ステータス: 翻訳完了
システム内更新日: 2023-09-14 17:11:19.396022
Title: Unlocking Fine-Grained Details with Wavelet-based High-Frequency Enhancement in Transformers
Title（参考訳）: ウェーブレットを用いた変圧器の高周波増幅による細粒度アンロック
Authors: Reza Azad, Amirhossein Kazerouni, Alaa Sulaiman, Afshin Bozorgpour, Ehsan Khodapanah Aghdam, Abin Jose, Dorit Merhof
Abstract要約: 医用画像のセグメンテーションは、診断、治療計画、疾患モニタリングにおいて重要な役割を担っている。本稿では,自己注意マップを慎重に再設計することで,トランスフォーマーモデルの局所的特徴不足に対処する。そこで本研究では,マルチスケールのコンテキスト拡張ブロックをスキップ接続内で提案し,スケール間の依存関係を適応的にモデル化する。
参考スコア（独自算出の注目度）: 4.208461204572879
License: http://creativecommons.org/licenses/by/4.0/
Abstract: Medical image segmentation is a critical task that plays a vital role in diagnosis, treatment planning, and disease monitoring. Accurate segmentation of anatomical structures and abnormalities from medical images can aid in the early detection and treatment of various diseases. In this paper, we address the local feature deficiency of the Transformer model by carefully re-designing the self-attention map to produce accurate dense prediction in medical images. To this end, we first apply the wavelet transformation to decompose the input feature map into low-frequency (LF) and high-frequency (HF) subbands. The LF segment is associated with coarse-grained features while the HF components preserve fine-grained features such as texture and edge information. Next, we reformulate the self-attention operation using the efficient Transformer to perform both spatial and context attention on top of the frequency representation. Furthermore, to intensify the importance of the boundary information, we impose an additional attention map by creating a Gaussian pyramid on top of the HF components. Moreover, we propose a multi-scale context enhancement block within skip connections to adaptively model inter-scale dependencies to overcome the semantic gap among stages of the encoder and decoder modules. Throughout comprehensive experiments, we demonstrate the effectiveness of our strategy on multi-organ and skin lesion segmentation benchmarks. The implementation code will be available upon acceptance. \href{https://github.com/mindflow-institue/WaveFormer}{GitHub}.
Abstract（参考訳）: 医療画像分割は診断、治療計画、疾患モニタリングにおいて重要な役割を果たす重要な課題である。医学画像からの解剖学的構造と異常の正確な区分は、様々な疾患の早期発見と治療に役立つ。本稿では,トランスフォーマーモデルの局所的特徴不足に対処するため,自己注意マップを慎重に再設計し,医用画像の正確な密度予測を行う。この目的のために、まずウェーブレット変換を適用し、入力特徴写像を低周波(LF)および高周波(HF)サブバンドに分解する。 LFセグメントは粗粒度の特徴に関連付けられ、HFコンポーネントはテクスチャやエッジ情報などの細粒度の特徴を保存する。次に、効率的な変換器を用いて自己注意操作を再構成し、周波数表現の上に空間的および文脈的注意を向ける。さらに,境界情報の重要性を高めるために,HF成分の上にガウスピラミッドを作成することにより,付加的な注意マップを付加する。さらに,エンコーダモジュールとデコーダモジュールのステージ間のセマンティックギャップを克服するため,スキップ接続内のマルチスケールコンテキスト拡張ブロックを提案し,スケール間の依存関係を適応的にモデル化する。包括的実験を通じて,多臓器および皮膚病変セグメンテーションベンチマークにおける戦略の有効性を実証した。実装コードは、受け入れ次第利用可能になる。 https://github.com/mindflow-institue/WaveFormer}{GitHub}

関連論文リスト

Wavelet-Guided Dual-Frequency Encoding for Remote Sensing Change Detection [67.84730634802204]
リモートセンシング画像の変化検出は,自然災害監視,都市拡張追跡,インフラ管理など,さまざまな工学的応用において重要な役割を担っている。既存のほとんどの手法は空間領域モデリングに依存しており、特徴表現の限られた多様性は微妙な変化領域の検出を妨げる。本研究では、特にウェーブレット領域における周波数領域の特徴モデリングが周波数成分の微細な違いを増幅し、空間領域において捉えにくいエッジ変化の知覚を高めることを観察する。
論文参考訳（メタデータ） (2025-08-07T11:14:16Z)
Frequency-enhanced Multi-granularity Context Network for Efficient Vertebrae Segmentation [33.99418884128739]
椎骨分割精度を向上させるために,周波数強調多粒性コンテキストネットワーク(FMC-Net)を導入する。高周波成分に対しては,HFR(High- frequency Feature Refinement)を適用し,特徴の顕著さを増幅する。低周波成分に対しては、多粒度状態空間モデル(MG-SSM)を用いて、異なる受容場を持つ特徴表現を集約する。
論文参考訳（メタデータ） (2025-06-29T04:53:02Z)
Freqformer: Image-Demoiréing Transformer via Efficient Frequency Decomposition [83.40450475728792]
本稿では,Freqformerについて述べる。Freqformerは,ターゲット周波数分離による画像復号化に特化して設計されたトランスフォーマーベースのフレームワークである。本手法は,モワールパターンを高周波数空間局在化テクスチャと低周波数スケールローバスト色歪みに明確に分割する有効な周波数分解を行う。様々なデモアのベンチマーク実験により、Freqformerは、コンパクトなモデルサイズで最先端のパフォーマンスを達成することを示した。
論文参考訳（メタデータ） (2025-05-25T12:23:10Z)
AFFSegNet: Adaptive Feature Fusion Segmentation Network for Microtumors and Multi-Organ Segmentation [32.74195208408193]
医用画像のセグメンテーションは、コンピュータビジョンにおいて重要な課題であり、診断、治療計画、疾患モニタリングにおける臨床医を支援する。本稿では,局所的特徴とグローバルな特徴を効果的に統合し,正確な医用画像分割を実現するトランスフォーマアーキテクチャである適応意味ネットワーク(ASSNet)を提案する。多臓器、肝腫瘍、膀胱腫瘍の分節を含む様々な医療画像の分節タスクに関するテストは、ATSNetが最先端の結果を達成することを実証している。
論文参考訳（メタデータ） (2024-09-12T06:25:44Z)
TransDAE: Dual Attention Mechanism in a Hierarchical Transformer for Efficient Medical Image Segmentation [7.013315283888431]
医用画像のセグメンテーションは、正確な疾患診断と効果的な治療戦略の開発に不可欠である。本稿では,トランスダエ(TransDAE)という,空間的・チャネル的関連性を含む自己認識機構を再定義する手法を紹介する。注目すべきは、TransDAEがSynapsのマルチオーガナイズデータセット上で、既存の最先端メソッドより優れていることだ。
論文参考訳（メタデータ） (2024-09-03T16:08:48Z)
CathFlow: Self-Supervised Segmentation of Catheters in Interventional Ultrasound Using Optical Flow and Transformers [66.15847237150909]
縦型超音波画像におけるカテーテルのセグメンテーションのための自己教師型ディープラーニングアーキテクチャを提案する。ネットワークアーキテクチャは、Attention in Attentionメカニズムで構築されたセグメンテーショントランスフォーマであるAiAReSeg上に構築されている。我々は,シリコンオルタファントムから収集した合成データと画像からなる実験データセット上で,我々のモデルを検証した。
論文参考訳（メタデータ） (2024-03-21T15:13:36Z)
Dual-scale Enhanced and Cross-generative Consistency Learning for Semi-supervised Medical Image Segmentation [49.57907601086494]
医用画像のセグメンテーションはコンピュータ支援診断において重要な役割を担っている。半教師型医用画像(DEC-Seg)のための新しいDual-scale Enhanced and Cross-generative consistency learning frameworkを提案する。
論文参考訳（メタデータ） (2023-12-26T12:56:31Z)
Disruptive Autoencoders: Leveraging Low-level features for 3D Medical Image Pre-training [51.16994853817024]
本研究は、3Dラジオグラフィ画像のための効果的な事前学習フレームワークの設計に焦点をあてる。ローカルマスキングと低レベルの摂動の組み合わせによって生成された破壊から、オリジナルのイメージを再構築しようとする事前トレーニングフレームワークであるDisruptive Autoencodersを紹介する。提案する事前トレーニングフレームワークは、複数のダウンストリームタスクでテストされ、最先端のパフォーマンスを実現する。
論文参考訳（メタデータ） (2023-07-31T17:59:42Z)
HST-MRF: Heterogeneous Swin Transformer with Multi-Receptive Field for Medical Image Segmentation [5.51045524851432]
医用画像セグメンテーションのためのHST-MRFモデルを提案する。主な目的は、トランスを用いたパッチセグメンテーションによる構造情報の損失を解決することである。実験の結果,提案手法は最先端モデルよりも優れ,優れた性能が得られることがわかった。
論文参考訳（メタデータ） (2023-04-10T14:30:03Z)
Reliable Joint Segmentation of Retinal Edema Lesions in OCT Images [55.83984261827332]
本稿では,信頼性の高いマルチスケールウェーブレットエンハンストランスネットワークを提案する。本研究では,ウェーブレット型特徴抽出器ネットワークとマルチスケール変圧器モジュールを統合したセグメンテーションバックボーンを開発した。提案手法は,他の最先端セグメンテーション手法と比較して信頼性の高いセグメンテーション精度を実現する。
論文参考訳（メタデータ） (2022-12-01T07:32:56Z)
Preservation of High Frequency Content for Deep Learning-Based Medical Image Classification [74.84221280249876]
大量の胸部ラジオグラフィーの効率的な分析は、医師や放射線技師を助けることができる。本稿では,視覚情報の効率的な識別と符号化のための離散ウェーブレット変換(DWT)を提案する。
論文参考訳（メタデータ） (2022-05-08T15:29:54Z)
TransAttUnet: Multi-level Attention-guided U-Net with Transformer for Medical Image Segmentation [33.45471457058221]
本稿では,TransAttUnetと呼ばれるトランスフォーマーベースの医用画像セマンティックセマンティック・セマンティック・フレームワークを提案する。特に,デコーダブロック間の複数スケールのスキップ接続を確立することで,セマンティック・スケールのアップサンプリング機能を集約する。我々の手法は一貫して最先端のベースラインを上回っている。
論文参考訳（メタデータ） (2021-07-12T09:17:06Z)
TransUNet: Transformers Make Strong Encoders for Medical Image Segmentation [78.01570371790669]
医用画像のセグメンテーションは医療システムの開発に必須の前提条件である。様々な医療画像セグメンテーションタスクにおいて、U-Netとして知られるu字型アーキテクチャがデファクトスタンダードとなっている。医用画像セグメンテーションの強力な代替手段として,トランスフォーマーとU-Netの両方を有効活用するTransUNetを提案する。
論文参考訳（メタデータ） (2021-02-08T16:10:50Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。

指定された論文の情報です。
本サイトの運営者は本サイト（すべての情報・翻訳含む）の品質を保証せず、本サイト（すべての情報・翻訳含む）を使用して発生したあらゆる結果について一切の責任を負いません。