論文の概要: Conditional Flow Matching for Cross-Field MRI Harmonisation
- arxiv url: http://arxiv.org/abs/2609.00960v1
- Date: Tue, 01 Sep 2026 09:18:26 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-02 16:31:36.517362
- Title: Conditional Flow Matching for Cross-Field MRI Harmonisation
- Title(参考訳): クロスフィールドMRI高調波化のための条件流マッチング
- Authors: Baris Imre, Aram Salehi, Levente Baljer, Andrew Webb, Marius Staring, Efe Ilicak,
- Abstract要約: 我々はMRIxFields2026チャレンジのためのクロスフィールド脳MRI変換について検討する。
ソースボリュームとターゲットボリュームは空間的に登録されているので,ソーススライスを直接ターゲットスライスに運ぶ速度場を学習する。
このマッピングを3つの被験者のみから学ぶために、統一モデルは3つの段階で訓練される。
- 参考スコア(独自算出の注目度): 1.4152206863712093
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Magnetic resonance images of the same subject look markedly different across field strengths, which complicates the comparison and pooling of data across sites. We address cross-field brain-MRI translation for the MRIxFields2026 challenge, and in particular its Task~3: a single model that translates between any directed pair of the five field strengths and across three contrasts. We phrase the problem as a conditional flow matching path: because the source and target volumes are spatially registered, we learn a velocity field that carries the source slice directly to the target slice, rather than starting from noise. To learn this mapping from only three paired subjects, the unified model is trained in three stages: a degradation-bridge pretraining that distills a restoration prior from the abundant unpaired retrospective cohort, a cross-field finetuning over all directed pairs on the paired cohort, and an adversarial refinement that sharpens the output. At inference, we integrate the learned velocity with a second-order Heun solver in a handful of steps. A restoration prior learned without any paired data already reaches a mean SSIM of 0.837, and each subsequent training stage improves on it. A single 6.3M-parameter model thereby covers all 60 field-pair and contrast combinations, with inference in five solver steps per slice. On the challenge evaluation set the model reaches a mean SSIM of 0.909, averaged over the three contrasts, outperforming regression and diffusion baselines built on the identical network on all three challenge metrics.
- Abstract(参考訳): 同じ被写体の磁気共鳴画像は、磁場強度によって著しく異なっており、サイト間でのデータの比較とプーリングを複雑にしている。
MRIxFields2026の課題、特にそのTask~3は、5つのフィールド強度の任意の方向と3つのコントラストの間で翻訳される単一のモデルである。
音源と目標体積が空間的に登録されているので、ノイズから始めるのではなく、ソーススライスを直接ターゲットスライスに運ぶ速度場を学習する。
このマッピングを3つの被験者のみから学ぶために、統一されたモデルは3段階に分けて訓練される: 豊富な未ペアのレトロスペクティブコホートから修復を蒸留する劣化ブリッジ事前訓練、ペアのコホート上のすべての有向ペアを横断的な微調整、出力を鋭くする敵の精細化。
推論では、学習速度を2階のHunソルバとほんの数ステップで統合する。
ペアデータのない事前学習された復元は、既に0.837の平均SSIMに達し、その後の訓練段階も改善される。
これにより、1つの6.3Mパラメータモデルは60のフィールドペアとコントラストの組み合わせをすべてカバーし、スライス毎に5つのソルバステップで推論を行う。
課題評価セットでは、3つのコントラストの平均0.909のSSIMに達し、同じネットワーク上に構築された回帰と拡散ベースラインよりも優れていた。
関連論文リスト
- CLIP Architecture for Abdominal CT Image-Text Alignment and Zero-Shot Learning: Investigating Batch Composition and Data Scaling [1.349025992778434]
医用画像とレポートの対比学習により訓練された視覚言語モデルは、強力なゼロショット診断能力を示す。
我々は,左右対称InfoNCE損失を用いた3次元腹部CTボリュームと放射線診断レポートとを一致させるデュアルエンコーダモデルであるMerlinを再現する。
論文 参考訳(メタデータ) (2026-04-15T07:10:01Z) - Adaptive Split-MMD Training for Small-Sample Cross-Dataset P300 EEG Classification [12.103074826558531]
データセット間のシフトは、大きなソースデータセットで小さなターゲットセットを増やそうとするときに発生する。
適応分割最大値離散化学習(AS-MMD)を紹介する。
AS-MMDは、ターゲット重み付き損失とソース/ターゲットサイズ比の平方根に結びついたウォームアップを組み合わせる。
目標のみのトレーニングやプールトレーニングよりも優れています。
論文 参考訳(メタデータ) (2025-10-24T18:48:21Z) - Two-Stage Triplet Loss Training with Curriculum Augmentation for
Audio-Visual Retrieval [3.164991885881342]
クロス検索モデルは堅牢な埋め込み空間を学習する。
この問題に対処するために,カリキュラム学習に根ざした新しいアプローチを導入する。
本稿では,モデルの学習過程をセミハードからハードトリップにガイドする2段階の学習パラダイムを提案する。
論文 参考訳(メタデータ) (2023-10-20T12:35:54Z) - ContrasInver: Ultra-Sparse Label Semi-supervised Regression for
Multi-dimensional Seismic Inversion [7.356328937024184]
コントラインバー(ContrasInver)は、2、3個の井戸の丸太を用いて地震波の逆解析を行う手法である。
実験では、ContrasInverは合成データSEAM Iで最先端の性能を達成した。
オランダのF3とDelftでは,それぞれ3つと2つの井戸ログのみを使用して,信頼性の高い結果をもたらす,初めてのデータ駆動型アプローチである。
論文 参考訳(メタデータ) (2023-02-13T15:19:51Z) - M3ST: Mix at Three Levels for Speech Translation [66.71994367650461]
本稿では,M3ST法を3段階に分けて提案し,拡張学習コーパスの多様性を高める。
ファインチューニングの第1段階では、単語レベル、文レベル、フレームレベルを含む3段階のトレーニングコーパスを混合し、モデル全体を混合データで微調整する。
MuST-C音声翻訳ベンチマークと分析実験により、M3STは現在の強いベースラインより優れ、平均的なBLEU29.9の8方向の最先端の結果が得られることが示された。
論文 参考訳(メタデータ) (2022-12-07T14:22:00Z) - Composed Image Retrieval with Text Feedback via Multi-grained
Uncertainty Regularization [73.04187954213471]
粗い検索ときめ細かい検索を同時にモデル化する統合学習手法を提案する。
提案手法は、強いベースラインに対して+4.03%、+3.38%、+2.40%のRecall@50精度を達成した。
論文 参考訳(メタデータ) (2022-11-14T14:25:40Z) - Modality-Aware Triplet Hard Mining for Zero-shot Sketch-Based Image
Retrieval [51.42470171051007]
本稿では,ZES-SBIR(Zero-Shot Sketch-Based Image Retrieval)問題に,クロスモダリティメトリック学習の観点から取り組む。
DMLにおける2つの基本的な学習手法、例えば分類訓練とペアトレーニングを組み合わせることで、ZS-SBIRの強力なベースラインを構築した。
モータリティ・アウェア・トリプルト・ハード・マイニング(MATHM)は3種類のペア・ラーニングによってベースラインを向上することを示す。
論文 参考訳(メタデータ) (2021-12-15T08:36:44Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。