論文の概要: Enhanced LULC Segmentation via Lightweight Model Refinements on ALOS-2 SAR Data
- arxiv url: http://arxiv.org/abs/2601.15705v1
- Date: Thu, 22 Jan 2026 07:18:06 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-01-23 21:37:20.520822
- Title: Enhanced LULC Segmentation via Lightweight Model Refinements on ALOS-2 SAR Data
- Title(参考訳): ALOS-2 SARデータを用いた軽量モデル微細化によるLULCセグメンテーションの強化
- Abstract要約: 本研究は,ALOS-2単一分極SARデータを用いた全国規模の土地利用/土地被覆(LULC)セマンティックセマンティックセマンティックセグメンテーションに焦点を当てた。
我々は,SAR高密度予測故障モード,境界過度平滑化,薄/細い構造の欠如,そして長い尾を持つラベルの下での希少な劣化に対処する。
結果として得られたモデルは、日本全体のALOS-2 LULCベンチマーク、特に表現不足クラスに対して一貫した改善をもたらす。
- 参考スコア(独自算出の注目度): 1.4401311275746886
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: This work focuses on national-scale land-use/land-cover (LULC) semantic segmentation using ALOS-2 single-polarization (HH) SAR data over Japan, together with a companion binary water detection task. Building on SAR-W-MixMAE self-supervised pretraining [1], we address common SAR dense-prediction failure modes, boundary over-smoothing, missed thin/slender structures, and rare-class degradation under long-tailed labels, without increasing pipeline complexity. We introduce three lightweight refinements: (i) injecting high-resolution features into multi-scale decoding, (ii) a progressive refine-up head that alternates convolutional refinement and stepwise upsampling, and (iii) an $α$-scale factor that tempers class reweighting within a focal+dice objective. The resulting model yields consistent improvements on the Japan-wide ALOS-2 LULC benchmark, particularly for under-represented classes, and improves water detection across standard evaluation metrics.
- Abstract(参考訳): 本研究は,全国規模の土地利用/土地被覆(LULC)セマンティックセマンティックセマンティックセマンティックセグメンテーションを,ALOS-2単一分極(HH)SARデータとともに日本全国に展開する。
SAR-W-MixMAE の自己教師付き事前学習 [1] に基づいて,SAR の高密度予測故障モード,境界過平滑化,細い/細い構造の欠如,長い尾を持つラベルの下での希少な劣化に対処し,パイプラインの複雑さを増大させることなく対処する。
3つの軽量な改良点を紹介します。
(i)マルチスケールデコードに高精細な特徴を注入すること。
(二)畳み込みの精巧化と段階的なアップサンプリングを交互に行う進歩的な精巧化ヘッド
(iii)焦点+焦点対象のクラス再重み付けを誘引する$α$スケール因子。
得られたモデルにより,日本全体のALOS-2 LULCベンチマーク,特に表現不足クラスに対する一貫した改善が得られ,標準評価指標による水検出が向上する。
関連論文リスト
- CLEAR: Conflict-aware Learning via Evidence-guided Adaptive Routing for Unified Sparse-View 3D Gaussian Super-Resolution [80.43237927269575]
Sparse-view 3D Gaussian Splatting Super- resolution のための最初の統一された単一ステージフレームワークとして CLEAR を提案する。
CLEARは、統合ガウス表現の中で、真のLR観測と外部HR事前の最適化を共同で行う。
合成と実世界の両方の4times$超高解像度ベンチマークの実験は、CLEARが常に最先端のレンダリング品質を達成していることを示している。
論文 参考訳(メタデータ) (2026-08-03T13:31:53Z) - Direction-adaptive Mamba: Spatial-Frequency Dual-Domain Collaborative Learning for PolSAR Image Classification [36.750686260055424]
深層学習は偏光合成開口レーダ(PolSAR)の画像分類を支配している。
マンバアーキテクチャは、線形複雑性と強力なグローバルモデリング能力のために、好ましいバックボーンとして機能する。
DA-MambaはPolSAR分類のための双方向協調学習を備えた指向適応型Mambaフレームワークである。
論文 参考訳(メタデータ) (2026-07-26T05:17:07Z) - REAL-OW: Rehearsal-free Open World Object Detection with Low-Rank Adaptation and Dual-Stage Objectness Modeling [56.888597798431704]
Open-World Object Detection (OWOD) では、未確認のオブジェクトを未知のものとして識別し、それを既知のカテゴリのセットにインクリメンタルに組み込む必要がある。
既存のフレームワークは、破滅的な忘れを緩和するために、模範的なリプレイに大きく依存しているが、実際のアプリケーションでは、データアクセス制限との生データ競合を保存し、データ露出のリスクをもたらす。
協調的なアダプタアーキテクチャを通じて段階的な知識を分離する新しいリハーサルフリーフレームワークであるREAL-OWを提案する。
論文 参考訳(メタデータ) (2026-07-03T06:38:54Z) - Multi-AUV Cooperative Target Tracking Based on Supervised Diffusion-Aided Multi-Agent Reinforcement Learning [19.584329065489893]
本稿では,グローバルトレーニングスケジューリング,マルチエージェント調整,ローカル意思決定,リアルタイム実行の4層からなる階層型MARLアーキテクチャを提案する。
1) 分離された経験プールによる非定常性軽減のための構造化経験リプレイによる二重決定アーキテクチャ,2) 拡散モデルの逆復調過程を誘導して収束を加速する高忠実度トレーニングサンプルを生成する教師付き学習機構,3) 行動クローン損失を組み込んだ外乱ロバストなポリシー学習により,高品質なリプレイ動作を導出し,不要なネットワーク更新を実現すること,の3つの革新を特徴とする。
論文 参考訳(メタデータ) (2026-03-31T08:32:32Z) - A Tutorial on ALOS2 SAR Utilization: Dataset Preparation, Self-Supervised Pretraining, and Semantic Segmentation [1.4401311275746886]
ALOS-2単チャネルSAR画像に適用したSimMIMの重み付き版であるSAR-W-SimMIMを紹介する。
本手法は,自己指導型事前訓練におけるスペックルと極度強度値の影響を低減することを目的としている。
SAR-W-MixMAEを用いた前回の試行と比較し,セマンティックセグメンテーションへの影響を検討した。
論文 参考訳(メタデータ) (2026-03-16T11:16:03Z) - Multi-modal Loop Closure Detection with Foundation Models in Severely Unstructured Environments [10.028232479762075]
本稿では,マルチモーダルパイプラインであるMPRFについて述べる。
S3LIデータセットとS3LI Vulcanoデータセットの実験は、MPRFが最先端の検索方法よりも精度が高いことを示している。
SLAMバックエンドに適した解釈可能な対応を提供することにより、MPRFは精度、効率、信頼性の間の良好なトレードオフを達成する。
論文 参考訳(メタデータ) (2025-11-07T16:30:35Z) - Dual-Stage Reweighted MoE for Long-Tailed Egocentric Mistake Detection [85.0189917888094]
本稿では,微妙で頻繁なミスによって生じる課題に対処するため,Dual-Stage Reweighted Mixture-of-Experts (DR-MoE) フレームワークを提案する。
提案手法は,特に稀かつ曖昧な誤りの特定において,高い性能を達成する。
論文 参考訳(メタデータ) (2025-09-16T12:00:42Z) - O2Former:Direction-Aware and Multi-Scale Query Enhancement for SAR Ship Instance Segmentation [0.3611754783778107]
合成開口レーダ(SAR)画像における船舶の船体セグメンテーションは、海上監視、環境分析、国家安全保障などの用途において重要である。
SAR船体画像は、スケール変動、物体密度、ファジィターゲット境界などの課題を示す。
我々は,SAR画像の構造的特徴を十分に活用して,Mask2Formerを拡張したカスタマイズされたインスタンスセグメンテーションフレームワークであるO2Formerを提案する。
論文 参考訳(メタデータ) (2025-06-13T16:06:51Z) - R-Sparse: Rank-Aware Activation Sparsity for Efficient LLM Inference [77.47238561728459]
R-スパース(R-Sparse)は、高度なLCMにおいて高い疎度を達成できる訓練不要なアクティベーション・スパシティ・アプローチである。
10種類のタスクにわたるLlama-2/3およびMistralモデルの実験は、R-Sparseが50%のモデルレベルの間隔で同等のパフォーマンスを達成することを示した。
論文 参考訳(メタデータ) (2025-04-28T03:30:32Z) - Fast and Accurate Gigapixel Pathological Image Classification with Hierarchical Distillation Multi-Instance Learning [51.525891360380285]
HDMILは階層的な蒸留マルチインスタンス学習フレームワークであり、無関係なパッチを排除して高速かつ正確な分類を実現する。
HDMILは、動的マルチインスタンスネットワーク(DMIN)と軽量インスタンスプレスクリーンネットワーク(LIPN)の2つの重要なコンポーネントで構成されている。
論文 参考訳(メタデータ) (2025-02-28T15:10:07Z) - X2-DFD: A framework for eXplainable and eXtendable Deepfake Detection [55.77552681618732]
X2-DFDは、eXplainableおよびeXtendableフレームワークであり、ディープフェイク検出のためのマルチモーダルな多言語モデル(MLLM)に基づいている。
最初の段階であるモデル特徴評価は、MLLMの偽造関係の特徴の検出可能性を体系的に評価する。
2番目のステージであるExplainable dataset Constructionは、Strong Feature StrengtheningとWeak Feature Supplementingの2つの重要なモジュールで構成されている。
3番目のステージであるファインチューニングと推論では、構築されたデータセット上でMLLMを微調整し、最終的な検出と説明のためにデプロイする。
論文 参考訳(メタデータ) (2024-10-08T15:28:33Z) - SARATR-X: Toward Building A Foundation Model for SAR Target Recognition [22.770010893572973]
SAR ATRの基盤モデル構築に向けた最初の試みをSARATR-Xと呼ぶ。
SARATR-Xは、自己教師付き学習(SSL)を通じて一般化可能な表現を学び、汎用的なSARターゲット検出と分類タスクへのラベル効率のモデル適応のための基盤を提供する。
SARATR-Xは0.18Mの未ラベルのSARターゲットサンプルで訓練されており、これは同時代のベンチマークを組み合わせてキュレーションされ、これまでで最大の公開データセットとなっている。
論文 参考訳(メタデータ) (2024-05-15T14:17:44Z) - Heterogeneous Network Based Contrastive Learning Method for PolSAR Land Cover Classification [18.37842655634498]
SL(Supervised Learning)は、高性能を実現するために大量のラベル付きPolSARデータを必要とする。
本稿では,異種ネットワークに基づくコントラスト学習法(HCLNet)を提案する。
ラベルなしのPolSARデータから高レベルな表現を学習し、マルチ機能やスーパーピクセルに応じて数ショットの分類を行う。
論文 参考訳(メタデータ) (2024-03-29T01:05:23Z) - Small Object Detection via Coarse-to-fine Proposal Generation and
Imitation Learning [52.06176253457522]
本稿では,粗粒度パイプラインと特徴模倣学習に基づく小型物体検出に適した2段階フレームワークを提案する。
CFINetは、大規模な小さなオブジェクト検出ベンチマークであるSODA-DとSODA-Aで最先端の性能を達成する。
論文 参考訳(メタデータ) (2023-08-18T13:13:09Z) - A Global Model Approach to Robust Few-Shot SAR Automatic Target
Recognition [6.260916845720537]
ディープラーニングベースのSAR自動ターゲット認識(ATR)モデルをトレーニングするために、クラス毎に数百のラベル付きサンプルを収集できるとは限らない。
この研究は特に数発のSAR ATR問題に対処しており、興味のあるタスクをサポートするためにラベル付きサンプルがわずかである。
論文 参考訳(メタデータ) (2023-03-20T00:24:05Z) - The KFIoU Loss for Rotated Object Detection [115.334070064346]
本稿では,SkewIoU損失とトレンドレベルアライメントを両立できる近似的損失を考案する上で,有効な方法の1つとして論じる。
具体的には、対象をガウス分布としてモデル化し、SkewIoUのメカニズムを本質的に模倣するためにカルマンフィルタを採用する。
KFIoUと呼ばれる新たな損失は実装が容易で、正確なSkewIoUよりもうまく動作する。
論文 参考訳(メタデータ) (2022-01-29T10:54:57Z) - DML-GANR: Deep Metric Learning With Generative Adversarial Network
Regularization for High Spatial Resolution Remote Sensing Image Retrieval [9.423185775609426]
我々は,HSR-RSI検索のためのDML-GANR(Generative Adversarial Network regularization)を用いたディープメトリック学習手法を開発した。
3つのデータセットの実験結果から,HSR-RSI検索における最先端技術よりもDML-GANRの方が優れた性能を示した。
論文 参考訳(メタデータ) (2020-10-07T02:26:03Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。