論文の概要: ERank in Latent Space as an Image-Complexity and Richness Measure
- arxiv url: http://arxiv.org/abs/2607.19315v2
- Date: Thu, 23 Jul 2026 10:08:22 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-24 14:12:06.745002
- Title: ERank in Latent Space as an Image-Complexity and Richness Measure
- Title(参考訳): 画像複雑度とリッチネス測定としての潜時空間のERank
- Authors: Maksim Smirnov, Grigory Kononov, Anastasiia Linich, Egor Surkov, Egor Shvetsov,
- Abstract要約: ERankは、画像がアクティベートするデコチャネル方向の数をカウントし、ノイズ下での動作を含む特性を特徴付ける。
データ選択基準として、低エランクサンプルの除去は超高分解能を改善し、高エランクサンプルの除去はOCRを改善する。
したがって、ERankは安価な信号であり、入力豊かさによってタスクの難易度が制御されるときに便利である。
- 参考スコア(独自算出の注目度): 1.1152530576068411
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We propose the effective rank (ERank) of the channel covariance of an image's deep feature map as a per-sample, label-free measure of visual richness, computed from a single forward pass through a frozen pretrained encoder. ERank counts how many decorrelated channel directions an image activates, and we characterize its properties, including its behavior under noise. Empirically, ERank orders images from plain to visually rich, correlates with codec bitrate, sharpness, and edge density, and correlates with human complexity annotations on IC9600 with $r = 0.72$. As a data-selection criterion, removing low-ERank samples improves super-resolution and removing high-ERank samples improves OCR, in both pretraining and finetuning, while selection does not help classification, segmentation, or denoising. ERank is thus a cheap richness signal, useful exactly when task difficulty is governed by input richness.
- Abstract(参考訳): 本研究では,画像の深部特徴写像のチャネル共分散の有効ランク (ERank) を,凍結した事前学習エンコーダを経由した単一の前方通過から計算した,サンプルごとのラベルなし視覚豊か度測定値として提案する。
ERankは、画像がアクティベートする非相関チャネル方向の数をカウントし、ノイズ下での動作を含む特性を特徴付ける。
経験的に、ERankはプレーンから視覚的にリッチなイメージを注文し、コーデックビットレート、シャープネス、エッジ密度と相関し、IC9600上の人間の複雑性アノテーションと相関し、$r = 0.72$である。
データ選択基準として、低エランクサンプルの除去は超分解能を改善し、高エランクサンプルの除去は事前訓練と微調整の両方においてOCRを改善し、選択は分類、分節化、および復調の助けにならない。
したがって、ERankは安価なリッチネス信号であり、入力リッチネスによってタスクの難易度が制御されるときに正確に有用である。
関連論文リスト
- Enhancing Visual Re-ranking through Denoising Nearest Neighbor Graph via Continuous CRF [17.05978491184936]
近近辺(NN)グラフに基づく視覚的再ランクは,検索精度向上のための強力なアプローチとして浮上している。
しかし、NNグラフに基づく再ランク付けの有効性は、エッジ接続の品質に制約されている。
本研究では,連続条件付ランダム場に基づく補的記述法を提案する。
論文 参考訳(メタデータ) (2024-12-18T14:16:40Z) - A Robust Multisource Remote Sensing Image Matching Method Utilizing Attention and Feature Enhancement Against Noise Interference [15.591520484047914]
本稿では,ノイズ干渉に対する注意と特徴強調を利用した,頑健なマルチソースリモートセンシング画像マッチング手法を提案する。
第1段階では、深い畳み込みと変圧器の注意機構を組み合わせることで、密集した特徴抽出を行う。
第2段階では、二項分類機構に基づく外乱除去ネットワークを導入する。
論文 参考訳(メタデータ) (2024-10-01T03:35:34Z) - Learning semantic image quality for fetal ultrasound from noisy ranking
annotation [7.078132778424183]
画像品質がセマンティック要件に依存するアプリケーションに対して,セマンティックな画像品質の概念を導入する。
画像のセマンティックな画質に基づいて画像のランク付けを行い、予測されたランク付けを不確実な推定で達成する頑健な粗大度モデルの設計を行う。
我々は,胎児超音波品質評価課題において,我々のランク付けアルゴリズムと最先端のランク付けアルゴリズムを比較した。
論文 参考訳(メタデータ) (2024-02-13T08:48:16Z) - Adaptive Feature Selection for No-Reference Image Quality Assessment by Mitigating Semantic Noise Sensitivity [55.399230250413986]
上流タスクから有害なセマンティックノイズを除去するためのQFM-IQM(Quality-Aware Feature Matching IQA Metric)を提案する。
提案手法は,8つの標準IQAデータセット上での最先端NR-IQA法よりも優れた性能を実現する。
論文 参考訳(メタデータ) (2023-12-11T06:50:27Z) - Advancing Unsupervised Low-light Image Enhancement: Noise Estimation, Illumination Interpolation, and Self-Regulation [55.07472635587852]
低光画像強調(LLIE)技術は、画像の詳細の保存とコントラストの強化に顕著な進歩をもたらした。
これらのアプローチは、動的ノイズを効率的に緩和し、様々な低照度シナリオを収容する上で、永続的な課題に直面する。
まず,低照度画像の雑音レベルを迅速かつ高精度に推定する方法を提案する。
次に、照明と入力の一般的な制約を満たすために、Learningable Illumination Interpolator (LII) を考案する。
論文 参考訳(メタデータ) (2023-05-17T13:56:48Z) - Deep Semantic Statistics Matching (D2SM) Denoising Network [70.01091467628068]
本稿では,Deep Semantic Statistics Matching (D2SM) Denoising Networkを紹介する。
事前訓練された分類ネットワークの意味的特徴を利用して、意味的特徴空間における明瞭な画像の確率的分布と暗黙的に一致させる。
識別画像のセマンティックな分布を学習することで,ネットワークの認知能力を大幅に向上させることを実証的に見出した。
論文 参考訳(メタデータ) (2022-07-19T14:35:42Z) - Embedding contrastive unsupervised features to cluster in- and
out-of-distribution noise in corrupted image datasets [18.19216557948184]
Web画像検索に検索エンジンを使用することは、イメージデータセットを作成する際の手作業によるキュレーションに代わる誘惑的な手段である。
主な欠点は、回収された間違った(ノイズの多い)サンプルの割合である。
本稿では,教師なしのコントラスト特徴学習を用いた検出ステップから始める2段階のアルゴリズムを提案する。
比較学習のアライメントと均一性原理により,OODサンプルは単位超球面上のIDサンプルから線形に分離できることがわかった。
論文 参考訳(メタデータ) (2022-07-04T16:51:56Z) - Semantic similarity metrics for learned image registration [10.355938901584565]
画像登録のための意味的類似度尺度を提案する。
このアプローチは、学習に基づく登録モデルの最適化を促進するデータセット固有の特徴を学習する。
自動エンコーダを用いた非監視的アプローチと、補助セグメンテーションデータを用いた半監督的アプローチの両方をトレーニングし、画像登録のための意味的特徴を抽出します。
論文 参考訳(メタデータ) (2021-04-20T15:23:58Z) - Attention-Aware Noisy Label Learning for Image Classification [97.26664962498887]
大規模ラベル付きサンプルで学習した深層畳み込みニューラルネットワーク(CNN)は、コンピュータビジョンにおいて顕著な進歩を遂げている。
大量のラベル付きビジュアルデータを取得する最も安価な方法は、Flickrのようなユーザーが提供するラベルでウェブサイトからクロールすることである。
本稿では,潜在的なラベルノイズのあるデータセットに基づいて学習したネットワークの識別能力を向上させるために,注目に敏感なラベル学習手法を提案する。
論文 参考訳(メタデータ) (2020-09-30T15:45:36Z) - ADRN: Attention-based Deep Residual Network for Hyperspectral Image
Denoising [52.01041506447195]
ノイズの多いHSIからクリーンなHSIへのマッピングを学習するために,注目に基づくディープ残差ネットワークを提案する。
実験の結果,提案手法は定量的および視覚的評価において最先端の手法よりも優れていた。
論文 参考訳(メタデータ) (2020-03-04T08:36:27Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。