論文の概要: Towards Standardized Light Field Quality Assessment: Hybrid Subjective Benchmarking and Objective Metric Evaluation
- arxiv url: http://arxiv.org/abs/2607.03494v1
- Date: Fri, 03 Jul 2026 17:03:45 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-07 22:26:29.633114
- Title: Towards Standardized Light Field Quality Assessment: Hybrid Subjective Benchmarking and Objective Metric Evaluation
- Title(参考訳): 照明品質評価の標準化に向けて:ハイブリッドな主観的ベンチマークと客観的メトリクス評価
- Authors: Saeed Mahmoudpour, Mylene C. Q. Farias, Gi-Mun Um, Myllena A. Prado, Ismael Seidel, Leonardo de Sousa Marques, Leonardo Andrade, Shengyang Zhao, Carla L Pagliari,
- Abstract要約: 本稿では、JPEG Pleno標準化活動の文脈で開発された光場QAのための標準化ワークフローを提案する。
このベンチマークは、従来のコーディング専用アーティファクトだけでなく、処理パイプラインで発生する歪みも含むように設計されている。
基準アンコール品質評価と目的のペアワイド精錬を組み合わせ, 微粒化評価を可能にするハイブリッド主観的手法を提案する。
- 参考スコア(独自算出の注目度): 3.966528468818454
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Benchmarking immersive media coding solutions, especially in the standardization context, requires reliable and reproducible subjective quality assessment (QA) procedures, along with objective quality metrics that remain accurate across different distortion types. This paper presents a standardized workflow for light field QA, developed and deployed in the context of JPEG Pleno standardization activities, which integrates benchmark generation, a hybrid subjective evaluation, and objective metric analysis into a common workflow. The benchmark is designed to encompass not only traditional coding-only artifacts but also distortions that arise in processing pipelines in which light field encoding is accompanied with view synthesis and reconstruction techniques. A hybrid subjective method is proposed enabling fine-grained assessment by combining reference-anchored quality rating with targeted pairwise refinement in perceptually ambiguous regions. The reliability of subjective scores is verified using statistical consistency analyses between observers of two cohorts. Finally, a large set of objective metrics is systematically evaluated in terms of global prediction accuracy, local agreement in ambiguous quality regions, and robustness across distortion families. The results show that several metrics achieve strong agreement for coding-only stimuli, but their performance consistently drops when view synthesis distortions are included. The analysis further highlights the importance of view-pooling strategy in the design of future light field quality metrics. The work provides a reproducible and standardization-ready framework for fine-grained light field QA, while identifying key limitations of current objective metrics under emerging coding pipelines. The subjectively annotated dataset is publicly available at https://plenodb.jpeg.org/lfqa/objectivecfp.
- Abstract(参考訳): 没入型メディアコーディングソリューションのベンチマークは、特に標準化の文脈において、信頼性と再現可能な主観的品質評価(QA)の手順と、異なる歪みタイプで正確な客観的な品質指標を必要とする。
本稿では,JPEG Pleno標準化活動の文脈で開発・展開された光場QAの標準化ワークフローについて述べる。
このベンチマークは、従来の符号化専用アーティファクトだけでなく、光場符号化にビュー合成と再構成技術が伴う処理パイプラインに発生する歪みも含むように設計されている。
主観的不明瞭な領域における基準アンコールド品質評価と目的のペアワイズ改良を組み合わせ, きめ細かな評価を可能にするハイブリッド主観的手法を提案する。
主観的スコアの信頼性は,2つのコホートの観測者間での統計的整合性解析を用いて検証した。
最後に,大域的予測精度,不明瞭な品質領域における局所的合意,歪み家族間のロバスト性の観点から,客観的指標の大規模なセットを体系的に評価する。
その結果、いくつかの指標は、符号化のみの刺激に対して強い一致を達成できたが、ビュー合成歪みを含むと、その性能は一貫して低下することがわかった。
この分析は、将来の光場品質指標の設計におけるビュープーリング戦略の重要性をさらに強調している。
この作業は、新しいコーディングパイプラインの下で現在の客観的メトリクスの重要な制限を特定しながら、微粒な光フィールドQAのための再現性と標準化可能なフレームワークを提供する。
主観的な注釈付きデータセットはhttps://plenodb.jpeg.org/lfqa/objectivecfp.orgで公開されている。
関連論文リスト
- EvalVerse: Pipeline-Aware and Expert-Calibrated Benchmarking for Professional Cinematic Video Generation [59.569634087474185]
EvalVerseは包括的でパイプライン対応で、専門家による評価フレームワークです。
まず、専門的な映画制作ワークフローに沿った評価分類にドメイン知識を整理する。
第2に、人間の専門家による判断を、大規模な人的アノテーションによるキュレートされたデータセットに蒸留する。
第3に、専門家による微調整戦略を通じて、この知識を視覚言語モデル(VLM)に注入する。
論文 参考訳(メタデータ) (2026-05-22T06:22:21Z) - K$α$LOS finds Consensus: A Meta-Algorithm for Evaluating Inter-Annotator Agreement in Complex Vision Tasks [4.297070083645049]
本稿では,「ローカライゼーションファースト」の原理を一般化した統一メタアルゴリズムであるK$LOSを提案する。
合意を査定する前に空間対応を解消することにより,複雑な分類問題を名目上の信頼性に変換する。
論文 参考訳(メタデータ) (2026-03-28T08:54:05Z) - TOPO-Bench: An Open-Source Topological Mapping Evaluation Framework with Quantifiable Perceptual Aliasing [10.736029638634504]
トポロジカル一貫性をトポロジカルマップの基本特性として定式化し、ローカライゼーション精度が効率的な代理計量を提供することを示す。
本研究では,環境間の公正な比較を可能にするために,データセットのあいまいさに関する最初の定量的尺度を提案する。
すべてのデータセット、ベースライン、評価ツールは完全にオープンソースであり、トポロジカルマッピングにおける一貫した再現可能な研究を促進する。
論文 参考訳(メタデータ) (2025-10-05T08:58:08Z) - Influence Guided Context Selection for Effective Retrieval-Augmented Generation [23.188397777606095]
Retrieval-Augmented Generation (RAG)は、大きな言語モデル(LLM)の幻覚に対処する。
既存のアプローチは、定義済みのコンテキスト品質評価指標に基づいて、コンテキスト選択によるパフォーマンスの向上を試みる。
我々は、文脈品質評価を推論時データ評価問題として再認識し、文脈影響値(CI値)を導入する。
リストから各コンテキストを除去する際の性能劣化を測定することにより、コンテキスト品質を定量化する。
論文 参考訳(メタデータ) (2025-09-21T07:19:09Z) - Rethinking Evaluation of Infrared Small Target Detection [105.59753496831739]
本稿では,画素レベルと目標レベルのパフォーマンスを取り入れたハイブリッドレベルのメトリクスを導入し,システム的エラー解析手法を提案し,クロスデータセット評価の重要性を強調した。
標準化されたベンチマークを容易にするオープンソースツールキットがリリースされた。
論文 参考訳(メタデータ) (2025-09-21T02:45:07Z) - Exploring Precision and Recall to assess the quality and diversity of LLMs [82.21278402856079]
我々はtextscLlama-2 や textscMistral のような大規模言語モデル (LLM) のための新しい評価フレームワークを提案する。
このアプローチにより、コーパスの整合を必要とせず、生成したテキストの品質と多様性を微妙に評価できる。
論文 参考訳(メタデータ) (2024-02-16T13:53:26Z) - TISE: A Toolbox for Text-to-Image Synthesis Evaluation [9.092600296992925]
単目的と多目的のテキスト・ツー・イメージ合成のための最先端手法の研究を行う。
これらの手法を評価するための共通フレームワークを提案する。
論文 参考訳(メタデータ) (2021-12-02T16:39:35Z) - Towards Question-Answering as an Automatic Metric for Evaluating the
Content Quality of a Summary [65.37544133256499]
質問回答(QA)を用いて要約内容の質を評価する指標を提案する。
提案指標であるQAEvalの分析を通じて,QAに基づくメトリクスの実験的メリットを実証する。
論文 参考訳(メタデータ) (2020-10-01T15:33:09Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。