論文の概要: Position: Fairness Failure in Generative Models is an Evaluation Problem
- arxiv url: http://arxiv.org/abs/2608.16974v1
- Date: Mon, 17 Aug 2026 14:41:28 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-19 21:40:53.083854
- Title: Position: Fairness Failure in Generative Models is an Evaluation Problem
- Title(参考訳): 位置: 生成モデルにおけるフェアネスの失敗は評価問題である
- Abstract要約: 本稿では、生成モデルにおける公平性障害は、究極的には評価問題に起因していると論じる。
評価選択を明示する最小限のレポーティングアーティファクトとしてフェアネスカードを提案する。
- 参考スコア(独自算出の注目度): 5.939858158928473
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Despite groundbreaking advancements in generative models during the last decade, concerns about their lack of fairness, reinforcing societal inequalities and harming marginalized groups, remain under-addressed and difficult to act upon. This position paper argues that fairness failures in generative models, albeit driven by multiple factors, are ultimately stemming from an evaluation problem: fairness findings are rarely comparable across papers or actionable for deployment decisions. This paper diagnoses recurring empirical and conceptual failure modes in current practice and motivates a shift from ad-hoc bias checks to standardized, generative-specific evaluation. We propose Fairness Cards as a minimal reporting artifact that makes evaluation choices explicit (prompt families, counterfactual protocols, metrics, and refusal handling) enabling reproducibility, comparability, and accountability. We conclude with additional recommendations towards a paradigm shift in evaluation standards. Our project page can be found at https://mariiavladimirova.github.io/fairness-cards .
- Abstract(参考訳): 過去10年間に生産モデルが画期的な進歩を遂げたにもかかわらず、その公正さの欠如、社会的不平等の強化、疎外化グループへの危害などの懸念は、未成年で行動しにくいままである。
このポジションペーパーでは、生成モデルにおけるフェアネスの失敗は、複数の要因によって引き起こされるが、究極的には評価の問題に起因している、と論じている。
本稿では,現在行われている経験的および概念的障害モードの再発を診断し,アドホックバイアスチェックから標準化された生成特異的評価への転換を動機づける。
フェアネスカードは,評価選択を明示する最小限のレポーティングアーティファクトとして,再現性,可視性,アカウンタビリティを実現するために提案する。
評価基準のパラダイムシフトに向けた追加の勧告で締めくくります。
私たちのプロジェクトページはhttps://mariiavladimirova.github.io/fairness-cards.orgにある。
関連論文リスト
- Moral Safety in LLMs: Exposing Performative Compliance with Puzzled Cues [43.033440772619485]
現在の公正度評価は、道徳的安全性を著しく過大評価していることを示す。
人口統計学的アイデンティティが明示的なラベルとして記載されている場合、モデルは公平に見えるが、同一のアイデンティティを推論しなければならない場合、測定されるほど公平ではない。
本稿では,既存の公正度ベンチマークに追加可能なモデルに依存しないロバスト性指標を提案する。
論文 参考訳(メタデータ) (2026-06-30T13:25:29Z) - To Compare, or Not to Compare: On Methodological Practices in Evaluating Social Bias [61.40435736418359]
異質なベンチマークを標準化する統一的なフレームワークを導入し、孤立した人口統計評価と強制選択比較設定を対比する。
比較設定は、主に不特定文脈によって引き起こされる潜在識別のアグレッシブな触媒として機能することを示す。
最後に、この比較偏見はモデルサイズと正にスケールする一般化された現象であることを示す。
論文 参考訳(メタデータ) (2026-06-23T13:53:50Z) - Do Fair Models Reason Fairly? Counterfactual Explanation Consistency for Procedural Fairness in Credit Decisions [0.0]
既存の結果フェアモデルは、個人に対して根本的に異なる推論を適用可能であることを示す。
本稿では,このバイアスを検出し緩和するフレームワークであるCECを提案する。
主なコントリビューションには、最寄りのカウンターファクト生成方法、統合勾配比較のための修正ベースライン、およびそれに対応するトレーニング損失が含まれる。
論文 参考訳(メタデータ) (2026-05-12T19:54:25Z) - Operationalizing Fairness in Text-to-Image Models: A Survey of Bias, Fairness Audits and Mitigation Strategies [5.336565378315399]
テキスト・ツー・イメージ(T2I)生成モデルは様々な産業で広く採用されているが、社会的ステレオタイプが頻発していることは批判されている。
本稿では,T2Iフェアネス文献の総合的な体系的レビューを行い,既存の研究をバイアスタイプとフェアネス概念の分類学にまとめる。
本稿では, 厳密な目標ベーステストに向けて, 記述的指標を超えて, 公平性を運用するための新たなフレームワークを提案する。
論文 参考訳(メタデータ) (2026-04-15T11:11:39Z) - CDRRM: Contrast-Driven Rubric Generation for Reliable and Interpretable Reward Modeling [61.75914342638658]
CDRRM(Contrast-Driven Reward Model)は、高品質なルーリック生成と優先判断のためのフレームワークである。
この作業は、報酬モデリングのためのスケーラブルで解釈可能で、データ効率のよいパスを提供する。
論文 参考訳(メタデータ) (2026-03-09T07:15:23Z) - From Bias to Balance: Fairness-Aware Paper Recommendation for Equitable Peer Review [1.9029881798999504]
本稿では,学術的品質を向上し,評価することのできる,レビュー後の論文選択のためのフレームワークを提案する。
Fair-PaperRecは、制御された条件下での公正なパラメータの振る舞いを分析して、実際の提出を検証することによって、レビュー後の論文選択のための実践的で株式に焦点を当てたフレームワークを提供し、いくつかの設定では、学術的な品質を向上し、測定することができる。
論文 参考訳(メタデータ) (2026-02-25T21:57:07Z) - A Coin Flip for Safety: LLM Judges Fail to Reliably Measure Adversarial Robustness [57.510025257780306]
既存の検証プロトコルは、レッドチーム固有の分散シフトを考慮できないことを示す。
我々は、より一貫して判断可能な振る舞いのベンチマークであるReliableBenchと、判断失敗を公開するために設計されたデータセットであるJiceStressTestを提案する。
論文 参考訳(メタデータ) (2026-02-04T15:13:35Z) - Where Fact Ends and Fairness Begins: Redefining AI Bias Evaluation through Cognitive Biases [77.3489598315447]
事実と公正の境界を識別することは有意義な公正性評価に不可欠である,と我々は主張する。
Fact-or-Fair は (i) 客観的なクエリを記述的, 事実に基づく判断, (ii) 主観的クエリを規範的, 公平性に基づく判断に整合させたベンチマークである。
論文 参考訳(メタデータ) (2025-02-09T10:54:11Z) - On the Fairness, Diversity and Reliability of Text-to-Image Generative Models [68.62012304574012]
マルチモーダル生成モデルは 信頼性 公正性 誤用の可能性について 批判的な議論を巻き起こしました
埋め込み空間におけるグローバルおよびローカルな摂動に対する応答を解析し、モデルの信頼性を評価するための評価フレームワークを提案する。
提案手法は, 信頼できない, バイアス注入されたモデルを検出し, 組込みバイアスの証明をトレースするための基礎となる。
論文 参考訳(メタデータ) (2024-11-21T09:46:55Z) - Fair Enough: Standardizing Evaluation and Model Selection for Fairness
Research in NLP [64.45845091719002]
現代のNLPシステムは様々なバイアスを示しており、モデル偏見に関する文献が増えている。
本稿では,その現状を解明し,公正学習における意味ある進歩の道筋を立案することを目的とする。
論文 参考訳(メタデータ) (2023-02-11T14:54:00Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。