論文の概要: The Decisive Power of Indecision: Low-Variance Risk-Limiting Audits and Election Contestation via Marginal Mark Recording
- arxiv url: http://arxiv.org/abs/2402.06515v4
- Date: Mon, 17 Jun 2024 18:04:22 GMT
- ステータス: 翻訳完了
- システム内更新日: 2024-06-20 04:15:24.267008
- Title: The Decisive Power of Indecision: Low-Variance Risk-Limiting Audits and Election Contestation via Marginal Mark Recording
- Title(参考訳): 意思決定の決定力:低分散リスク制限監査とマルジナルマーク記録による選挙コンテスト
- Abstract要約: リスクリミット監査(リスクリミット監査、RLA)は、大規模な選挙の結果を検証する技術である。
我々は、効率を改善し、統計力の進歩を提供する監査の新たなファミリーを定めている。
新しい監査は、複数の可能なマーク解釈を宣言できるように、キャストボイトレコードの標準概念を再考することで実現される。
- 参考スコア(独自算出の注目度): 51.82772358241505
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: Risk-limiting audits (RLAs) are techniques for verifying the outcomes of large elections. While they provide rigorous guarantees of correctness, widespread adoption has been impeded by both efficiency concerns and the fact they offer statistical, rather than absolute, conclusions. We attend to both of these difficulties, defining new families of audits that improve efficiency and offer qualitative advances in statistical power. Our new audits are enabled by revisiting the standard notion of a cast-vote record so that it can declare multiple possible mark interpretations rather than a single decision; this can reflect the presence of marginal marks, which appear regularly on hand-marked ballots. We show that this simple expedient can offer significant efficiency improvements with only minor changes to existing auditing infrastructure. We consider two ways of representing these marks, both yield risk-limiting comparison audits in the formal sense of Fuller, Harrison, and Russell (IEEE Security & Privacy 2023). We then define a new type of post-election audit we call a contested audit. These permit each candidate to provide a cast-vote record table advancing their own claim to victory. We prove that these audits offer remarkable sample efficiency, yielding control of risk with a constant number of samples (that is independent of margin). This is a first for an audit with provable soundness. These results are formulated in a game-based security model that specify quantitative soundness and completeness guarantees. These audits provide a means to handle contestation of election results affirmed by conventional RLAs.
- Abstract(参考訳): リスクリミット監査(リスクリミット監査、RLA)は、大規模な選挙の結果を検証する技術である。
正確性に関する厳密な保証を提供する一方で、効率上の懸念と、それらが絶対的な結論ではなく統計的に提供しているという事実の両方によって広く採用が妨げられている。
我々は、これらの困難に両立し、効率を改善し、統計力の質的な進歩を提供する新しい監査の家族を定義します。
我々の新しい監査は、キャスト・ボイト・レコードの標準概念を再考することで、単一の決定ではなく、複数の可能なマーク解釈を宣言できるようにします。
既存の監査インフラにマイナーな変更を加えるだけで、この単純な迅速さによって、大幅な効率改善が実現できることが示される。
リスク制限比較監査はどちらも、Fuller、Harrison、Russell(IEEE Security & Privacy 2023)という形式的な意味で行われます。
次に、競合監査と呼ぶ新しいタイプの選挙後監査を定義します。
これにより、各候補者は、自身の勝利の主張を推し進めるキャスト・ボイト・レコード・テーブルを提供することができる。
これらの監査が顕著なサンプル効率を示し、一定の数のサンプル(マージンとは無関係)でリスクを制御できることを実証する。
これは、証明可能な音のオーディションとしては初めてのものです。
これらの結果は、定量的な音質と完全性を保証するゲームベースのセキュリティモデルで定式化される。
これらの監査は、従来のRSAによって確認された選挙結果のコンテストに対処する手段を提供する。
関連論文リスト
- Manipulation-Proof Oblivious Audits against Deceptive Model Providers [4.614773550999029]
規制の文脈では、監査は通常、宣言または容易に検出され、モデルプロバイダがプロセスを操作することができる。
この脆弱性は、フェアネス評価の文脈では特に深刻である。
本稿では,このような操作の聴取後検出可能性を大幅に向上する新しい監査プロトコルを提案する。
論文 参考訳(メタデータ) (2026-08-05T02:12:54Z) - Fairness Auditing: Lower Bounds on Company Manipulation [4.867679624126028]
フェアネス監査は、雇用、貸与、自動意思決定といった高度なアプリケーションでますます義務付けられている。
最近の研究はブラックボックスフェアネス監査の基本的な不可能な結果を確立している。
有限監査資源の下では避けられない事後操作の程度を定量化する。
論文 参考訳(メタデータ) (2026-08-01T10:11:20Z) - Sequential Fairness Auditing with Limited Output Access [6.933020649563105]
外部評価は、AIシステムのガバナンスの中心になりつつある。
実際には、独立監査人はデプロイされたモデルへのアクセスに制限があり、クエリベースのインタラクションに頼らなければならない。
既存のフェアネス評価手法の多くは、静的データセットと固定サンプル統計検査を前提としている。
モデル出力アクセスの制限下での耐久性を考慮した逐次仮説検定問題としてフェアネス監査を定式化する。
論文 参考訳(メタデータ) (2026-06-29T14:17:33Z) - Sublinear Risk-Limiting Audits from Direct Ballot Selection and Statistical Ballot Manifests [47.94589114324381]
リスクリミット監査(リスクリミット監査、RLA)は、不正な選挙結果が検出されない特定の最大確率を厳格に保証する、選挙後の監査手続きである。
典型的な選挙手続きはバッチサイズに対して自動的に大まかな見積もりを提供するが、わずかに不正確な場合でさえ従来のRLAを無効にする。
信頼できない集計によって報告されるバッチサイズが、事実、正確なマニフェストであり、直接投票選択と呼ばれる新しいRAAのクラスであることを保証する統計的メカニズムを提案する。
論文 参考訳(メタデータ) (2026-05-18T17:12:11Z) - Adaptive auditing of AI systems with anytime-valid guarantees [8.752768302067638]
2つの'重複'の観点から仮説テストフレームワークを導入します。
我々は,オーディタを「賭けによる検証」の実行として形式化し,これは重複するヌル仮説をテストするための同時eプロセスに変換する。
提案手法は, 任意の値の型I誤差制御を維持し, 事前特定試験法より優れており, 統計的に厳密な結論に到達でき, 時には20の観測しか得られない。
論文 参考訳(メタデータ) (2026-05-07T22:33:48Z) - Trust but Verify: Introducing DAVinCI -- A Framework for Dual Attribution and Verification in Claim Inference for Language Models [53.279391576560755]
大規模言語モデル(LLM)は、広範囲のNLPタスクにおいて顕著な流速と汎用性を示してきたが、実際的な不正確さと制限が伴う傾向にある。
これは、信頼と妥当性が最優先される医療、法律、科学コミュニケーションといった、高リスク領域に重大なリスクをもたらす。
LLM出力の事実的信頼性と解釈可能性を高めるために設計されたDAVinCI - Dual Attribution and Verificationフレームワークを紹介する。
論文 参考訳(メタデータ) (2026-04-23T01:37:50Z) - Best Arm Identification with LLM Judges and Limited Human [18.85883540190321]
固定信頼ベストアーム識別(BAI)について検討する。
本研究では,各アームの平均値と逆正当性重み付け残差を結合した平均値の推定器を開発する。
推定器と信頼性シーケンスに基づいて,アームを適応的に選択し,監査するアルゴリズムを提案する。
論文 参考訳(メタデータ) (2026-01-29T09:50:34Z) - Noisy but Valid: Robust Statistical Evaluation of LLMs with Imperfect Judges [14.256638949961063]
これに対応するために、"ノイズだが妥当"な仮説テストフレームワークを導入します。
本フレームワークは,キャリブレーションの不確実性にもかかわらず,有限サンプル型Iエラー制御(正当性)を理論的に保証する。
論文 参考訳(メタデータ) (2026-01-28T18:05:06Z) - Preventing the Collapse of Peer Review Requires Verification-First AI [49.995126139461085]
我々は、真理結合、すなわち、過度に科学的真理をトラックする場所のスコアの厳密さを提案する。
プロキシ・ソブリン評価に向けた相転移を駆動する2つの力の形式化を行う。
論文 参考訳(メタデータ) (2026-01-23T17:17:32Z) - UniAud: A Unified Auditing Framework for High Auditing Power and Utility with One Training Run [9.400936999321415]
データに依存しない監査のための統合フレームワークUniAudを提案する。
データ依存監査のためのUniAud++として、このフレームワークを拡張します。
我々は,O(T)監査の最先端の監査結果と数千ランの監査結果とが一致していることを示す。
論文 参考訳(メタデータ) (2025-07-06T16:35:48Z) - COIN: Uncertainty-Guarding Selective Question Answering for Foundation Models with Provable Risk Guarantees [51.5976496056012]
COINは、統計的に有効な閾値を校正し、質問毎に1つの生成された回答をフィルタリングする不確実性保護選択フレームワークである。
COINはキャリブレーションセット上で経験的誤差率を推定し、信頼区間法を適用して真誤差率に高い確率上界を確立する。
リスク管理におけるCOINの堅牢性,許容回答を維持するための強いテストタイムパワー,キャリブレーションデータによる予測効率を実証する。
論文 参考訳(メタデータ) (2025-06-25T07:04:49Z) - Auditing for Bias in Ad Delivery Using Inferred Demographic Attributes [50.37313459134418]
広告配信のブラックボックス監査において,予測誤差が偏見の監査に与える影響について検討した。
本稿では,広告配信アルゴリズムのスキュー評価において,推測誤差を軽減する手法を提案する。
論文 参考訳(メタデータ) (2024-10-30T18:57:03Z) - Efficient Weighting Schemes for Auditing Instant-Runoff Voting Elections [57.67176250198289]
AWAIREは、適応的に重み付けされたテスト統計量であり、本質的には、テストに有効な仮説のセットを「学習」する。
我々は、より広範囲にスキームと設定を検討し、実践のための効率的な選択を特定し、推奨する。
現在のAWAIRE実装の制限は、少数の候補者に限られている。
論文 参考訳(メタデータ) (2024-02-18T10:13:01Z) - A Brief Tutorial on Sample Size Calculations for Fairness Audits [6.66743248310448]
本チュートリアルでは、フェアネス監査に必要なサブグループサンプルサイズを決定する方法についてのガイダンスを提供する。
本研究は,2値分類モデルと混同行列の要約として導出された多重公平度指標の監査に適用できる。
論文 参考訳(メタデータ) (2023-12-07T22:59:12Z) - TrustFed: A Reliable Federated Learning Framework with Malicious-Attack
Resistance [8.924352407824566]
フェデレートラーニング(FL)は、個々のデータのプライバシを確保しながら、複数のクライアント間で協調的な学習を可能にする。
本稿では,階層型監査に基づくFL(HiAudit-FL)フレームワークを提案する。
シミュレーションの結果、HiAudit-FLは、システムオーバーヘッドを小さくして、潜在的悪意のあるユーザを効果的に識別し、対処できることが示されている。
論文 参考訳(メタデータ) (2023-12-06T13:56:45Z) - Equal Opportunity of Coverage in Fair Regression [50.76908018786335]
我々は、予測の不確実性の下で公正な機械学習(ML)を研究し、信頼性と信頼性のある意思決定を可能にする。
本研究は,(1)類似した結果の異なる集団に対するカバー率が近いこと,(2)人口全体のカバー率が一定水準にあること,の2つの特性を達成することを目的としたカバーの平等機会(EOC)を提案する。
論文 参考訳(メタデータ) (2023-11-03T21:19:59Z) - Binary Classification with Confidence Difference [100.08818204756093]
本稿では,信頼性差分法 (ConfDiff) という,弱教師付き二項分類問題について考察する。
本稿では,この問題に対処するためのリスク一貫性のあるアプローチを提案し,推定誤差が最適収束率と一致することを示す。
また,整合性や収束率も証明されたオーバーフィッティング問題を緩和するためのリスク補正手法も導入する。
論文 参考訳(メタデータ) (2023-10-09T11:44:50Z) - Adaptively Weighted Audits of Instant-Runoff Voting Elections: AWAIRE [61.872917066847855]
即時投票(IRV)選挙の監査方法は、リスク制限や、各投票における投票の電子的記録であるキャスト投票記録(CVR)を必要とするものではない。
我々は,CVRが利用できない場合に,適応的に重み付けされたテストスーパーマーチンガルを用いてITV選挙を効率よく監査するRLA手法を開発した。
論文 参考訳(メタデータ) (2023-07-20T15:55:34Z) - New Algorithms and Applications for Risk-Limiting Audits [4.375873233252245]
リスク制限監査(RLA)は、選挙の正確性に対する信頼性を高める重要なツールである。
この研究は、古典的な(バレエレベルの)RLAをバッチで動作するものに変換するための、Batchcompと呼ばれる新しいジェネリックメソッドを提案する。
本稿では,既存のRLA手法であるALPHAを国勢調査に適用する手法に適用する。
論文 参考訳(メタデータ) (2023-05-06T13:34:39Z) - Auditing Ranked Voting Elections with Dirichlet-Tree Models: First Steps [23.14629947453497]
ランク付けされた投票システムは世界中の多くの場所で使用されている。
フルハンドカウント以外に、STVのリスク制限監査(RLA)手法は知られていない。
本稿では,高次元パラメータを計算的に効率的に扱える統計モデルDirichlet-treeを用いたランキングシステムの監査手法を提案する。
論文 参考訳(メタデータ) (2022-06-29T13:06:42Z) - Individually Fair Learning with One-Sided Feedback [15.713330010191092]
我々は,学習者が正に予測されたインスタンスに対してのみ真のラベルを観察できる,一方的なフィードバックを伴うオンライン学習問題を考察する。
各ラウンドで$k$インスタンスが到着し、学習者が配置したランダム化ポリシーに従って分類結果を受け取る。
そこで我々は,一方的なフィードバックによるオンライン学習の問題から,文脈的半帯域問題に対する公平性違反を報告したパネルを構築。
論文 参考訳(メタデータ) (2022-06-09T12:59:03Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。