論文の概要: Sequential Audit Sampling with Statistical Guarantees
- arxiv url: http://arxiv.org/abs/2604.06116v1
- Date: Tue, 07 Apr 2026 17:26:23 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-08 17:42:09.964921
- Title: Sequential Audit Sampling with Statistical Guarantees
- Title(参考訳): 統計的保証者によるシークエンシャルオーディストサンプリング
- Abstract要約: 本研究は, 有限個体群を対象とした逐次的な検査問題として, 追加の逐次収集項目を用いた監査サンプリングを定式化した。
偏差率でヌル仮説と代替仮説を定義し、停止規則と決定規則を定め、有限人口誤差確率で正確な逐次境界条件を定式化する。
正確な設計は、決定エラー確率を極端に制御し、シミュレーションベースの実装は、期待される停止時間の計算を可能にしながら、その設計を近似する。
- 参考スコア(独自算出の注目度): 6.101839518775968
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: Financial statement auditing is conducted under a risk-based evidence approach to obtain reasonable assurance. In practice, auditors often perform additional sampling or related procedures when an initial sample does not provide a sufficient basis for a conclusion. Across jurisdictions, current standards and practice manuals acknowledge such extensions, while the statistical design of sequential audit procedures has not been fully explored. This study formulates audit sampling with additional, sequentially collected items as a sequential testing problem for a finite population under sampling without replacement. We define null and alternative hypotheses in terms of a tolerable deviation rate, specify stopping and decision rules, and formulate exact sequential boundary conditions in terms of finite-population error probabilities. For practical implementation, we calibrate those boundaries by Monte Carlo simulation at least-favorable deviation rates. The exact design yields ex ante control of decision error probabilities, and the simulation-based implementation approximates that design while allowing the computation of expected stopping times. The framework is most naturally suited to attribute auditing and deviation-rate auditing, especially tests of controls, and it can be extended to one-sided, two-stage, and truncated designs.
- Abstract(参考訳): ファイナンシャルステートメント監査は、合理的な保証を得るためにリスクベースのエビデンスアプローチの下で実施される。
実際には、初期サンプルが結論の十分な基礎を提供していない場合、監査人は追加のサンプリングや関連する手順を行うことが多い。
法域全体にわたって、現在の基準と実践マニュアルは、このような拡張を認めているが、シーケンシャルな監査手順の統計設計は、完全には検討されていない。
本研究は, 有限個体群を対象とした逐次的な検査問題として, 追加の逐次収集項目を用いた監査サンプリングを定式化した。
我々は、許容偏差率の観点からヌルおよび代替仮説を定義し、停止および決定規則を規定し、有限人口誤差確率の観点から正確な逐次境界条件を定式化する。
実際に実装するために、モンテカルロシミュレーションによりこれらの境界を少なくとも良好な偏差率で校正する。
正確な設計は、決定エラー確率を極端に制御し、シミュレーションベースの実装は、期待される停止時間の計算を可能にしながら、その設計を近似する。
このフレームワークは、特に制御の試験において、監査と逸脱率監査の属性に最も適しており、片面、二段、切り離した設計にまで拡張することができる。
関連論文リスト
- Local Violation Certification for Linear Predict-Then-Optimize Pipelines [0.0]
入力不確実性下での線形決定パイプラインに特化して設計された局所的違反認定のための枠組みを提案する。
我々は,標準サンプリング手法が稀な違反に対して効率よく失敗することを数学的に証明し,直接的な構造的アプローチの動機付けを行う。
我々は,排出規制の対象となる経済力派遣システムへのアプローチを実証し,正確な監査可能なリスク評価を提供する。
論文 参考訳(メタデータ) (2026-08-05T05:58:06Z) - Sequential Fairness Auditing with Limited Output Access [6.933020649563105]
外部評価は、AIシステムのガバナンスの中心になりつつある。
実際には、独立監査人はデプロイされたモデルへのアクセスに制限があり、クエリベースのインタラクションに頼らなければならない。
既存のフェアネス評価手法の多くは、静的データセットと固定サンプル統計検査を前提としている。
モデル出力アクセスの制限下での耐久性を考慮した逐次仮説検定問題としてフェアネス監査を定式化する。
論文 参考訳(メタデータ) (2026-06-29T14:17:33Z) - Adaptive auditing of AI systems with anytime-valid guarantees [8.752768302067638]
2つの'重複'の観点から仮説テストフレームワークを導入します。
我々は,オーディタを「賭けによる検証」の実行として形式化し,これは重複するヌル仮説をテストするための同時eプロセスに変換する。
提案手法は, 任意の値の型I誤差制御を維持し, 事前特定試験法より優れており, 統計的に厳密な結論に到達でき, 時には20の観測しか得られない。
論文 参考訳(メタデータ) (2026-05-07T22:33:48Z) - Bridging Conformal Prediction and Scenario Optimization: Discarded Constraints and Modular Risk Allocation [0.0]
本稿では,システム・アンド・コントロールの観点から,その接続を直接検討する。
ブロックワイドキャリブレーション証明書を1つのジョイント保証に組み合わせた,単純なモジュラ構成規則を導入する。
論文 参考訳(メタデータ) (2026-03-19T18:37:58Z) - Data Fusion with Distributional Equivalence Test-then-pool [5.5945020319921435]
既存のテスト-then-pool (TTP) 手順は、歴史的および同時試行間の制御結果の平等性をテストすることでこの問題に対処する。
我々は,最終治療効果試験のType-Iエラー率を厳格に制御しながら,制御アームを融合する新しいTTPフレームワークを開発した。
論文 参考訳(メタデータ) (2026-03-12T12:38:35Z) - Predicting fixed-sample test decisions enables anytime-valid inference [0.3222802562733787]
我々は,任意の固定サンプル仮説テストから任意の有意なテストに変換する簡単な手順を導入する。
我々は、null仮説が偽である場合に、かなりのサンプル貯蓄でType-Iエラー制御と準最適パワーを確保する。
臨床試験などの分野では、早期に安全に停止することで、患者が最高の治療を受けられるようにし、効果的な治療法の開発を加速することができる。
論文 参考訳(メタデータ) (2026-02-14T20:17:51Z) - COIN: Uncertainty-Guarding Selective Question Answering for Foundation Models with Provable Risk Guarantees [51.5976496056012]
COINは、統計的に有効な閾値を校正し、質問毎に1つの生成された回答をフィルタリングする不確実性保護選択フレームワークである。
COINはキャリブレーションセット上で経験的誤差率を推定し、信頼区間法を適用して真誤差率に高い確率上界を確立する。
リスク管理におけるCOINの堅牢性,許容回答を維持するための強いテストタイムパワー,キャリブレーションデータによる予測効率を実証する。
論文 参考訳(メタデータ) (2025-06-25T07:04:49Z) - SConU: Selective Conformal Uncertainty in Large Language Models [59.25881667640868]
SconU(Selective Conformal Uncertainity)と呼ばれる新しいアプローチを提案する。
我々は,特定の管理可能なリスクレベルで設定されたキャリブレーションの不確実性分布から,与えられたサンプルが逸脱するかどうかを決定するのに役立つ2つの共形p値を開発する。
我々のアプローチは、単一ドメインと学際的コンテキストの両方にわたる誤発見率の厳密な管理を促進するだけでなく、予測の効率を高める。
論文 参考訳(メタデータ) (2025-04-19T03:01:45Z) - Conformal Generative Modeling with Improved Sample Efficiency through Sequential Greedy Filtering [55.15192437680943]
生成モデルは出力に対する厳密な統計的保証を欠いている。
厳密な統計的保証を満たす予測セットを生成する逐次共形予測法を提案する。
このことは、高い確率で予測セットが少なくとも1つの許容可能な(または有効な)例を含むことを保証している。
論文 参考訳(メタデータ) (2024-10-02T15:26:52Z) - Few-Shot Scenario Testing for Autonomous Vehicles Based on Neighborhood Coverage and Similarity [8.97909097472183]
大規模展開の前には、自律走行車(AV)の安全性能の試験と評価が不可欠である。
特定のAVに対して許容されるテストシナリオの数は、テスト予算と時間に対する厳格な制約によって著しく制限されています。
フェーショットテスト(FST)問題が初めてこの問題を定式化し、この問題に対処するための体系的なフレームワークを提案する。
論文 参考訳(メタデータ) (2024-02-02T04:47:14Z) - Sequential Predictive Two-Sample and Independence Testing [114.4130718687858]
逐次的非パラメトリック2サンプルテストと独立テストの問題点について検討する。
私たちは賭けによる(非パラメトリックな)テストの原則に基づいています。
論文 参考訳(メタデータ) (2023-04-29T01:30:33Z) - Near-Optimal Non-Parametric Sequential Tests and Confidence Sequences
with Possibly Dependent Observations [44.71254888821376]
我々は、一般的な非データ生成プロセスの下で、最初のタイプIエラーと予測リジェクション時間保証を提供する。
本研究では, 平均処理効果など, 方程式を推定することによって定義されるパラメータの推測に, 結果を適用する方法を示す。
論文 参考訳(メタデータ) (2022-12-29T18:37:08Z) - Sequential Kernelized Independence Testing [77.237958592189]
我々は、カーネル化依存度にインスパイアされたシーケンシャルなカーネル化独立試験を設計する。
シミュレーションデータと実データの両方にアプローチのパワーを実証する。
論文 参考訳(メタデータ) (2022-12-14T18:08:42Z) - Shortcomings of Top-Down Randomization-Based Sanity Checks for
Evaluations of Deep Neural Network Explanations [67.40641255908443]
モデルランダム化に基づく正当性チェックの限界を,説明書の評価のために同定する。
トップダウンモデルランダム化は、フォワードパスアクティベーションのスケールを高い確率で保存する。
論文 参考訳(メタデータ) (2022-11-22T18:52:38Z) - Stopping Criterion Design for Recursive Bayesian Classification:
Analysis and Decision Geometry [11.399206131178104]
本稿では, 後進状態に関する幾何学的解釈を提案する。
状態後部の最大値を超える信頼しきい値が硬さに悩まされていることを示す。
そこで我々は,その限界を克服するための幾何学的洞察を持つ新しい停止・終了基準を提案する。
論文 参考訳(メタデータ) (2020-07-30T16:21:10Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。