論文の概要: PAIR-CI: Calibrated Conditional Independence Testing for Causal Discovery with Incomplete Data
- arxiv url: http://arxiv.org/abs/2605.04838v1
- Date: Wed, 06 May 2026 12:34:37 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-07 18:41:07.813856
- Title: PAIR-CI: Calibrated Conditional Independence Testing for Causal Discovery with Incomplete Data
- Title(参考訳): PAIR-CI: 不完全なデータによる因果発見のための校正条件独立テスト
- Abstract要約: PAIR-CIは非パラメトリック条件独立(CI)テストであり,複数の命令を直接推論手順に統合することによりキャリブレーションを回復する。
確率的に一貫した分散推定器は、クロスバリデーションと多重計算による不確かさを共同で説明する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: The standard constraint-based paradigm for causal discovery with incomplete data -- impute first, test second -- is frequently miscalibrated: any consistent conditional independence (CI) test rejects a true null with probability approaching 1 when imputation error induces spurious conditional dependence. We introduce PAIR-CI, a nonparametric CI test that restores calibration by integrating multiple imputation directly into the inferential procedure via a paired permutation design. PAIR-CI compares cross-validated models that include and exclude the candidate variable while receiving the same imputed conditioning set, forcing imputation error to cancel in their loss difference rather than contaminate the test statistic. A provably consistent variance estimator jointly accounts for uncertainty arising from cross-validation and multiple imputation -- to our knowledge, the first formal unification of these two inferential frameworks. In simulations, existing imputation-based CI tests exhibit false positive rates of 28--45% when data are missing not at random (MNAR), whereas PAIR-CI averages below the nominal 5% level across data-generating processes and missingness mechanisms. These gains are largest in nonlinear settings and grow with causal graph size: when integrated into the PC algorithm, PAIR-CI reduces structural Hamming distance by 8% on 10-variable nonlinear graphs, 15% on 30-variable equivalents, and up to 44% on the 56-variable HAILFINDER network, with stable performance in all settings.
- Abstract(参考訳): 不完全なデータを持つ因果発見のための標準的な制約ベースのパラダイム(第一にインプット、第二にテスト)は、しばしば誤解される: 一貫性のある条件独立(CI)テストは、インプットエラーが突発的な条件依存を引き起こすと、確率が1に近づく真のヌルを拒絶する。
PAIR-CIはパラメトリックなCIテストで、複数の命令をペアの置換設計によって直接推論手順に統合することでキャリブレーションを復元する。
PAIR-CIは、同一のインプット条件セットを受け取りながら候補変数を含意・排除するクロスバリデーションモデルを比較し、インプットエラーはテスト統計を汚染するのではなく、損失差をキャンセルする。
確実な一貫性のある分散推定器は、クロスバリデーションと多重インプットから生じる不確実性を、私たちの知る限り、これら2つの推論フレームワークの最初の公式な統合として、共同で説明します。
シミュレーションでは、既存の計算ベースのCIテストでは、データがランダムに欠けていない場合(MNAR)に28~45%の偽陽性率を示し、一方、PAIR-CIの平均は、データ生成プロセスと欠落メカニズムで名目上の5%以下である。
PCアルゴリズムに統合された場合、PAIR-CIは10変数の非線形グラフにおいて構造ハミング距離を8%削減し、30変数の等価グラフでは15%、56変数のHAILFINDERネットワークでは最大44%削減する。
関連論文リスト
- EDGE: a closed-form directed test for the calibration of probabilistic binary classifiers [0.0]
本稿では,正規確率分類器の校正テストであるEDGEを提案し,ロジスティック回帰法を提案する。
EDGEは、同一のビン付き予測観測テーブルを信頼性図のプロットとして読み出し、その標準化されたビン残差をスムーズなキャリブレーション歪みの小さな前提に投影する。
リンクと特徴の相違により、既定のデフォルトが22のシナリオのうち、19のシナリオで全ての競合するビン付きテストに導かれるか、あるいは結び付けられ、再適合ベースのStukelスコアテストが20%から28%のサンプルで分離される場合、計算可能のままであった。
論文 参考訳(メタデータ) (2026-08-20T19:06:05Z) - Post-Hoc Trajectory-Risk Certification for Modular LLM-Based Security Agents [1.4915002678801434]
ボンフェロニ配置は分布自由であるが,相関誤差下では保守的であることを示す。
粗いラベルの選択は、学習された依存なしにほぼ完璧な相関関係を作ることができる。
ステージ単位の証明書とペアの重なり合うバウンドを用いたモジュール証明書は、正の平均利得が0.6%となる。
論文 参考訳(メタデータ) (2026-08-04T23:48:36Z) - Distributionally Faithful Imputation via Positive Semi-Definite Kernel Density Estimation [55.47411235954028]
マスク観測による密度推定では,不規則に不規則に不規則な計算を行う。
我々は,ニュートン内点法で解ける閉じた形状の辺縁を持つ凸型経験的リスク問題を得る。
結果のPSDインプットモデルでは、同一の入射密度から単一および多重インプットが得られる。
論文 参考訳(メタデータ) (2026-07-08T15:51:05Z) - Fast Nonparametric Conditional Independence Testing via Two-Stage Regression [1.8275108630751837]
本稿では, BLITZ (Broad-to-Local Independence Testing via residualiZation) を導入する。
BLITZは低次回帰を用いて条件集合への広いスムーズな依存を除去し、小さな非線形特徴写像を適用し、これらの特徴を浅い木回帰で残す。
この2段階の設計は,木残基が直面する有効複雑性を低減し,過度な過度な過度なオーバーフィッティングを回避しつつ,浅い木が残留条件-平均バイアスを制御できることを理論的に示す。
論文 参考訳(メタデータ) (2026-06-16T14:55:00Z) - IV-ICL: Bounding Causal Effects with Instrumental Variables via In-Context Learning [11.804716294874018]
IV-ICLは、因果効果の限界後部分布を直接学習し、その量子化として境界を導出するアモータイズされたベイズ内文脈学習法である。
合成および半合成IVベンチマーク上でIV-ICLを評価し,より信頼性が高く,より情報性の高い間隔を生成することを示す。
論文 参考訳(メタデータ) (2026-05-13T03:00:08Z) - The Verification Tax: Fundamental Limits of AI Auditing in the Rare-Error Regime [0.0]
最も引用されているキャリブレーションの結果は、CIFAR-100上での温度スケーリング後のECEの0.012は、統計的ノイズフロアより下である。
モデル誤差率のエプシロンによるキャリブレーション誤差を推定するミニマックスレートは Theta((Lepsilon/m)2/3) であり、推定器が打ち負かせない。
論文 参考訳(メタデータ) (2026-04-14T16:48:24Z) - Beyond the Fold: Quantifying Split-Level Noise and the Case for Leave-One-Dataset-Out AU Evaluation [1.7159330469510958]
クロスバリデーション自体が測定可能な分散をもたらすことを示す。
BP4D+では、3倍の主成分排他的分割を繰り返して、平均F1で平均0.065ドルという経験的なノイズフロアを生成する。
さらに、5つのAUデータセットにわたるLeave-One-Dataset-Outプロトコルを用いて、データセット間のロバスト性を評価する。
論文 参考訳(メタデータ) (2026-04-02T15:28:55Z) - LEC: Linear Expectation Constraints for False-Discovery Control in Selective Prediction and Routing Systems [95.35293543918762]
大規模言語モデル(LLM)はしばしば信頼できない答えを生成するが、不確実性のある手法は誤った予測と完全に区別することができない。
我々は、この問題を、偽発見率(FDR)制御のレンズを通して解決し、全ての許容された予測のうち、エラーの割合が目標のリスクレベルを超えないことを保証する。
本稿では,線形期待制約を強制することで,選択予測を制約付き決定問題として再解釈するLECを提案する。
論文 参考訳(メタデータ) (2025-12-01T11:27:09Z) - A Sample Efficient Conditional Independence Test in the Presence of Discretization [54.047334792855345]
離散化されたデータに直接条件付き独立テスト(CI)は、誤った結論につながる可能性がある。
最近の進歩は、観測データをバイナライズすることで、潜伏変数間の適切なCI関係を推測することを目指している。
そこで本研究では,バイナライゼーションプロセスに依存しないサンプル効率のCIテストを提案する。
論文 参考訳(メタデータ) (2025-06-10T12:41:26Z) - Uncertainty-Calibrated Test-Time Model Adaptation without Forgetting [65.21599711087538]
テスト時間適応(TTA)は、与えられたモデルw.r.t.を任意のテストサンプルに適用することにより、トレーニングデータとテストデータの間の潜在的な分散シフトに取り組むことを目指している。
事前の手法は各テストサンプルに対してバックプロパゲーションを実行するため、多くのアプリケーションに対して許容できない最適化コストがかかる。
本稿では, 有効サンプル選択基準を策定し, 信頼性および非冗長なサンプルを同定する, 効率的なアンチフォッティングテスト時間適応法を提案する。
論文 参考訳(メタデータ) (2024-03-18T05:49:45Z) - Federated Causal Discovery from Heterogeneous Data [70.31070224690399]
任意の因果モデルと異種データに対応する新しいFCD法を提案する。
これらのアプローチには、データのプライバシを保護するために、生データのプロキシとして要約統計を構築することが含まれる。
提案手法の有効性を示すために, 合成および実データを用いた広範囲な実験を行った。
論文 参考訳(メタデータ) (2024-02-20T18:53:53Z) - Model-based causal feature selection for general response types [8.228587135343071]
Invariant causal prediction (ICP) は、不均一な設定からのデータを必要とする因果的特徴選択の手法である。
我々は変換モデル(TRAM)ベースのICPを開発し、連続的、分類的、カウント型、非形式的に検閲された応答を可能にする。
我々は、オープンソースのRパッケージ「tramicp」を提供し、シミュレーションデータに対する我々のアプローチを評価し、重篤な患者の生存の因果的特徴を調査する事例研究を行った。
論文 参考訳(メタデータ) (2023-09-22T12:42:48Z) - Conservative Prediction via Data-Driven Confidence Minimization [70.93946578046003]
機械学習の安全性クリティカルな応用においては、モデルが保守的であることが望ましいことが多い。
本研究では,不確実性データセットに対する信頼性を最小化するデータ駆動信頼性最小化フレームワークを提案する。
論文 参考訳(メタデータ) (2023-06-08T07:05:36Z) - Stable Prediction with Model Misspecification and Agnostic Distribution
Shift [41.26323389341987]
機械学習アルゴリズムでは、2つの主要な仮定が性能を保証するために必要である。
1つは、トレーニングデータと同じ分布からテストデータが引き出され、もう1つは、モデルが正しく指定されていることである。
モデルのミススペクテーションの下では、トレーニングデータとテストデータの間の分布シフトは、パラメータ推定の不正確さと未知のテストデータ間の予測の不安定性をもたらす。
可変デコリレーション正規化器と重み付き回帰モデルとを協調的に最適化する新しいDecororrelated Weighting Regression (DWR)アルゴリズムを提案する。
論文 参考訳(メタデータ) (2020-01-31T08:56:35Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。