論文の概要: Audited Selective Verification for Risk-Controlled N-1 Thermal Contingency Screening under Deployment Shift
- arxiv url: http://arxiv.org/abs/2607.13221v1
- Date: Tue, 14 Jul 2026 19:29:59 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-16 16:39:12.575611
- Title: Audited Selective Verification for Risk-Controlled N-1 Thermal Contingency Screening under Deployment Shift
- Title(参考訳): 配置シフトによるリスク制御N-1温度特異性スクリーニングの聴覚的検証
- Authors: Jayakumar Manoharan,
- Abstract要約: 監査選択検証(Audited Selective Verification)は、あらゆるコントローラの出力に対するリスク予算のスクリーニングとトリアージ層である。
妥当性は、サロゲート精度ではなく、実際の検証と監査にかかっているため、任意のデプロイメントシフトの下で保持される。
最大1354台までの公共送電システムでは、違反率は予算内に留まり、標準決定型および校正型スクリーンはシフト中は安全でない。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Real-time N-1 contingency screening in an energy management system trades assurance against cost: verifying every credible outage with full power flow is too slow, while fast linear-sensitivity screening gives no statistical guarantee and can silently pass unsafe operating points, especially when a controller drives the system into unfamiliar regimes. This paper introduces Audited Selective Verification, a risk-budgeted screening and triage layer for any controller's output (optimization, model-predictive, or learned). A cheap surrogate proposes which outages to skip; an online audit runs full power flow on a small random sample each window; and a calibrated threshold certifies a thermal-violation-rate bound for the skipped set at a chosen budget and confidence, with a corresponding bound for the unverified trusted subset. Validity rests on real verification and the audit rather than on surrogate accuracy, so it holds under arbitrary deployment shift. It is a risk-budgeted screen, not a replacement for deterministic verification when policy requires checking every credible contingency. On three public transmission systems up to 1354 buses, the realized violation rate stays within budget, standard deterministic and calibrated screens become unsafe under shift, and the method cuts full power-flow studies by 29 to 75 percent per real-time operating point.
- Abstract(参考訳): エネルギー管理システムにおけるリアルタイムN-1同時スクリーニングは、コストに対する保証と引き換えに: フルパワーフローで信頼できるすべての障害を検証するのは遅すぎるが、高速な線形感度スクリーニングは統計的保証を与えず、特に制御器が不慣れな状態にシステムを駆動した場合、無防備な動作ポイントを無音で通過させることができる。
本稿では,任意のコントローラの出力(最適化,モデル予測,学習)に対するリスク予算スクリーニングとトリアージ層であるAudited Selective Verificationを紹介する。
安価なサロゲートは、どの障害をスキップするかを提案し、オンライン監査は、各ウィンドウ毎に小さなランダムなサンプルに対して全電力フローを実行し、キャリブレーション閾値は、選択された予算と信頼性でスキップされたセットに対する熱違反率を、未検証の信頼サブセットに対応するバウンドで認定する。
妥当性は、サロゲート精度ではなく、実際の検証と監査にかかっているため、任意のデプロイメントシフトの下で保持される。
リスク予算のスクリーンであり、政策がすべての信頼できる緊急性をチェックする必要がある場合、決定論的検証の代わりにはならない。
1354台までの公共送電システムでは、実現された違反率は予算内に留まり、標準決定性および校正画面はシフト中は安全ではなくなり、リアルタイムの運用ポイント当たり29~75%の電力フロー研究が削減される。
関連論文リスト
- Budgeted Act-or-Defer Multi-Agent LLM Deliberation with Local Reliability Bounds [8.682220907885714]
これを予算化された行動または決定決定として定式化します。
システムは議論のプレフィックスを低次元の状態にマップする。
境界がユーザ指定の信頼性しきい値を超えた場合にのみ作用する。
論文 参考訳(メタデータ) (2026-06-28T23:46:56Z) - Bayesian control for coding agents [63.64172141184361]
本稿では,コーディングエージェントのためのコスト依存型シーケンシャル仮説テストフレームワークを提案する。
ベイズ管制官は、正確性に対する信念を維持し、より多くの証拠を集め、候補者を精査し、検証し、停止するかを決定する。
本研究では, 信頼状態が, 不確実性定量化のためのトークン確率と生ツール・サクセスベースラインを上回り, 解釈可能な正当性スコアを得ることを示す。
論文 参考訳(メタデータ) (2026-06-23T11:41:32Z) - Invisible Manipulation Channels in AI-Assisted Financial Advisory: Implications for Market Integrity and Regulatory Design [2.061257001243159]
本稿では,LLM推論のサンプリング層で動作している目に見えない操作チャネルを実験的に検証する。
この推測段階の操作は統計的に検出が困難であることを示す。
リスクの高い金融AIシステムに対するQRNG認証を必須とする4つの規制改正を提案する。
論文 参考訳(メタデータ) (2026-06-15T02:27:42Z) - False Sense of Safety in Selective Signal Classification: Auditing Bound Tightness and Exchangeability for Risk Control [6.3999417080764225]
分布自由リスク制御による選択的な予測では、キャリブレーションドローに対する信頼度1-deltaでは、受け入れられた入力のエラー率は、ユーザ予算のアルファ値以下である。
我々はこの約束を、機械異常音検出(ASD)とAI生成画像鑑定という信号領域検出器で監査する。
論文 参考訳(メタデータ) (2026-06-13T06:48:50Z) - Drift-to-Action Controllers: Budgeted Interventions with Online Risk Certificates [1.565870461096057]
Drift2Actは、監視を明示的な安全性で制約された意思決定として扱う、ドリフト・ツー・アクションのコントローラである。
ほぼゼロに近い安全違反と、WILDS Camelyon17、DomainNet、および制御された合成ドリフトストリームの適度なコストでの高速回復を実現する。
論文 参考訳(メタデータ) (2026-03-09T16:34:12Z) - Conformal Thinking: Risk Control for Reasoning on a Compute Budget [60.65072883773352]
大規模言語モデル(LLM)の推論により、トークンの予算が増加するにつれて、データセットレベルの精度が向上する。
我々は、予算設定問題をリスクコントロールとして再設定し、計算を最小化しながらエラー率を制限する。
我々のフレームワークは、モデルが自信のあるときに推論を停止する上位しきい値と、未解決のインスタンスを事前に停止させる新しい下位しきい値を導入する。
論文 参考訳(メタデータ) (2026-02-03T18:17:22Z) - Reliable LLM-Based Edge-Cloud-Expert Cascades for Telecom Knowledge Systems [54.916243942641444]
大規模言語モデル(LLM)は、通信などの分野において、自動化の鍵となる存在として浮上している。
本研究では,問合せパイプラインによる意思決定を支援する,エッジクラウドに精通したLLMベースの知識システムについて検討する。
論文 参考訳(メタデータ) (2025-12-23T03:10:09Z) - Audit the Whisper: Detecting Steganographic Collusion in Multi-Agent LLMs [0.0]
Audit the Whisperは、理論、ベンチマーク設計、検出、検証にまたがるカンファレンスグレードの研究成果物である。
i) パラフレーズ, レート制限, 役割置換などの介入が, ペアリングしたKullback-Leibler診断によって定量的なペナルティの操作を課すことを示すチャネル容量分析を行った。
我々は、匿名化された再生スクリプト、匿名化されたマニフェスト、ドキュメントをリリースし、外部監査官がすべての図を再現し、二重盲検要件を満たし、最小限の努力でフレームワークを拡張します。
論文 参考訳(メタデータ) (2025-10-05T17:51:52Z) - COIN: Uncertainty-Guarding Selective Question Answering for Foundation Models with Provable Risk Guarantees [51.5976496056012]
COINは、統計的に有効な閾値を校正し、質問毎に1つの生成された回答をフィルタリングする不確実性保護選択フレームワークである。
COINはキャリブレーションセット上で経験的誤差率を推定し、信頼区間法を適用して真誤差率に高い確率上界を確立する。
リスク管理におけるCOINの堅牢性,許容回答を維持するための強いテストタイムパワー,キャリブレーションデータによる予測効率を実証する。
論文 参考訳(メタデータ) (2025-06-25T07:04:49Z) - Bandit Quickest Changepoint Detection [55.855465482260165]
すべてのセンサの継続的な監視は、リソースの制約のためにコストがかかる可能性がある。
有限パラメータ化確率分布の一般クラスに対する検出遅延に基づく情報理論の下界を導出する。
本稿では,異なる検知オプションの探索と質問行動の活用をシームレスに両立させる,計算効率のよいオンラインセンシング手法を提案する。
論文 参考訳(メタデータ) (2021-07-22T07:25:35Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。