論文の概要: ALIVE: Warnings Before Exclusion in Budgeted Multi-Source Learning
- arxiv url: http://arxiv.org/abs/2607.29400v1
- Date: Fri, 31 Jul 2026 13:18:47 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-03 16:35:22.231831
- Title: ALIVE: Warnings Before Exclusion in Budgeted Multi-Source Learning
- Title(参考訳): ALIVE:予算のかかるマルチソース学習における排除前の警告
- Authors: Xiyang Zhang, Hongzhi Wang, Yuanhe Tian,
- Abstract要約: ルーティング決定は次のトランザクションで修正可能だが、遅延ソースの除外は後続の判断で継続される。
我々は,有限人口監査と学習が予算を共有している場合,不平等なパーシステンス行動を認める証拠を問う。
- 参考スコア(独自算出の注目度): 18.17400877167872
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: A routing decision can be revised at the next transaction, but a latched source exclusion persists across later decisions. We ask what evidence should authorize these unequal-persistence actions when finite-population auditing and learning share a budget. ALIVE (Action-Layered Intervention via Evidence) is an auditable control layer: one randomized without-replacement prefix supplies cached evidence, heuristic warnings drive non-latching floor-bounded routing, and only two fresh simultaneous certificate separations may latch an exclusion request subject to capacity-feasible activation. Conditional on fixed support and labels under an ideal uniform audit permutation, any predictable controller preserving this interface inherits an anytime familywise bound of δon acting against a source that fails the pre-fixed absolute or relative strict-majority-disagreement predicate. With a published known-size, all-strict-majority PPR engine, median evidence count fell from 304 to 96 identities in e40 and from 171 to 62 in e60, while both engines used 48 in e80. In the matched CIFAR controller, the persistent-action layer added +0.1935 accuracy-AUBC percentage points over routing-only in all ten paired seed clusters. The +0.1954-point full-system contrast against CBR was also positive but did not meet the predeclared multiplicity-adjusted criterion (conditional Holm-adjusted sign-flip reference value =.097656). On a fixed natural panel, exploratory PPR used a median closure prefix of 95 rather than 105 for exploratory Serfling/FPC, but still exposed 88.0% of the panel and had no downstream task. Together these results map a restraint--power--cost--utility boundary: the action contract controls a defined persistent decision, while net value depends on evidence margin, audit cost, and budget regime.
- Abstract(参考訳): ルーティング決定は次のトランザクションで修正可能だが、遅延ソースの除外は後続の判断にまたがって継続する。
有限人口監査と学習が予算を共有している場合に、これらの不平等なパーシステンス行為を承認する証拠を問う。
ALIVE (Action-Layered Intervention via Evidence) は監査可能な制御層であり、1つのランダム化された非置換プレフィックスはキャッシュされた証拠を供給し、ヒューリスティックな警告は非ラッチなフロアバウンドルーティングを駆動し、2つの新しい同時証明書分離だけがキャパシティ実現可能なアクティベーションを受けることができる。
理想的な均一な監査順応の下で、固定されたサポートとラベルを条件として、このインターフェースを保存する予測可能なコントローラは、事前に固定された絶対値または相対的な厳密な値の不一致述語に反するソースに対して、δonの家族的に束縛された任意の境界を継承する。
e40では304個から96個に、e60では171個から62個に、両エンジンは48個に落ち込んだ。
一致したCIFARコントローラでは、永続的なアクション層は、全10ペアのシードクラスタでルーティングのみに+0.1935の精度-AUBCのパーセンテージを付加した。
CBRに対する+0. 1954点フルシステムコントラストも正であったが、事前宣言された多重度調整基準(条件付きホルム調整符号-フリップ基準値 =.097656)を満たしていなかった。
固定された自然パネルでは、探索型PPRはサーフリング/FPCの105ではなく95の中央値のクロージャプレフィックスを使用していたが、それでもパネルの88.0%を露出し、下流のタスクは無かった。
アクション契約は定義された永続的な決定を制御し、純価値はエビデンスマージン、監査コスト、予算体系に依存します。
関連論文リスト
- Level, Sharpness, and Corpus: Why Zero-Shot OOD Detector Rankings Do Not Transfer [36.02174685737611]
各検出器は、少なくとも1つのドメインで80%$ FPR95 を超え、所望の検出器は、分配データと基礎となる VLM の両方に依存する。
本稿では, ベース検出器, レベル, シャープネスの非補償融合により, 補完的証拠を保存する検出器非依存ラッパーであるComplementary Evidence Guard(CEG)を紹介する。
論文 参考訳(メタデータ) (2026-07-29T08:00:49Z) - Looping Is Not Reliability: State-Bound Evidence and Typed Revision Contracts for Agentic Code Repair [36.56438114281786]
正しいパッチの発見と保持、検証、提出のギャップについて検討する。
我々はエビデンスバウンド型ループ契約を導出し、その機械的に強制可能なサブセットを参照実装でインスタンス化する。
論文 参考訳(メタデータ) (2026-07-27T16:05:23Z) - Constrained Path Reasoning: Measuring When Committed Stages Earn Their Cost [2.9867974725783113]
Constrained Path Reasoning (CPR)は、ソース認識パス仮説とステージレベルの会計とをペアリングする。
CPRは、タスク互換のコミットメントは、移行を分解し、候補の質量を集中し、正規性を誘導し、そのゲインが宣伝されたエラーや実行コストを超えたときにフィードバックを公開することができると予測している。
論文 参考訳(メタデータ) (2026-07-19T13:11:18Z) - Beyond Logprobs: A Multi-Signal Confidence Engine for LLM-Based Document Field Extraction [2.1997815944423516]
ExtractConfはクロスドメインでフィールドに依存しない信頼性エンジンである。
同じ文書の2つの構造的に異なる読影において、信頼度を推定する。
0.928ROC AUCを達成し、logprob-meanよりも選択的な予測リスクを70%削減する。
論文 参考訳(メタデータ) (2026-06-23T10:58:08Z) - Cherry-pick Override: Unsafe Directional Commitment in LLM Judges under Mixed Evidence [14.905172804386973]
我々は、検証生成とコミットメント承認を分離する外部コミットメント制御層を論じる。
我々はCCOを明示的なタスク契約で定義し、同一のデノミネータ診断プロトコルで報告する。
論文 参考訳(メタデータ) (2026-06-05T20:51:51Z) - Auditable Decision Models with Learned Abstention and Real-Time Steering [6.287457666346811]
生産AIシステムは、不完全、矛盾、あるいは不十分な証拠で運用されることが多い。
我々は,不確実性が明確でなければならないAIシステムの運用上の決定制御について検討する。
本稿では,YES,NO,TBDを予測する境界決定制御モデルであるEvaluatorDPTを提案する。
論文 参考訳(メタデータ) (2026-05-26T23:37:56Z) - Counterfactual Likelihood Tests for Indirect Influence in Private Reasoning Channels [51.56484100374058]
本稿では,私的推論チャネル間の影響を測定するための実証実験について述べる。
この方法は、上流のプライベートブロックを長さマッチングドナーブロックに置き換え、公開トークンシーケンスと下流ターゲットを固定し、下流ターゲットの負のログに似たシフトを測定する。
論文 参考訳(メタデータ) (2026-05-18T20:27:43Z) - Distributional Energy-Based Models for Uncertainty-Aware Structured LLM Reasoning [40.342912574072024]
大規模言語モデルは、旅行計画やコードソリューションのような構造化されたアウトプットを生成する。
個々の推論ステップは正しく見えるが、アウトプット全体が予算に違反したり、テストケースに失敗したり、あるいは以前の推論に矛盾することがある。
構造化LCM出力の検証のための決定論的解析制約付き学習品質スコアラを提案する。
論文 参考訳(メタデータ) (2026-05-15T17:08:27Z) - Adaptive Consensus in LLM Ensembles via Sequential Evidence Accumulation: Automatic Budget Identification and Calibrated Commit Signals [0.0]
DASEは、ベンチマークをまたいで一般化するコミット型ルーティングパーティションを生成する。
インジェクション帯域ではなく、適応的な停止が正確さを駆動する。
インジェクションベースの手法は、逆Uの精度-vs-推論軌道を示す。
論文 参考訳(メタデータ) (2026-05-05T19:24:10Z) - Affordance Agent Harness: Verification-Gated Skill Orchestration [45.231685718099264]
Affordance groundingは、オープンワールドのシーンでエージェントがどこでどのように対話すべきかを特定する必要がある。
本稿では,エビデンスストアとコストコントロールを備えたクローズドループランタイムであるAffordance Agent Harnessを提案する。
論文 参考訳(メタデータ) (2026-05-01T13:45:16Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。