論文の概要: Lottery Tickets Are Not Deployment Tickets
- arxiv url: http://arxiv.org/abs/2607.27031v1
- Date: Wed, 29 Jul 2026 15:25:19 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-30 21:06:25.726317
- Title: Lottery Tickets Are Not Deployment Tickets
- Title(参考訳): ロットティケットはデプロイティケットではない
- Authors: Bum Jun Kim,
- Abstract要約: 我々は、下流決定論理を再構成することなく、精度に適合した宝くじ券または他のスパースチャレンジャーが、既存の高密度モデルを置き換えることができるかどうかを検討する。
実験全体を通して、スパース候補は繰り返し密度参照精度を回復するが、行動学的に異なるままである。
固定閾値ポリシー診断を備えた小さなギャップ設定では、宝くじの交換は受け入れレビュー決定の7%から10%に変化する。
- 参考スコア(独自算出の注目度): 4.230349220081444
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Reports on how sparsification, compression, and lottery tickets change model behavior have been mixed in the prior literature, with beneficial effects observed in some studies and adverse effects in others. Moreover, prior work has not considered actual deployment conditions, where decision logic is already fixed for the incumbent. To assess these mixed findings from a practical standpoint, we study the production-replacement question at the deployment level, namely whether an accuracy-matched lottery ticket or another sparse challenger can replace an incumbent dense model without reconfiguring downstream decision logic. We therefore audit a broad, protocol-specific panel of deployment-relevant behaviors spanning calibration, OOD response, class-level reliability, representations, and downstream policy decisions, and summarize clean-accuracy-excluded deviations with a behavioral-compatibility distance. Across extensive experiments, sparse candidates repeatedly recover dense-reference accuracy yet remain behaviorally different; in several study-band-matched settings, LTs also show lower corruption accuracy. In small-gap settings with fixed-threshold policy diagnostics, lottery-ticket replacement changes 7% to 10% of accept--review decisions. This churn creates precisely the burden that drop-in replacement is meant to avoid: reconfiguring and revalidating downstream decision logic. These findings establish the limits of clean-accuracy certification: Establishing compatibility with a fixed incumbent is distinct from attributing churn uniquely to sparsity or treating every measured deviation as harmful. Our theory explains the routing result: Even exact pointwise top-1 agreement cannot bound fixed-threshold decision changes, and small confidence shifts near the operating boundary can generate first-order routing churn.
- Abstract(参考訳): スパシフィケーション,圧縮,抽選券の変動に関する報告は,従来の文献では混在しており,いくつかの研究では有益な効果がみられ,他の文献では有害な効果がみられている。
さらに、以前の作業では、決定ロジックが既存のものにすでに固定されている実際のデプロイメント条件は考慮されていない。
実運用の観点からこれらの混合結果を評価するため,下流決定論理を再構成することなく,精度に適合した抽選券やスパースチャレンジャーが既存の密集モデルを置き換えることができるかどうかを,展開レベルで検討した。
そこで我々は, キャリブレーション, OOD応答, クラスレベルの信頼性, 表現, 下流政策決定にまたがる, 展開関連行動の広範かつプロトコル固有のパネルを監査し, クリーン・正確性を除く偏差を行動適合距離で要約する。
広範囲にわたる実験を通じて、スパース候補は繰り返し密度参照精度を回復するが、行動学的に異なるままであり、いくつかの研究バンドマッチング環境では、LTは汚職精度も低下する。
固定閾値ポリシー診断を備えた小さなギャップ設定では、宝くじの交換は受け入れ-レビュー決定の7%から10%に変化する。
このチャーンによって、ダウンストリーム決定ロジックを再設定し、再検証する、ドロップイン置換が避けることを意図した、まさに負担が生じる。
固定された既存物との互換性を確立することは、疎外性に独自にチャーンを帰属させることや、測定されたすべての偏差を有害として扱うこととは異なる。
我々の理論は、ルーティング結果を説明する: 正確なポイントワイドトップ1合意でさえ、固定閾値決定の変更を拘束することはできず、操作境界付近の小さな信頼度シフトは、一階のルーティングチャーンを生成することができる。
関連論文リスト
- Conformal Changepoint Localization and Root Cause Analysis with Corrupted Observations [55.76952683833966]
本稿では,データ破損時の信頼性設定サイズを低減するために,重み付きCONCH(W-CONCH)と重み付きCROC(W-CROC)を提案する。
画像ベースおよび実世界の変化点と根本原因ベンチマークの実験は、不確実性ベースの重み付けが信頼性セットのサイズを大幅に減少させることを示している。
論文 参考訳(メタデータ) (2026-07-29T05:16:59Z) - Budgeted Act-or-Defer Multi-Agent LLM Deliberation with Local Reliability Bounds [8.682220907885714]
これを予算化された行動または決定決定として定式化します。
システムは議論のプレフィックスを低次元の状態にマップする。
境界がユーザ指定の信頼性しきい値を超えた場合にのみ作用する。
論文 参考訳(メタデータ) (2026-06-28T23:46:56Z) - How Useful is Causal Invariance for Domain Adaptation in Finite-Sample Settings? [58.740078141879984]
機械学習モデルは、トレーニングされたソースディストリビューションとは異なるターゲットディストリビューションにデプロイされると、しばしば劣化する。
因果関係に基づく領域一般化における最近の研究は、共用因果構造が不変な予測因子を誘導する方法を示している。
本稿では,完全あるいは部分的な因果知識が,教師付きドメイン適応を確実に改善できるかどうかについて検討する。
論文 参考訳(メタデータ) (2026-06-10T21:07:49Z) - Proper Scoring Rules for Agentic Uncertainty Quantification [0.038379177968040606]
Trajectory Proper Score (TPS) は、厳密に適切なトラジェクトリレベルスコアルールの予測非依存のファミリーである。
軌道ECEは分解能が弱いが、スカラー化された軌道ブライアは崩壊したスカラーのみを付与する。
論文 参考訳(メタデータ) (2026-05-23T22:22:00Z) - \mathsf{VISTA}: Decentralized Machine Learning in Adversary Dominated Environments [21.69919643934826]
分散機械学習は、評価などのアウトソーシング計算を信頼できないワーカノードに頼っていることが多い。
本稿では, 相互に整合性がある場合にのみ, 報告を受理し, 報奨するインセンティブ指向の枠組みを通じて, 敵に支配される設定について検討する。
本稿では,最適化履歴を用いた適応アルゴリズムであるmathsfVISTAを提案する。
論文 参考訳(メタデータ) (2026-05-08T15:07:15Z) - Correction and Corruption: A Two-Rate View of Error Flow in LLM Protocols [51.56484100374058]
そこで本研究では,単一プロトコルステップを正確なマッチングタスクで監査するためのペアアウトカム計測インタフェースを提案する。
各インスタンスについて、インターフェースはベースラインの正当性ビットと後ステップの正当性ビットを記録する。
これらのレートは精度の変化を予測し、種、混合物、パイプライン間でテスト可能な再利用可能な経験的インターフェースを定義する。
論文 参考訳(メタデータ) (2026-04-20T13:25:40Z) - Correct Answers from Sound Reasoning: Verifiable Process Supervision for Language Models [94.68358825189738]
本稿では,予測精度と推論品質を協調的に最適化する検証済み領域の学習後フレームワークを提案する。
我々は,エンジン信号に対して推論ステップを確定的に検証できる制御テストベッドであるチェスのVPSを評価する。
VPSは、推論品質を著しく向上させながら精度を保ち、勝利率エラーを最大30%削減し、一貫性をほぼ飽和状態に回復する。
論文 参考訳(メタデータ) (2026-04-03T15:19:46Z) - Partial Causal Structure Learning for Valid Selective Conformal Inference under Interventions [0.0]
ゲノミクスの実験では、交換可能性はしばしば、対象変数を「影響を受けない」ままにしておく介入のサブセットにのみ保持される。
i)「影響のない」キャリブレーション例の誤分類が、明示的な関数$g(,n)$の汚染分数とキャリブレーションセットサイズを介してどのようにカバレッジを劣化させるか、および (ii) 2つの後続指標$Z_a,i=mathbf1iinmathrmdesc(a)$のみを推定するタスク駆動部分因果学習の定式化。
論文 参考訳(メタデータ) (2026-03-02T18:58:22Z) - Conformal Tradeoffs: Guarantees Beyond Coverage [0.02648566468224904]
配置されたコンフォーマル予測器は、有限操作ウィンドウ上で稼働する長期間の意思決定基盤である。
マージのカバレッジは、デプロイメントに直面する量を特定しません。
私たちは、範囲を超えて運用の認証と計画のためのフレームワークを提供しています。
論文 参考訳(メタデータ) (2026-02-20T07:58:25Z) - COIN: Uncertainty-Guarding Selective Question Answering for Foundation Models with Provable Risk Guarantees [51.5976496056012]
COINは、統計的に有効な閾値を校正し、質問毎に1つの生成された回答をフィルタリングする不確実性保護選択フレームワークである。
COINはキャリブレーションセット上で経験的誤差率を推定し、信頼区間法を適用して真誤差率に高い確率上界を確立する。
リスク管理におけるCOINの堅牢性,許容回答を維持するための強いテストタイムパワー,キャリブレーションデータによる予測効率を実証する。
論文 参考訳(メタデータ) (2025-06-25T07:04:49Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。