論文の概要: The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models
- arxiv url: http://arxiv.org/abs/2608.22876v2
- Date: Tue, 25 Aug 2026 04:49:06 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-26 14:09:34.164873
- Title: The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models
- Title(参考訳): Maskはモデルではない - 注意、状態空間、ハイブリッドシーケンスモデルにおける事前修正不変性の検討
- Authors: Taebong Kim, Youngsik Hong, Minsik Kim, Sunyoung Choi, Jaewon Jang, Minseo Kim,
- Abstract要約: ライトウェイトな監査と2つのフォワードパス、トレーニングやグラデーションなし、因果関係が壊れる場所をローカライズするレイヤ毎のスコアを与えます。
192回中8回のチェックポイント試験ではマスク検査では検出されなかったが, 監査では全192/192を正確な層に局在させた。
- 参考スコア(独自算出の注目度): 2.1763040274946337
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Hybrid sequence models must satisfy prefix invariance: representations at position t must not depend on future inputs, yet this is rarely verified. We formalize prefix invariance and give a lightweight audit, two forward passes, no training or gradients, yielding a per-layer score localizing where causality breaks. Attention-mask inspection, the field's default check, is incomplete: causality is a graph-level property, and leaks can occur via scans, aggregations, or normalization despite correct masks. Across 192 injected-fault trials on eight checkpoints, mask inspection detected none, while our audit localized all 192/192 to the exact layer. Static/dynamic analysis of chunked-scan code in transformers found the same defect in Zamba2 and Nemotron-H, an inter-chunk axis error fixed via the reference implementation. The method fits on one page and runs in seconds.
- Abstract(参考訳): ハイブリッドシーケンスモデルはプレフィックス不変性を満たさなければならない: 位置 t での表現は将来の入力に依存してはならないが、これが証明されることは滅多にない。
我々はプレフィックス不変性を定式化し、軽量な監査を行い、2つの前進パス、トレーニングや勾配を行わず、因果関係が壊れる場所を階層ごとのスコアでローカライズする。
フィールドのデフォルトチェックであるアテンションマスク検査は不完全である。因果性はグラフレベルのプロパティであり、正しいマスクにもかかわらず、スキャン、集約、正規化によってリークが発生する可能性がある。
192回以上の検診試験では,マスク検査では検出されなかったが,監査では全192/192を正確な層に局在させた。
変圧器におけるチャンクスキャンコードの静的・動的解析により、Zamba2 と Nemotron-H に同じ欠陥が見つかった。
メソッドは1ページに収まり、数秒で実行される。
関連論文リスト
- Distribution-free false-alarm calibration and chance-corrected spatial evaluation for industrial anomaly detection [2.5273986395975476]
我々は、分布自由な上限値とペア化された最小交差空間テストを組み合わせる。
我々は,3つのISP-ADモダリティと3つの固定データ分割から120個の点欠陥画像上の3つの検出器を評価する。
論文 参考訳(メタデータ) (2026-08-15T07:21:05Z) - Temporal Leakage in LLM Backtesting: Measurement, Validation, and Adjusted Scores [6.428238071336693]
LLMバックテストにおける汚染の標準チェックは非形式的であることを示す。
4つのフラッグシップモデルは、記憶できない質問で失敗します。
受動的バックテストが2つを本当のスキルから切り離すことができないことを証明しています。
論文 参考訳(メタデータ) (2026-08-04T00:45:54Z) - Conformal calibration and look-elsewhere effect in anomaly detection for new-physics searches [0.0]
機械学習による異常検出は、新しい物理学の探索を再構築している。
本稿では,共形予測に基づく校正層を提案する。
論文 参考訳(メタデータ) (2026-06-11T18:00:02Z) - Observation-Aligned Mask Priors for Learning Physical Dynamics from Authentic Occlusions [5.712248310668237]
観測適応マスクプライオリティ(英: Observation-Aligned Mask Priors)は、観測マスクの分布を学習するフレームワークである。
この交叉に基づく分割は、すべての有効次元にクエリされる確率が厳密に正であることを示します。
論文 参考訳(メタデータ) (2026-05-16T05:23:49Z) - Neural Uncertainty Principle: A Unified View of Adversarial Fragility and LLM Hallucination [60.197429875410286]
大規模言語モデルにおける視覚と幻覚の対立的脆弱性は、伝統的に別の問題と見なされている。
損失誘起状態下でのニューラル不確実性原理(NUP)の定式化により, ほぼバウンド状態においては, さらなる圧縮は感度分散の増大を伴うことが判明した。
視覚では、高度に結合したコンポーネントをマスキングすることで、コストのかかる敵の訓練なしに堅牢性を向上させる。
言語では、任意の応答トークンを生成する前に、同じプレフィルステージプローブが幻覚リスクを検出する。
論文 参考訳(メタデータ) (2026-03-20T02:07:10Z) - Hard-normal Example-aware Template Mutual Matching for Industrial Anomaly Detection [78.734927709231]
異常検出器は、クエリー画像の未知の欠陥を検出し、ローカライズするために工業製造で広く使われている。
これらの検出器は異常のないサンプルで訓練され、ほとんどの通常のサンプルと区別された異常を成功させた。
しかし、ハードノーマルな例は、ほとんどの通常のサンプルから遠く離れており、しばしば既存の方法によって異常と誤認される。
論文 参考訳(メタデータ) (2023-03-28T17:54:56Z) - Uncertainty Estimation via Response Scaling for Pseudo-mask Noise
Mitigation in Weakly-supervised Semantic Segmentation [29.464035548191895]
Wakly-Supervised Semantic (WSSS) は、高密度アノテーションの重い負担なしにオブジェクトをセグメント化する。
本研究では,不確実性推定のための予測マップを複数回スケーリングすることで,応答の雑音変化をシミュレートする。
この不確実性は、ノイズの監視信号を緩和するためにセグメンテーション損失の重み付けに使用される。
論文 参考訳(メタデータ) (2021-12-14T14:37:19Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。