論文の概要: How Many Categories Are Enough? Distribution-Free Certification Limits for Few-Shot Anomaly Thresholds
- arxiv url: http://arxiv.org/abs/2610.00236v1
- Date: Wed, 23 Sep 2026 03:24:09 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-03 01:19:23.580385
- Title: How Many Categories Are Enough? Distribution-Free Certification Limits for Few-Shot Anomaly Thresholds
- Title(参考訳): カテゴリはいくつあるか? 数秒の異常な閾値に対する配当不要認定限度
- Abstract要約: 数発の異常検知器はランクメトリクスによって判断されるが、展開には制御された偽警報速度(FAR)のアラームしきい値が必要である。
画像やカテゴリ単位の通常の証拠が、目に見えないカテゴリのしきい値を証明するのにどの程度必要か尋ねる。
目標のみのLeft-one-image-out(LOIO)キャリブレーションは分解能に制限され,シフトフレジブルであることを示す。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Few-shot anomaly detectors are judged by ranking metrics, yet deployment requires an alarm threshold with a controlled false-alarm rate (FAR). We ask how much normal evidence, in images or category units, is needed to certify such a threshold for an unseen category. Using a frozen DINOv2 principal component analysis (PCA) residual ranker on 15 MVTec and 12 VisA categories under four corruption types, we show that target-only leave-one-image-out (LOIO) calibration is resolution-limited and shift-fragile: rank values cannot fall below $1/(k+1)$, and at the attainable level $α=0.20$, empirical FAR reaches 0.341 on Gaussian-corrupted MVTec at $k=4$, 1.7 times the nominal level. A category-count feasibility calculus is then derived: even with all-zero category losses and no multiplicity charged, any deterministic, uniformly valid, distribution-free 95% upper confidence bound (UCB) requires at least 14, 29, and 59 independent and identically distributed (iid) category draws at $α=0.20$, $0.10$, and $0.05$; these counts are necessary but not sufficient. The Cross-category Reliability Estimation with Source Support (CRESS) protocol splits source categories into disjoint reference, proposal, and certification roles. With only three or four certification categories, all 960 frozen configurations return the fail-closed threshold $τ^\star=0$, and the smallest category-level UCB is 0.950. Image-unit analyses of the same archive select positive thresholds in 36.7% to 60.3% of target cells; these bounds hold for the selected source mixture, not for the marginal risk of a new-category draw. The contribution is a quantitative feasibility boundary and an estimand-aware protocol specifying when source evidence can, and cannot, support a transferable reliability claim.
- Abstract(参考訳): 数発の異常検知器はランクの指標によって判断されるが、展開には制御された偽アラームレート(FAR)のアラーム閾値が必要である。
画像やカテゴリ単位の通常の証拠が、目に見えないカテゴリのしきい値を証明するのにどの程度必要か尋ねる。
15 MVTec と 12 VisA の 4 つの汚職型における凍結した DINOv2 主成分分析 (PCA) 残量ランキングを用いて、目標のみの残像除去 (LOIO) キャリブレーションは分解能に制限され、シフトフランジルであることを示す。
圏数計算が導出される: 全ゼロの圏の損失と乗法性がないにもかかわらず、決定論的、一様に有効で、分布自由な95%上の信頼境界(UCB)は、少なくとも14, 29, 59の独立で同一に分散された(iid)圏は、$α=0.20$, $0.10$, $0.05$である。
ソースサポートによるクロスカテゴリ信頼性評価(CRESS)プロトコルは、ソースカテゴリを非結合参照、提案、認定ロールに分割する。
3つまたは4つの認証カテゴリで、凍結された960のすべての構成は、フェールクロースされた閾値$τ^\star=0$を返し、最小のカテゴリレベルのCBは0.950である。
同じアーカイブの画像単位解析では、ターゲット細胞の36.7%から60.3%の正の閾値が選択されている。
コントリビューションは、量的実現可能性境界と、ソースエビデンスがいつ、かつ、転送可能な信頼性クレームをサポートすることができるかを指定する推定対応プロトコルである。
関連論文リスト
- Baszta: Data-Centric Fine-Tuning of a Polish Multi-Label Safety Classifier [0.0]
ポーランドのコンテンツセーフティ分類器を5つのカテゴリにまたがって細調整したアレグロ/ハーバート・ベース・ケースド(124M)を開発した。
我々は,共有分布Gadzi Jzykベンチマークを用いて,ビエリクガード(Sjka)に対する結果モデルの評価を行った。
論文 参考訳(メタデータ) (2026-09-24T09:05:28Z) - Refuse, Decompose, Refresh: A Claim-Safe Protocol for Closed-Loop AI Evaluation [0.39287497907611874]
AI評価は完璧に再現可能であり、いまだに間違った主張を支持している。
3つのアクションを持つクレームセーフプロトコルを提案する。
プロトコルをアグリゲートのみのシミュレータでインスタンス化する。
論文 参考訳(メタデータ) (2026-09-17T15:09:16Z) - Evidential Rule Learning for Interpretable Classification with Abstention [3.0509197593879853]
Fast Evidential Rule Learning (FERL)は、アウトプットが明確である解釈可能な、正確なファジィルールモデルを学ぶ。
FERLの信念、妥当性、および棄権能力は、単一の決定論的パスにおけるファジィなメンバーシップから直接生じる。
論文 参考訳(メタデータ) (2026-08-06T10:39:48Z) - Knowledge Index of Noah's Ark [63.143852586221534]
KINAは,261分野にわたる899項目のベンチマークである。
ボーナス・オン・バートーナメントがFOSDを弱く支配していることを示す。
トップモデルであるGemini-3.1-Pro-Previewは53.17%、Claude-Opus-4.6は49.92%、GPT-5.4は48.55%に達した。
論文 参考訳(メタデータ) (2026-06-03T17:06:49Z) - Instance-Optimal Estimation with Multiple LLM Judges on a Budget [84.31744861038106]
我々は、この問題を*予算付きヘテロスケダティックなマルチジャッジ推定*として定式化する。
K$のプロンプト-レスポンスペア、J$の既知のコストと未知のクエリ-ジャッジ分散が与えられた場合、目標は、$ell_p$-errorを最小化しながら、有界スコアベクトルを推定することである。
EST-IVWEは,予算の低次項までのオラクルIVWEレートと一致していることを示す。
論文 参考訳(メタデータ) (2026-05-22T08:26:08Z) - MEMSAD: Gradient-Coupled Anomaly Detection for Memory Poisoning in Retrieval-Augmented Agents [0.0]
検索強化エージェントに対するメモリ中毒攻撃を,統合評価フレームワークを用いたStackelbergゲームとして定式化する。
ASR-R: 0.25〜1.00$) による攻撃成功度を4倍に向上させる。
私たちの主な貢献は、勾配結合に接地したキャリブレーションに基づく防御であるMEMSADである。
論文 参考訳(メタデータ) (2026-05-05T08:15:41Z) - Budget-Sensitive Discovery Scoring: A Formally Verified Framework for Evaluating AI-Guided Scientific Selection [0.0]
Budget-Sensitive Discovery Score (BSDS)は、各予算レベルで誤った発見を罰する。
Discovery Quality Score (DQS)は、チェリーピックされた予算でうまく機能することで、プロジェクタがインフレできないような、単一のサマリー統計を提供する。
フレームワークは、候補が予算制約と非対称なエラーコストの下で選択される任意の設定に適用されます。
論文 参考訳(メタデータ) (2026-03-12T18:09:53Z) - Adaptive Hierarchical Certification for Segmentation using Randomized Smoothing [87.48628403354351]
機械学習の認証は、特定の条件下では、敵対的なサンプルが特定の範囲内でモデルを回避できないことを証明している。
セグメンテーションの一般的な認証方法は、平らな粒度のクラスを使い、モデルの不確実性による高い断続率をもたらす。
本稿では,複数レベルの階層内で画素を認証し,不安定なコンポーネントに対して粗いレベルに適応的に認証を緩和する,新しい,より実用的な設定を提案する。
論文 参考訳(メタデータ) (2024-02-13T11:59:43Z) - Binary classification with ambiguous training data [69.50862982117127]
教師付き学習では、ドメインの専門家でさえラベル付けが難しい曖昧な(A)サンプルに直面します。
この問題は、ラベルなしサンプルが必ずしも難しいサンプルではないため、半教師付き学習とは大きく異なる。
論文 参考訳(メタデータ) (2020-11-05T00:53:58Z) - Sharp Statistical Guarantees for Adversarially Robust Gaussian
Classification [54.22421582955454]
逆向きに頑健な分類の過剰リスクに対する最適ミニマックス保証の最初の結果を提供する。
結果はAdvSNR(Adversarial Signal-to-Noise Ratio)の項で述べられており、これは標準的な線形分類と逆数設定との類似の考え方を一般化している。
論文 参考訳(メタデータ) (2020-06-29T21:06:52Z) - Generalized Focal Loss: Learning Qualified and Distributed Bounding
Boxes for Dense Object Detection [85.53263670166304]
一段検出器は基本的に、物体検出を密度の高い分類と位置化として定式化する。
1段検出器の最近の傾向は、局所化の質を推定するために個別の予測分岐を導入することである。
本稿では, 上記の3つの基本要素, 品質推定, 分類, ローカライゼーションについて述べる。
論文 参考訳(メタデータ) (2020-06-08T07:24:33Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。