論文の概要: Where the Numbers Come From: Auditing Evaluation in Provenance-Based Intrusion Detection
- arxiv url: http://arxiv.org/abs/2609.33532v1
- Date: Sun, 27 Sep 2026 13:01:02 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-05 15:58:15.762161
- Title: Where the Numbers Come From: Auditing Evaluation in Provenance-Based Intrusion Detection
- Title(参考訳): 数値がどこから来るか:前向きな侵入検知における評価の監査
- Abstract要約: 証明に基づく侵入検知器のスコアを再現しても、そのアラームの出力やエンコーダが使用する情報についてそのスコアが何を言っているかは定かでない。
我々は、リリースした9つの実装を監査し、独自のコードを使用して4つの検出器を実行し、3つの測定効果を分離する。
- 参考スコア(独自算出の注目度): 42.49426058823369
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Reproducing a provenance-based intrusion detector's score does not establish what that score says about its emitted alarms or the information its encoder uses. We audit nine released implementations, execute four detectors using their own code, and isolate three measurement effects. First, a fixed-alert comparison separates label choice from neighbourhood credit: ThreaTrace reports precision 0.938 with neighbourhood credit, although only seven of its 994 alarms carry its own attack label. Second, removing test-label checkpoint selection lowers attack detection precision (ADP) by 0.16 to 0.33 across four forty-member word2vec configurations without changing detector order. Third, a buffer-reuse defect gives a linear encoder unintended degree-dependent inputs. Correcting it lowers type-only ADP in every identical-input initialization pair on two hosts, while historical word2vec effects depend on the host. These findings qualify claims from the inspected implementations about alarm precision, performance magnitude and static-attribute sufficiency. STRICT connects them to six checkable reporting requirements. Because the comparisons condition on benchmark targets, they neither validate those labels nor establish a universal detector ranking.
- Abstract(参考訳): 証明に基づく侵入検知器のスコアを再現しても、そのアラームの出力やエンコーダが使用する情報についてそのスコアが何を言っているかは定かでない。
我々は、リリースした9つの実装を監査し、独自のコードを使用して4つの検出器を実行し、3つの測定効果を分離する。
ThreaTraceは、994のアラームのうち7つだけが独自のアラームラベルを持っているが、その精度は0.938と報告している。
第2に、テストラベルチェックポイントの選択を除去することで、検出順序を変更することなく、4つのワード2vec構成で攻撃検出精度(ADP)を0.16から0.33に下げる。
第三に、バッファ再利用欠陥は線形エンコーダに意図しない次数依存入力を与える。
2つのホスト上の全ての同一入力初期化ペアにおいて、タイプのみのADPを補正する一方で、歴史的な2vec効果はホストに依存する。
これらの結果は,アラーム精度,性能等級,静的属性満足度に関する検査結果から得られた主張を裏付けるものである。
STRICTはそれらを6つのチェック可能なレポート要求に接続する。
ベンチマークターゲットにおける比較条件のため、それらのラベルを検証したり、普遍的な検出器ランキングを確立したりしない。
関連論文リスト
- A First-Principles Evaluation of Graph-Based Network Intrusion Detection Systems [7.608784888435352]
グラフベースのネットワーク侵入検知システム(GIDS)は、強力なベンチマーク検出指標を報告しているが、これらの指標はデプロイ可能性についてはほとんど確立していない。
我々は,9つの代表的なGIDSを調査し,その中の5つをGIDS-Eval内に再実装し,マッチしたプロトコルの下で4つのデータセット上で評価する。
我々は,同じフレームワーク上に構築されたエンコーダフリーコントロールであるGIDS-Liteを紹介した。
論文 参考訳(メタデータ) (2026-09-10T22:38:09Z) - What the Detector Can See: Evaluating CPS Anomaly Detectors Independently of the Decision Rule [6.145872664954402]
異常検知器は、しばしばサイバー物理システムの最後の防御線である。
これらの検出器は通常、単一の動作点における精度、リコール、F1を用いて比較される。
我々は、CPS異常検出器を2段階のパイプラインとして扱う:ステージ1は残差に観測をマッピングし、ステージ2は残差をアラームにマッピングする。
我々は,3つのCPSベンチマーク(SWaT,WADI,HAI)の5つの検出器を評価した。
論文 参考訳(メタデータ) (2026-08-03T19:35:00Z) - Cybersecurity Detection Classification with Reasoning-enabled Language Models [50.72675435043546]
セキュリティオペレーションセンター(SOC)の大きな問題は、警告疲労である。
以前の作業では、大きな言語モデル(LLM)がトリアージラベルを直接出力するように促すか、あるいは微調整するが、検出が真の脅威であるかどうかを判断するよう訓練することはない。
我々は、実際の人間ラベルのWindowsエンドポイント検出に対して、推論可能なトリアージ分類器(CoT)を訓練する。
論文 参考訳(メタデータ) (2026-07-30T16:22:13Z) - Fantastic Adaptive Taxonomies and How to Use Them [100.20614173157708]
AdaMASTは、実行トレースをコンパクトでエビデンスに基づく障害分類に変換する。
コードには手書きのコードはなく、人間による注釈もない。
エージェント・システム・サーチでは、失敗候補の分類コード診断が自由形式より優れている。
論文 参考訳(メタデータ) (2026-07-17T17:41:16Z) - Confidently Wrong: Severity-Aware Calibration of Prompt-Injection Detectors under Attack Shift [0.0]
私は、ProtectAI-v2とPrompt-Guard-2チェックポイントの3つの放出検出器を1つのソース校正閾値で評価した。
重大度指標Sを報告し、検知器が犯した攻撃に対する自信と、偽陰性率と差別を報告します。
3つとも間接的行動ヒジャック注入を確実に通過し、2つのベンダーに共通する盲点と4倍の大きさの範囲を達成します。
論文 参考訳(メタデータ) (2026-06-21T20:30:12Z) - Identifying Label Errors in Object Detection Datasets by Loss Inspection [4.442111891959355]
本稿では,オブジェクト検出データセットにおけるラベル誤り検出手法のベンチマークを紹介する。
そこで本研究では,軌道上でランダムに導入した4種類のラベルエラーと,良好なラベル付きオブジェクト検出データセットの試験セットをシミュレートする。
論文 参考訳(メタデータ) (2023-03-13T10:54:52Z) - GLENet: Boosting 3D Object Detectors with Generative Label Uncertainty Estimation [70.75100533512021]
本稿では,対象物の潜在的可算有界箱の多様性として,ラベルの不確実性問題を定式化する。
本稿では,条件付き変分オートエンコーダを応用した生成フレームワークであるGLENetを提案する。
GLENetが生成するラベルの不確実性はプラグアンドプレイモジュールであり、既存のディープ3D検出器に便利に統合することができる。
論文 参考訳(メタデータ) (2022-07-06T06:26:17Z) - Attentive Prototypes for Source-free Unsupervised Domain Adaptive 3D
Object Detection [85.11649974840758]
3Dオブジェクト検出ネットワークは、トレーニングされたデータに対してバイアスを受ける傾向がある。
そこで本研究では,ライダーを用いた3次元物体検出器のソースレス・教師なし領域適応のための単一フレーム手法を提案する。
論文 参考訳(メタデータ) (2021-11-30T18:42:42Z) - Supervision by Registration and Triangulation for Landmark Detection [70.13440728689231]
本稿では,マルチビュー映像を用いた教師なし手法である登録・三角測量(srt)による監視を行い,ランドマーク検出器の精度と精度を向上させる。
ラベルのないデータを活用することで、検出者は大量のラベルのないデータから自由に学べる。
論文 参考訳(メタデータ) (2021-01-25T02:48:21Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。