論文の概要: Quantitative Symbolic Patch Impact Analysis
- arxiv url: http://arxiv.org/abs/2605.13885v1
- Date: Mon, 11 May 2026 18:38:58 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-15 21:45:34.397025
- Title: Quantitative Symbolic Patch Impact Analysis
- Title(参考訳): 定量的・シンボリック・パッチ・インパクト分析
- Authors: Laboni Sarker, Abdus Satter, Tevfik Bultan,
- Abstract要約: ソフトウェアパッチの評価手法である定量的部分等価解析を導入する。
パッチ付きプログラムとオリジナルプログラムが同一または異なる動作を示す入力条件を同定する。
その結果, 定量的部分等価解析はパッチの影響を効果的に評価し, 定量化することがわかった。
- 参考スコア(独自算出の注目度): 1.025934121856305
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Traditional equivalence checking classifies programs as equivalent or non-equivalent, providing insufficient information for tasks like patch impact analysis where it is expected the patched version of the program to be non-equivalent to the original program. When two program versions are non-equivalent, determining under what conditions they differ and what percentage of inputs are affected remains an open challenge. In this work, we introduce quantitative partial equivalence analysis, an approach for assessing software patches by quantifying behavioral differences between the original (vulnerable) code and the patched code. Using symbolic analysis, we identify input conditions under which patched and original programs exhibit identical or divergent behaviors. Our approach refines non-equivalence by measuring the extent of behavioral divergence across the input domain. For efficient quantitative analysis of numerical domains, we propose a range-based search heuristic that provides a sound lower bound on equivalence. We demonstrate our approach on 90 CVE patches from widely used open-source projects (Linux, Qemu, FFmpeg), as well as on a Juliet Test Suite-based dataset containing programs with CWEs. Our results show that quantitative partial equivalence analysis effectively characterizes and quantifies patch impact. Additionally, experiments on the EqBench benchmark reveal five C program pairs that are mislabeled as equivalent, and we identify the input conditions under which their behaviors diverge.
- Abstract(参考訳): 従来の等価チェックは、プログラムを等価または非等価と分類し、パッチ影響分析のようなタスクに不十分な情報を提供する。
2つのプログラムバージョンが等価でない場合、どの条件で異なるか、どの入力が影響を受けるかを決定することは、依然としてオープンな課題である。
そこで本研究では,ソフトウェアパッチの評価手法である定量的部分同値解析を導入し,元コードとパッチコードとの振る舞いの差異を定量化する手法を提案する。
シンボリック解析を用いて、パッチ付きプログラムとオリジナルプログラムが同一または異なる動作を示す入力条件を同定する。
提案手法は,入力領域間での振る舞いのばらつきの程度を測定することによって,非等価性を改良する。
数値領域の効率的な定量的解析を行うため,同値性に低い音を与える範囲に基づく探索ヒューリスティックを提案する。
我々は、広く使われているオープンソースプロジェクト(Linux、Qemu、FFmpeg)の90のCVEパッチと、CWEを含むプログラムを含むJuliet Test Suiteベースのデータセットに対するアプローチを実証する。
その結果, 定量的部分等価解析はパッチの影響を効果的に評価し, 定量化することがわかった。
さらに、EqBenchベンチマークの実験では、5つのCプログラムペアを等価と誤ラベルし、それらの動作が分岐する入力条件を特定する。
関連論文リスト
- AQAScore: Evaluating Semantic Alignment in Text-to-Audio Generation via Audio Question Answering [97.52852990265136]
音声対応大規模言語モデルの推論機能を活用するバックボーン非依存評価フレームワークであるAQAScoreを紹介する。
AQAScoreは人格関連性、ペア比較、構成推論タスクを含む複数のベンチマークで評価する。
論文 参考訳(メタデータ) (2026-01-21T07:35:36Z) - State Field Coverage: A Metric for Oracle Quality [45.805303746415944]
オラクルの品質を評価するための新しい指標であるステートフィールドカバレッジを導入する。
私たちのメトリクスの主な直感は、より高い状態のフィールドカバレッジを持つオラクルは、分析中のソフトウェアの欠陥を検出する傾向にあるということです。
静的に計算されているため、メトリックは効率的であり、テストオラクルを改善するための直接的なガイダンスを提供する。
論文 参考訳(メタデータ) (2025-10-03T14:57:37Z) - Semiparametric conformal prediction [79.6147286161434]
ベクトル値の非整合性スコアの結合相関構造を考慮した共形予測セットを構築する。
スコアの累積分布関数(CDF)を柔軟に推定する。
提案手法は,現実の回帰問題に対して,所望のカバレッジと競争効率をもたらす。
論文 参考訳(メタデータ) (2024-11-04T14:29:02Z) - Invariant-based Program Repair [1.7767466724342067]
本稿では,プログラム不変量の概念に基づく汎用型自動プログラム修復(APR)フレームワークについて述べる。
本稿では,APRにおける不変量を利用したパフォーマンスバグの修復システムを構築することにより,APRにおける不変量を活用することの有用性を実証する。
論文 参考訳(メタデータ) (2023-12-27T17:46:19Z) - Invalidator: Automated Patch Correctness Assessment via Semantic and
Syntactic Reasoning [6.269370220586248]
本稿では,意味論的および統語論的推論により,APR生成パッチの正当性を自動的に評価する手法を提案する。
我々は、Defects4Jの現実世界のプログラムで生成された885パッチのデータセットについて実験を行った。
実験の結果,INVALIDATORは79%のオーバーフィッティングパッチを正しく分類し,最高のベースラインで検出されたパッチを23%上回った。
論文 参考訳(メタデータ) (2023-01-03T14:16:32Z) - QuaPy: A Python-Based Framework for Quantification [76.22817970624875]
QuaPyは、定量化を行うためのオープンソースのフレームワークである(例えば、教師付き精度推定)。
Pythonで書かれており、pip経由でインストールできる。
論文 参考訳(メタデータ) (2021-06-18T13:57:11Z) - Performance Evaluation of Adversarial Attacks: Discrepancies and
Solutions [51.8695223602729]
機械学習モデルの堅牢性に挑戦するために、敵対攻撃方法が開発されました。
本稿では,Piece-wise Sampling Curving(PSC)ツールキットを提案する。
psc toolkitは計算コストと評価効率のバランスをとるオプションを提供する。
論文 参考訳(メタデータ) (2021-04-22T14:36:51Z) - Deconfounding Scores: Feature Representations for Causal Effect
Estimation with Weak Overlap [140.98628848491146]
推定対象の偏りを伴わずに高い重なりを生じさせる,デコンファウンディングスコアを導入する。
分離スコアは観測データで識別可能なゼロ共分散条件を満たすことを示す。
特に,この手法が標準正規化の魅力的な代替となることを示す。
論文 参考訳(メタデータ) (2021-04-12T18:50:11Z) - Symbolic Parallel Adaptive Importance Sampling for Probabilistic Program
Analysis [9.204612164524947]
確率論的ソフトウェア分析は、プログラムの実行中に発生するターゲットイベントの確率を定量化することを目的としている。
本稿では,SYMbolic Parallel Adaptive Importance Sampling (SYMPAIS)を提案する。
論文 参考訳(メタデータ) (2020-10-10T17:39:12Z) - Uncertainty-aware Score Distribution Learning for Action Quality
Assessment [91.05846506274881]
行動品質評価(AQA)のための不確実性認識スコア分布学習(USDL)手法を提案する。
具体的には、異なる評価スコアの確率を記述したスコア分布に関連する事例として、アクションを考察する。
微粒なスコアラベルが利用できる状況下では、多パス不確実性を考慮したスコア分布学習法(MUSDL)を考案し、スコアの不整合成分を探索する。
論文 参考訳(メタデータ) (2020-06-13T15:41:29Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。