論文の概要: Towards Standardized Evaluation of GPU Memory Safety with GMSBench
- arxiv url: http://arxiv.org/abs/2609.08871v1
- Date: Tue, 08 Sep 2026 15:11:57 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-11 15:25:51.521091
- Title: Towards Standardized Evaluation of GPU Memory Safety with GMSBench
- Title(参考訳): GMSBenchによるGPUメモリ安全性の標準化評価に向けて
- Abstract要約: GMSBenchは、幅広いメモリ安全性違反を評価するために設計されたGPUメモリ安全性ベンチマークである。
GMSBenchは、空間、時間、エラーにまたがる149の自己完結テストで構成されている。
我々は、広く使われているGPUメモリエラー検出ツールであるCompute Sanitizerを評価し、GMSBenchの有用性を実証する。
- 参考スコア(独自算出の注目度): 9.227375465245993
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: As GPUs become increasingly integral to high-performance computing and machine learning, ensuring memory safety in GPU programs has become crucial for reliable and secure execution. However, evaluating GPU memory safety techniques remains challenging due to the lack of comprehensive and standardized benchmarks. In this paper, we present GMSBench, a GPU memory safety benchmark designed to evaluate a broad range of memory safety violations across different GPU memory spaces and execution scenarios. GMSBench comprises 149 self-contained CUDA tests spanning spatial, temporal, and concurrency errors. The suite provides a standardized foundation for the evaluation and comparative analysis of GPU memory safety mechanisms and helps expose gaps in their detection coverage. We demonstrate the utility of GMSBench by evaluating Compute Sanitizer, a widely used GPU memory error detection tool across multiple GPU architectures.
- Abstract(参考訳): 高性能コンピューティングや機械学習にGPUがますます不可欠になるにつれて、GPUプログラムにおけるメモリ安全性の確保は信頼性とセキュアな実行に不可欠になっている。
しかし、包括的で標準化されたベンチマークが欠如しているため、GPUメモリ安全性技術の評価は依然として難しい。
本稿では,異なるGPUメモリ空間と実行シナリオにまたがる幅広いメモリ安全性違反を評価するために設計されたGPUメモリ安全性ベンチマークであるGMSBenchを提案する。
GMSBenchは、空間的、時間的、並行性のエラーにまたがる149の自己完結CUDAテストで構成されている。
このスイートは、GPUメモリの安全性メカニズムの評価と比較分析のための標準化された基盤を提供し、検出カバレッジのギャップを明らかにするのに役立つ。
我々は、複数のGPUアーキテクチャで広く使われているGPUメモリエラー検出ツールであるCompute Sanitizerを評価し、GMSBenchの有用性を実証する。
関連論文リスト
- FlashMemory-DeepSeek-V4: Lightning Index Ultra-Long Context via Lookahead Sparse Attention [77.12062766962815]
Lookahead Sparse Attention (LSA)は、DeepSeek-V4アーキテクチャ上に構築されたNeural Memory Indexerを利用している。
このアーキテクチャをバックボーンフリーの非結合なトレーニング戦略でインスタンス化する。
FM-DS-V4は、物理KVキャッシュのフットプリントを、フルコンテキストベースラインのわずか13.5%まで圧縮することを示した。
論文 参考訳(メタデータ) (2026-06-08T06:25:54Z) - Is One Score Enough? Rethinking the Evaluation of Sequentially Evolving LLM Memory [50.857546269660276]
本稿では,大規模言語モデル(LLM)メモリを逐次進化させる診断評価フレームワークであるSeqMem-Evalを紹介する。
最終的なパフォーマンスのみに焦点を当てるのではなく、SeqMem-Evalは、シーケンシャル推論において、メモリ状態がどのように進化し、一般化し、エクスペリエンスを集約し、有用な情報を保持するかを評価する。
論文 参考訳(メタデータ) (2026-05-14T20:15:22Z) - Understand and Accelerate Memory Processing Pipeline for Disaggregated LLM Inference [45.78442013449325]
大規模言語モデルは、複雑な推論をサポートするための効率的な長文処理と生成機構に依存している。
これらの最適化は、Prepare Memory、Compute Relevancy、Retrieval、Apply to Inferenceという4段階のメモリ処理パイプラインに統合できることを示す。
この知見に触発されて、textbheterogeneous システムはメモリ処理の高速化やエンドツーエンドの推論に適していると論じる。
論文 参考訳(メタデータ) (2026-03-30T21:03:39Z) - GPU-Fuzz: Finding Memory Errors in Deep Learning Frameworks [16.88852734850369]
GPUメモリエラーは、ディープラーニング(DL)フレームワークにとって重要な脅威であり、クラッシュやセキュリティ問題にもつながります。
本稿では,演算子パラメータを形式的制約としてモデル化することで,これらの問題を効率的に位置決めするGPU-Fuzzを紹介する。
論文 参考訳(メタデータ) (2026-02-11T03:32:43Z) - GPU-Accelerated Algorithms for Graph Vector Search: Taxonomy, Empirical Study, and Research Directions [54.570944939061555]
本稿では,GPU加速グラフに基づくベクトル探索アルゴリズムについて包括的に研究する。
我々は、GPU最適化戦略の詳細な分類を確立し、アルゴリズムタスクとハードウェア実行ユニット間のマッピングを明確にする。
我々の発見は、スケーラブルで堅牢なGPUベースの近接検索システムを設計するための明確なガイドラインを提供する。
論文 参考訳(メタデータ) (2026-02-10T16:18:04Z) - Scaling Behaviors of Evolutionary Algorithms on GPUs: When Does Parallelism Pay Off? [43.96509049196842]
進化的アルゴリズム(EA)はグラフィックス処理ユニット(GPU)に実装され、並列処理能力を活用して効率を向上させる。
我々は,GPU並列処理が,単純な加速度測定以上のEAの挙動をどのように変化させるかを検討する。
その結果,GPUアクセラレーションの影響は多種多様であり,アルゴリズム構造に強く依存していることが判明した。
論文 参考訳(メタデータ) (2026-01-26T12:55:21Z) - CuFuzz: Hardening CUDA Programs through Transformation and Fuzzing [12.40365281970697]
CuFuzzは、最先端のCPUファジィツールを拡張する新しいコンパイラとランタイムの共同設計ソリューションである。
CuFuzzはGPUプログラムをコンパイラIRレベルの変換を使用してCPUプログラムに変換する。
CuFuzzは、広く使用されているベンチマークで122のセキュリティ脆弱性を発見した。
論文 参考訳(メタデータ) (2026-01-03T03:02:47Z) - xMem: A CPU-Based Approach for Accurate Estimation of GPU Memory in Deep Learning Training Workloads [2.2991119948183525]
ジョブがどれだけのGPUメモリを必要とするかを推定することは、高度なスケジューリングとGPUの共有を可能にするための基本となる。
我々は、CPUのみの動的解析を利用してGPUメモリのピーク要求を正確に推定する新しいフレームワークであるxMemを提案する。
ANOVAとMonte Carloの結果を含む5209実行の解析は、xMemのメリットを強調している。
論文 参考訳(メタデータ) (2025-10-23T23:16:27Z) - GPUMC: A Stateless Model Checker for GPU Weak Memory Concurrency [3.1882747895372217]
GPUMCは、スコープドRC11弱いメモリモデルの下でGPU共有メモリプログラムの正しさをチェックするステートレスモデルチェッカーである。
ベンチマークとリアルタイムGPUプログラムを用いてGPUMCを評価する。
論文 参考訳(メタデータ) (2025-05-26T16:47:44Z) - HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading [79.38548165722229]
HEADINFERはKVキャッシュをCPURAMにオフロードするが、GPU上のトランスフォーマー層のKVキャッシュを完全に保存する必要はない。
HEADINFERはメモリフットプリントを大幅に削減し,計算効率を向上することを示した。
論文 参考訳(メタデータ) (2025-02-18T06:26:05Z) - LLMem: Estimating GPU Memory Usage for Fine-Tuning Pre-Trained LLMs [4.536118764799076]
ハードウェアに制限がある微調整済みの大規模言語モデルでは、GPUメモリの制約が問題となっている。
LLMemは、分散微調整法を適用する際のGPUメモリ消費を推定するソリューションである。
LLMemは1つのGPU上でのピークGPUメモリ使用量を正確に推定し、エラー率は最大1.6%であることを示す。
論文 参考訳(メタデータ) (2024-04-16T22:11:35Z) - EVEREST: Efficient Masked Video Autoencoder by Removing Redundant Spatiotemporal Tokens [57.354304637367555]
ビデオ表現学習のための驚くほど効率的なMVAアプローチであるEVERESTを提案する。
リッチなモーション特徴を含むトークンを発見し、事前トレーニングと微調整の両方の間、非形式的なトークンを破棄する。
提案手法は,MVAの計算とメモリ要求を大幅に低減する。
論文 参考訳(メタデータ) (2022-11-19T09:57:01Z) - Faster than FAST: GPU-Accelerated Frontend for High-Speed VIO [46.20949184826173]
この研究は、既存のコンピュータビジョンアルゴリズムを改善するために、効率的な低レベルGPUハードウェア固有の命令の適用性に焦点を当てている。
特に、非マックス抑圧とその後の特徴選択は、全体的な画像処理遅延への顕著な寄与である。
論文 参考訳(メタデータ) (2020-03-30T14:16:23Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。