論文の概要: STILL: Recovering Lowered STL Semantics for LLM-assisted C++ Decompilation
- arxiv url: http://arxiv.org/abs/2608.26408v1
- Date: Wed, 26 Aug 2026 21:20:54 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-28 16:30:58.176453
- Title: STILL: Recovering Lowered STL Semantics for LLM-assisted C++ Decompilation
- Title(参考訳): STILL: LLM支援C++デコンパイルのための低いSTLセマンティクスの復元
- Abstract要約: 制御フローグラフから関数レベルのSTLコンテナセマンティクスを予測する構造的セマンティクスインタフェースSTILLを提案する。
StlBenchでは、STILLがコンテナレベルの共通STLセマンティクスを予測する。
取り除かれたHumanEvalの非コンパイルでは、DeepSeek-Chatの改良は28.4%に到達した。
- 参考スコア(独自算出の注目度): 51.12395225250876
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: LLM-assisted decompilation improves readability and re-executability, but still underperforms on stripped C++ functions that use the Standard Template Library (STL). Compilation, optimization, and symbol stripping remove or obscure source-level semantics such as container types and library-call structure, while traditional decompiler output often fails to recover them. We present STILL, a structured semantic interface that predicts function-level STL container semantics from stripped control-flow graphs and renders them as compact hints for LLM refinement. On StlBench, STILL predicts common container-level STL semantics, with the strongest cross-dataset results for stable string and vector slices. On stripped HumanEval decompilation, these hints enable DeepSeek-chat refinement to reach 28.4% executability, compared with 17.4% for no-hint refinement and 8.9% for raw Ghidra decompilation; hint utility is downstream-backbone-dependent, with decompilation-specialized models requiring lightweight adaptation to benefit from the same interface.
- Abstract(参考訳): LLM支援の逆コンパイルは可読性と再実行性を改善するが、STL(Standard Template Library)を使用する削除されたC++関数ではまだ性能が低い。
コンパイル、最適化、シンボルのストリップは、コンテナタイプやライブラリコール構造のようなソースレベルのセマンティクスを削除または曖昧にします。
制御フローグラフから関数レベルのSTLコンテナセマンティクスを予測し,それをLLM精細化のためのコンパクトなヒントとして描画する構造的セマンティクスインタフェースSTILLを提案する。
StlBenchでは、STILLがコンテナレベルの共通STLセマンティクスを予測する。
取り除かれたHumanEvalのデコンパイルでは、DeepSeek-Chatの改良は28.4%に到達し、非ヒントの改良は17.4%、生のGhidraのデコンパイルは8.9%になった。
関連論文リスト
- Portable models as a replacement for industrial heuristics in compiler optimizations [0.0]
本稿では,コンパクトコンパイラ,ソース・ソース・ツール,インタプリタにおける関数インライン化決定の予測の可能性について検討する。
この作業の関連性は、成熟したインライン化最適化を限られたコンパイラ基盤を持つシステムに転送する必要性によって決定される。
論文 参考訳(メタデータ) (2026-07-19T19:43:14Z) - HELIOS: Hierarchical Graph Abstraction for Structure-Aware LLM Decompilation [11.110675371854988]
textscHELIOSは、バイナリの逆コンパイルを構造化推論タスクとして再構成するフレームワークである。
textscHELIOSは、セキュリティ設定のリバースエンジニアリングのための実用的なビルディングブロックである。
論文 参考訳(メタデータ) (2026-01-21T02:37:33Z) - Multi-Agent Taint Specification Extraction for Vulnerability Detection [49.27772068704498]
コンテナ分析を使用した静的アプリケーションセキュリティテスト(SAST)ツールは、高品質な脆弱性検出結果を提供するものとして広く見なされている。
本稿では,Large Language Models (LLM) のセマンティック理解と従来の静的プログラム解析を戦略的に組み合わせたマルチエージェントシステムであるSemTaintを提案する。
私たちは、SemTaintを最先端のSASTツールであるCodeQLと統合し、これまでCodeQLで検出できなかった162の脆弱性の106を検出して、その効果を実証しています。
論文 参考訳(メタデータ) (2026-01-15T21:31:51Z) - TASO: Jailbreak LLMs via Alternative Template and Suffix Optimization [52.01940078632388]
テンプレートと接尾辞を交互に最適化する新しいジェイルブレイク手法であるTASOを紹介する。
我々は,24個のLLMのベンチマークデータセットにおけるTASOの有効性を評価する。
論文 参考訳(メタデータ) (2025-11-23T18:49:27Z) - Context-Guided Decompilation: A Step Towards Re-executability [50.71992919223209]
バイナリ逆コンパイルは、ソフトウェアセキュリティ分析、リバースエンジニアリング、マルウェア理解において重要な役割を果たす。
大規模言語モデル (LLMs) の最近の進歩により、ニューラルデコンパイルが可能になったが、生成されたコードは一般的に意味論的にのみ使用可能である。
In-context Learning(ICL)を活用して,再実行可能なソースコードを生成するためのILC4Decompを提案する。
論文 参考訳(メタデータ) (2025-11-03T17:21:39Z) - TIT: A Tree-Structured Instruction Tuning Approach for LLM-Based Code Translation [11.882496324328905]
LLMに基づくコード翻訳のためのツリー構造化命令チューニングパラダイムであるTITを提案する。
構文的混乱を軽減するため、構文的情報表現モジュールは言語に依存しない構文的特徴を統合する。
高品質の粒度並列データを生成するために、細粒度並列データセット拡張モジュールは、ノードとコードセグメントを整列する。
論文 参考訳(メタデータ) (2025-10-10T13:53:46Z) - D-LiFT: Improving LLM-based Decompiler Backend via Code Quality-driven Fine-tuning [49.16469288280772]
逆コンパイラは、バイナリから可読なソースコードを再構築する。
近年の進歩にもかかわらず、そのアウトプットは構文上の誤りや意味的な誤りに悩まされ、読みにくいままである。
大規模言語モデル (LLMs) の出現により、研究者は逆コンパイラ出力を洗練するためのLLMの可能性を探り始めた。
D-LIFTは、微調整強化学習を施した拡張逆コンパイラLLMパイプラインである。
論文 参考訳(メタデータ) (2025-06-11T19:09:08Z) - VecTrans: Enhancing Compiler Auto-Vectorization through LLM-Assisted Code Transformations [17.974013479973774]
VecTransは、コンパイラベースのコードベクトル化を強化するために、大きな言語モデルを活用するフレームワークである。
VecTransは1.77倍のGeomeanスピードアップを実現し、51のテストケースのうち24をベクトル化することに成功した。
論文 参考訳(メタデータ) (2025-03-25T08:39:35Z) - ReF Decompile: Relabeling and Function Call Enhanced Decompile [50.86228893636785]
逆コンパイルの目標は、コンパイルされた低レベルコード(アセンブリコードなど)を高レベルプログラミング言語に変換することである。
このタスクは、脆弱性識別、マルウェア分析、レガシーソフトウェアマイグレーションなど、さまざまなリバースエンジニアリングアプリケーションをサポートする。
論文 参考訳(メタデータ) (2025-02-17T12:38:57Z) - LLM-Vectorizer: LLM-based Verified Loop Vectorizer [12.048697450464935]
大規模言語モデル(LLM)は、個々の配列要素を処理するスカラープログラムからベクトル化されたコードを生成することができる。
LLMは1.1xから9.4xまでのランタイムスピードアップで高性能なベクトルコードを生成することができる。
我々のアプローチでは、TSVCベンチマークデータセットで正しいベクター化の38.2%を検証できる。
論文 参考訳(メタデータ) (2024-06-07T07:04:26Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。