論文の概要: ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair
- arxiv url: http://arxiv.org/abs/2607.01916v3
- Date: Thu, 09 Jul 2026 01:58:28 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-10 16:54:55.14524
- Title: ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair
- Title(参考訳): ContextSniper: AntTrailのレポジトリ・レベル・プログラムの修復に有効なコードメモリ
- Authors: Chiwang Luk, Matin Mohammad Najafi, Zhifeng Jia, Wei Yang, Xiuchang Li, Jinwei Zhu, Yang Ren, Lei Chen, Gao Cong,
- Abstract要約: 本稿では,AntTrail の Code-Repair モジュールであるContextSniper について述べる。
一致した50タスク/条件の比較では、ContextSniperはトークンの総使用量を51.5%削減し、ログのコストを36.4%削減した。
これらの結果は、ContextSniperが、修復品質の計測不能な損失を伴わずに、リポジトリレベルの修復エージェントのトークンとコストオーバーヘッドを大幅に削減できることを示唆している。
- 参考スコア(独自算出の注目度): 15.009388828577423
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Large language model agents can repair real repository issues, but they often spend large context budgets on whole-file reads, broad searches, and long terminal outputs where useful evidence is mixed with irrelevant code and logs. This paper presents ContextSniper, AntTrail's code-repair module for precision evidence selection in repository-level program repair, part of AntTrail's broader agent-memory engine. AntTrail is available at https://gitcode.com/datagallery/AntTrail. ContextSniper indexes code and action memory as three abstract levels, retrieves candidates with a hybrid ranker, filters long tool output through an intention-aware context gate, and returns compact evidence packets while keeping full source recoverable on demand. In a matched 50-task-per-condition comparison on SWE-bench Lite (same tasks, baseline vs.\ ContextSniper), ContextSniper reduces total token use by 51.5% and logged cost by 36.4% for OpenClaw, and by 38.9% and 27.3% for Claude Code, with submitted-resolution rates essentially unchanged in both host-agent settings. In a separate five-task comparison, ContextSniper beats existing memory- and RAG-style integrations on token efficiency. These results suggest ContextSniper can substantially cut token and cost overhead for repository-level repair agents without a measurable loss in repair quality. The evaluation harness for this study is available at https://gitcode.com/lukchiwang/ContextSniper.
- Abstract(参考訳): 大規模な言語モデルエージェントは、実際のリポジトリの問題を修正することができるが、多くの場合、有効なエビデンスと無関係なコードとログが混在している、ファイル全体の読み込み、広範囲な検索、長い端末出力に、大きなコンテキスト予算を費やす。
本稿では、AntTrailのより広範なエージェントメモリエンジンの一部である、リポジトリレベルのプログラム修復において、精度の高いエビデンスを選択するための、AntTrailのコード修復モジュールであるContextSniperについて述べる。
AntTrailはhttps://gitcode.com/datagallery/AntTrailで入手できる。
ContextSniperは、コードとアクションメモリを3つの抽象レベルとしてインデックスし、ハイブリッドローダで候補を検索し、意図を認識したコンテキストゲートを通じて長いツール出力をフィルタリングし、必要に応じて全ソースを復元しながら、コンパクトなエビデンスパケットを返す。
SWE-bench Lite (Same task, baseline vs。
ContextSniperはOpenClawの合計トークン使用量を51.5%削減し、ログインコストを36.4%削減し、Claude Codeの38.9%と27.3%を削減した。
別の5タスク比較では、ContextSniperがトークン効率に関する既存のメモリやRAGスタイルの統合に勝っている。
これらの結果は、ContextSniperが、修復品質の計測不能な損失を伴わずに、リポジトリレベルの修復エージェントのトークンとコストオーバーヘッドを大幅に削減できることを示唆している。
この研究の評価ハーネスはhttps://gitcode.com/lukchiwang/ContextSniper.orgで公開されている。
関連論文リスト
- Understanding and Evaluating Claw-like Agent Security Through a Computer-Systems Lens [65.53494487819053]
クローのようなAIエージェント(OpenClawなど)は、認証情報、ファイル、ツール、外部サービスへの永続的なアクセスを伴う、常にオンのプロセスである。
我々はClawのようなエージェントをエージェントコンピュータシステムとして扱い、そのゲートウェイランタイムがOSのような仲介の役割を担っている。
我々は、4つの攻撃面にわたる406の敵タスクのベンチマークであるSafeClawArenaを開発した。
論文 参考訳(メタデータ) (2026-06-29T18:00:45Z) - Local LLM Agents as Vulnerable Runtimes:A Source-Code Audit of the Agent Runtime Layer [19.371045551006304]
OpenClawやNanobotといったローカルLLMエージェントはエンドユーザマシン上で動作し、ホストリソースで動作します。
CLAWAUDITは、ローカルエージェントランタイムにおける脆弱性の暴露を測定するための静的監査フレームワークである。
事前のライブコード監査では、これらのリコール指向のルールは手作業によるトリアージを必要とし、本番デプロイメント前にセマンティックフィルタリングを動機付けている。
論文 参考訳(メタデータ) (2026-06-19T03:40:00Z) - Code-QA-Bench: Separating Code Reasoning from Documentation Memorization in Repository-Level QA [7.478327602641997]
Code-QA-Benchはリポジトリレベルのコード理解ベンチマークを合成するためのフレームワークである。
10のPythonリポジトリで528のコードデリバティブと100のドキュメント依存タスクを生成します。
フレームワークはオープンソースで、ドキュメント化されたPythonリポジトリに適用できる。
論文 参考訳(メタデータ) (2026-05-28T02:52:58Z) - Skill-as-Pseudocode: Refactoring Skill Libraries to Pseudocode for LLM Agents [50.78646963535282]
Skill-as-Pseudocode (SaP) はマークダウンスキルライブラリの型付き擬似コードへの自動変換である。
1つ以上のスキルから引き出された類似の手続きパスのクラスタごとに、SaPは型付きコントラクトを抽出し、それを4チェック決定性検証器を通じてフィルタリングする。
プロモートされた契約は、復元された具体的なアクションテンプレートと共に書き直されたスキルスケルトンにインライン化され、エージェントは2つの補完的な信号を与える。
論文 参考訳(メタデータ) (2026-05-27T04:48:40Z) - CommitDistill: A Lightweight Knowledge-Centric Memory Layer for Software Repositories [0.5872014229110213]
ソフトウェアは、コミットメッセージ、プルリクエストの議論、スレッド発行に大量の構造化されていない知識を蓄積します。
エージェントのタイプメモリアーキテクチャ(MemGPT、生成エージェント、YangらのPlugMemモジュール)に関する最近の研究は、エージェントメモリは生の対話テキストではなく、蒸留された型付き知識であるべきだと主張している。
私たちは、決定論的、依存性なし、ローカルのみ、埋め込みなしという制約のある体制の下で、ソフトウェアリポジトリ自身のgit履歴にそのスタンスを適用します。
論文 参考訳(メタデータ) (2026-05-18T12:14:28Z) - Correctness-Aware Repository Filtering Under Maximum Effective Context Window Constraints [0.0]
コンテキストウィンドウ効率は、大規模言語モデル(LLM)ベースの開発ツールの実践的な制約である。
トークン化前のレポジトリスキャンをインターセプトする,正当性を考慮したコンテキスト衛生フレームワークを提案する。
対照的に、我々のフレームワークはインデクシングを必要とせず、ファイル決定あたり0.01msで動作する。
論文 参考訳(メタデータ) (2026-05-14T04:37:39Z) - SWE-chat: Coding Agent Interactions From Real Users in the Wild [70.18158706281724]
SWE-chatは、オープンソースの開発者から収集された実際のコーディングエージェントセッションの大規模なデータセットである。
現在、データセットには6000のセッションが含まれており、63,000以上のユーザプロンプトと355,000のエージェントツールコールが含まれている。
論文 参考訳(メタデータ) (2026-04-22T17:08:19Z) - Selective Memory for Artificial Intelligence: Write-Time Gating with Hierarchical Archiving [0.0]
パラメトリックアプローチは、選択的な更新を前に、知識を重みに圧縮する。
合成サリエンススコアを用いて、入ってくる知識オブジェクトをフィルタリングする書き込み時間ゲーティングを導入する。
論文 参考訳(メタデータ) (2026-03-16T23:06:44Z) - Trace: Securing Smart Contract Repository Against Access Control Vulnerability [58.02691083789239]
GitHubはソースコード、ドキュメント、設定ファイルを含む多数のスマートコントラクトリポジトリをホストしている。
サードパーティの開発者は、カスタム開発中にこれらのリポジトリからコードを参照、再利用、フォークすることが多い。
スマートコントラクトの脆弱性を検出する既存のツールは、複雑なリポジトリを扱う能力に制限されている。
論文 参考訳(メタデータ) (2025-10-22T05:18:28Z) - CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification [71.34070740261072]
本稿では,テストケースの生成と完成におけるモデルの能力を評価するためのベンチマークCLOVERを提案する。
ベンチマークはタスク間でのコード実行のためにコンテナ化されています。
論文 参考訳(メタデータ) (2025-02-12T21:42:56Z) - RepoCoder: Repository-Level Code Completion Through Iterative Retrieval
and Generation [96.75695811963242]
RepoCoderはリポジトリレベルのコード補完プロセスを合理化するフレームワークである。
類似性ベースのレトリバーと、事前訓練されたコード言語モデルが組み込まれている。
バニラ検索で拡張されたコード補完アプローチよりも一貫して優れています。
論文 参考訳(メタデータ) (2023-03-22T13:54:46Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。