論文の概要: ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair
- arxiv url: http://arxiv.org/abs/2607.01916v1
- Date: Thu, 02 Jul 2026 09:15:28 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-03 19:45:08.75575
- Title: ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair
- Title(参考訳): ContextSniper: AntTrailのレポジトリ・レベル・プログラムの修復に有効なコードメモリ
- Abstract要約: 本稿では,AntTrailのトークン効率の高いコードメモリ層であるContextSniperについて述べる。
AntTrailのより広範なエージェントメモリエンジンのコーディング専門化として、ContextSniperは精度証明の選択のためにSniper機能を実装している。
OpenClaw と Claude Code を用いて SWE-bench Lite 上でContextSniper を評価する。
- 参考スコア(独自算出の注目度): 15.009388828577423
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Large language model agents can repair real repository issues, but they often spend large context budgets on whole-file reads, broad searches, and long terminal outputs where useful evidence is mixed with irrelevant code and logs. This paper presents ContextSniper, AntTrail's token-efficient code memory layer for repository-level program repair. As the coding specialization of AntTrail's broader agent memory engine, ContextSniper implements the Sniper feature for precision evidence selection: it retrieves candidate code and runtime evidence, ranks it with hybrid retrieval signals, filters long outputs through an intention-aware context gate, and returns compact evidence packets while preserving recoverable source context outside the prompt. We evaluate ContextSniper on SWE-bench Lite with OpenClaw and Claude Code, using 50 task runs per host-agent condition. ContextSniper reduces total token use by 51.5% and logged cost by 36.4% for OpenClaw, and reduces total token use by 38.9% and estimated cost by 27.3% for Claude Code. Submitted-resolution rates decrease slightly, from 26.0% to 24.0% for OpenClaw and from 32.0% to 30.0% for Claude Code. ContextSniper's pilot testing scripts are open-sourced at https://github.com/Calluking/ContextSniper
- Abstract(参考訳): 大規模な言語モデルエージェントは、実際のリポジトリの問題を修正することができるが、多くの場合、有効なエビデンスと無関係なコードとログが混在している、ファイル全体の読み込み、広範囲な検索、長い端末出力に、大きなコンテキスト予算を費やす。
本稿では,AntTrailのトークン効率の高いコードメモリ層であるContextSniperについて述べる。
AntTrailのより広範なエージェントメモリエンジンのコーディング専門化として、ContextSniperはSniper機能を実装して、精度の高いエビデンス選択を行う: 候補コードと実行時エビデンスを検索し、ハイブリッド検索信号でランク付けし、意図認識のコンテキストゲートを介して長い出力をフィルタリングし、プロンプトの外で復元可能なソースコンテキストを保存しながら、コンパクトエビデンスパケットを返却する。
OpenClaw と Claude Code を用いて SWE-bench Lite 上でContextSniper を評価する。
ContextSniperはOpenClawのトークン総使用量を51.5%削減し、ログ化コストを36.4%削減し、Claude Codeのトークン総使用量を38.9%削減し、27.3%削減した。
OpenClawでは26.0%から24.0%に、Claude Codeでは32.0%から30.0%に減少する。
ContextSniperのパイロットテストスクリプトはhttps://github.com/Calluking/ContextSniperでオープンソース化される
関連論文リスト
- Skill Issue: Lessons from Optimizing Repository SKILLs for Coding Agents [0.09558392439655013]
コーディングエージェントは、SKILLsからリポジトリの知識を読み取るようになっている。
最近の研究は、ベンチマークに対して文書を最適化することで、これらのファイルを自動で合成する。
より難しいタスク --- リポジトリのプルリクエストをマージし、単一の凍結されたベースコミットでリターンし、同じエージェントがそれなしでよいかどうかで候補ドキュメントをスコアします。
論文 参考訳(メタデータ) (2026-09-11T11:41:29Z) - Adaptive Critical Token-Aware Retrieval for Repository-Level Code Generation [53.85136813868056]
ACToRは、リポジトリレベルのコード生成のための適応型クリティカルトークン対応検索フレームワークである。
我々は、ACToRが、リポジトリレベルのベンチマークにおいて、最先端のメソッドを一貫して上回っていることを示す。
論文 参考訳(メタデータ) (2026-09-01T17:59:39Z) - Can Coding Agents Solve Repository-Level Issues with Rendered Code? An Exploratory Study of Visual Representations [30.48772161139388]
本稿では,画像のレンダリングがエージェントコーディングの運用コンテキストとして機能するかどうかを検討する。
レンダリングされたコードは、プロンプトトーケンコストを一貫して削減するが、その節約率は、ビジュアル圧縮比と直線的に増加しない。
主にエンドツーエンドの修理精度を保っていますが、基盤となるモデルやエージェントアーキテクチャのパフォーマンス制限を克服することはできません。
論文 参考訳(メタデータ) (2026-08-10T08:24:19Z) - VITAL-RAG: Invariance Race for Context Allocation in Coding Agents [16.861820396751188]
コーディングエージェントはリポジトリ全体からコードを取得することが多いが、最終的なモデル入力に適合する証拠は限られている。
我々は、標準コードオブジェクトによるエビデンスを整理するVITAL-RAGを導入し、すでに表現されていないセマンティクスを追加する場合にのみ、クエリ関連コンパニオンを1つ保持する。
RepoBenchでは、VITALRAGはRecall@4Kを39.59%から63.67%に改善し、証拠トークンを35.63%削減した。
論文 参考訳(メタデータ) (2026-07-29T14:05:28Z) - Agent Retrieval Bench: Evaluating Repository Context Retrieval for Coding Agents [8.81342573156581]
Agent Retrieval Benchはこの上流検索問題のファイルレベルベンチマークである。
ベンチマークでは、code2test、 comment2context、 trace2code、Edit2rippleの4つの肯定的なタスクがカバーされている。
コーパスには308のベースコミットスナップショット、392,000ファイル、7.9百万チャンクが含まれている。
論文 参考訳(メタデータ) (2026-07-27T09:39:09Z) - Understanding and Evaluating Claw-like Agent Security Through a Computer-Systems Lens [65.53494487819053]
クローのようなAIエージェント(OpenClawなど)は、認証情報、ファイル、ツール、外部サービスへの永続的なアクセスを伴う、常にオンのプロセスである。
我々はClawのようなエージェントをエージェントコンピュータシステムとして扱い、そのゲートウェイランタイムがOSのような仲介の役割を担っている。
我々は、4つの攻撃面にわたる406の敵タスクのベンチマークであるSafeClawArenaを開発した。
論文 参考訳(メタデータ) (2026-06-29T18:00:45Z) - Local LLM Agents as Vulnerable Runtimes:A Source-Code Audit of the Agent Runtime Layer [19.371045551006304]
OpenClawやNanobotといったローカルLLMエージェントはエンドユーザマシン上で動作し、ホストリソースで動作します。
CLAWAUDITは、ローカルエージェントランタイムにおける脆弱性の暴露を測定するための静的監査フレームワークである。
事前のライブコード監査では、これらのリコール指向のルールは手作業によるトリアージを必要とし、本番デプロイメント前にセマンティックフィルタリングを動機付けている。
論文 参考訳(メタデータ) (2026-06-19T03:40:00Z) - FastContext: Training Efficient Repository Explorer for Coding Agents [29.359764163872473]
大規模言語モデル(LLM)コーディングエージェントは、ソフトウェアエンジニアリングタスクにおいて大きな成果を上げている。
関連するコードを見つけることは、相当量のトークン予算を消費し、関係のないスニペットでエージェントのコンテキストを汚染する。
我々は、リポジトリの探索と解決を分離する専用の探索サブエージェントであるFastContextを紹介します。
論文 参考訳(メタデータ) (2026-06-12T03:23:59Z) - Code-QA-Bench: Separating Code Reasoning from Documentation Memorization in Repository-Level QA [7.478327602641997]
Code-QA-Benchはリポジトリレベルのコード理解ベンチマークを合成するためのフレームワークである。
10のPythonリポジトリで528のコードデリバティブと100のドキュメント依存タスクを生成します。
フレームワークはオープンソースで、ドキュメント化されたPythonリポジトリに適用できる。
論文 参考訳(メタデータ) (2026-05-28T02:52:58Z) - SCDBench: A Benchmark for LLM-Based Smart Contract Decompilers [55.39407031861402]
本稿では,スマートコントラクトデコンパイルのためのデータセットとベンチマーク手法であるSCDBenchを紹介する。
データセットには600の現実のSolidityコントラクトと、ペア化されたバイトコード入力、地味なソースコード、再生可能なセマンティックチェックポイントが含まれている。
我々は,GLM-5の変種を含むゼロショット逆コンパイル設定において,Claude Opus 4.7,GPT-5.3-Codex,GLM-5を評価した。
論文 参考訳(メタデータ) (2026-05-27T20:08:47Z) - Skill-as-Pseudocode: Refactoring Skill Libraries to Pseudocode for LLM Agents [50.78646963535282]
Skill-as-Pseudocode (SaP) はマークダウンスキルライブラリの型付き擬似コードへの自動変換である。
1つ以上のスキルから引き出された類似の手続きパスのクラスタごとに、SaPは型付きコントラクトを抽出し、それを4チェック決定性検証器を通じてフィルタリングする。
プロモートされた契約は、復元された具体的なアクションテンプレートと共に書き直されたスキルスケルトンにインライン化され、エージェントは2つの補完的な信号を与える。
論文 参考訳(メタデータ) (2026-05-27T04:48:40Z) - CommitDistill: A Lightweight Knowledge-Centric Memory Layer for Software Repositories [0.5872014229110213]
ソフトウェアは、コミットメッセージ、プルリクエストの議論、スレッド発行に大量の構造化されていない知識を蓄積します。
エージェントのタイプメモリアーキテクチャ(MemGPT、生成エージェント、YangらのPlugMemモジュール)に関する最近の研究は、エージェントメモリは生の対話テキストではなく、蒸留された型付き知識であるべきだと主張している。
私たちは、決定論的、依存性なし、ローカルのみ、埋め込みなしという制約のある体制の下で、ソフトウェアリポジトリ自身のgit履歴にそのスタンスを適用します。
論文 参考訳(メタデータ) (2026-05-18T12:14:28Z) - Correctness-Aware Repository Filtering Under Maximum Effective Context Window Constraints [0.0]
コンテキストウィンドウ効率は、大規模言語モデル(LLM)ベースの開発ツールの実践的な制約である。
トークン化前のレポジトリスキャンをインターセプトする,正当性を考慮したコンテキスト衛生フレームワークを提案する。
対照的に、我々のフレームワークはインデクシングを必要とせず、ファイル決定あたり0.01msで動作する。
論文 参考訳(メタデータ) (2026-05-14T04:37:39Z) - SWE-chat: Coding Agent Interactions From Real Users in the Wild [70.18158706281724]
SWE-chatは、オープンソースの開発者から収集された実際のコーディングエージェントセッションの大規模なデータセットである。
現在、データセットには6000のセッションが含まれており、63,000以上のユーザプロンプトと355,000のエージェントツールコールが含まれている。
論文 参考訳(メタデータ) (2026-04-22T17:08:19Z) - Selective Memory for Artificial Intelligence: Write-Time Gating with Hierarchical Archiving [0.0]
パラメトリックアプローチは、選択的な更新を前に、知識を重みに圧縮する。
合成サリエンススコアを用いて、入ってくる知識オブジェクトをフィルタリングする書き込み時間ゲーティングを導入する。
論文 参考訳(メタデータ) (2026-03-16T23:06:44Z) - TeaRAG: A Token-Efficient Agentic Retrieval-Augmented Generation Framework [62.66056331998838]
TeaRAGは、検索内容と推論ステップの両方を圧縮できるトークン効率のエージェントRAGフレームワークである。
報奨関数は,過剰な推論ステップをペナルティ化しながら,知識マッチング機構によって知識満足度を評価する。
論文 参考訳(メタデータ) (2025-11-07T16:08:34Z) - Trace: Securing Smart Contract Repository Against Access Control Vulnerability [58.02691083789239]
GitHubはソースコード、ドキュメント、設定ファイルを含む多数のスマートコントラクトリポジトリをホストしている。
サードパーティの開発者は、カスタム開発中にこれらのリポジトリからコードを参照、再利用、フォークすることが多い。
スマートコントラクトの脆弱性を検出する既存のツールは、複雑なリポジトリを扱う能力に制限されている。
論文 参考訳(メタデータ) (2025-10-22T05:18:28Z) - SolBench: A Dataset and Benchmark for Evaluating Functional Correctness in Solidity Code Completion and Repair [51.0686873716938]
コード補完モデルによって生成されたSolidityスマートコントラクトの機能的正しさを評価するベンチマークであるSolBenchを紹介する。
本稿では,スマートコントラクトの機能的正当性を検証するための検索拡張コード修復フレームワークを提案する。
その結果、コード修復と検索技術は、計算コストを削減しつつ、スマートコントラクト完了の正しさを効果的に向上することを示した。
論文 参考訳(メタデータ) (2025-03-03T01:55:20Z) - CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification [71.34070740261072]
本稿では,テストケースの生成と完成におけるモデルの能力を評価するためのベンチマークCLOVERを提案する。
ベンチマークはタスク間でのコード実行のためにコンテナ化されています。
論文 参考訳(メタデータ) (2025-02-12T21:42:56Z) - On The Importance of Reasoning for Context Retrieval in Repository-Level Code Editing [82.96523584351314]
我々は、コンテキスト検索のタスクをリポジトリレベルのコード編集パイプラインの他のコンポーネントと分離する。
我々は、推論が収集された文脈の精度を向上させるのに役立っているが、それでもその十分性を識別する能力は欠如していると結論づける。
論文 参考訳(メタデータ) (2024-06-06T19:44:17Z) - RepoCoder: Repository-Level Code Completion Through Iterative Retrieval
and Generation [96.75695811963242]
RepoCoderはリポジトリレベルのコード補完プロセスを合理化するフレームワークである。
類似性ベースのレトリバーと、事前訓練されたコード言語モデルが組み込まれている。
バニラ検索で拡張されたコード補完アプローチよりも一貫して優れています。
論文 参考訳(メタデータ) (2023-03-22T13:54:46Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。