論文の概要: READU: Inconsistency-Driven Just-in-Time Detection and Repair of README Bugs
- arxiv url: http://arxiv.org/abs/2607.15780v1
- Date: Fri, 17 Jul 2026 09:29:51 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-20 17:56:52.813112
- Title: READU: Inconsistency-Driven Just-in-Time Detection and Repair of README Bugs
- Title(参考訳): READU: 不整合駆動ジャストインタイム検出とREADMEバグの修復
- Abstract要約: 本稿では,バグのジャスト・イン・タイム検出と修復のための不整合駆動手法であるREADUを提案する。
6つの人気のあるリポジトリから6000のコミットに対して、READUは75%の精度で真の陽性を検出し、0.01ドル未満のコミットを1分未満で消費する。
66のバグを報告し、そのうち44が確認され、26が修正された。
- 参考スコア(独自算出の注目度): 12.692695524978332
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Repository-level documentation, such as READMEs, is often the first point of contact between users and a repository. When this documentation is incorrect, users may encounter runtime errors or waste their time debugging. We call such mistakes in repository-level documentation README bugs. Addressing README bugs is challenging because documentation mixes prose with code, its connection to the source of truth is loose, and finding a bug still leaves developers to craft a repair. This paper presents READU, an inconsistency-driven technique for just-in-time detection and repair of README bugs. The key insight behind READU is that README bugs often manifest as inconsistencies between documentation and another source of truth: either repository-internal facts, such as source code, or repository-external facts, such as external dependencies. READU applies a high-recall commit filter, runs internal and external consistency checkers in parallel, uses an alert judge to remove false positives, and automatically synthesizes documentation patches. On 6,000 recent commits from six popular repositories including Linux and Spring Boot, READU detects 244 true positives with 75% precision, while consuming less than $0.01 and less than one minute per commit, on average. Of these true positives, READU correctly repairs 217. We report 66 found README bugs, of which (so far) 44 are confirmed and 26 are fixed.
- Abstract(参考訳): READMEsのようなリポジトリレベルのドキュメントは、しばしばユーザーとレポジトリの間の最初の接触点である。
このドキュメントが正しくない場合、ユーザは実行時のエラーに遭ったり、時間のデバッグを無駄にしたりします。
このようなミスをリポジトリレベルのドキュメントREADMEバグと呼んでいます。
READMEのバグに対処することは、ドキュメントが散文とコードとを混同しているため、難しい。
本稿では,READMEバグのジャスト・イン・タイム検出と修復のための不整合駆動手法であるREADUを提案する。
READUの背景にある重要な洞察は、READMEのバグは、しばしばドキュメントと他の情報源の矛盾として現れる:ソースコードのようなリポジトリ内部の事実、あるいは外部依存関係のようなリポジトリ外部の事実である。
READUはハイリコールコミットフィルタを適用し、内部および外部の一貫性チェッカーを並行して実行し、警告ジャッジを使用して偽陽性を除去し、自動的にドキュメントパッチを合成する。
LinuxとSpring Bootを含む6つの人気のあるリポジトリからの6000のコミットに対して、READUは75%の精度で244の真正値を検出し、平均して0.01ドル未満で1分未満のコミットを消費する。
これらの真の陽性のうち、READUは217を正しく修復する。
66例のREADMEバグが報告され,そのうち44例(現在)が確認され,26例が修正された。
関連論文リスト
- COMMITGUARD: Differential Slice Fuzzing for Commit-Induced Bug Detection [5.733954327924554]
COMMITGUARDは、コード変更を検証するためのコミット対応差分スライスベースのファジリングアプローチである。
我々は,openSSL, libpcap, leptonicaから300件のコミットに対してCOMMITGUARDを評価した。
論文 参考訳(メタデータ) (2026-08-18T05:57:09Z) - AgentDebugX: An Open-Source Toolkit for Failure Observability, Attribution, and Recovery in LLM Agents [83.37969790806069]
LLMエージェントのエラーは、エラーが表面化するステップが原因ではないことが多いため、デバッグが難しい。
Agent DebuggerXはオープンソースのフレームワークで、デバッグをDe Detect, Attribute, Recover, Rerunのクローズドループとして整理する。
コアとなるDeep Debuggerは、グローバルな軌跡理解を通じてマルチターン根本原因診断を行う。
論文 参考訳(メタデータ) (2026-07-21T06:21:13Z) - Anchored Self-Play for Code Repair [68.0728003844994]
コード修復は言語モデル(LM)の重要な機能である
本稿では,1つのモデルを強化学習で訓練し,バグを生成して修正する__generator--fixer self-play__を提案する。
BugSourceBenchでは、セルフプレイは難しいが非現実的なバグへと向かっている。
本稿では,参照バグの生成と混合のためのコード埋め込み型類似性報酬をフィクスチャトレーニングに付加することにより,小さな参照セットでセルフプレイをアンロックするAnchored Self-Play (ASP)を提案する。
論文 参考訳(メタデータ) (2026-07-03T17:51:52Z) - RepoRescue: An Empirical Study of LLM Agents on Whole-Repository Compatibility Rescue [17.088503865332402]
オープンソースライブラリやツールは広く再利用されているが、互換性の維持は高価である。
バグ修正とは異なり、互換性の回復は元の環境で動作したが、エコシステムのドリフト後に失敗するリポジトリから始まる。
193のPythonと122のJavaリポジトリからRepoRescueを構築します。
論文 参考訳(メタデータ) (2026-07-01T17:51:28Z) - Characterizing and Mitigating False-Positive Bug Reports in the Linux Kernel [14.987479226824023]
本研究は,Linuxカーネルにおける偽陽性バグレポートの総合的研究である。
我々はBugzillaとSyzkallerから収集された1,509の真正のバグと497の偽陽性を含む2,006のバグレポートのデータセットを手作業で構築する。
検索強化世代(RAG)は、様々なプロンプト戦略の中で、91%のリコールと88%のF1スコアを達成した。
論文 参考訳(メタデータ) (2026-05-08T12:48:36Z) - Outrunning LLM Cutoffs: A Live Kernel Crash Resolution Benchmark for All [57.23434868678603]
Live-kBenchは、新たに発見されたカーネルバグのエージェントをスクラップし、評価するセルフ進化ベンチマークの評価フレームワークである。
kEnvは、カーネルのコンパイル、実行、フィードバックのためのエージェントに依存しないクラッシュ解決環境である。
kEnvを用いて3つの最先端エージェントをベンチマークし、最初の試行で74%のクラッシュを解決したことを示す。
論文 参考訳(メタデータ) (2026-02-02T19:06:15Z) - BugGen: A Self-Correcting Multi-Agent LLM Pipeline for Realistic RTL Bug Synthesis [1.9291502706655312]
我々はBugGenを紹介した。これは完全な自律型マルチエージェントパイプラインで、RTLの機能的バグを生成し、挿入し、検証する。
BugGenはモジュールを分割し、クローズドループエージェントアーキテクチャを介して突然変異ターゲットを選択し、反復的な洗練とロールバック機構を採用している。
5つのOpenTitan IPブロックで評価され、BugGenは機能精度94%の500のユニークなバグを発生し、通常のマニュアル専門家の挿入より5倍速い時間当たり17.7のバグを検証した。
論文 参考訳(メタデータ) (2025-06-12T09:02:20Z) - CrashFixer: A crash resolution agent for the Linux kernel [58.152358195983155]
この作業は、システムレベルのLinuxカーネルバグのベンチマークと、Linuxカーネルで実験を実行するプラットフォームを共有するkGymの上に構築されている。
CrashFixerはLinuxカーネルのバグに適応する最初のLCMベースのソフトウェア修復エージェントである。
論文 参考訳(メタデータ) (2025-04-29T04:18:51Z) - RepoAudit: An Autonomous LLM-Agent for Repository-Level Code Auditing [8.846583362353169]
RepoAuditは、自律的なリポジトリレベルのコード監査エージェントである。
78.43%の精度で、15の現実世界のベンチマークプロジェクトにおいて40の真のバグを検出する。
また、著名なプロジェクトの185の新たなバグを検出し、そのうち174が確認または修正されている。
論文 参考訳(メタデータ) (2025-01-30T05:56:30Z) - GenAudit: Fixing Factual Errors in Language Model Outputs with Evidence [64.95492752484171]
GenAudit - 文書基底タスクの事実チェック LLM 応答を支援するためのツール。
GenAuditは、レファレンス文書でサポートされていないクレームを修正したり削除したりすることでLCMレスポンスを編集することを提案し、また、サポートしているように見える事実の参照から証拠を提示する。
GenAuditは、さまざまなドメインから文書を要約する際に、8つの異なるLCM出力でエラーを検出することができる。
論文 参考訳(メタデータ) (2024-02-19T21:45:55Z) - RAP-Gen: Retrieval-Augmented Patch Generation with CodeT5 for Automatic
Program Repair [75.40584530380589]
新たな検索型パッチ生成フレームワーク(RAP-Gen)を提案する。
RAP-Gen 以前のバグ修正ペアのリストから取得した関連する修正パターンを明示的に活用する。
RAP-GenをJavaScriptのTFixベンチマークとJavaのCode RefinementとDefects4Jベンチマークの2つのプログラミング言語で評価する。
論文 参考訳(メタデータ) (2023-09-12T08:52:56Z) - Using Developer Discussions to Guide Fixing Bugs in Software [51.00904399653609]
我々は,タスク実行前に利用可能であり,また自然発生しているバグレポートの議論を,開発者による追加情報の必要性を回避して利用することを提案する。
このような議論から派生したさまざまな自然言語コンテキストがバグ修正に役立ち、オラクルのバグ修正コミットに対応するコミットメッセージの使用よりもパフォーマンスの向上につながることを実証する。
論文 参考訳(メタデータ) (2022-11-11T16:37:33Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。