論文の概要: ProDebug: An Automated Debugging System for Prolog
- arxiv url: http://arxiv.org/abs/2605.27124v1
- Date: Tue, 26 May 2026 14:57:50 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-27 17:51:42.281244
- Title: ProDebug: An Automated Debugging System for Prolog
- Title(参考訳): ProDebug: Prolog用の自動デバッグシステム
- Abstract要約: Prologは宣言型プログラミング言語としてよく知られている。
多くの学生は、命令型言語で見慣れたデバッグメカニズムが欠けているため、Prologが難しいと感じている。
大規模な授業では、学生にタイムリーでパーソナライズされたフィードバックを提供することの難しさが増す。
- 参考スコア(独自算出の注目度): 5.6063157789389875
- License: http://creativecommons.org/licenses/by-nc-sa/4.0/
- Abstract: Prolog is a well-known declarative programming language commonly used in introductory courses on logic and reasoning. However, many students find Prolog challenging because it lacks the familiar debugging mechanisms found in imperative languages. In large classes, this difficulty is exacerbated by the challenge of providing timely and personalized feedback to students. In this work, we introduce ProDebug, the first tool to combine Large Language Models (LLMs) with spectrum-based and mutation-based techniques for automated debugging of Prolog assignments. ProDebug automatically identifies faults and proposes bug repairs for student Git submissions. Faults are detected using three approaches--spectrum-based, mutation-based, and LLM reasoning--while repairs are generated using mutation-based techniques and LLMs. Our evaluation on 1499 buggy student submissions from a bachelor's level programming class demonstrates the potential of automated, LLM-augmented feedback systems to scale support for declarative programming education.
- Abstract(参考訳): Prologは論理学と推論の入門コースでよく使われる宣言型プログラミング言語である。
しかし、多くの学生は、命令型言語で見慣れたデバッグメカニズムが欠けているため、Prologが難しいと感じている。
大規模な授業では、学生にタイムリーでパーソナライズされたフィードバックを提供することの難しさが増す。
本稿では, Prolog 代入の自動デバッギングのためのスペクトルベースおよび突然変異ベースのテクニックと, LLM(Large Language Models)を併用した最初のツールである ProDebug を紹介する。
ProDebugは自動的に障害を特定し、学生Gitのサブミッションのバグ修正を提案する。
欠陥は、スペクトルベース、突然変異ベース、LSM推論の3つのアプローチを用いて検出される。
学士レベルのプログラミングクラスからの1499人のバギー学生に対する評価は、宣言型プログラミング教育をサポートするためのLLM拡張フィードバックシステムの可能性を示している。
関連論文リスト
- Beyond the Traceback: Using LLMs for Adaptive Explanations of Programming Errors [52.619793817715326]
本稿では,LLM生成したPythonエラーメッセージを,多段階のクラウドソースで評価する。
LLMで書き直されたメッセージは主観評価を著しく向上させたが、これらの評価結果は客観的デバッグ性能の統計的に有意な改善には至らなかった。
これは重要なヒューマンとAIの相補性ギャップを浮き彫りにしている。
論文 参考訳(メタデータ) (2026-08-21T09:14:28Z) - How LLMs Fail and Generalize in RTL Coding for Hardware Design? [56.361436215029045]
我々は,認知理論に触発された問題解決性に基づく新しい誤り分類法を導入する。
我々の分類学は、障害を構文、意味、解決可能な機能、解決不可能な機能タイプに分類する。
論文 参考訳(メタデータ) (2026-04-26T14:34:49Z) - InspectCoder: Dynamic Analysis-Enabled Self Repair through interactive LLM-Debugger Collaboration [71.18377595277018]
大きな言語モデル(LLM)は、診断が難しい複雑なロジックエラーを伴うバグの多いコードを生成することが多い。
対話型デバッガ制御による動的解析を LLM に委ねる初のエージェントプログラム修復システムである InspectCoder を提案する。
論文 参考訳(メタデータ) (2025-10-21T06:26:29Z) - DebugTA: An LLM-Based Agent for Simplifying Debugging and Teaching in Programming Education [32.673843958049254]
プログラミングと指導(DT)タスクでは、学生は誤ったコードを修正する支援を受ける。
DebugTA, 標準コード検索専用ツール, 参照コード調整用変数置換, リアルタイムコード解析用外部コンパイラを提案する。
DebugTAは、計算コストを大幅に削減しつつ、教育効率を継続的に改善することを示す。
論文 参考訳(メタデータ) (2025-10-13T07:17:18Z) - Do AI models help produce verified bug fixes? [62.985237003585674]
大規模言語モデルは、ソフトウェアバグの修正に使用される。
本稿では,プログラマが大規模言語モデルを用いて,自身のスキルを補完する方法について検討する。
その結果は、プログラムバグに対する保証された修正を提供するAIとLLMの適切な役割への第一歩となる。
論文 参考訳(メタデータ) (2025-07-21T17:30:16Z) - NL-Debugging: Exploiting Natural Language as an Intermediate Representation for Code Debugging [84.28260138164391]
大規模言語モデル(LLM)の最近の進歩は、コード関連タスクを強化するために自然言語推論を活用することに注意を向けている。
本稿では,自然言語を中間表現として用い,コード改善のための新しいフレームワークであるNL-GINGを紹介する。
論文 参考訳(メタデータ) (2025-05-21T10:38:50Z) - Self-Steering Language Models [113.96916935955842]
DisCIPL は "self-steering" 言語モデル (LM) の手法である。
DisCIPLは、Followerモデルの集団によって実行されるタスク固有の推論プログラムを生成する。
我々の研究は、高度に並列化されたモンテカルロ推論戦略の設計空間を開く。
論文 参考訳(メタデータ) (2025-04-09T17:54:22Z) - VerilogCoder: Autonomous Verilog Coding Agents with Graph-based Planning and Abstract Syntax Tree (AST)-based Waveform Tracing Tool [4.027984601764008]
We propose VerilogCoder, a system of multiple Artificial Intelligence (AI) agent for Verilog code generation。
提案手法は、構文的に94.2%、機能的に正当なVerilogコードを生成する。
論文 参考訳(メタデータ) (2024-08-15T20:06:06Z) - Decoding Logic Errors: A Comparative Study on Bug Detection by Students
and Large Language Models [5.162225137921625]
大規模言語モデル(LLM)は、最近、様々な計算タスクにおいて驚くべきパフォーマンスを示した。
GPT-3 と GPT-4 の2つの LLM の性能について検討した。
論文 参考訳(メタデータ) (2023-11-27T17:28:33Z) - Benchmarking Large Language Models for Automated Verilog RTL Code
Generation [21.747037230069854]
有用なVerilogを生成するために,大規模言語モデル(LLM)を特徴付ける。
機能解析のためのテストベンチと,Verilogコードの構文をテストするフローからなる評価フレームワークを構築した。
その結果,LLMの微調整結果は,構文的に正しいコードを生成する能力が高いことがわかった。
論文 参考訳(メタデータ) (2022-12-13T16:34:39Z) - Self-Supervised Log Parsing [59.04636530383049]
大規模ソフトウェアシステムは、大量の半構造化ログレコードを生成する。
既存のアプローチは、ログ特化や手動ルール抽出に依存している。
本稿では,自己教師付き学習モデルを用いて解析タスクをマスク言語モデリングとして定式化するNuLogを提案する。
論文 参考訳(メタデータ) (2020-03-17T19:25:25Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。