論文の概要: Abductive Vibe Coding (Extended Abstract)
- arxiv url: http://arxiv.org/abs/2601.01199v1
- Date: Sat, 03 Jan 2026 14:57:20 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-01-06 16:25:22.072959
- Title: Abductive Vibe Coding (Extended Abstract)
- Title(参考訳): Abductive Vibe Coding (Extended Abstract)
- Abstract要約: この抽象論は、ビブ符号化されたアーティファクトの妥当性に関する分析可能な半形式的理性の抽出に向けた進行中の作業について述べる。
我々のフレームワークは、直接正確性を決定するのではなく、生成したコードが適切に考慮された条件のセットを生成します。
- 参考スコア(独自算出の注目度): 5.33940904910024
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: When software artifacts are generated by AI models ("vibe coding"), human engineers assume responsibility for validating them. Ideally, this validation would be done through the creation of a formal proof of correctness. However, this is infeasible for many real-world vibe coding scenarios, especially when requirements for the AI-generated artifacts resist formalization. This extended abstract describes ongoing work towards the extraction of analyzable, semi-formal rationales for the adequacy of vibe-coded artifacts. Rather than deciding correctness directly, our framework produces a set of conditions under which the generated code can be considered adequate. We describe current efforts towards implementing our framework and anticipated research opportunities.
- Abstract(参考訳): ソフトウェアアーチファクトがAIモデル(“バイブコーディング”)によって生成される場合、ヒューマンエンジニアはそれらを検証する責任を負う。
理想的には、この検証は正当性の正式な証明を作成することによって行われる。
しかし、これは、AI生成アーティファクトの要件が形式化に抵抗する場合に、多くの実世界のビブコーディングシナリオでは実現不可能である。
この拡張抽象論は、ビブ符号化されたアーティファクトの妥当性に関する分析可能な半形式的理性の抽出に向けた進行中の作業について記述している。
我々のフレームワークは、直接正確性を決定するのではなく、生成したコードが適切に考慮された条件のセットを生成します。
本稿では,本フレームワークの実装に向けた現在の取り組みと今後の研究機会について述べる。
関連論文リスト
- Reality Is the Final Verifier: On Two Key Gaps in Agentic Software Engineering [78.51705689800838]
本稿では, 要求, モデル, 評価器の見直しに, 展開証拠を用いた保証・修正ループを提案する。
そこで我々は,人的判断,エージェント能力,計算能力に対する資源配分問題としてエージェント開発を保証した。
論文 参考訳(メタデータ) (2026-09-10T17:58:48Z) - On Automated and Explainable Provenance of AI-Generated Code [56.818202904805446]
次世代のCodeGenAIツールは、説明可能な証明の基礎の上に構築されなければならない、と我々は主張する。
本稿では,大規模実証研究とポストホック因果・解釈可能性技術を組み合わせた研究プログラムについて述べる。
論文 参考訳(メタデータ) (2026-08-03T14:50:31Z) - Formal-Method-Guided Vibe Coding: Closing the Verification Loop on AI-Generated Safety-Critical Software Through Model-Driven Engineering [40.048798975817924]
バイブコーディングは高速で、低臨界のコンシューマソフトウェアには適しています。
DO-178C、IEC 61508、ISO 26262によって管理される安全クリティカルなシステムでは、認証への道は提供されない。
フォーマルな検証を通じてビブコーディングをガイドするクローズドループパイプラインであるForgeを紹介します。
論文 参考訳(メタデータ) (2026-06-21T10:01:45Z) - VASO: Formally Verifiable Self-Evolving Skills for Physical AI Agents [57.240036084348354]
本稿では,ロボットスキルコントラクトの検証誘導自己進化のためのフレームワークであるVASOを紹介する。
VASOは論理的に一貫性のないスキル契約を検証し、グローバルおよびローカルな時間的仕様に対してスキルによって誘発される計画を検証する。
Clearpath Jackal と PX4 のクアッドコプタータスクでは、VASO は100点未満の最適化サンプルを使用して97.2% の形式的な仕様準拠に達した。
論文 参考訳(メタデータ) (2026-06-03T20:02:35Z) - Event-B Agent: Towards LLM Agent for Formal Model Synthesis and Repair [13.777416057673761]
Event-B Agentは、ソフトウェア設計のインターリーブな性質にインスパイアされた、新しいフレームワークである。
Event-B Agentは、エンド・ツー・エンドの形式モデル合成と修復において、ベースラインを大幅に上回ることを示す。
以上の結果から,Event-B Agent は形式的モデル合成と修復の修正に向けた有望なステップであることが示唆された。
論文 参考訳(メタデータ) (2026-05-17T14:23:45Z) - Agentic AI-assisted coding offers a unique opportunity to instill epistemic grounding during software development [0.02058747290260746]
チャットベースのビブコーディングは、エージェントの足場を使用したAI支援エージェントソフトウェア開発に進化した。
現在のトレンドの1つは、プロジェクトやメソッドスコープドドキュメントのような、この計画文書を超えてドキュメントを活用することです。
ここでは、コミュニティが管理するフィールドスコープの基盤文書であるGROUNDING.mdを提案する。
論文 参考訳(メタデータ) (2026-04-23T14:50:35Z) - Intent Formalization: A Grand Challenge for Reliable Coding in the Age of AI Agents [7.228124845671868]
エージェントAIシステムは、驚くほどの頻度でコードを生成することができる。
生成されたコードが実際にユーザが意図した通りに動作するようにします。
論文 参考訳(メタデータ) (2026-03-17T21:28:59Z) - Veri-Sure: A Contract-Aware Multi-Agent Framework with Temporal Tracing and Formal Verification for Correct RTL Code Generation [4.723302382132762]
シリコングレードの正しさは、 (i) シミュレーション中心の評価の限られたカバレッジと信頼性、 (ii) 回帰と修復幻覚、 (iii) エージェントハンドオフ間で意図が再解釈される意味的ドリフトによってボトルネックが残っている。
エージェントの意図を整合させる設計契約を確立するマルチエージェントフレームワークであるVeri-Sureを提案する。
論文 参考訳(メタデータ) (2026-01-27T16:10:23Z) - Enhancing Formal Software Specification with Artificial Intelligence [1.4217721366366873]
形式的ソフトウェア仕様は、早期エラー検出と明示的な不変性を可能にすることが知られている。
表記のオーバーヘッドが高く、伝統的な形式言語を使うのに必要な専門知識があるため、工業的採用が限られている。
近年の人工知能の進歩は、これらのコストを大幅に削減しつつ、形式仕様の利点の多くを維持することができる。
論文 参考訳(メタデータ) (2026-01-11T13:53:22Z) - Simple Agents Outperform Experts in Biomedical Imaging Workflow Optimization [69.36509281190662]
生産レベルのコンピュータビジョンツールを科学データセットに適応させることは、重要な"ラストマイル"ボトルネックである。
我々は、AIエージェントを使ってこの手動コーディングを自動化し、最適なエージェント設計のオープンな問題に焦点を当てる。
簡単なエージェントフレームワークが、人間-専門家のソリューションよりも優れた適応コードを生成することを実証する。
論文 参考訳(メタデータ) (2025-12-02T18:42:26Z) - ThinkFake: Reasoning in Multimodal Large Language Models for AI-Generated Image Detection [51.93101033997245]
AI生成画像のリアリズムの増大は、誤情報やプライバシー侵害に対する深刻な懸念を引き起こしている。
我々は、AI生成画像検出のための新しい推論に基づく一般化可能なフレームワークThinkFakeを提案する。
我々は、ThinkFakeがGenImageベンチマークで最先端の手法より優れており、挑戦的なLOKIベンチマークで強力なゼロショットの一般化を示すことを示す。
論文 参考訳(メタデータ) (2025-09-24T07:34:09Z) - Re:Form -- Reducing Human Priors in Scalable Formal Software Verification with RL in LLMs: A Preliminary Study on Dafny [78.1575956773948]
強化学習(RL)で訓練された大規模言語モデル(LLM)は、信頼性も拡張性もない、という大きな課題に直面している。
有望だが、ほとんど報われていない代替手段は、フォーマルな言語ベースの推論である。
生成モデルが形式言語空間(例えばダフニー)で機能する厳密な形式体系におけるLLMの接地は、それらの推論プロセスと結果の自動的かつ数学的に証明可能な検証を可能にする。
論文 参考訳(メタデータ) (2025-07-22T08:13:01Z) - Leveraging LLMs for Formal Software Requirements -- Challenges and Prospects [0.0]
VERIFAI1は、このギャップを埋めるための自動化および半自動化アプローチを調査することを目的としている。
本論文では, 課題の繰り返しと今後の研究方向性を明らかにするために, 関連文献の予備的な合成について述べる。
論文 参考訳(メタデータ) (2025-07-18T19:15:50Z) - VEL: A Formally Verified Reasoner for OWL2 EL Profile [0.0]
VEL はマシンチェック可能な正当性証明を備えた公式な EL++ 推論器である。
本研究は,理論および実装レベルでの正確性を確保するために,推論アルゴリズムの機械化の必要性を実証するものである。
論文 参考訳(メタデータ) (2024-12-11T19:17:28Z) - RLeXplore: Accelerating Research in Intrinsically-Motivated Reinforcement Learning [50.55776190278426]
外部報酬は、特定のタスクにおける強化学習(RL)エージェントを効果的に導くことができる。
RLeXploreは,8つの最先端固有の報酬手法の信頼性のある実装を提供する,統一的で高度にモジュール化されたプラグイン・アンド・プレイ・フレームワークである。
論文 参考訳(メタデータ) (2024-05-29T22:23:20Z) - Generation Probabilities Are Not Enough: Uncertainty Highlighting in AI Code Completions [54.55334589363247]
本研究では,不確実性に関する情報を伝達することで,プログラマがより迅速かつ正確にコードを生成することができるかどうかを検討する。
トークンのハイライトは、編集される可能性が最も高いので、タスクの完了が早くなり、よりターゲットを絞った編集が可能になることがわかりました。
論文 参考訳(メタデータ) (2023-02-14T18:43:34Z) - Hierarchical Variational Autoencoder for Visual Counterfactuals [79.86967775454316]
条件変量オート(VAE)は、説明可能な人工知能(XAI)ツールとして注目されている。
本稿では, 後部の効果がいかに緩和され, 対物的効果が成功するかを示す。
本稿では,アプリケーション内の分類器を視覚的に監査できる階層型VAEについて紹介する。
論文 参考訳(メタデータ) (2021-02-01T14:07:11Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。