論文の概要: ATM: CID-Brokered Pre-Write Admission for Multi-Agent Code Co-Synthesis
- arxiv url: http://arxiv.org/abs/2607.00041v1
- Date: Mon, 29 Jun 2026 16:02:38 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-02 19:56:07.590524
- Title: ATM: CID-Brokered Pre-Write Admission for Multi-Agent Code Co-Synthesis
- Title(参考訳): ATM: マルチエージェントコード合成のためのCID-Brokeredプリライト・アドミッション
- Abstract要約: AI-Atomic-Framework (ATM) は、単一のガバナンスドメイン内で動作するソフトウェアエージェントのための仕様ベースのガバナンス基盤である。
ATMは、タスクインテント、リポジトリの範囲、書き込みの許可、検証、エビデンス義務を1つのガバナンスチェーンにバインドする。
結果は、観測された単一ドメイン設定における実現可能性、監査可能性、およびバウンドリカビリティをサポートするが、広範な比較優位性やクロスクローンガバナンスは主張しない。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Multi-agent LLM systems can decompose software-engineering work into planning, generation, validation, and repair, but a narrower systems problem remains: before any governed shared mutation is applied, a system must decide which concurrently formed write intents may proceed in parallel, which require deterministic composition or serialization, and which must take a fail-closed path. We address this problem with the AI-Atomic-Framework (ATM), a specification-grounded governance substrate for software agents operating within a single governance domain. ATM binds task intent, repository scope, write admission, validation, and evidence obligations into one governance chain. A Content Identifier (CID) broker serves as the shared-mutation admission subsystem. Adapter-guided atomization maps write intents to semantic atoms and bounded regions; when persistent atom-map coverage is incomplete, virtual atoms provide temporary auditable governance units for conservative comparison and routing. Governed shared writes are ultimately applied by a neutral steward rather than directly by proposing agents. Evaluation combines controlled, field, adoption, and extension evidence, including a 12-scenario deterministic design matrix, three archived runner cases, ATM-AdmissionBench, three archived same-file boundary cases, a three-week external-adopter study, and an operational recovery-routing benchmark. The results support feasibility, auditability, and bounded recoverability within the observed single-domain settings, but do not claim broad comparative superiority or cross-clone governance.
- Abstract(参考訳): マルチエージェントLLMシステムは、ソフトウェアエンジニアリングの作業を計画、生成、検証、修復に分解することができるが、より狭いシステム問題は残る。
AI-Atomic-Framework(ATM)は、単一のガバナンスドメイン内で動作するソフトウェアエージェントのための、仕様ベースのガバナンス基盤である。
ATMは、タスクインテント、リポジトリの範囲、書き込みの許可、検証、エビデンス義務を1つのガバナンスチェーンにバインドする。
Content Identifier (CID)ブローカは、共有変更入力サブシステムとして機能する。
適応誘導原子化マップは意味的原子や有界領域への意図を記述する; 永続的な原子マップのカバレッジが不完全であれば、仮想原子は保守的な比較とルーティングのための一時的な監査可能なガバナンス単位を提供する。
統治された共有書き込みは、エージェントの提案によって直接ではなく、最終的には中立的なスチュワードによって適用される。
評価には、制御、フィールド、採用、拡張エビデンス、12-scenario決定論的設計マトリクス、3つのアーカイブされたランナーケース、ATM-AdmissionBench、3つのアーカイブされた同ファイル境界ケース、3週間の外部アドミニストレーション、運用中のリカバリルーティングベンチマークなどが含まれている。
結果は、観測された単一ドメイン設定における実現可能性、監査可能性、およびバウンドリカビリティをサポートするが、広範な比較優位性やクロスクローンガバナンスは主張しない。
関連論文リスト
- AgentCompass: A Unified Evaluation Infrastructure for Agent Capabilities [55.23913617185508]
Agentは、LLM(Large Language Models)ベースのエージェントを評価するための、オープンソース、軽量、インフラストラクチャである。
Benchmark、Harness、Environmentという3つの独立したコンポーネントに関する評価プロセスを編成する。
フォールトトレラントなランタイムと、報酬ハックのような障害モードを透過的に診断する包括的なトラジェクトリ分析ツールを備えている。
論文 参考訳(メタデータ) (2026-07-15T11:11:17Z) - EfficientGraph-RAG: Structured Retrieval-State Management for Cross-Task Retrieval-Augmented Generation [45.66803833786235]
検索拡張世代は、外部知識で大規模言語モデルを構築する標準的な方法となっている。
EfficientGraph-RAGは、3つの評価されたLongBench検索スタイルのサブセットで平均された回答品質の指標で第1位である。
論文 参考訳(メタデータ) (2026-05-25T03:08:53Z) - PRIMA: Operational Patterns for Resilient Multi-Agent Research with Verifiable Identity and Convergent Feedback [0.0]
PRIMAは、複数時間にわたる協調型マルチエージェント研究システムとして運用されている。
主なコントリビューションは、生存可能な障害モードのための3つの運用パターンである。
グラフ同型ケーススタディは、生成されたアーティファクトのアーキテクチャ的クレームを根拠にしている。
論文 参考訳(メタデータ) (2026-05-23T23:27:46Z) - SARC: A Governance-by-Architecture Framework for Agentic AI Systems [0.0]
エージェントAIシステムは、ツール、サブエージェント、外部サービスを通じてますます機能するが、ガバナンスコントロールは、プロンプト、ダッシュボード、ポストホックドキュメンテーションにアタッチされることが多い。
SARCは、制約をステート、アクションスペース、報酬と共に第一級の仕様オブジェクトとして扱うツール使用エージェントのためのランタイムガバナンスアーキテクチャである。
SARCは厳密な述語の下でゼロのハードコントラスト違反を実行し、その宣言されたPAAのスロットリング応答は、ポリシー・アズ・コードのみと比較して、ソフトウインドウのオーバーアーを89.5%削減する。
論文 参考訳(メタデータ) (2026-05-08T13:34:36Z) - Authorization Propagation in Multi-Agent AI Systems: Identity Governance as Infrastructure [0.0]
我々はこの問題を認可伝搬と呼ぶ。
RBAC、ABAC、ReBACのような古典的なアクセス制御モデルでは、完全には対処できない。
この論文は、認可伝達をワークフローレベルのプロパティとして形式化し、3つのサブプロブレムを特定し、マルチエージェントAIシステムにおける認可アーキテクチャの7つの構造的要件を導出する。
論文 参考訳(メタデータ) (2026-05-06T20:56:17Z) - A Trace-Based Assurance Framework for Agentic AI Orchestration: Contracts, Testing, and Governance [0.22940141855172028]
本稿では,Large Language Models (LLM) を用いたエージェントAIシステムの保証フレームワークを提案する。
実行は、明示的なステップとトレースコントラクトを備えたメッセージ・アクション・トレース(MAT)として実装される。
このフレームワークは、有界摂動に対する予算付き反例探索として定式化されたストレステストを含む。
論文 参考訳(メタデータ) (2026-03-18T10:23:48Z) - From Prompt-Response to Goal-Directed Systems: The Evolution of Agentic AI Software Architecture [0.0]
Agentic AIは、ステートレスでプロンプト駆動型生成モデルからゴール指向システムへのアーキテクチャ移行を表す。
本稿では、知的エージェント理論と現代のLCM中心のアプローチを結びつけることによって、この遷移を考察する。
この研究は、標準化されたエージェントループ、登録、監査可能な制御機構への収束を特定する。
論文 参考訳(メタデータ) (2026-02-11T03:34:48Z) - NEMO: Execution-Aware Optimization Modeling via Autonomous Coding Agents [41.70615840873279]
本稿では,決定問題の自然言語記述を形式的に実行可能な数学的最適化実装に変換するシステムNEMOを提案する。
NEMOは、LLMとAPIベースのインタラクションに類似したファーストクラスの抽象化として扱われる、自律型コーディングエージェント(ACAs)とのリモートインタラクションに焦点を当てている。
ACAはサンドボックス環境で実行されるため、NEMOが生成したコードはビルドによって実行可能であり、自動検証と修復が可能である。
論文 参考訳(メタデータ) (2026-01-29T07:57:23Z) - From Laboratory to Real-World Applications: Benchmarking Agentic Code Reasoning at the Repository Level [38.24989792739013]
本稿では,帰納的アサーション検証を中心とした診断ベンチマークであるRepoReasonを紹介する。
本研究では, 環境を意味として利用し, 地盤構造を再現する実行駆動型突然変異フレームワークを実装した。
我々の発見は、次世代のエージェントソフトウェアエンジニアリングを最適化するための、詳細なホワイトボックスの洞察を提供する。
論文 参考訳(メタデータ) (2026-01-07T09:22:28Z) - Laser: Governing Long-Horizon Agentic Search via Structured Protocol and Context Register [38.329346729947304]
本稿では,エージェント検索の安定化とスケーリングのためのフレームワークであるLaserを紹介する。
レーザーはエージェントの振る舞いを計画、タスク解決、振り返りの3つの空間に整理する。
レーザーは、プロンプトオンリーと微調整設定の両方で既存のエージェント検索ベースラインを一貫して上回る。
論文 参考訳(メタデータ) (2025-12-23T15:53:33Z) - AI Bill of Materials and Beyond: Systematizing Security Assurance through the AI Risk Scanning (AIRS) Framework [31.261980405052938]
人工知能(AI)システムの保証は、ソフトウェアサプライチェーンセキュリティ、敵機械学習、ガバナンスドキュメントに分散している。
本稿では,AI保証の運用を目的とした脅威モデルに基づくエビデンス発生フレームワークであるAI Risk Scanning(AIRS)フレームワークを紹介する。
論文 参考訳(メタデータ) (2025-11-16T16:10:38Z) - Diagnose, Localize, Align: A Full-Stack Framework for Reliable LLM Multi-Agent Systems under Instruction Conflicts [75.20929587906228]
LLM(Large Language Model)を利用したマルチエージェントシステム(MAS)は、複雑なタスクにおける協調推論、ツールの使用、役割特化調整を急速に進めている。
しかし、信頼性クリティカルなデプロイメントは、体系的な障害モード、すなわち命令の競合による階層的コンプライアンスによって妨げられている。
論文 参考訳(メタデータ) (2025-09-27T08:43:34Z) - MA-RAG: Multi-Agent Retrieval-Augmented Generation via Collaborative Chain-of-Thought Reasoning [36.3918410061572]
MA-RAGは、複雑な情報探索タスクにおける固有の曖昧さと推論の問題に対処する。
エンドツーエンドの微調整や分離されたコンポーネント拡張に依存する従来のRAGメソッドとは異なり、MA-RAGは特別なAIエージェントの協調的なセットを編成する。
本結果は,検索強化システムにおける協調的,モジュール型推論の有効性を浮き彫りにしたものである。
論文 参考訳(メタデータ) (2025-05-26T15:05:18Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。