論文の概要: Lingering Authority: Revocable Resource-and-Effect Capabilities for Coding Agents
- arxiv url: http://arxiv.org/abs/2606.22504v1
- Date: Sun, 21 Jun 2026 13:52:37 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-25 14:49:46.412907
- Title: Lingering Authority: Revocable Resource-and-Effect Capabilities for Coding Agents
- Title(参考訳): Lingering Authority: コーディングエージェントのリソース・アンド・エフェクト機能
- Authors: Igor Santos-Grueiro,
- Abstract要約: PortICOは、プランナーに露出する機能のリファレンスモニターである。
明示的なタスクコントラクトを初期機能にコンパイルし、ルールを付与し、信頼できるクロージャ述語、グローバルな否定ルールを付与する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Coding agents often receive broad tool access for an entire task, even when a resource is needed only for one subgoal. We call this gap lingering authority: a temporary resource/effect capability remains exposed after the episode that justified it has closed. PORTICO is a reference monitor for revocable capabilities exposed to the planner. It compiles an explicit task contract into initial capabilities, grant rules, trusted closure predicates, and global deny rules. A request-grant-invoke lifecycle materializes expansions as opaque, epoch-bound handles. Closure removes those handles from the next planner interface and rejects stale replay before side effects. The monitor assumes mediated tools and a sound typed catalog. In controlled coding-agent tasks, PORTICO records no executed contract-forbidden effects in the evaluated runs, while controlled grants recover boundary work blocked by a fixed narrow envelope. A non-revoking comparator receives the same initial envelope and the same grants at the same turns. On the closure slice, both systems match task success, scope compliance, and all pre-closure decisions; PORTICO then rejects 10/10 post-closure reuses, while the comparator permits 10/10. A deterministic stale-write audit records 0/6 versus 6/6 executed forbidden effects. Scripted traces and six live model traces over file writes, git mutation, and network egress show the same split. In a four-episode same-policy diagnostic, broad request exposure preserves zero executed forbidden effects but raises blocked proposals from 67 to 84. Frozen real-repository runs, with commits and traces recorded, exercise the same lifecycle on real project layouts.
- Abstract(参考訳): コーディングエージェントは、リソースが1つのサブゴールにのみ必要である場合でも、タスク全体に対して幅広いツールアクセスを受け取ることが多い。
一時的なリソース/エフェクトの能力は、それが閉鎖されたことを正当化したエピソードの後に明らかにされ続けています。
PortICOは、プランナーに公開する無効化機能のためのリファレンスモニターである。
明示的なタスクコントラクトを初期機能にコンパイルし、ルールを付与し、信頼できるクロージャ述語、グローバルな否定ルールを付与する。
request-grant-invokeライフサイクルは、不透明でエポックバウンドなハンドルとして拡張を実現する。
Closureは次のプランナーインターフェイスからハンドルを取り除き、サイドエフェクトの前に古いリプレイを拒否する。
モニターは、仲介ツールとサウンドタイプ付きカタログを仮定する。
制御されたコーディングエージェントタスクでは、PortICOは評価された実行において実行されたコントラクト禁止効果を記録せず、制御された権限は、固定された狭い封筒でブロックされた境界処理を回復する。
非取り消しコンパレータは同じ初期封筒を受け取り、同じターンで同じ付与を行う。
PortICOは10/10の閉鎖後再利用を拒絶し、コンパレータは10/10を許可する。
決定論的ストールライト監査は、実行禁止効果に対して0/6を記録する。
スクリプトトレースと6つのライブモデルトレース ファイル書き込み、git変異、ネットワークエクスプレスは、同じ分割を示している。
4段階の同一政治診断では、広帯域要求露光は、実行禁止効果をゼロに保ちながら、67から84までのブロックされた提案を提起する。
コミットとトレースを記録して、実際のプロジェクトのレイアウトで同じライフサイクルを実行する。
関連論文リスト
- Cordon: Semantic Transactions for Tool-Using LLM Agents [11.567293065381918]
本稿では,コミット前にエージェント効果のステージングと検証を行うトランザクションランタイムシステムであるCordonを紹介する。
適度な承認とレイテンシのオーバーヘッドで、良質なタスク補完を保ちながら、不可逆的な効率の失敗を減らす。
論文 参考訳(メタデータ) (2026-06-16T06:21:14Z) - Regimes: An Auditable, Held-Out-Gated Improvement Loop Demonstrated on LongMemEval with ActiveGraph [0.0]
イベントソースのエージェントランタイムは、制御された改善をファーストクラスのワークフローに変換する。
エージェントの状態が追加のみのイベントログの決定論的プロジェクションである場合、障害が記録され、実行がログから正確にリプレイされ、候補パッチスコープがタイプされたパイプラインシームに反映され、ゲートが監査可能である。
我々は、ActiveGraphランタイムのループであるRegimesでこれを実証し、失敗した評価を診断し、パイプラインポイントで修復を提案し、静的チェック、サンドボックスの実行、インサンプル評価、ホールドアウトバリデーションの後にのみそれを促進します。
論文 参考訳(メタデータ) (2026-06-08T23:04:35Z) - The Path Matters: Learning a Token-Commitment Policy for Diffusion Language Models [52.93186090124315]
トークンのコミットメントは、再利用可能なトレースステートポリシとして学ぶことができる、と私たちは主張する。
凍結拡散言語モデルのためにこのポリシーをインスタンス化する軽量プラグインコントローラであるTraceLockを紹介する。
論文 参考訳(メタデータ) (2026-05-23T18:23:46Z) - Verify-Gated Completion as Admission Control in a Governed Multi-Agent Runtime: A Bounded Architecture Case Study [0.6875312133832079]
制御されたマルチエージェントランタイムの入出力制御パターンとして,検証ゲート補完について検討する。
観測条件下では,読み取り専用検証ゲートとパケット化入力記録が検査可能で,フェールクロースされた。
論文 参考訳(メタデータ) (2026-05-18T07:52:13Z) - Affordance Agent Harness: Verification-Gated Skill Orchestration [45.231685718099264]
Affordance groundingは、オープンワールドのシーンでエージェントがどこでどのように対話すべきかを特定する必要がある。
本稿では,エビデンスストアとコストコントロールを備えたクローズドループランタイムであるAffordance Agent Harnessを提案する。
論文 参考訳(メタデータ) (2026-05-01T13:45:16Z) - IMPACT-CYCLE: A Contract-Based Multi-Agent System for Claim-Level Supervisory Correction of Long-Video Semantic Memory [73.22944697933603]
既存のパイプラインは不透明でエンドツーエンドの出力を生成し、検査の中間状態は公開しない。
IMPACT-Cycleは,マルチモーダル反復クレームレベルのメンテナンスとして,長時間ビデオ理解を再構築するマルチエージェントシステムである。
論文 参考訳(メタデータ) (2026-04-22T03:03:33Z) - Compiling Activation Steering into Weights via Null-Space Constraints for Stealthy Backdoors [48.881343993730844]
安全性に整合した大規模言語モデル(LLM)は、現実世界のパイプラインにますますデプロイされている。
敵は通常の評価では動作しないバックドアのチェックポイントを配布することができる。
最近のポストホック重み付け法は、そのようなバックドアを注入するための効率的なアプローチを提供する。
論文 参考訳(メタデータ) (2026-04-14T06:48:33Z) - A Physical Agentic Loop for Language-Guided Grasping with Execution-State Monitoring [5.437966695589128]
我々は、接地された実行状態上で動作する有界な実施エージェントとして言語誘導の把握を再構築する。
未修正の学習操作プリミティブをラップする物理エージェントループを導入する。
眼内カメラD405を用いた移動マニピュレータのループを検証した。
論文 参考訳(メタデータ) (2026-04-08T08:01:35Z) - OpenKedge: Governing Agentic Mutation with Execution-Bound Safety and Evidence Chains [2.124730017640531]
OpenKedgeは、突然変異を支配プロセスとして再定義するプロトコルである。
EEC(Intent-to-Execution Evidence Chain)は、意図、文脈、政策決定、実行境界、成果を統一された系統にリンクする。
マルチエージェントのコンフリクトシナリオとクラウドインフラストラクチャの変異に対してOpenKedgeを評価した。
論文 参考訳(メタデータ) (2026-04-07T22:51:08Z) - AgentSys: Secure and Dynamic LLM Agents Through Explicit Hierarchical Memory Management [47.49917373646469]
既存の防御は肥大した記憶を与えられたまま扱い、回復力を維持することに集中する。
我々は、明示的なメモリ管理を通じて間接的なインジェクションを防御するフレームワークであるAgentSysを紹介する。
論文 参考訳(メタデータ) (2026-02-07T06:28:51Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。