論文の概要: Five Primitives for Governing Autonomous AI Agents at Runtime
- arxiv url: http://arxiv.org/abs/2608.26696v1
- Date: Thu, 27 Aug 2026 06:53:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-28 16:30:58.27802
- Title: Five Primitives for Governing Autonomous AI Agents at Runtime
- Title(参考訳): 実行時に自律型AIエージェントを統治する5つの原始
- Abstract要約: 自律的なAIエージェントの管理は問題であり、モデルアライメントの問題ではない、と私たちは主張する。
行動を起こす前に答えなければならない質問から5つのプリミティブを導き出す。
エージェントのアクションが実行前にポリシーに対して媒介される実装について述べる。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Enterprise deployments of autonomous AI agents inherit a control model built for human users and long-lived services, and the fit fails in three specific ways: agent principals are ephemeral, appearing and vanishing faster than provisioning; their actions are selected by a model rather than programmed, so the set of things they may attempt is not known in advance; and the population is discovered rather than provisioned, because anyone who can call an API can create one. We argue that governing such agents is a runtime problem -- not a model-alignment problem and not a build-time problem -- and we derive five primitives from the questions that must be answered before an action takes effect and after it has: discovery, identity, governance, attestation, and supply chain. For each we state what fails if it is absent and why the others cannot structurally supply it. We describe an implementation in which an agent's action is mediated against policy before it takes effect, authorised against a per-tenant action vocabulary, and recorded in a hash-linked signed ledger a third party can verify with the vendor out of the loop. We report what the architecture costs: the enforcement point sits on the request's critical path, identity requires a sidecar per workload, and fail-closed mediation converts availability incidents into denial. We are explicit about implementation status: four primitives are built and running in private pilots, and the fifth is built as separate tooling and not yet integrated into the request path. We keep it in the set deliberately: a five-part decomposition that exactly matches what its authors happened to build is not a taxonomy but a description of a codebase.
- Abstract(参考訳): エージェントプリンシパルは、プロビジョニングよりも短命で、出現し、消滅する。それらのアクションは、プログラムされたモデルではなく、モデルによって選択される。
このようなエージェントの管理は実行時問題(モデルアライメントの問題ではなく、ビルド時の問題)であり、アクションが効く前に答えなければならない質問から5つのプリミティブ(発見、アイデンティティ、ガバナンス、検証、サプライチェーン)を導き出します。
それぞれについて、もし欠落している場合の失敗と、他のメンバが構造的にそれを供給できない理由を述べています。
本稿では、エージェントのアクションが実行前にポリシーに対して仲介され、テナント毎のアクションボキャブラリに対して認可され、ハッシュリンクされた署名付き台帳に記録された実装について述べる。
実行ポイントは要求のクリティカルパスに位置し、アイデンティティはワークロード毎にサイドカーを必要とし、フェイルクローズされた仲介は可用性インシデントを否定的に変換する。
4つのプリミティブがプライベートパイロットで構築され、実行され、5番目のプリミティブは別個のツールとして構築され、リクエストパスにはまだ統合されていません。
著者が構築したものと正確に一致する5つの部分の分解は、分類ではなく、コードベースの記述です。
関連論文リスト
- Where Accountability Lives: Mapping Human Responsibility to Workflow Artifacts in Agentic Software Development [0.0]
コーディングエージェントの作者、プルリクエストのオープン、プロダクションリポジトリ内のプッシュコード。
アーティファクトを残すワークフローイベント、エージェントによるコーディングツール4つ、および7つのプロバイダによるポリシー文書18つについて、それぞれについて読んでいます。
あるプロバイダは、タスクを割り当てた開発者が結果のプルリクエストを承認することを禁じる。別のプロバイダは、設定されたリスクしきい値以下でプルリクエストを承認し、レビューを無効にできるエージェントを文書化する。
我々は、強制的、助言的、欠落した検証の通常の3方向の区別をグリッドに置き換え、メカニズムがチェックを誰が実行したかで補完するかどうかを区別する。
論文 参考訳(メタデータ) (2026-08-16T11:11:04Z) - ScrambleToolBench: Agents Search Exhaustively Even When Their Own Map Points to the Next Step [74.83535434786145]
ScrambleToolBenchは,行動推論の分離を目的とした対話型端末ベンチマークである。
このベンチマークでは、エージェントがテストとエラーのインタラクションを通じて、隠されたツールの振る舞いを明らかにする必要がある。
現状の言語モデルに対する我々の評価は、初期発見が成功しても頑健な適応にはならないことを示している。
論文 参考訳(メタデータ) (2026-08-03T15:07:46Z) - From Profiling to Synthesis: Benchmarking Implicit Behavioral Alignment in Personalized LLM Agents [56.187590188698955]
大規模言語モデルは、ますます有能な自律エージェントを可能にしてきたが、そのようなエージェントを実用的に有効にするためには、パーソナライズが不可欠である。
最近のベンチマークではエージェントのパーソナライゼーションの評価が始まっているが、それらは主に静的な選好スナップショット、固定されたインタラクションログ、あるいは事前に定義されたユーザプロファイルに対する質問応答に依存している。
縦断的相互作用履歴から構築した暗黙的行動アライメントのベンチマークであるIBA-Benchを紹介する。
IBA-Agentは、広範囲な検索と軌道レベルのアライメントを通じて競合する優先順位を調整するエージェントフレームワークである。
論文 参考訳(メタデータ) (2026-08-03T12:52:04Z) - Agentic Cloud Decoys: A Deception-Driven Framework for Autonomous Intrusion Investigation [0.0]
我々は,高忠実度クラウドデコイと自律言語モデルエージェントを組み合わせたフレームワークであるCloud Decoy AI Agentを紹介する。
調査単位はイベントではなくセッションであり、セッションキーは、ID階層化された認証情報の導入によって隠蔽される。
10のコントロールされたAWS S3シナリオで、9つの完全に再構築され、観測されたアーティファクトに追跡不可能なアサーションを含むレポートはなく、レイテンシは4分から5分でした。
論文 参考訳(メタデータ) (2026-07-27T05:05:57Z) - Dynamic Capability Scoping for Enterprise AI Agents: A Synthetic Dataset and Three-Source Permission Architecture [0.0]
能動スコープは動的に最小限の原理を踏襲し、検出前に予防機構として扱う必要があると我々は主張する。
エージェントの文脈に存在しないクレデンシャルは、エージェントの推論にかかわらず誤用することはできない。
我々は、多部門企業政策に基づく600のエンタープライズタスクプロンプトの合成データセットをコントリビュートする。
論文 参考訳(メタデータ) (2026-07-24T16:08:03Z) - Capable but Careless: Do Computer-Use Agents Follow Contextual Integrity? [54.701199583505144]
アプリケーション間アクセスは、ほとんど見落とされたプライバシーリスクを生み出す。
我々はAgentCIBenchを紹介します。これは、このリスクを決定論的に評価されたシナリオに変換する評価ハーネスです。
我々は15のフロンティアエージェントを評価し、驚くほど高い失敗率を見出す。
論文 参考訳(メタデータ) (2026-06-22T11:36:58Z) - A Five-Plane Reference Architecture for Runtime Governance of Production AI Agents [0.0]
本稿では,生産AIエージェントのガバナンスのための参照アーキテクチャを提案する。
我々は、許容と否定を一般化する6つの割り込みプリミティブの分類を定義し、4つの正当性不変量について主張する。
5つの具体的判断にまたがる7つの生産エージェントの脅威の隠蔽を実証する。
論文 参考訳(メタデータ) (2026-06-10T16:54:47Z) - PRISM: : Planning and Reasoning with Intent in Simulated Embodied Environments [59.07829883257003]
5つの集合住宅の上に建設され、PRISMは300の人間認証タスクを3つの能力レベルに構成する。
PRISMはエージェントに依存しない実行可能なアクションAPIを公開し、任意のエージェントをエンドツーエンドで評価できるようにする。
論文 参考訳(メタデータ) (2026-05-12T04:59:47Z) - Authorization Propagation in Multi-Agent AI Systems: Identity Governance as Infrastructure [0.0]
我々はこの問題を認可伝搬と呼ぶ。
RBAC、ABAC、ReBACのような古典的なアクセス制御モデルでは、完全には対処できない。
この論文は、認可伝達をワークフローレベルのプロパティとして形式化し、3つのサブプロブレムを特定し、マルチエージェントAIシステムにおける認可アーキテクチャの7つの構造的要件を導出する。
論文 参考訳(メタデータ) (2026-05-06T20:56:17Z) - Sponge Tool Attack: Stealthy Denial-of-Efficiency against Tool-Augmented Agentic Reasoning [58.432996881401415]
最近の作業では、エージェント推論を可能にするために、外部ツールで大きな言語モデル(LLM)を拡張している。
本稿では,入力プロンプトを書き換えることのみでエージェント推論を妨害するスポンジツールアタック(STA)を提案する。
STAは、意味的忠実度の高い原文からの良心的な即興的な書き直しを生成する。
論文 参考訳(メタデータ) (2026-01-24T19:36:51Z) - When Disagreements Elicit Robustness: Investigating Self-Repair Capabilities under LLM Multi-Agent Disagreements [56.29265568399648]
我々は、不一致が早期のコンセンサスを防ぎ、探索されたソリューション空間を拡張することを主張する。
タスククリティカルなステップの相違は、ソリューションパスのトポロジによってコラボレーションを損なう可能性がある。
論文 参考訳(メタデータ) (2025-02-21T02:24:43Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。