論文の概要: Auditable Claims about AI Agents
- arxiv url: http://arxiv.org/abs/2610.07459v1
- Date: Mon, 05 Oct 2026 22:11:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-08 02:58:29.691123
- Title: Auditable Claims about AI Agents
- Title(参考訳): AIエージェントに関する監査可能な主張
- Abstract要約: EU AI法第12条は、イベントの自動記録を許可するためにリスクの高いシステムを必要とするが、どの記録が所定の主張を定めるかは明記していない。
その地位は1つの文である: チェックするためには、エージェントに関するクレームは、そのポリシー、そのスコープ、解決するレコード、そして誰がそれを書かなければならない。
これはAuditable Agentsフレームワークのポリシーチェック可能性の次元を単一のアクションからクレームへと拡張します。
- 参考スコア(独自算出の注目度): 15.013095062109405
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Organizations make claims about their AI agents: a person approves every external email, every action is logged, an evaluation shows the agent is safe to deploy. Article 12 of the EU AI Act requires high-risk systems to allow the automatic recording of events but does not say which records settle a given claim. The position is one sentence: to be checked, a claim about an agent must first name its policy, its scope, the records that would settle it, and who writes them. Adapting the preconditions of an assurance engagement, we call a claim auditable when these elements and a decision rule are fixed before any verdict and the records are obtainable. This extends the Policy Checkability dimension of our Auditable Agents framework from single actions to claims. Agents add three conditions: coverage by an independent record, authorization bound to each action's arguments, and completeness beyond integrity. Under an explicit model, we prove that support is impossible without each wherever its hypotheses hold. A claim-check table applies the method to six common claims, anchored in current NIST, IETF, and OWASP drafts. A worked case follows one claim through five evidence states. We close with a practice box and steps for operators, buyers, auditors, and standard setters.
- Abstract(参考訳): 人はすべての外部メールを承認し、すべてのアクションがログされ、評価はエージェントがデプロイするのに安全であることを示します。
EU AI法第12条は、イベントの自動記録を許可するためにリスクの高いシステムを必要とするが、どの記録が所定の主張を定めるかは明記していない。
その地位は1つの文である: チェックするためには、エージェントに関するクレームは、まずそのポリシー、そのスコープ、解決するレコード、そして誰がそれを書かなければならない。
保証契約の前提条件に適合して、我々は、これらの要素と決定規則が確定した時に監査可能なクレームを、任意の評決と記録が取得可能である前に呼び出す。
これはAuditable Agentsフレームワークのポリシーチェック可能性の次元を単一のアクションからクレームへと拡張します。
エージェントは、独立したレコードによるカバレッジ、各アクションの引数に縛られた認可、完全性を超えた完全性という3つの条件を追加する。
明示的なモデルの下では、各仮説が持たないところでは、サポートは不可能であることを示す。
クレームチェックテーブルは、現在のNIST、IETF、OWASPドラフトに固定された6つの共通クレームにメソッドを適用します。
効力のある事例は、5つの証拠書を通じて1つの主張に従う。
私たちは、オペレータ、買い手、監査人、標準セッターのための練習ボックスとステップを閉じています。
関連論文リスト
- EIO-Agents: The Missing Semantic Layer for AI Agent Evaluation [0.0]
我々は、相互運用可能なAIエージェント評価のためのオープン仕様であるEIO-Agentsを紹介する。
スコアは要約し、解釈し、記録を辿るが、いずれも証拠の意味や証明できるものを定義していない。
AIエージェントがより大きな運用責任を負うようになると、評価はスコアや評決の集まり以上のものでなければならない。
論文 参考訳(メタデータ) (2026-10-06T03:10:53Z) - Let the Agent Do It? How Software Practitioners Understand and Make Permission Decisions in Agentic AI Assistants [43.6631255471383]
エージェントAIアシスタントは、ファイルの変更、コマンドの実行、外部リソースへのアクセスによって、開発者の代理として機能するようになっている。
これらのアクションは、しばしばパーミッションを必要とするが、エージェントの自律性から恩恵を受けながら、実践者がパーミッションの決定を行う方法については、ほとんど知られていない。
実践者は直接観察したり、レビューしたりすることでエージェントの振る舞いをよく理解するが、意思決定やデータの使用、その他の活動は明らかになっていない。
以上の結果から,パーミッションシステムは,逐次的行動のレビューを容易にし,エージェントが意図したこととを区別し,可逆性を明確化し,単一行動の拒否を拒否することの区別を行なわなければならないことが示唆された。
論文 参考訳(メタデータ) (2026-10-05T09:43:54Z) - An Evidence Model for Agentic Processes: Evidence Claims, Trust Assumptions, and Policy Assessment [0.0]
本稿では,エージェントプロセスのエビデンスクレームモデルを提案する。
それは、アーティファクトの完全性、時間的存在、証明、承認の証拠、宣言された命令、取得のクレーム、関係のクレーム、熟考のトレーサビリティ、監視のクレーム、承認のクレーム、政策評価のクレーム、リスク処理のクレーム、緩和実施のクレーム、管理の対応クレームを区別する。
このモデルは、これらの主張をメカニズム、仮定、制限、脅威にマッピングし、機能的なCEOエージェント、幹部、運用、エビデンス、監査ロール、プラン-do-act-インスパイアされたマネジメント応答ループを備えたエージェント組織に配置する。
論文 参考訳(メタデータ) (2026-09-08T09:25:28Z) - A Black Box for Agentic Processes: Blockchain-Anchored Evidence for AI Agent Communication, Human Oversight, and GRC Audits [0.0]
2026年のOpenAI/Hugging Faceインシデントに触発されたこのポジションとアーキテクチャ論文は、エージェントプロセスのための製品とベンダー中立のブラックボックスアーキテクチャを提案する。
アーキテクチャは、選択されたエージェント通信、ヒューマン・イン・ザ・ループの承認、ツールコール、およびプロセスアーティファクトに対して、機密性の高いコンテンツをチェーン上に配置することなく、ブロックチェーンで暗号化されたコミットメントを生成する。
論文 参考訳(メタデータ) (2026-09-03T15:55:39Z) - Explanation-Bound Tool Execution for AI Agents: Server-Verified Action Claims Without Trusting Model Rationales [4.805352087824778]
説明境界ツール実行(Explanation-Bound Tool Execution)は、意思決定に関連する合理的なコンテンツを型付けされたアクションクレームに変換し、それらをサーバが所有するインテント、ポリシー、ペイロード、ツール、リスク、証明、新鮮な事実に対してチェックする。
我々は,この構成を明示的な調停と信頼性のある仮定の下で形式化し,最小限の監査パケットを用いたバージョン付き参照プロファイルを実装した。
論文 参考訳(メタデータ) (2026-07-28T07:16:12Z) - Agent Security Needs Redefinition through a Holistic Framework [46.88917910966891]
被告は、命令が悪意あるように見えるかどうかを問う。ベンチマークは、エージェントが有害な鳴き声を行うかどうかを問う。
我々は,エージェントの軌道全体にわたって連続的に評価されなければならない4つの特性を通じて,コンテキストセキュリティを運用する。
論文 参考訳(メタデータ) (2026-07-24T06:43:09Z) - PolicyGuard: A Dialogue-Grounded Sub-Agent Verifier for Policy Adherence in LLM Agents [46.25624714630383]
LLMエージェントは、ツールコールを通じて、組織に代わってユーザーリクエストを処理する。
外部チェックは非準拠のエージェントアクションをブロックする。
本稿では,エージェントの対話に対する見解,文脈におけるポリシー上の理由,エージェントの次のターンに対して実行可能なフィードバックを提供するサブエージェント検証ツールであるPolicYGUARDを紹介する。
論文 参考訳(メタデータ) (2026-06-28T06:27:36Z) - A Five-Plane Reference Architecture for Runtime Governance of Production AI Agents [0.0]
本稿では,生産AIエージェントのガバナンスのための参照アーキテクチャを提案する。
我々は、許容と否定を一般化する6つの割り込みプリミティブの分類を定義し、4つの正当性不変量について主張する。
5つの具体的判断にまたがる7つの生産エージェントの脅威の隠蔽を実証する。
論文 参考訳(メタデータ) (2026-06-10T16:54:47Z) - A New Framework for Cybersecurity Refusals in AI Agents [52.94784168139071]
攻撃的セキュリティの文脈において、拒絶境界を確立するための最初の枠組みを提示する。
本研究では,現在のLLMエージェントがWebベースの攻撃的セキュリティシナリオにおいて,適切な拒絶境界にどのように準拠しているかを評価するために,このフレームワークを適用した。
論文 参考訳(メタデータ) (2026-05-31T15:39:39Z) - Agents of Chaos [50.53354213047402]
実験室環境に展開する自律言語モデルを用いたエージェントの探索的再チームの研究を報告する。
20人のAI研究者が、良心的および敵対的な条件下でエージェントと対話した。
我々の発見は、現実的なデプロイメント設定におけるセキュリティ、プライバシ、ガバナンスに関連する脆弱性の存在を確立します。
論文 参考訳(メタデータ) (2026-02-23T16:28:48Z) - SmartSnap: Proactive Evidence Seeking for Self-Verifying Agents [45.71333459905404]
SmartSnapは、受動的でポストホックな検証から、エージェント自身による積極的な自己検証へのパラダイムシフトである。
両ミッションで設計された新しいタイプのエージェントである「自己検証エージェント」を導入し、タスクを完了し、検証された証拠でその達成を証明した。
モデルファミリとスケールにわたるモバイルタスクの実験は、SmartSnapパラダイムによって、スケーラブルなLLM駆動エージェントのトレーニングが可能になることを実証しています。
論文 参考訳(メタデータ) (2025-12-26T14:51:39Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。