論文の概要: An Evidence Model for Agentic Processes: Evidence Claims, Trust Assumptions, and Policy Assessment
- arxiv url: http://arxiv.org/abs/2609.08481v1
- Date: Tue, 08 Sep 2026 09:25:28 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-11 16:24:05.206687
- Title: An Evidence Model for Agentic Processes: Evidence Claims, Trust Assumptions, and Policy Assessment
- Title(参考訳): エージェント・プロセスのエビデンス・モデル:エビデンス・クレーム、信頼評価、政策評価
- Abstract要約: 本稿では,エージェントプロセスのエビデンスクレームモデルを提案する。
それは、アーティファクトの完全性、時間的存在、証明、承認の証拠、宣言された命令、取得のクレーム、関係のクレーム、熟考のトレーサビリティ、監視のクレーム、承認のクレーム、政策評価のクレーム、リスク処理のクレーム、緩和実施のクレーム、管理の対応クレームを区別する。
このモデルは、これらの主張をメカニズム、仮定、制限、脅威にマッピングし、機能的なCEOエージェント、幹部、運用、エビデンス、監査ロール、プラン-do-act-インスパイアされたマネジメント応答ループを備えたエージェント組織に配置する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Agentic AI systems increasingly exchange messages, invoke tools, request approvals, hold structured decision sessions, and modify shared artifacts. Logs and anchors can make selected records tamper-evident, but they can also mislead if their evidentiary meaning is implicit: a hash does not establish semantic truth, a signature does not establish authorization, and an external anchor does not establish capture completeness. This paper proposes an evidence claim model for agentic processes. It distinguishes artifact integrity, temporal existence, provenance, approval evidence, declared ordering, capture claim, relevance claim, deliberation traceability, monitoring claim, anchoring authorization claim, policy assessment claim, risk treatment claim, mitigation implementation claim, and management response claim. Semantic validity is treated as a recurring limitation. The model maps these claims to mechanisms, assumptions, limitations, and threats, and situates them in an agent organization with functional CEO agent, executive, operational, evidence, and audit roles, plus a plan-do-check-act-inspired management response loop. The contribution is conceptual: it does not validate a particular implementation, prevent all failures, or automate legal compliance. It provides a vocabulary for stating which claims an agentic black box can support, which claims it cannot establish, and which controls are required around it.
- Abstract(参考訳): エージェントAIシステムは、メッセージの交換、ツールの呼び出し、要求承認、構造化された決定セッションの開催、共有アーティファクトの変更をますます進めている。
ログとアンカーは選択されたレコードを改ざんするが、その明示的な意味が暗黙的である場合は誤認することもできる:ハッシュは意味的な真理を定めず、シグネチャは認証を定めず、外部アンカーはキャプチャ完全性を定めない。
本稿では,エージェントプロセスのエビデンスクレームモデルを提案する。
それは、アーティファクトの完全性、時間的存在、証明、承認の証拠、宣言された命令、取得のクレーム、関係のクレーム、熟考のトレーサビリティ、監視のクレーム、承認のクレーム、政策評価のクレーム、リスク処理のクレーム、緩和実施のクレーム、管理の対応クレームを区別する。
セマンティックな妥当性は繰り返しの限界として扱われる。
このモデルは、これらの主張をメカニズム、仮定、制限、脅威にマッピングし、機能的なCEOエージェント、幹部、運用、エビデンス、監査ロール、プラン-do-act-インスパイアされたマネジメント応答ループを備えたエージェント組織に配置する。
特定の実装を検証せず、すべての失敗を防ぎ、法的コンプライアンスを自動化する。
エージェントブラックボックスがサポートできると主張するもの、確立できないもの、その周辺にどのコントロールが必要かを記述するための語彙を提供する。
関連論文リスト
- From Intent to Execution Grant: An Execution-Boundary Conformance Profile for High-Risk AI Actions [9.27474112226667]
EBL-Coreは、1つの標準的な、完全に実体化されたAI生成候補が、明示的な条件下でアクションスコープ実行権限を受け取ることができるかどうかを決定する。
拘束力、政策非監視、エビデンス処理、決定論的判断、検証、ライフサイクル行動の付与などである。
100回の試験で32回の同時再空輸試験が成功し、1回の試行で完全に1回成功し、テスト効果が保護された。
論文 参考訳(メタデータ) (2026-09-10T14:21:45Z) - A Black Box for Agentic Processes: Blockchain-Anchored Evidence for AI Agent Communication, Human Oversight, and GRC Audits [0.0]
2026年のOpenAI/Hugging Faceインシデントに触発されたこのポジションとアーキテクチャ論文は、エージェントプロセスのための製品とベンダー中立のブラックボックスアーキテクチャを提案する。
アーキテクチャは、選択されたエージェント通信、ヒューマン・イン・ザ・ループの承認、ツールコール、およびプロセスアーティファクトに対して、機密性の高いコンテンツをチェーン上に配置することなく、ブロックチェーンで暗号化されたコミットメントを生成する。
論文 参考訳(メタデータ) (2026-09-03T15:55:39Z) - Stored Is Not Supported: Typed Provenance and Assertion Guardrails for Persistent AI Agents [2.124730017640531]
永続AIエージェントは、リフレクション、検索、統合を通じて自伝的状態を構築する。
自伝的アサーション境界性に対する型付き前置詞とアサーションガードレールを指定する。
論文 参考訳(メタデータ) (2026-09-02T05:35:33Z) - Offline-Verifiable Accountability for Cross-Organization Agent Messaging: A Preserved Evidence-Bundle Approach [0.5801044612920815]
クロスオーガナイゼーション・エージェントは、後の監査または紛争審査において独立して検証可能な証拠を必要とする。
既存のメカニズムは、認証ロギング、デリゲートセマンティクス、署名されたチェックポイント、一貫性チェックなど、有用な部分を提供します。
本稿では,エージェント・ツー・エージェント・ワークフローイベントのためのエビデンスバンドルモデルとポリシー制御オフライン検証手法を提案する。
論文 参考訳(メタデータ) (2026-08-28T17:18:49Z) - Mandato: Protocol-Level Enforcement of Digitally Signed Mandates on AI Agent Actions with Cryptographically Chained Audit Trails [0.0]
我々は、プロトコルレベルでエージェントアクションにデジタル署名された委任を強制するガバナンスプロキシであるMandatoを提示する。
委任状(英: Mandate)とは、エージェントがどのツールを呼び出すかを指定する、機械可読で暗号的に署名された認証文書である。
本稿では, 基準システムの実装状況と, 実施オーバーヘッド, 監査完全性, タンパー・エビデンス検証コストをカバーする定量的評価計画について述べる。
論文 参考訳(メタデータ) (2026-08-14T08:33:43Z) - From Trajectories to Evidence: Auditable Experimental Records for Industrial Research Agents [47.678562263387214]
研究エージェントは、産業レコメンデーション設定において、多段階の機械学習実験をますます実施している。
生成されたアーティファクトは、サポートされないか、不完全かもしれないし、実行されたラウンドは無効かもしれないし、あるいは廃止されるかもしれないし、後の修正は、以前の発見を曖昧にするかもしれない。
本稿では,連続的アーティファクトのバウンダリ検証と実行後のクレーム資格を結合するエビデンス・グラウンド・フレームワークを提案する。
論文 参考訳(メタデータ) (2026-08-05T13:37:38Z) - Towards Trustworthy Embodied Intelligence: A Systems Framework and Graded Trustworthiness Levels [53.63220028820581]
身体的知性は、学習した知覚と意思決定をリアルタイムの計算、制御、物理的相互作用と統合する。
我々は,信頼に値するインテリジェンスを,特定のタスクを確実に実行するための持続能力として定義する。
論文 参考訳(メタデータ) (2026-07-28T17:50:44Z) - Agent Security Needs Redefinition through a Holistic Framework [46.88917910966891]
被告は、命令が悪意あるように見えるかどうかを問う。ベンチマークは、エージェントが有害な鳴き声を行うかどうかを問う。
我々は,エージェントの軌道全体にわたって連続的に評価されなければならない4つの特性を通じて,コンテキストセキュリティを運用する。
論文 参考訳(メタデータ) (2026-07-24T06:43:09Z) - DRNOISE: Benchmarking Deep Research Agents in Misleading Evidence Environments [51.049999642138]
誤解を招く証拠の下で、回答回復のための100タスクのベンチマークであるDRNOISEを紹介する。
それぞれのタスクは、2つの間接的レコードチェーンが支持する固有の金の答えを持ち、ペアのノイズ条件は競合する答えを直接記述する1つのもっともらしい文書を付加する。
強いクリーンタスク性能を持つエージェント全体で、この単一の介入は66-88ポイントの精度低下を引き起こす。
論文 参考訳(メタデータ) (2026-07-19T15:20:40Z) - Verifiable Agentic Infrastructure: Proof-Derived Authorization for Sovereign AI Systems [2.124730017640531]
構造化された人工物から実行権限を演算する制御された突然変異システムに対する検証フレームワークを提案する。
DTFは、エージェント実行を統治可能、監査可能、およびソブリンAIデプロイメントにバウンド化するためのインフラストラクチャ基盤を提供する。
論文 参考訳(メタデータ) (2026-05-13T17:58:52Z) - Agents of Chaos [50.53354213047402]
実験室環境に展開する自律言語モデルを用いたエージェントの探索的再チームの研究を報告する。
20人のAI研究者が、良心的および敵対的な条件下でエージェントと対話した。
我々の発見は、現実的なデプロイメント設定におけるセキュリティ、プライバシ、ガバナンスに関連する脆弱性の存在を確立します。
論文 参考訳(メタデータ) (2026-02-23T16:28:48Z) - Preventing the Collapse of Peer Review Requires Verification-First AI [49.995126139461085]
我々は、真理結合、すなわち、過度に科学的真理をトラックする場所のスコアの厳密さを提案する。
プロキシ・ソブリン評価に向けた相転移を駆動する2つの力の形式化を行う。
論文 参考訳(メタデータ) (2026-01-23T17:17:32Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。