論文の概要: Governing Actions, Not Agents: Institutional Attestation as a Governance Model for Autonomous AI Systems
- arxiv url: http://arxiv.org/abs/2606.26298v1
- Date: Wed, 24 Jun 2026 18:43:00 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-26 18:46:32.05649
- Title: Governing Actions, Not Agents: Institutional Attestation as a Governance Model for Autonomous AI Systems
- Title(参考訳): エージェントではなく行動の統治:自律型AIシステムのガバナンスモデルとしての制度的検証
- Authors: Jakob Salfeld-Nebgen,
- Abstract要約: 人間の機関は、連続した行動の時点で独立して証明された証拠を要求することによって、強力な自律的なアクターを統治してきた。
我々は、AIエージェントシステムの計算ガバナンスモデルとして、この制度パターンを定式化する。
提案したモデルでは、エージェントは計画と推論の完全な自律性を保持するが、指定されたリスクの高い行動に対する実行権限は保持しない。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Autonomous AI agents may begin to perform consequential, irreversible actions such as clinical prescribing and production software deployment. This paper observes that human institutions have governed powerful autonomous actors not by monitoring their reasoning but by requiring independently attested evidence at the point of consequential action. We formalise this institutional pattern as a computational governance model for AI agent systems. Under the proposed model, an agent retains full autonomy over planning and reasoning but holds no execution authority over designated high-risk actions. Execution is conditional on preconditions that are each independently attested by a separate authoritative source, cryptographically bound to a declared intent, and evaluated by a deterministic policy. Decisions are recorded in a tamper-evident log amenable to independent re-verification. We present a proof-of-concept implementation and illustrate the model with examples from software deployment and clinical prescribing.
- Abstract(参考訳): 自律型AIエージェントは、臨床プリスクライブやプロダクションソフトウェアデプロイメントのような、連続的で不可逆なアクションを実行し始める可能性がある。
本稿では,人間の機関が,理性を監視するのではなく,連続的な行動の時点で独立に証明された証拠を必要とすることによって,強力な自律的アクターを支配下に置いたことを観察する。
我々は、AIエージェントシステムの計算ガバナンスモデルとして、この制度パターンを定式化する。
提案モデルでは、エージェントは計画と推論に対して完全な自律性を保持するが、指定されたリスクの高い行動に対する実行権限は保持しない。
実行は、それぞれ独立した権威ソースによって独立に証明され、宣言された意図に暗号的に拘束され、決定論的ポリシーによって評価される前提条件で条件づけられる。
決定は、独立した再検証が可能な、未確認のログに記録される。
本稿では,概念実証の実装について紹介し,ソフトウェアデプロイメントと臨床プリスクリプティングの例を示す。
関連論文リスト
- Cognitive Digital Twins: Ethical Risks and Governance for AI Systems That Model the Mind [12.629706595738755]
私たちは認知デジタルツイン(CDT)を認知デジタルツイン(CDT)と呼んでいる。
CDTは認知推論と縦方向の表現、シミュレーション、プロキシアクションを組み合わせる。
権威、自律性、アクセスとコントロール、説明責任、可用性を中心に組織された5Aガバナンスフレームワークを導入します。
我々は、同意、目的制限、妥当性、トレーサビリティ、コンテスト、独立レビュー、モデルリタイアを強化する高リスクCDTの要件を提案する。
論文 参考訳(メタデータ) (2026-06-22T09:40:09Z) - Neuro-Symbolic Agents for Regulated Process Automation: Challenges and Research Agenda [43.328395470827665]
規制産業に埋め込まれた象徴的な構造は、コアアーキテクチャコンポーネントとして扱われるべきである、と我々は主張する。
本稿では,鉄道監視の補完パラダイムとしてコンプライアンス・バイ・コンストラクションを提案する。
我々は、高影響研究領域として、規制プロセスの自動化に携わるよう、ニューロシンボリックなコミュニティに呼びかける。
論文 参考訳(メタデータ) (2026-06-11T14:34:11Z) - Provably Secure Agent Guardrail [89.79561918065122]
既存の防衛アーキテクチャは経験的セマンティックガードレールと確率論的大モデル調整器に依存している。
本稿では,論理的推論の基本的制約に基づくエージェントのための新しいセキュリティパラダイムを提案する。
論文 参考訳(メタデータ) (2026-05-28T02:12:41Z) - Digital Identity for Agentic Systems: Toward a Portable Authorization Standard for Autonomous Agents [0.0]
本稿では,保険請求処理とサプライチェーンの整合性における代表的企業利用事例について分析する。
発行者認可認可ペイロードに基づく自律エージェントの携帯型認証モデルを提案する。
論文 参考訳(メタデータ) (2026-05-12T04:04:34Z) - Governed Reasoning for Institutional AI [0.0]
認知コア(Cognitive Core)は、9種類の認知プリミティブから構築された決定基盤である。
ヒューマンレビューは、ポストホックチェックではなく実行条件である。
我々は、11ケースの事前承認控訴評価セットで3つのシステムをベンチマークした。
論文 参考訳(メタデータ) (2026-04-12T14:09:18Z) - Architecting Secure AI Agents: Perspectives on System-Level Defenses Against Indirect Prompt Injection Attacks [46.32011684548212]
AIエージェントは間接的なプロンプトインジェクションに対して脆弱であり、信頼できないデータに埋め込まれた悪意のある命令は危険なエージェントアクションを引き起こす可能性がある。
本稿では,間接的インジェクション攻撃に対するシステムレベルの防御の展望について論じる。
論文 参考訳(メタデータ) (2026-03-31T17:15:46Z) - I Can't Believe It's Corrupt: Evaluating Corruption in Multi-Agent Governance Systems [8.670200461690454]
機関的AIの完全性は、デプロイ後仮定ではなく、デプロイ前要件として扱われるべきであることを示す。
エージェントが異なる権限構造の下で正式な政府の役割を担っているマルチエージェントガバナンスシミュレーションを評価した。
28,112個の転写セグメントにまたがる独立系裁判官によるルールブレーキングと乱用の結果を収集する。
論文 参考訳(メタデータ) (2026-03-19T13:34:54Z) - Normative active inference: A numerical proof of principle for a computational and economic legal analytic approach to AI governance [0.6267988254367711]
本稿では,AIエージェントの行動に法的規範がどう影響するかを計算学的に考察する。
我々は,エージェントに意図的な制御システムを与える設計による規制によって,合法的で規範に敏感なAI行動が達成可能であることを提案する。
我々は、文脈依存の嗜好が自律エージェントの安全メカニズムとしてどのように機能するかを議論することで結論付けた。
論文 参考訳(メタデータ) (2025-11-24T17:30:51Z) - Toward a Theory of Agents as Tool-Use Decision-Makers [89.26889709510242]
真の自律性は、エージェントが、彼らが知っていること、必要なこと、そしてその知識を効率的に獲得する方法を統治する、一貫性のある疫学の枠組みに根ざす必要がある、と我々は主張する。
本研究では,内的推論と外的行動を等価な疫学ツールとして扱う統一理論を提案し,エージェントが内観と相互作用を体系的に調整することを可能にする。
この視点は、エージェントの設計を単なるアクションエグゼクタから知識駆動インテリジェンスシステムにシフトさせ、適応的で効率的でゴール指向の行動が可能な基礎エージェントを構築するための原則化された道筋を提供する。
論文 参考訳(メタデータ) (2025-06-01T07:52:16Z) - Artificial Intelligence in Government: Why People Feel They Lose Control [44.99833362998488]
行政における人工知能の利用は急速に拡大している。
AIはより効率と応答性を約束するが、政府機能への統合は公正性、透明性、説明責任に関する懸念を提起する。
この記事では、デリゲートの特別事例として、AI導入に関するプリンシパル・エージェント理論を適用します。
論文 参考訳(メタデータ) (2025-05-02T07:46:41Z) - The simulation of judgment in LLMs [32.57692724251287]
大規模言語モデル(LLM)は、情報フィルタリングから説明と信頼性の判断を通じて知識ギャップの評価と対処に至るまで、評価プロセスに組み込まれている。
これにより、このような評価がどのように構築されるのか、どのような仮定に依存しているのか、その戦略が人間のものとどのように異なるのかを調べる必要が生じる。
我々は、専門家の評価に対して、6つのLCM(NewsGuardとMedia Bias/Fact Check)と、制御された実験を通して収集された人間の判断に対してベンチマークを行った。
論文 参考訳(メタデータ) (2025-02-06T18:52:10Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。