論文の概要: A2AS: Agentic AI Runtime Security and Self-Defense
- arxiv url: http://arxiv.org/abs/2510.13825v1
- Date: Wed, 08 Oct 2025 14:28:04 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-10-17 21:15:14.447054
- Title: A2AS: Agentic AI Runtime Security and Self-Defense
- Title(参考訳): A2AS:エージェントAIランタイムのセキュリティと自己依存
- Abstract要約: A2ASフレームワークはAIエージェントとLLMベースのアプリケーションのセキュリティレイヤとして導入された。
A2ASは認証された動作を実行し、モデルの自己防衛を起動し、コンテキストウィンドウの整合性を保証する。
セキュリティ境界を定義し、プロンプトを認証し、セキュリティルールとカスタムポリシーを適用し、エージェントの動作を制御する。
- 参考スコア(独自算出の注目度): 0.11630883536265196
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: The A2AS framework is introduced as a security layer for AI agents and LLM-powered applications, similar to how HTTPS secures HTTP. A2AS enforces certified behavior, activates model self-defense, and ensures context window integrity. It defines security boundaries, authenticates prompts, applies security rules and custom policies, and controls agentic behavior, enabling a defense-in-depth strategy. The A2AS framework avoids latency overhead, external dependencies, architectural changes, model retraining, and operational complexity. The BASIC security model is introduced as the A2AS foundation: (B) Behavior certificates enable behavior enforcement, (A) Authenticated prompts enable context window integrity, (S) Security boundaries enable untrusted input isolation, (I) In-context defenses enable secure model reasoning, (C) Codified policies enable application-specific rules. This first paper in the series introduces the BASIC security model and the A2AS framework, exploring their potential toward establishing the A2AS industry standard.
- Abstract(参考訳): A2ASフレームワークは、HTTPSによるHTTPのセキュリティと同様、AIエージェントやLLMベースのアプリケーションのためのセキュリティレイヤとして導入された。
A2ASは認証された動作を実行し、モデルの自己防衛を起動し、コンテキストウィンドウの整合性を保証する。
セキュリティ境界を定義し、プロンプトを認証し、セキュリティルールとカスタムポリシーを適用し、エージェントの振る舞いを制御し、詳細な戦略を可能にする。
A2ASフレームワークは、レイテンシのオーバーヘッド、外部依存関係、アーキテクチャの変更、モデル再トレーニング、運用上の複雑さを回避する。
B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B )(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)))))B(B)(B)(B)(B)(B)( B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)())))B)(B)(B)(B)(B)(B)(B)( B)(B)(B)(B)(B)(B)(B)(B)(B)(B)(B)()))))))B(B(B(B
このシリーズの最初の論文では、BASICセキュリティモデルとA2ASフレームワークを紹介し、A2AS業界標準を確立する可能性を探っている。
関連論文リスト
- A New Framework for Cybersecurity Refusals in AI Agents [52.94784168139071]
攻撃的セキュリティの文脈において、拒絶境界を確立するための最初の枠組みを提示する。
本研究では,現在のLLMエージェントがWebベースの攻撃的セキュリティシナリオにおいて,適切な拒絶境界にどのように準拠しているかを評価するために,このフレームワークを適用した。
論文 参考訳(メタデータ) (2026-05-31T15:39:39Z) - ClawLess: A Security Model of AI Agents [34.70695138834452]
我々は、AIエージェントに対して正式に認証されたポリシーを実行するセキュリティフレームワークであるClawLessを紹介する。
ClawLessは、システムエンティティ、信頼範囲、パーミッションに関するきめ細かいセキュリティモデルを形式化する。
このアプローチは、エージェントの内部設計に関係なくセキュリティを確保するために、正式なセキュリティモデルを実践的にブリッジする。
論文 参考訳(メタデータ) (2026-04-07T12:19:55Z) - A Framework for Formalizing LLM Agent Security [46.86073273904095]
LLMエージェントのセキュリティは本質的にコンテキスト的です。
LLMエージェントに対する既存のセキュリティ攻撃の定義は、しばしばこの文脈の性質を捉えない。
本稿では,文脈的セキュリティの観点から,既存の攻撃と防御を体系化するフレームワークを提案する。
論文 参考訳(メタデータ) (2026-03-19T21:01:49Z) - Authenticated Workflows: A Systems Approach to Protecting Agentic AI [0.0]
企業エージェントAIのための,最初の完全信頼層である認証を導入します。
我々は、すべての境界交差において、意図(組織方針を満たす操作)と整合性(操作は暗号的に真である)を強制する。
これにより、決定論的セキュリティ操作が提供され、有効な暗号証明が実行されるか、拒否される。
論文 参考訳(メタデータ) (2026-02-11T03:04:50Z) - CaMeLs Can Use Computers Too: System-level Security for Computer Use Agents [60.98294016925157]
AIエージェントは、悪意のあるコンテンツがエージェントの行動をハイジャックして認証情報を盗んだり、金銭的損失を引き起こすような、インジェクション攻撃に弱い。
CUAのためのシングルショットプランニングでは、信頼できるプランナーが、潜在的に悪意のあるコンテンツを観察する前に、条件付きブランチで完全な実行グラフを生成する。
このアーキテクチャ分離は命令インジェクションを効果的に防止するが、ブランチステアリング攻撃を防ぐには追加の対策が必要であることを示す。
論文 参考訳(メタデータ) (2026-01-14T23:06:35Z) - BlockA2A: Towards Secure and Verifiable Agent-to-Agent Interoperability [8.539128225018489]
BlockA2Aはエージェントとエージェントの相互運用性のための統合されたマルチエージェント信頼フレームワークである。
集中的な信頼ボトルネックを排除し、メッセージの信頼性と実行の整合性を確保し、エージェント間のインタラクションにおける説明責任を保証する。
ビザンチンエージェントのフラグング、リアクティブ実行停止、即時許可取り消しなど、リアルタイムメカニズムによる攻撃を中和する。
論文 参考訳(メタデータ) (2025-08-02T11:59:21Z) - Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security [63.41350337821108]
マルチモーダル大規模言語モデル(MLLM)のセキュリティを高めるために,Secure Tug-of-War(SecTOW)を提案する。
SecTOWは2つのモジュールで構成される:ディフェンダーと補助攻撃者。どちらも強化学習(GRPO)を使用して反復的に訓練される。
SecTOWは、一般的な性能を維持しながら、セキュリティを大幅に改善することを示す。
論文 参考訳(メタデータ) (2025-07-29T17:39:48Z) - ARMOR: Aligning Secure and Safe Large Language Models via Meticulous Reasoning [49.47193675702453]
大規模言語モデル(LLM)は、顕著な生成能力を示している。
LLMは、安全上の制約を回避できる悪意のある命令に弱いままである。
推論に基づく安全アライメントフレームワークARMORを提案する。
論文 参考訳(メタデータ) (2025-07-14T09:05:54Z) - OpenAgentSafety: A Comprehensive Framework for Evaluating Real-World AI Agent Safety [58.201189860217724]
OpenAgentSafetyは,8つの危機リスクカテゴリにまたがるエージェントの動作を評価する包括的なフレームワークである。
従来の作業とは異なり、我々のフレームワークは、Webブラウザ、コード実行環境、ファイルシステム、bashシェル、メッセージングプラットフォームなど、実際のツールと対話するエージェントを評価します。
ルールベースの分析とLSM-as-judgeアセスメントを組み合わせることで、過度な行動と微妙な不安全行動の両方を検出する。
論文 参考訳(メタデータ) (2025-07-08T16:18:54Z) - DRIFT: Dynamic Rule-Based Defense with Injection Isolation for Securing LLM Agents [52.92354372596197]
大規模言語モデル(LLM)は、強力な推論と計画能力のため、エージェントシステムの中心となってきています。
この相互作用は、外部ソースからの悪意のある入力がエージェントの振る舞いを誤解させる可能性がある、インジェクション攻撃のリスクも引き起こす。
本稿では,信頼に値するエージェントシステムのための動的ルールベースの分離フレームワークを提案する。
論文 参考訳(メタデータ) (2025-06-13T05:01:09Z) - LlamaFirewall: An open source guardrail system for building secure AI agents [0.5603362829699733]
大規模言語モデル(LLM)は、単純なチャットボットから複雑なタスクを実行できる自律エージェントへと進化してきた。
リスクを軽減するための決定論的解決策が欠如していることを考えると、リアルタイムガードレールモニターが不可欠である。
私たちはオープンソースのセキュリティにフォーカスしたガードレールフレームワークであるLlamaFirewallを紹介します。
論文 参考訳(メタデータ) (2025-05-06T14:34:21Z) - Building A Secure Agentic AI Application Leveraging A2A Protocol [0.0]
A2Aプロトコルを中心とした総合的なセキュリティ分析を提供する。
我々は、A2Aデプロイメントにおける潜在的なセキュリティ問題を評価するために、積極的な脅威モデリングを適用する。
本稿では,A2Aプロトコルを確実に活用するために必要な知識と実践的ガイダンスを開発者やアーキテクトに提供する。
論文 参考訳(メタデータ) (2025-04-23T17:27:49Z) - DoomArena: A framework for Testing AI Agents Against Evolving Security Threats [84.94654617852322]
本稿では,AIエージェントのセキュリティ評価フレームワークであるDoomArenaを紹介する。
プラグインフレームワークであり、現実的なエージェントフレームワークと簡単に統合できる。
モジュールであり、エージェントがデプロイされる環境の詳細から攻撃の開発を分離する。
論文 参考訳(メタデータ) (2025-04-18T20:36:10Z) - Tit-for-Tat: Safeguarding Large Vision-Language Models Against Jailbreak Attacks via Adversarial Defense [90.71884758066042]
大きな視覚言語モデル(LVLM)は、視覚入力による悪意のある攻撃に対する感受性という、ユニークな脆弱性を導入している。
本稿では,脆弱性発生源からアクティブ防衛機構へ視覚空間を変換するための新しい手法であるESIIIを提案する。
論文 参考訳(メタデータ) (2025-03-14T17:39:45Z) - A Formal Model of Security Controls' Capabilities and Its Applications to Policy Refinement and Incident Management [0.2621730497733947]
本稿では,セキュリティ管理がセキュリティポリシーを強制する上で提供する機能を抽象化する形式モデルであるSecurity Capability Model(SCM)を提案する。
実世界のシナリオで有効性を検証することで、SCMは異なる複雑なセキュリティタスクの自動化を可能にすることを示す。
論文 参考訳(メタデータ) (2024-05-06T15:06:56Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。