論文の概要: MasDrift: Benchmarking Authorization Preservation Across Multi-Agent Architectures
- arxiv url: http://arxiv.org/abs/2608.07556v2
- Date: Tue, 11 Aug 2026 07:14:50 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-12 16:08:30.469887
- Title: MasDrift: Benchmarking Authorization Preservation Across Multi-Agent Architectures
- Title(参考訳): MasDrift: マルチエージェントアーキテクチャのベンチマークによる認証保存
- Authors: Zhuoning Xu, Xiucheng Zhang, Hanjun Luo, Yingbin Jin, Yinpeng Dong, Hanan Salam,
- Abstract要約: MasDriftは8つのドメインにまたがる600の生産性タスクのベンチマークである。
MasDriftは、階層の深さとピア幅を変えながら、単一エージェント、集中型、分散化されたコーディネーションを比較する。
我々は,認証証拠の在り処で異なる2つの防衛措置を比較した。一方は,元のユーザ要求に待ち受けている毎回再審理を行い,もう一方はデリゲートチェーンに沿って緩和された政策を実行する。
- 参考スコア(独自算出の注目度): 23.859862132370168
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Multi-agent systems (MAS) decompose long-horizon tasks across supervisors and subagents, but delegated goals do not necessarily carry their original authorization boundaries. Existing safety benchmarks mainly study adversarial compromise, while work on constraint drift lacks controlled architecture-level evaluation. We introduce MasDrift, a benchmark of 600 benign productivity tasks across eight domains. Each task pairs required work with reserved actions. MasDrift compares single-agent, centralized, and decentralized coordination while varying hierarchy depth and peer width, measuring task completion and authorization preservation. Across generic multi-agent conditions, centralized hierarchies achieve 93.9--98.6% task completion versus 85.7--87.0% for peer networks, while unauthorized actions occur in 2.7--19.8% of tasks versus 0.6--0.8%, a gap that widens with hierarchy depth. We further compare two defenses that differ in where authorization evidence resides. One re-anchors every pending call to the original user request. The other carries an attenuated policy along the delegation chain. Re-anchoring reduces unauthorized actions in every model configuration we evaluate, at a cost of 1.6 points of pooled completion. Chain propagation blocks required work instead, forfeiting up to 36.3 points. A heterogeneous case study confirms that the failure follows from coordination rather than model strength. MasDrift exposes a centralization tradeoff and makes authorization preservation a measurable property of MAS design.
- Abstract(参考訳): マルチエージェントシステム(MAS)は、監督官とサブエージェントをまたがる長距離タスクを分解するが、委任されたゴールは必ずしも元の認証境界を持たない。
既存の安全ベンチマークは、主に敵の妥協を研究し、制約ドリフトの研究は、制御されたアーキテクチャレベルの評価を欠いている。
MasDriftは8つのドメインにまたがる600の生産性タスクのベンチマークである。
各タスクペアは、予約されたアクションで作業を必要とします。
MasDriftは、階層の深さとピア幅を変えながら、単一エージェント、集中型、分散化されたコーディネーションを比較し、タスクの完了と承認の保存を測定する。
一般的なマルチエージェント条件全体において、中央集権階層は、ピアネットワークでは 85.7--87.0% に対して 93.9--98.6% のタスク完了を達成するが、未承認のアクションは 2.7--19.8% のタスクで発生する。
さらに、認証証拠の所在で異なる2つの防衛法を比較する。
1つの再アンカーは、元のユーザリクエストに待機する毎回コールする。
他方は、デリゲートチェーンに沿って縮小されたポリシーを実行します。
再アンカリングは、評価するすべてのモデル構成における不正なアクションを、1.6ポイントのプールドコンプリートで削減します。
チェーンの伝搬ブロックは代わりに作業を必要とし、最大36.3ポイントを没収した。
不均一なケーススタディでは、失敗はモデル強度よりもコーディネーションによるものだと確認されている。
MasDriftは集中化トレードオフを公開し、認証保存をMAS設計の計測可能な特性にする。
関連論文リスト
- ClawArena-Team: Benchmarking Subagent Orchestration and Dynamic Workflows in Language-Model Agents [61.184954205350984]
ClawArena-Teamは、41のマルチターン、マルチモーダル、マルチエージェントシナリオのベンチマークである。
全体的なスコア -- Subagent-Management Score (SMS) -- は、タスクの正しさを最小限のプライマリとモダリティのルーティング因子によって乗算する。
論文 参考訳(メタデータ) (2026-06-30T06:06:08Z) - The Best-Laid SCHEMEs: Coordinated Sabotage and Monitoring in Multi-Agent Systems [0.0]
SCHEMEは7つの設定と8つの実際のオープンソースライブラリにわたる17のタスクインスタンスのベンチマークである。
各設定は、エージェントの適切なサブセットが単独で成功しないように設計されている。
GPT 5.1 Codex と Gemini 3.1 Pro ですでに協調サボタージュが実用化されていることを示す。
論文 参考訳(メタデータ) (2026-05-27T23:30:21Z) - Do Coding Agents Understand Least-Privilege Authorization? [14.240332406666779]
我々は、現在のモデルが認証境界自体を推測できるかどうか検討する。
We show that frontier model often off permissions by the execution chain while giving unuseed or sensitive accesss。
そこで我々は,まずカバレッジ指向のポリシを生成し,各エントリをグラウンドと感度で監査する,十分性-高度分解法を提案する。
論文 参考訳(メタデータ) (2026-05-14T14:05:58Z) - SDOF: Taming the Alignment Tax in Multi-Agent Orchestration with State-Constrained Dispatch [0.0]
制約状態マシンとしてマルチエージェント実行を扱うフレームワークであるSDOFを提案する。
Beisen iTalentプラットフォームが支援する採用システムでは、専門家による185のシナリオが1671のライブAPIコールを起動する。
GSPO 対応 7B Intent Router は,この FSM 制約付き逆ルーティングベンチマークにおいてゼロショット GPT-4o よりも高いジョイント精度を実現する。
論文 参考訳(メタデータ) (2026-04-20T12:51:39Z) - AITH: A Post-Quantum Continuous Delegation Protocol for Human-AI Trust Establishment [9.198471344145092]
本稿では,ポスト量子連続デリゲートプロトコルであるAITH(AI Trust Handshake)を提案する。
AITHは、(1)ML-DSA-87 (FIPS 204, NIST Level 5)で署名された継続的デリゲーション証明書、(2)ハード制約、レート制限、エスカレーショントリガを強制する6チェック境界エンジン、(3)プッシュベースのリコールプロトコルが、1秒以内に無効を伝搬する。
論文 参考訳(メタデータ) (2026-04-09T01:30:28Z) - Claw-Eval: Toward Trustworthy Evaluation of Autonomous Agents [66.97968363332465]
エージェントベンチマークの3つのギャップに対処するエンドツーエンド評価スイートであるClaw-Evalを紹介した。
Claw-Evalは3つのグループにまたがる9つのカテゴリにまたがる300の人間検証タスクで構成されている。
すべてのエージェントアクションは、3つの独立したエビデンスチャネルを通じて記録される。
論文 参考訳(メタデータ) (2026-04-07T17:43:18Z) - Towards a Science of Scaling Agent Systems [79.64446272302287]
エージェント評価の定義を定式化し,エージェント量,コーディネーション構造,モデル,タスク特性の相互作用として,スケーリング法則を特徴付ける。
協調指標を用いて予測モデルを導出し,R2=0をクロスバリデーションし,未知のタスク領域の予測を可能にする。
ツールコーディネーショントレードオフ: 固定的な計算予算の下では, ツールヘビータスクはマルチエージェントのオーバーヘッドから不均衡に悩まされ, 2) 能力飽和: 調整が減少または負のリターンを, 単一エージェントのベースラインが45%を超えると達成できる。
論文 参考訳(メタデータ) (2025-12-09T06:52:21Z) - Eigen-1: Adaptive Multi-Agent Refinement with Monitor-Based RAG for Scientific Reasoning [53.45095336430027]
暗黙的な検索と構造化された協調を組み合わせた統合フレームワークを開発する。
Humanity's Last Exam (HLE) Bio/Chem Goldでは,48.3%の精度を実現している。
SuperGPQAとTRQAの結果はドメイン間の堅牢性を確認した。
論文 参考訳(メタデータ) (2025-09-25T14:05:55Z) - A Cordial Sync: Going Beyond Marginal Policies for Multi-Agent Embodied
Tasks [111.34055449929487]
エージェントが協力して家具をリビングルームに移動させるという,新しいタスクFurnMoveを紹介した。
既存のタスクとは異なり、FurnMoveはエージェントが各タイミングで調整する必要がある。
既存の分散化されたアクションサンプリング手順は、表現力のある共同アクションポリシーを許さない。
SynC-policiesとCORDIALを用いて、我々のエージェントはFurnMoveで58%の完成率を達成する。
論文 参考訳(メタデータ) (2020-07-09T17:59:57Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。