論文の概要: ResidualAuth: What Authorization State Must Language Agents Preserve under Revocable Delegation?
- arxiv url: http://arxiv.org/abs/2609.08062v1
- Date: Tue, 08 Sep 2026 00:05:05 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-10 19:44:08.535723
- Title: ResidualAuth: What Authorization State Must Language Agents Preserve under Revocable Delegation?
- Title(参考訳): ResidualAuth: Revocable Delegationの下で保存される許可状態の言語エージェントは?
- Authors: Moonwon Choi, Seokho Jeong, Seunggeun Lee,
- Abstract要約: ツールを使用する言語エージェントは、外部サービスを通じて動作しながら、権限の委譲と取り消しが可能である。
2つの認証履歴は、同一の現在の許可と同一のオールペアの到達性を持つことができるが、同一のダイレクトエッジの取り消し後に、反対の判断を必要とすることを示す。
- 参考スコア(独自算出の注目度): 0.22940141855172033
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Tool-using language agents can delegate and revoke permissions while acting through external services. We show that two authorization histories can have identical current permissions and identical all-pairs reachability yet require opposite decisions after the same direct-edge revocation. We formalize the information needed to preserve such distinctions as a residual authorization state. We prove that exponentially many future-distinct states can share one fixed transitive closure, and give exact or tight asymptotic bounds on the state required by an exact monitor as delegation redundancy varies. ResidualAuth compiles these constructions into paired language-agent episodes. Across four open-weight models, a fixed 256-token summary solved 0-2/16 pairs, sham reads solved 0/16, and authenticated current-query reads solved 15-16/16. In a separate held-out online-memory diagnostic, exact ledger serializations fit all 128 four-coordinate pairs at both 768 and 1,024 tokens. At either cap, factually supported model-written memories sufficient for every prespecified continuation solved at most 1/128 pairs per model. A hard gate reduced eight observed unauthorized effects to zero without changing the preceding attempts. These results distinguish required authorization state, usable decision information, online state maintenance, and effect mediation.
- Abstract(参考訳): ツールを使用する言語エージェントは、外部サービスを通じて動作しながら、権限の委譲と取り消しが可能である。
2つの認証履歴は、同一の現在の許可と同一のオールペアの到達性を持つことができるが、同一のダイレクトエッジの取り消し後に、反対の判断を必要とすることを示す。
我々は、そのような区別を維持するために必要な情報を、残留認証状態として定式化する。
我々は、指数関数的に多くの未来の固有状態が1つの固定された推移的閉包を共有できることを証明し、デリゲートの冗長性が変化するにつれて、正確なモニターによって要求される状態の正確なあるいは厳密な漸近的境界を与える。
ResidualAuthはこれらの構成をペア化された言語エージェントのエピソードにコンパイルする。
4つのオープンウェイトモデル、固定256トーケンの要約で0-2/16対、シャム読み込みで0/16、認証されたカレントクエリで15-16/16が解決された。
独立したオンラインメモリ診断では、正確な台帳シリアライゼーションが768トークンと1,024トークンの両方で128の4座標ペアに適合する。
いずれのキャップでも、1モデル当たり1/128対の差分で解決されたすべての所定の継続に対して、実際にサポートされているモデル記述メモリが十分である。
ハードゲートは、前回の試行を変更することなく、観測された8つの無許可効果をゼロに減らした。
これらの結果は、必要な認可状態、使用可能な決定情報、オンライン状態維持、効果メディエーションを区別する。
関連論文リスト
- Beyond Agent Harnesses: Cross-Substrate Authority for Multi-Agent Systems [11.339095480463712]
エージェントシステムはワークスペースを変更しながらモデル可視メモリを保持し、ランタイム、レジストリ、承認サービスは両方の外部で権限状態を保持することができる。
決定に関連する認証情報は、プランナー可視のワークスペースやメモリ状態の外に存在します。
3つの実験は、実際のGit系統を使用したプランナー・オブザーブレーションと実行時の権限チェックを比較する。
論文 参考訳(メタデータ) (2026-09-08T09:11:53Z) - Recognition Without Enforcement: Configuration-Dependent Failures in LLM Agent Instruction Arbitration and External Control [0.0]
LLMエージェントはシステムプロンプト、ユーザ、メモリ、ツールから命令を仲裁するが、この仲裁は信頼境界を強制するものではない。
ソースフォーマット機能はモデルアクティベーションから線形にデオード可能であり、モデルがトリガーされたときの偽の権威を明示的に識別することができる。
モデル自己配置をセキュリティ境界ではなく機能として扱い、認証されたソースルーティングと機能限定ツールの実行を組み合わせた外部参照モニタを実装します。
論文 参考訳(メタデータ) (2026-08-28T16:34:05Z) - From Traceability to Justifiability: Accountability Structures in Agentic Software Engineering [0.0]
公開資料のみから、AIレコードがクレームを表現できるかどうか、宣言された場所を保持できるかどうかを測定する。
188個の二重グレード細胞で、デフォルトレコードが行動システムのコンテンツアイデンティティを出力するプラットフォームは見つからなかった。
計器は、パイプラインが発行した排気のみからの保証深度を計算し、宣言された深さと比較する。
論文 参考訳(メタデータ) (2026-08-21T16:45:00Z) - Fingerprinting Text-to-Image Diffusion Models via Collapsed Generation [38.697895774925136]
崩壊生成は、学習された生成プロセスの本質的でモデルに依存した特性である。
崩壊した世代指紋は、混乱の少ない異なるソースモデルを識別できることを示す。
これらの指紋は、微調整されたデリバティブや、一般的で適応的なモデルやクエリレベルの難読化の下でも検証可能である。
論文 参考訳(メタデータ) (2026-08-12T07:12:38Z) - Turning Interaction History into Execution State: A Runtime Layer for Long-Horizon Coding Agents [48.967927222079965]
Ledgerは、エージェントの完了したインタラクションを明示的な実行状態に蒸留するランタイム層である。
Ledgerはこの状態をオンライン実行台帳に保持し、各ステップの2つのバウンダリに適用される。
500のSWE-bench検証インスタンス全体で、LedgerはPass@1を56.2%から64.2%に、GPT-5 miniを75.8%から81.0%に、MiniMax M2.5を81.0%に引き上げている。
論文 参考訳(メタデータ) (2026-08-01T18:25:00Z) - Stage-Replay Divergence Follows the KV Cache: Fixed-Prefix Precision Controls and Bidirectional Cache Transplantation [51.56484100374058]
Stage-replayは中間トークンプレフィックスを再構築し、プレフィックスに最初に到達したデコーダ状態からの継続として、新しいプリフィル継続を処理する。
一致した200itemの実験では、保持されたライブキャッシュと同一の整数トークンのワンショットプリフィルを比較し、両側に正確なレプリカを配置する。
論文 参考訳(メタデータ) (2026-07-30T16:41:40Z) - aiAuthZ: Off-Host, Identity-Bound Authorization for AI Agents [0.0]
エージェントのホストから安全判断を移動させる認証ゲートウェイであるaiAuthZを紹介します。
各決定はSHA-256ハッシュチェーン監査ログに参加し、受信メッセージはHMAC認証QRレシートを生成する。
残りの攻撃成功率は15モデルすべてで0%となり、0.03ミリ秒以上の決定遅延は発生しない。
論文 参考訳(メタデータ) (2026-07-06T18:00:49Z) - MobileGym: A Verifiable and Highly Parallel Simulation Platform for Mobile GUI Agent Research [39.68394140712043]
MobileGymは、日常的なモバイル利用のための軽量で完全に制御可能な環境である。
階層化された状態モデルと宣言的なタスク定義フレームワークは、状態のプログラマビリティとタスク作成を大規模に実践的に保ちます。
単一のプログラム的判断メカニズムは、決定論的評価評価と高密度報酬の両方を提供する。
論文 参考訳(メタデータ) (2026-05-25T17:59:49Z) - Overeager Coding Agents: Measuring Out-of-Scope Actions on Benign Tasks [40.270213696031625]
OverEager-Genは、良質なタスクの振る舞いをオーバーイーガーするベンチマークである。
クロード・コードでは、同意宣言を削除するだけで、オーバーイーガー率は0.0%から17.1%に上昇する。
オーバーイーガー・ジェン(OverEager-Gen)は、入場前に各シナリオの識別力を認定する。
論文 参考訳(メタデータ) (2026-05-18T16:00:41Z) - Do Coding Agents Understand Least-Privilege Authorization? [14.240332406666779]
我々は、現在のモデルが認証境界自体を推測できるかどうか検討する。
We show that frontier model often off permissions by the execution chain while giving unuseed or sensitive accesss。
そこで我々は,まずカバレッジ指向のポリシを生成し,各エントリをグラウンドと感度で監査する,十分性-高度分解法を提案する。
論文 参考訳(メタデータ) (2026-05-14T14:05:58Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。