論文の概要: Context Is Not Authority: Structured Runtime Governance for Financial Market Agents
- arxiv url: http://arxiv.org/abs/2608.09025v1
- Date: Mon, 10 Aug 2026 02:26:07 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-11 19:16:37.040635
- Title: Context Is Not Authority: Structured Runtime Governance for Financial Market Agents
- Title(参考訳): コンテキストは権限ではない - 金融市場エージェントのための構造化ランタイムガバナンス
- Abstract要約: SAGE-Finは金融特有の権限取扱契約である。
提案を型付きアダプタバウンド候補にコンパイルする。
それは、名目上の型が消費する応答、実行、またはポリシーアダプタと一致する正確なアーティファクトレシートを必要とする。
- 参考スコア(独自算出の注目度): 16.252780383876928
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Financial agents can turn correct context into an unauthorized effect: a customer-facing commitment, trade, or deployed policy. We present SAGE-Fin, a finance-specific authority-handoff contract that makes the proposed effect, not merely its text, the object of runtime control. SAGE-Fin compiles proposals into typed, adapter-bound candidates; records missing or stale institutional obligations as coverage debt; contracts authority under current market, account, policy, and dialogue state; and requires an exact-artifact receipt whose nominal type matches the consuming response, execution, or policy adapter. Evidence and workflow progress cannot substitute for effect authority, and prior authorization is rechecked after state changes. Across an authored 616-case catalog, five deterministic specifications yield 3,080 outputs; a label-isolated harness obtains 616/616 binary reference-prototype parity, including 3/3 named response-gate fixtures, while 22 tests cover selected paths. These results establish executable conformance, not independent safety accuracy. Separately, SAGE-Fin's response gate processed real customer-facing production requests at a confidential digital-asset platform. An operational team independent of the implementation team reached a strongly positive post-deployment conclusion on practical usefulness and workflow fit, and end-user feedback was also strongly positive. Disclosure permits only the review's independence, stakeholder classes, assessed dimensions, and directional conclusion, so this is qualitative field corroboration rather than an aggregate effect estimate. Three distinct de-identified predecessor failures, with independently confirmed 0/3 interception, ground repeated-emission drift, stale account evidence, and missing escalation state without estimating prevalence or treatment effect.
- Abstract(参考訳): ファイナンシャルエージェントは、正しいコンテキストを不正な効果、すなわち顧客を対象とするコミットメント、取引、あるいはデプロイされたポリシーに変換することができる。
SAGE-Finは金融に特有な権限取扱契約であり、実行時制御の対象であるテキストだけでなく、提案する効果を生んでいる。
SAGE-Finは、提案を型付けされたアダプタバウンドの候補にまとめ、カバーラインの負債として制度上の義務を欠いた、または古い記録、現在の市場、会計、政策、対話状態の下での契約権限、そして名目上のタイプが消費された応答、実行、またはポリシーアダプタと一致する正確な人工的な領収書を要求する。
エビデンスとワークフローの進捗はエフェクト権限の代わりにはならず、事前の認可は状態変更後に再チェックされる。
ラベル付きハーネスは、3/3の名前の応答ゲートフィクスチャを含む616/616のバイナリ参照-プロトタイプパリティを取得し、22のテストは選択されたパスをカバーする。
これらの結果は、独立した安全精度ではなく、実行可能な適合性を確立する。
SAGE-Finのレスポンスゲートは、秘密のデジタルアセットプラットフォームで実際の顧客向けプロダクションリクエストを処理します。
実装チームから独立した運用チームは、実用性とワークフローの適合性に関して、デプロイ後の強く肯定的な結論に達し、エンドユーザからのフィードバックも強く肯定的だった。
開示は、レビューの独立性、ステークホルダークラス、評価された次元、方向性の結論のみを許可するので、これは総合的な効果推定ではなく質的なフィールドの相関である。
個別に確認された0/3インターセプション、地上からの繰り返し放出ドリフト、古いアカウントの証拠、そして頻度や治療効果を見積もることなくエスカレーション状態が失われた。
関連論文リスト
- From Intent to Execution Grant: An Execution-Boundary Conformance Profile for High-Risk AI Actions [9.27474112226667]
EBL-Coreは、1つの標準的な、完全に実体化されたAI生成候補が、明示的な条件下でアクションスコープ実行権限を受け取ることができるかどうかを決定する。
拘束力、政策非監視、エビデンス処理、決定論的判断、検証、ライフサイクル行動の付与などである。
100回の試験で32回の同時再空輸試験が成功し、1回の試行で完全に1回成功し、テスト効果が保護された。
論文 参考訳(メタデータ) (2026-09-10T14:21:45Z) - A Finger on the Scale: Covert Policy Steering through Agentic Skills [42.71897827897363]
再利用可能なエージェントスキルは、タスクプロシージャ、ツールユースガイダンス、出力制約を備えた大きな言語モデル(LLM)エージェントを拡張する。
我々は、その宣言された機能とユーザ認証された目的と整合し続けるために、スキルによるポリシーを必要とするスキルポリシーの整合性を定式化する。
SkillShiftは、明示的なコマンドインジェクションやタスクハイジャックを使わずに、隠蔽ポリシーステアリングのための制約付きブラックボックスフレームワークである。
論文 参考訳(メタデータ) (2026-09-02T13:15:14Z) - $Z^2$-ACT: End-to-End Verifiable Agentic Intent Control for Open 6G RAN [43.15181031994434]
本稿では,ゼロ知識監査制御とゼロ信頼検証エージェントインテントアーキテクチャを提案する。
実大規模言語モデルは、オペレータの意図をIntent Contractsに変換するために、非リアルタイムパスで使用される。
その結果、動作フィルタリングと攻撃レジリエンスを適度なレイテンシとシグナリングコストで改善したことが示唆された。
論文 参考訳(メタデータ) (2026-08-21T12:44:03Z) - PACEShop: Evaluating Personalized, Actionable, Compositional, and Evidence-grounded Shopping Assistants [36.11628216058589]
ショッピングアシスタントは、ランク付けされた製品リストから構造化された意思決定サポートへとシフトしており、そこではシステムは買い物客のコンテキスト、製品証拠、そして次のステップのガイダンスを一貫性のあるレコメンデーションエクスペリエンスへと合成する必要がある。
既存のパーソナライズ、グラウンド化、LCM-as-a-judgeベンチマークはこの問題の一部をカバーしているが、構造化されたショッピングアシスト応答に対する共同評価ターゲットを定義していない。
PACE: Personalized, Actionable, compositional, Evidence-grounded Evaluation。
PACEを2つのアーティファクトでインスタンス化します。PACEShopは、ターゲットを、構造化されたペルソナ、監査を備えた22,625のコントロールレコードを通じて測定可能にするベンチマークデータセットです。
論文 参考訳(メタデータ) (2026-08-20T01:21:51Z) - A Policy Algebra for Trust-Preserving Agentic AI Execution [5.943264605557423]
本稿では,エージェント能力の行使可能な信頼性エンベロープを定義するポリシー代数を提案する。
この評価は、能力ベンチマークではなく、信頼性と信頼性のトレードオフとして解釈される。
論文 参考訳(メタデータ) (2026-08-17T10:59:15Z) - Correct Is Not Governed: Provenance Integrity in Agentic Workflows [0.0]
本稿では,決定論的因果状態層であるMatrixについて述べる。これは権威と事実の依存関係を記録し,完成証拠を検証し,影響を受ける作業を選択的に無効化する。
結果は、マトリックスを一般的な精度向上剤として確立せず、エージェントワークを監査可能かつ独立的に検証するための制度的整合層としての役割を担っている。
論文 参考訳(メタデータ) (2026-08-13T03:12:13Z) - From Trajectories to Evidence: Auditable Experimental Records for Industrial Research Agents [47.678562263387214]
研究エージェントは、産業レコメンデーション設定において、多段階の機械学習実験をますます実施している。
生成されたアーティファクトは、サポートされないか、不完全かもしれないし、実行されたラウンドは無効かもしれないし、あるいは廃止されるかもしれないし、後の修正は、以前の発見を曖昧にするかもしれない。
本稿では,連続的アーティファクトのバウンダリ検証と実行後のクレーム資格を結合するエビデンス・グラウンド・フレームワークを提案する。
論文 参考訳(メタデータ) (2026-08-05T13:37:38Z) - Safety Invariants for Agents Orchestrating Irreversible State Transitions: A Four-Dimensional Formalism Evaluated on Public Ledgers [0.0]
フォーマリズムを使って、実行忠実性( executionfidelity)と呼ばれる保証を記述し、証明します。
7つの安全不変量は、経験から数えられるのではなく、忠実性条件に由来するもので、保証を解除する。
システムはデプロイされ、8つのチェーンにまたがる108のプロダクション書き込み操作によって、障害分類が復活する。
論文 参考訳(メタデータ) (2026-08-01T17:29:42Z) - A Decision-Centered Reference Architecture for Trustworthy Agentic Commerce [0.0]
エージェントコマースは、エージェントショッピングを、ポリシーを解釈し、チェックアウトを準備し、トランザクション対応言語を生成し、委譲された支払い権限の下で行動するソフトウェアエージェントに拡張する。
本研究では,標準エンベロープを中心に構築されたプロトコルに依存しないアーキテクチャ,保護された依存性と結果,Ed25519あるいはHMAC認証,ライブ要求リバインド,7軸生成ゲート,実行時依存性再検証,セマンティック不変量について述べる。
論文 参考訳(メタデータ) (2026-07-20T08:33:31Z) - Decision Support for Marketplace Policies under Incomplete Evidence: From Replay to Launch Readiness [0.5013248430919224]
本稿では,有望な証拠と実効性のある証拠とを区別するDSS(Support-Aware decision- supported system)を提案する。
このフレームワークは、リプレイ、サポート対応のオフポリシー評価(OPE)、保守的な下限ランキング、マルチサイドガードレール、アウトオブタイムバリデーション、感度分析、干渉対応のバリデーション設計を統合している。
フレームワークをiPinYouスタイルのRTBログに適用することで、マージンゲートのフロアポリシーを主要な候補と特定する。
論文 参考訳(メタデータ) (2026-05-13T00:26:50Z) - Autonomous FAIR Digital Objects: From Passive Assertions to Active Knowledge [5.118282682919236]
Web上の科学知識のキュレーションは、中央集権化と制度的な連続性に依存するが、登録が近いと、データがオンラインのままであってもアクティブなスチュワードシップは停止する。
我々は、自律デジタルオブジェクト(aFDO)の概念を抽象的なアイデアから運用モデルへと前進させる。
AFDOは、セマンティックWeb標準に固定された3つの機能、すなわち、ポータブルな条件-アクションルールのためにPROV-O、SHACL、ODRLに整合したRDF-star上のポリシー層、そして、発表毎の評価コストを制限したActivityStreams 2.0上のアナウンス層、そして、3マルチを解決した合意層である。
論文 参考訳(メタデータ) (2026-05-11T11:12:55Z) - Beyond Task Success: An Evidence-Synthesis Framework for Evaluating, Governing, and Orchestrating Agentic AI [0.0]
本稿では,手動符号化コーパスにおける有界なエビデンス合成に寄与する。
本稿では,(1)評価,ガバナンス,オーケストレーション,保証にまたがる4層フレームワーク,(2)可観測性,決定性,タイムライン,検証性に基づくODTA実行時配置テスト,(3)状態変更動作のための最小アクション検証バンドル,の3つの関連アーティファクトを紹介する。
論文 参考訳(メタデータ) (2026-04-18T20:28:26Z) - Verification of Robust Properties for Access Control Policies [51.736723807086385]
既存のアクセス制御ポリシーの検証方法は、検証が進む前に、ポリシーを完全かつ完全に決定する必要がある。
本稿では,政策構造がどのような決定を下すか,どのような決定を下すか,あるいはその後の拡張に拘わらず,その決定を行うかという課題について,ロバストなプロパティ検証を導入する。
可能なすべてのポリシー拡張を普遍的に定量化しているにもかかわらず、判断は二階述語論理プログラミング言語における探索の証明に還元されることを示す。
論文 参考訳(メタデータ) (2026-03-13T17:14:38Z) - LLM-based Triplet Extraction from Financial Reports [39.146761527401424]
Ontology Conformance と Faithfulness を用いた半自動三重項抽出パイプラインを提案する。
また, LLM-as-a-judge チェックとのマッチングを併用し, 被験者の幻覚率を65.2%から1.6%に下げるハイブリッド検証戦略を提案する。
論文 参考訳(メタデータ) (2026-02-12T12:36:10Z) - Preventing the Collapse of Peer Review Requires Verification-First AI [49.995126139461085]
我々は、真理結合、すなわち、過度に科学的真理をトラックする場所のスコアの厳密さを提案する。
プロキシ・ソブリン評価に向けた相転移を駆動する2つの力の形式化を行う。
論文 参考訳(メタデータ) (2026-01-23T17:17:32Z) - Making LLMs Reliable When It Matters Most: A Five-Layer Architecture for High-Stakes Decisions [51.56484100374058]
現在の大規模言語モデル(LLM)は、実行前にアウトプットをチェックできるが、不確実な結果を伴う高い戦略決定には信頼性が低い検証可能な領域で優れている。
このギャップは、人間と人工知能(AI)システムの相互認知バイアスによって引き起こされ、そのセクターにおける評価と投資の持続可能性の保証を脅かす。
本報告では、7つのフロンティアグレードLDMと3つの市場向けベンチャーヴィグネットの時間的圧力下での系統的質的評価から生まれた枠組みについて述べる。
論文 参考訳(メタデータ) (2025-11-10T22:24:21Z) - Are You Getting What You Pay For? Auditing Model Substitution in LLM APIs [71.7892165868749]
LLM(Commercial Large Language Model) APIは基本的な信頼の問題を生み出します。
ユーザーは特定のモデルに課金するが、プロバイダが忠実に提供できることを保証することはない。
我々は,このモデル置換問題を定式化し,現実的な逆条件下での検出方法を評価する。
我々は,信頼された実行環境(TEE)を実用的で堅牢なソリューションとして使用し,評価する。
論文 参考訳(メタデータ) (2025-04-07T03:57:41Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。