論文の概要: Which Rules Matter Now? Policy-Centroid Routing Before an Intelligent System Acts
- arxiv url: http://arxiv.org/abs/2608.30757v1
- Date: Mon, 31 Aug 2026 13:24:47 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-01 18:31:31.41539
- Title: Which Rules Matter Now? Policy-Centroid Routing Before an Intelligent System Acts
- Title(参考訳): 今、どのルールが重要か? インテリジェントシステム法に先立つ政策中心のルーティング
- Authors: Thomson D. Nguy,
- Abstract要約: ポリシーセントロイドルーティングは、偏見の前にレイヤーを生成する。
いくつかの体制が一度に引き起こされることがある。
本論文では, フェーザブルな6つの命題と7つの後続研究について述べる。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Before an intelligent system can decide whether an action is allowed, it must first know which rules the action has approached. A single proposed action can implicate several policy regimes at once. Their requirements may stack, overlap, or qualify one another, yet many remain written in natural language while the action itself arrives as an incomplete description of intent. The first problem is not judgment. It is attention. Policy-centroid routing creates a layer before adjudication. It compresses expressions within each policy regime into one or more representative centroids, places the proposed action in the same semantic space, applies a declared measure, and routes every regime crossing a declared threshold to authoritative review. Several regimes may trigger at once. The output is a review agenda, not permission, prohibition, legality, breach, compliance, certification, or enforcement. The paper develops six falsifiable propositions and seven follow-on studies comparing the hypothesis with structured workflows, lexical and semantic retrieval, hierarchical and direct classification, and selective prediction under matched review burden. The studies are designed to identify where policy geometry recovers applicable regimes, where compression loses rare or overlapping obligations, and where the mechanism should abstain. The paper includes a synthetic worked example and reports no empirical efficacy result.
- Abstract(参考訳): インテリジェントなシステムがアクションが許可されるかどうかを決定する前に、まずはアクションがアプローチしたルールを知る必要があります。
単一の提案された行動は、複数の政策体制を同時に含み得る。
彼らの要求は積み重ねたり、重複させたり、資格を与えたりできるが、多くは自然言語で書かれており、アクション自体が意図の完全な記述として到着する。
第一の問題は判断ではない。
注意が必要です。
ポリシーセントロイドルーティングは、偏見の前にレイヤーを生成する。
各政策体制内の表現を1つ以上の代表的なセントロイドに圧縮し、提案されたアクションを同じ意味空間に配置し、宣言された尺度を適用し、宣言されたしきい値を越える全てのレギュレーションを権威的なレビューにルーティングする。
いくつかの体制が一度に引き起こされることがある。
アウトプットは、許可、禁止、合法性、侵害、コンプライアンス、認証、執行ではなく、レビューの議題である。
本論文は, 仮説を構造化ワークフロー, 語彙的および意味的検索, 階層的および直接的分類, マッチングされたレビューの負担下での選択的予測と比較する6つの有理的命題と7つの後続研究を開発した。
これらの研究は、政策幾何学が適用可能な体制を回復する場所、圧縮が希少または重複する義務を失う場所、そしてメカニズムが停止すべき場所を特定するように設計されている。
本論文は、合成作業例を含み、経験的効果を報告しない。
関連論文リスト
- Why2Speak: Faithful Reasoning for Abstaining Action Policies [0.19336815376402716]
我々は,直接的な意思決定方針,推論方針,教師付き微調整,強化学習を比較した。
最強の直接政策はより高い品質を達成するが、検査する理由を示さない。
監視された微調整は、推論を抑えるか、意思決定の質を向上させることなく維持する一方、強化学習は推論ポリシーを改善するのに失敗する。
論文 参考訳(メタデータ) (2026-08-21T02:00:21Z) - Governing Mental-State Inference: Source-Neutral Regulatory Triggers and Tiered Obligations [0.0]
神経工学の倫理に関するユネスコ勧告は非結合的ガイダンスである。
本稿では、技術的に媒介された人間関係の精神状態属性に対するソースニュートラルトリガーを開発する。
論文 参考訳(メタデータ) (2026-08-02T02:28:40Z) - AutoCedar: An Agentic Framework for Verifier-Guided Access Control Policy Synthesis [0.2449909275410288]
AutoCedarは、自然言語のアクセス制御要件をレビューされ、チェック可能なターゲットに変換する検証済みのシステムである。
そして、そのターゲットに対するシーダーポリシーを合成する。
論文 参考訳(メタデータ) (2026-07-04T01:13:32Z) - How to Catch a GPU: A Taxonomy of Verification and Enforcement Mechanisms for International AI Agreements [0.0]
本論では,合意に違反する十分な能力が存在する場合には,規制体制の下にいなければならないという原則に基づく分類法を提案する。
これにより、未管理の資源取得を防止し、制御体制外の全容量を検出し、制御体制からの脱却を防止するための合意の遵守を確保する問題が解消される。
この分類法を既存の提案に適用すると、制御体制からの脱出を防ぎつつ、資源の獲得を防ぎ、制御体制以外の全ての能力を検出することに注意が向けられることが明らかになる。
論文 参考訳(メタデータ) (2026-06-16T10:51:52Z) - PolicyBank: Evolving Policy Understanding for LLM Agents [51.86716874651299]
PolicyBankは構造化されたツールレベルの政策洞察を維持し、それらを反復的に洗練する。
PolicyBankは、人間の神託に対するギャップの最大82%を閉じている。
論文 参考訳(メタデータ) (2026-04-16T20:29:30Z) - Dense Policy: Bidirectional Autoregressive Learning of Actions [51.60428100831717]
本稿では,行動予測における自己回帰的政策の新たなパラダイムを確立するために,Dense Policyと呼ばれる双方向拡張学習手法を提案する。
軽量なエンコーダのみのアーキテクチャを使用して、アクションシーケンスを初期単一フレームからターゲットシーケンスへ粗い方法で反復的に展開する。
実験により、我々の密集した政策は自己回帰学習能力に優れており、既存の全体的生成ポリシーを超越できることが示された。
論文 参考訳(メタデータ) (2025-03-17T14:28:08Z) - Policy Dispersion in Non-Markovian Environment [53.05904889617441]
本稿では,非マルコフ環境下での国家行動ペアの歴史から,多様な政策の学習を試みる。
まず、ポリシー埋め込みを学習するために、トランスフォーマーベースの手法を採用する。
次に,政策埋め込みを積み重ねて分散行列を構築し,多様な政策の集合を誘導する。
論文 参考訳(メタデータ) (2023-02-28T11:58:39Z) - Indivisible Participatory Budgeting under Weak Rankings [0.6853165736531939]
参加型予算設定(PB)は、社会的選択設定に広く適用できるため、近年で注目されている。
本稿では,分類の弱いPBの分類法を提案し,そのアルゴリズム的および公理的問題について検討する。
本論文は,これらの規則の実践的魅力,計算複雑性,公理的遵守のトレードオフを明らかにするのに役立つ。
論文 参考訳(メタデータ) (2022-07-16T16:46:12Z) - Sayer: Using Implicit Feedback to Optimize System Policies [63.992191765269396]
我々は、暗黙のフィードバックを活用して、新しいシステムポリシーを評価し、訓練する方法論を開発する。
Sayerは、強化学習の2つのアイデアに基づいて、既存のポリシーで収集されたデータを活用する。
Sayer氏は任意のポリシーを正確に評価し、生産ポリシーを上回るような新しいポリシーをトレーニングできることを示します。
論文 参考訳(メタデータ) (2021-10-28T04:16:56Z) - Nested Counterfactual Identification from Arbitrary Surrogate
Experiments [95.48089725859298]
観測と実験の任意の組み合わせからネスト反事実の同定について検討した。
具体的には、任意のネストされた反事実を非ネストされたものへ写像できる反ファクト的非ネスト定理(英語版)(CUT)を証明する。
論文 参考訳(メタデータ) (2021-07-07T12:51:04Z) - State Augmented Constrained Reinforcement Learning: Overcoming the
Limitations of Learning with Rewards [88.30521204048551]
制約付き強化学習の一般的な定式化には、与えられた閾値に個別に蓄積しなければならない複数の報酬が含まれる。
ここでは,任意の重み付けされた報酬の線形結合によって,所望の最適政策を誘導できない簡単な例を示す。
この研究は、ラグランジュ乗算器で状態を増大させ、原始双対法を再解釈することで、この欠点に対処する。
論文 参考訳(メタデータ) (2021-02-23T21:07:35Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。