論文の概要: Policy-Conditioned Constrained Decoding for Column-Level Access Control in Text-to-SQL
- arxiv url: http://arxiv.org/abs/2607.12341v1
- Date: Tue, 14 Jul 2026 04:41:09 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-15 17:08:30.037235
- Title: Policy-Conditioned Constrained Decoding for Column-Level Access Control in Text-to-SQL
- Title(参考訳): テキスト・トゥ・SQLにおける列レベルアクセス制御のためのポリシー制約付き制約付き復号法
- Abstract要約: テキスト音声システムにおける意味的使用に関するコラム利用ポリシーを定式化する。
単一クエリのカラム使用違反を確定的に除去する,トークン単位のロジットマスクを適用する。
PCC-は、スパイダー-CUで最大88.7%のリークとカバーを達成している。
- 参考スコア(独自算出の注目度): 10.411303902761631
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Text-to-SQL is increasingly deployed across trust boundaries between data providers and users. Such deployment must balance three competing requirements: policy compliance, answer coverage, and bounded cost. Existing approaches typically decide refusal based on which columns a query mentions and enforce it stochastically. Whether a query is compliant, however, depends not only on which columns appear but on how they are used, and stochastic enforcement cannot deterministically rule out violations. We formalize this requirement as a column-use policy over semantic use: output, filter condition, and aggregation argument. We integrate the policy by aligning each role with grammar productions tracked by the decoder. The resulting system, PCC-SQL, applies a per-token logits mask that deterministically eliminates single-query column-use violations on the supported SQL fragment in a single decoding pass. Across three benchmarks and three open-source models, PCC-SQL achieves 0% Leakage Rate and Coverage up to 88.7% on Spider-CU, while staying within +10% tokens of direct prompting. We additionally assess semantic alignment with execution accuracy.
- Abstract(参考訳): Text-to-SQLは、データプロバイダとユーザ間の信頼境界を越えてデプロイされるようになっている。
このようなデプロイメントは,ポリシコンプライアンス,回答カバレッジ,制限付きコストという,競合する3つの要件のバランスを取る必要があります。
既存のアプローチでは、クエリが言及する列に基づいて拒否を決定し、確率的に強制するのが一般的である。
しかし、クエリが準拠しているかどうかは、どの列が現れるかだけでなく、どのように使用されるかにも依存する。
我々は、この要件を意味的使用よりもカラム利用ポリシーとして、出力、フィルタ条件、集約引数として定式化する。
それぞれの役割をデコーダが追跡する文法生成と整合させることでポリシーを統合する。
結果として得られたシステムであるPCC-SQLは、単一の復号パスでサポート対象のSQLフラグメントに対する単一クエリカラム使用違反を決定的に排除する、トークン単位のロジットマスクを適用している。
3つのベンチマークと3つのオープンソースモデルで、PCC-SQLは、スパイダー-CUで最大88.7%のリーク率とカバレッジを達成した。
さらに,セマンティックアライメントを実行精度で評価する。
関連論文リスト
- CAPER: Clause-Aligned Process Supervision for Text-to-SQL [11.286563956844946]
本稿では,SQL 抽象構文木への反実的介入を通じて,自動的に節レベルの監視を導出する CAPER を提案する。
得られたデータは、ポリシー最適化と候補検証のための軽量なクロース境界フィードバックであるCAPER-9Bのトレーニングに使用される。
BIRDとスパイダーの実験では、節順の監督は実行精度を向上するだけでなく、GPT-5.4よりも15.3%の改善を達成し、障害局所化能力を強化し、84.53%の精度と90.60%のMRRを達成した。
論文 参考訳(メタデータ) (2026-06-02T08:35:40Z) - EXPO-SQL: Execution-based Clause-level Policy Optimization for Text-to-SQL [30.5119607116771]
テキスト・ツー・クエリにより、ユーザは自然言語を使ってデータベースをクエリできる。
既存の大規模言語モデルに基づく強化学習手法は、正しい節と間違った節を等しく扱う。
文問合せのためのEXPO-(Execution-based clause-level Policy Optimization for Text-to- querying)を提案する。
論文 参考訳(メタデータ) (2026-04-29T10:33:16Z) - R$^3$-SQL: Ranking Reward and Resampling for Text-to-SQL [55.967050404665606]
R$3$-はBIRD-devで75.03の精度を達成した。
論文 参考訳(メタデータ) (2026-04-28T07:40:50Z) - PV-SQL: Synergizing Database Probing and Rule-based Verification for Text-to-SQL Agents [7.865833770467325]
テキスト・ツー・システムは、特に微妙な要求のある複雑なクエリにおいて、深いコンテキスト理解に苦しむことが多い。
本稿では,2つの相補的コンポーネント(プローブと検証)を通じて,これらの障害に対処するエージェントフレームワークであるPV-Verifyを紹介する。
Probeコンポーネントは、データベースから具体的なレコードを取得するための探索クエリを反復的に生成し、値形式、列のセマンティクス、テーブル間の関係の曖昧さを解消し、よりリッチなコンテキスト理解を構築する。
論文 参考訳(メタデータ) (2026-04-19T22:54:05Z) - Text-to-SQL as Dual-State Reasoning: Integrating Adaptive Context and Progressive Generation [54.53145282349042]
DSR-sourced, textbfDual-textbfS textbfReasoning frameworkを導入する。
ポストトレーニングやインコンテキストの例がなければ、DSR-sourcedは競合性能を達成し、スパイダー2.0-Snowで35.28%、BIRD開発で68.32%に達する。
論文 参考訳(メタデータ) (2025-11-26T13:52:50Z) - Role-Conditioned Refusals: Evaluating Access Control Reasoning in Large Language Models [9.010745644432221]
本研究は, LLMのアクセス制御ポリシーに準拠する能力に着目し, 承認された場合に応答し, 拒否した場合に応答することに着目し, 役割条件の拒絶について検討する。
この振る舞いを評価するために、SpiderとBIRDのテキスト・ツー・ショット・データセットを拡張する新しいデータセットを作成しました。
論文 参考訳(メタデータ) (2025-10-09T00:28:59Z) - ScenarioBench: Trace-Grounded Compliance Evaluation for Text-to-SQL and RAG [0.0]
Scenarioは、コンプライアンスコンテキストにおけるText-to-retrieval-augmented生成を評価するための、ポリシーベースでトレース対応のベンチマークである。
論文 参考訳(メタデータ) (2025-09-29T02:51:08Z) - Weaver: Interweaving SQL and LLM for Table Reasoning [62.55797244714265]
Weaverは、構造化データ検索のためのsqlとセマンティック処理のためのLLMを組み合わせたフレキシブルなステップバイステッププランを生成する。
Weaverは、4つのTableQAデータセットで、最先端のメソッドを一貫して上回る。
論文 参考訳(メタデータ) (2025-05-25T03:27:37Z) - ReFoRCE: A Text-to-SQL Agent with Self-Refinement, Consensus Enforcement, and Column Exploration [32.83579488224367]
ReFoRCEは、スパイダー2.0のリーダーボードのトップのテキスト・トゥ・信頼のエージェントです。
ReFoRCEは35.83のスパイダー2.0-Snowと36.56のスコアで最先端の結果を得た。
論文 参考訳(メタデータ) (2025-02-02T05:25:03Z) - RSL-SQL: Robust Schema Linking in Text-to-SQL Generation [51.00761167842468]
本稿では、双方向スキーマリンク、コンテキスト情報拡張、バイナリ選択戦略、マルチターン自己補正を組み合わせたRSLと呼ばれる新しいフレームワークを提案する。
ベンチマークの結果,オープンソースのソリューション間でのSOTA実行精度は67.2%,BIRDは87.9%,GPT-4オクルージョンは87.9%であった。
提案手法は,DeepSeekを同一のプロンプトで適用した場合,GPT-4ベースのテキスト・ツー・シークシステムよりも優れている。
論文 参考訳(メタデータ) (2024-10-31T16:22:26Z) - Wav2SQL: Direct Generalizable Speech-To-SQL Parsing [55.10009651476589]
Speech-to-Spider (S2Spider) は、与えられたデータベースに対する音声質問をsqlクエリに変換することを目的としている。
ケースドシステム間の誤り合成を回避した,最初の直接音声-話者パーシングモデルWav2を提案する。
実験結果から,Wav2は誤差混成を回避し,ベースラインの精度を最大2.5%向上させることで最先端の結果が得られることがわかった。
論文 参考訳(メタデータ) (2023-05-21T19:26:46Z) - Weakly Supervised Text-to-SQL Parsing through Question Decomposition [53.22128541030441]
我々は最近提案されたQDMR(QDMR)という意味表現を活用している。
質問やQDMR構造(非専門家によって注釈付けされたり、自動予測されたりする)、回答が与えられたら、我々は自動的にsqlクエリを合成できる。
本結果は,NL-ベンチマークデータを用いて訓練したモデルと,弱い教師付きモデルが競合することを示す。
論文 参考訳(メタデータ) (2021-12-12T20:02:42Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。