論文の概要: Regime-Conditional Retrieval: Theory and a Transferable Router for Two-Hop QA
- arxiv url: http://arxiv.org/abs/2604.09019v1
- Date: Fri, 10 Apr 2026 06:31:51 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-13 17:57:53.721149
- Title: Regime-Conditional Retrieval: Theory and a Transferable Router for Two-Hop QA
- Title(参考訳): レジーム・コンディショナル検索:2ホップQAのための理論と伝達可能なルータ
- Abstract要約: 2ホップQA検索クエリは、ホップ2エンティティが質問(Q-dominant)で明示的に命名されているか、ブリッジ通路(B-dominant)でのみ命名されているかによって決定される2つのレジームに分けられる。
この分割を3つの定理で定式化する。
この理論に基づいて,質問のみと質問余剰関係文検索を選択可能な軽量バイナリルータを提案する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Two-hop QA retrieval splits queries into two regimes determined by whether the hop-2 entity is explicitly named in the question (Q-dominant) or only in the bridge passage (B-dominant). We formalize this split with three theorems: (T1) per-query AUC is a monotone function of the cosine separation margin, with R^2 >= 0.90 for six of eight type-encoder pairs; (T2) regime is characterized by two surface-text predicates, with P1 decisive for routing and P2 qualifying the B-dominant case, holding across three encoders and three datasets; and (T3) bridge advantage requires the relation-bearing sentence, not entity name alone, with removal causing an 8.6-14.1 pp performance drop (p < 0.001). Building on this theory, we propose RegimeRouter, a lightweight binary router that selects between question-only and question-plus-relation-sentence retrieval using five text features derived directly from the predicate definitions. Trained on 2WikiMultiHopQA (n = 881, 5-fold cross-fitted) and applied zero-shot to MuSiQue and HotpotQA, RegimeRouter achieves +5.6 pp (p < 0.001), +5.3 pp (p = 0.002), and +1.1 pp (non-significant, no-regret) R@5 improvement, respectively, with artifact-driven.
- Abstract(参考訳): 2ホップQA検索は、ホップ2エンティティが質問(Q-dominant)で明示的に命名されているか、ブリッジ通路(B-dominant)でのみ命名されているかによって決定される2つのレシエーションにクエリを分割する。
すなわち, (T1) per-query AUC はコサイン分離マージンのモノトン関数であり, R^2 >= 0.90 は8つのタイプエンコーダペアのうち6つのタイプエンコーダペアに対して, (T2) は2つの曲面テキスト述語で特徴づけられ, P1 はルーティングに決定的であり, P2 は3つのエンコーダと3つのデータセットにまたがって, B-dominant ケースを予選する。
この理論に基づいて、述語定義から直接派生した5つのテキスト特徴を用いた質問専用と質問+関連文検索を選択可能な軽量バイナリルータRegimeRouterを提案する。
2WikiMultiHopQA (n = 881, 5-fold cross-fitted)でトレーニングされ、MuSiQueとHotpotQAにゼロショットを適用したRegimeRouterは、それぞれ5.6 pp (p < 0.001), +5.3 pp (p = 0.002), +1.1 pp (非重要、非再帰) R@5の改善を実現した。
関連論文リスト
- SeGDeP: Semantic- and Geometric-Aware Decoupled Prompts for Reasoning Segmentation [51.46828526392219]
推論セグメンテーションは暗黙の言語学的結論を正確なマスクに変換する。
既存のMLLMセグメンタインタフェースでは、特別なトリガーを使用するか、両方の信号を1つのコンテキストに圧縮する。
明示的なWhat-whereインターフェースであるSeGDePを提示する。
論文 参考訳(メタデータ) (2026-09-08T15:11:32Z) - Architecture-Dependent Causal Transfer of Activation States Across Large Language Models [51.56484100374058]
内部言語アクティベーション状態は、異なる大きな言語モデル間で因果的に転送することができる。
生成中に投影された活性化をターゲットモデルに注入すると、統計的に有意で事前登録された因果効果が生じる。
現在実装されているLCM間のエンド・ツー・エンドのアクティベーション・ステート・トランスファーは、ユニバーサルではなくアーキテクチャに依存していると結論付けている。
論文 参考訳(メタデータ) (2026-08-17T09:53:27Z) - Query-Aware Spreading Activation for Multi-Hop Retrieval over Knowledge Graphs [0.0]
ほとんどの既存のシステムでは、問題はシードノードのみを設定する。
このアーキテクチャでは、完全なグラフをPythonメモリにロードし、様々なイテレーションで反復的なソルバを必要とする。
そこで我々は,同じクエリ認識を実現する拡散活性化法を提案する。
ステップごとに1つのセマンティックゲートで検索する。
論文 参考訳(メタデータ) (2026-06-29T11:10:19Z) - Dissecting Agentic RAG: A Component Ablation for Multi-Hop QA with a Local 7B Model [0.0]
5000の質問に対して評価したフルエージェントRAGパイプラインのアブレーション制御を行った。
相互階数融合による固定ハイブリッド検索は規則に基づく適応的ルーティングよりも一貫して優れていることがわかった。
論文 参考訳(メタデータ) (2026-06-19T15:50:35Z) - Convergence Theory for Iterative LLM-Based Neural Architecture Search: A Parametric Cross-Entropy Framework with Closed-Form Proxy Reliability [48.83701310501069]
大規模言語モデル(LLM)は、反復型ニューラルアーキテクチャサーチ(NAS)におけるジェネレータとしてますます使われている。
我々は,LCM-NASを,実行可能プログラム上でのパラメトリッククロスエントロピー(CE)法としてモデル化する。
我々は,(1)エリートアーキテクチャの反復LEM微調整は,LLMファミリーに制限されたCE更新と同等であり,(2)期待されるアーキテクチャ品質はサイクル毎に単調に低下せず,(3)エリートセットの確率は幾何率で一定点に収束する,という6つの結果を示した。
論文 参考訳(メタデータ) (2026-05-28T15:45:19Z) - Every Component is a Lookup: Token Attribution and Composition from a Single Decomposition [1.3290717106567922]
We exploit a shared key-value template $(S)U$ to developing Unpack, a backward recursion that decomposes credit through both sublayers。
GPT-2では、Wang et al. (2023) によって記述された3つの合成接続をすべて復元し、各接続のモード固有のルーティングを含む。
160Mから6.9Bまでのピキア族全体において、この抑制パターンはあらゆるスケールで一貫して回復される。
論文 参考訳(メタデータ) (2026-05-22T09:03:01Z) - Pairwise matrices for sparse autoencoders: single-feature inspection mislabels causal axes [2.741152471987327]
標準スパースオートエンコーダプロトコルは、各機能をトップアクティベーションコンテキストからラベル付けし、単一機能ステアリングによって検証する。
本稿では,Qwen3-1.7B-Instruct上での標準ワンコーナプロトコルミスをGemma-2-2B-itで再現した,ペアワイズ行列プロトコルと共変ステアリング係数を提案する。
これら3つの所見はGemmaでモデル特異的な損傷シグネチャを再現し,一致した形状制御はCIを10倍に分離する。
論文 参考訳(メタデータ) (2026-05-04T21:11:21Z) - Equifinality in Mixture of Experts: Routing Topology Does Not Determine Language Modeling Quality [0.0]
学習したセントロイドに対するコサイン類似性ルーティングを用いたスパース・ミックス・オブ・エクササイズ(MoE)アーキテクチャを構築した。
ルーティングトポロジがパープレキシティ(PPL)を決定できないことが分かりました。
トポロジレベルの等質性と共存するエキスパートレベルと因果制御性について、共用論文で検討する。
論文 参考訳(メタデータ) (2026-04-15T21:02:02Z) - BridgeRAG: Training-Free Bridge-Conditioned Retrieval for Multi-Hop Question Answering [0.0]
本稿では,BridgeRAGを提案する。
BridgeRAGは、スコアリングからカバーを分離する: 二重エンタテイティーANNは、第2のホップ候補プールを広げる。
ブリッジコンディショニングが生産的再ランク付けを引き起こすことを示す(並列チェーンでは18.7%、単一チェーンでは0.6%)。
論文 参考訳(メタデータ) (2026-04-03T18:27:51Z) - Evaluating Small Language Models for Front-Door Routing: A Harmonized Benchmark and Synthetic-Traffic Experiment [0.05586191108738562]
小型言語モデル(SLM)は、サブ秒、ゼロマージナルコスト、セルフホストタスクの分類に十分な推論能力を持つ。
Study 1はPhi-3.5-mini、Qwen2.5-1.5B、Qwen-2.5-3Bを同一のAzure T4ハードウェア、サービススタック、量子化、固定60ケースコーパスで同期したオフラインベンチマークである。
研究2は、合成トラフィック下で事前登録された4本腕ランダム化実験であり、有効サンプルサイズは腕あたり60ケースである。
論文 参考訳(メタデータ) (2026-03-26T15:57:46Z) - Reinforcement Learning for Parameterized Quantum State Preparation: A Comparative Study [2.4542351340244264]
我々は、純離散ゲート選択からパラメータ化量子状態準備への強化学習により、指向性量子回路合成(DQCS)を拡張した。
ゲートタイプと影響を受けるキュービット(s)と回転角を協調的に選択する一段エージェントとを比較した。
本稿では,2から10キュービットのシステム上でのPPO(Proximal Policy Optimization)とAdvantage Actor--Critic(Advantage Actor--Critic)を評価する。
論文 参考訳(メタデータ) (2026-02-18T15:10:43Z) - ACAR: Adaptive Complexity Routing for Multi-Model Ensembles with Auditable Decision Traces [3.151184728006369]
本稿では,聴覚条件下でのマルチモデルオーケストレーションのための測定フレームワークACARを提案する。
ACARは、N=3プローブサンプルから計算した自己整合分散(sigma)を使用して、単一モデル、2モデル、3モデル実行モードでタスクをルーティングする。
我々は4つのベンチマークにまたがる1,510のタスクに対してACARを評価し、7,550以上の監査可能な実行を生成した。
論文 参考訳(メタデータ) (2026-02-06T23:27:17Z) - BRIDGE: Building Representations In Domain Guided Program Verification [67.36686119518441]
BRIDGEは、検証をコード、仕様、証明の3つの相互接続ドメインに分解する。
提案手法は, 標準誤差フィードバック法よりも精度と効率を著しく向上することを示す。
論文 参考訳(メタデータ) (2025-11-26T06:39:19Z) - Faithful Chain-of-Thought Reasoning [51.21714389639417]
CoT(Chain-of-Thought)は言語モデル(LM)のパフォーマンスを様々な推論タスクで向上させる。
翻訳と問題解決という2つの段階を含む推論フレームワークであるFithful CoTを提案する。
このことは、推論連鎖が最終回答の忠実な説明を提供することを保証している。
論文 参考訳(メタデータ) (2023-01-31T03:04:26Z) - Regret Bounds for Noise-Free Cascaded Kernelized Bandits [45.551266812295005]
RKHS関数クラスを用いたノイズフリーグレーボックス設定において,関数ネットワークの最適化を検討する。
本研究では,(1)チェーン:スカラー値関数のカスケード,(2)マルチアウトプットチェーン:ベクトル値関数のカスケード,(3)フィードフォワードネットワーク:完全に接続されたスカラー値関数のフィードフォワードネットワークの3種類の構造について検討する。
論文 参考訳(メタデータ) (2022-11-10T09:12:55Z) - Disentangled Representation Learning for Text-Video Retrieval [51.861423831566626]
テキスト・ビデオ検索(TVR)における相互モダリティの相互作用
我々は相互作用のパラダイムを深く研究し、その計算を2つの項に分けることができることを示した。
本稿では,逐次的かつ階層的な表現を捉えるための非絡み合いフレームワークを提案する。
論文 参考訳(メタデータ) (2022-03-14T13:55:33Z) - R2-D2: A Modular Baseline for Open-Domain Question Answering [0.1529342790344802]
この研究は、新しい4段階のオープンドメインQAパイプラインR2-D2(Rank twice, reaD twice)を提示する。
パイプラインは、レトリバー、パスリランカ、抽出リーダ、生成リーダ、およびすべてのシステムコンポーネントから最終的な予測を集約するメカニズムで構成されている。
論文 参考訳(メタデータ) (2021-09-08T08:51:27Z) - PlueckerNet: Learn to Register 3D Line Reconstructions [57.20244406275875]
本稿では,ユークリッド空間における2つの部分重畳された3次元線再構成の問題をニューラルネットワークで解く手法を提案する。
室内および屋外の両方のデータセットを用いた実験により,本手法の登録精度(回転と翻訳)は,ベースラインを著しく上回ることがわかった。
論文 参考訳(メタデータ) (2020-12-02T11:31:56Z) - FastLR: Non-Autoregressive Lipreading Model with Integrate-and-Fire [74.04394069262108]
我々は,全てのターゲットトークンを同時に生成する非自己回帰(NAR)リップリーダーモデルであるFastLRを提案する。
FastLRは最先端のリップリーダーモデルと比較して10.97$times$のスピードアップを実現している。
論文 参考訳(メタデータ) (2020-08-06T08:28:56Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。