論文の概要: Fenced Citation-Context Retrieval for Case Law: Temporal Leakage and Degree Control Across Two Jurisdictions
- arxiv url: http://arxiv.org/abs/2607.17142v2
- Date: Tue, 21 Jul 2026 14:23:05 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-22 14:48:36.379353
- Title: Fenced Citation-Context Retrieval for Case Law: Temporal Leakage and Degree Control Across Two Jurisdictions
- Title(参考訳): Fenced Citation-Context Retrieval for Case Law: Temporal Leakage and Degree Control around two Jurisdictions
- Abstract要約: 先行事例検索は,クエリケースの事実に関連する先行事例を特定することを目的としている。
本稿では,クエリの先行する引用に制限された入力コンテキストでBM25を増強する,ゼロトレーニング,時間的フェンス付きレトリバーを提案する。
実験は米国連邦法(CLERC)と欧州法(ECtHR-PCR)の2つの司法管轄区域にまたがる。
- 参考スコア(独自算出の注目度): 4.366904149463058
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Prior case retrieval (PCR) aims to identify the precedent cases relevant to the facts of a query case. Incoming citation context, the text with which later cases characterize a case when citing it, is a powerful relevance signal, yet it is typically evaluated without a temporal constraint, so the retriever is credited with citations made after the query. We introduce a zero-training, temporally fenced retriever that augments BM25 with incoming citation context restricted to citations predating the query, together with a temporal-admission decomposition that quantifies the phantom fraction: the share of a citation-context gain attributable to citations not known to predate the query. Experiments span two jurisdictions, U.S. federal (CLERC) and European (ECtHR-PCR) case law. On ECtHR-PCR, without any training, the fenced retriever outperforms a strong degree-controlled baseline across the full recall ladder, and a temporal-admission decomposition attributes 14.9% (validation) of an unfenced citation-context gain over BM25 to citations not known to predate the query. Citation-context retrieval must therefore be temporally fenced and degree-controlled before its reported gains can be interpreted.
- Abstract(参考訳): 先行事例検索(PCR)は,クエリケースの事実に関連する前例を同定することを目的としている。
引用コンテキストでは、後続の事例が引用するケースを特徴付けるテキストは、強力な関連信号であるが、通常は時間的制約なしで評価されるため、検索者はクエリ後に作成された引用でクレジットされる。
本稿では,クエリを先行する引用に制限された応答コンテキストでBM25を付加するゼロトレーニング,時間的フェンス付きレトリバーと,ファントム分数の定量化を行う時間的アドミッション分解について紹介する。
実験は米国連邦法(CLERC)と欧州法(ECtHR-PCR)の2つの司法管轄区域にまたがる。
ECtHR-PCRは、トレーニング無しで、フェンス付きレトリバーは、完全なリコールはしごをまたいで、強い度合い制御されたベースラインを上回り、クエリの事前を知らない引用に対してBM25を上回り、不慣れな引用-コンテキストゲインの時間的アドミッション分解属性14.9%(バリデーション)を上回ります。
したがって、Citation-context検索は、報告された利得が解釈される前に、時間的に遮蔽され、度合いが制御されなければならない。
関連論文リスト
- LegalPincite: Multi-level Legal Information Retrieval Dataset [1.2425910171551517]
我々は、欧州連合司法裁判所(CJEU)の判断に基づいて構築された大規模な法的情報検索データセットに貢献する。
データセットは、 (i) マスクされたケース/パラグラフクエリ、削除された引用情報、 (ii) 全ての段落を含むコーパス、 (iii) ケースレベルおよび段落レベルの接頭辞を含む。
論文 参考訳(メタデータ) (2026-08-04T14:46:19Z) - Dr-CiK: A Testbed for Foresight-Driven Agents [58.303939183596015]
本稿では,文書コーパスから予測関連コンテキストを検索できるかどうかを評価するベンチマークであるDr-CiKを紹介する。
我々は,Dr-CiKの予測性能が,高品質な文脈で大幅に向上することを示す。
我々の研究は、未来を予測するための適切なコンテキストを探索するフォレスト駆動エージェントの研究を動機付けている。
論文 参考訳(メタデータ) (2026-05-27T03:26:42Z) - Temporal Decay of Co-Citation Predictability: A 20-Year Statute Retrieval Benchmark from 396M Ukrainian Court Citations [0.0]
共励構造は法情報システムにおいて安定した検索信号を提供すると広く想定されている。
UA-StatuteRetrievalは20の年次スナップショットにまたがる共励予測可能性を測定するベンチマークである。
その結果,Adamic-Adar MRRは記事の固定セットで33%減少し,列車/テスト時分割で47%減少し,真の時相崩壊が確認された。
論文 参考訳(メタデータ) (2026-05-17T20:15:37Z) - Automatic Construction of a Legal Citation Graph from 100 Million Ukrainian Court Decisions: Large-Scale Extraction, Topological Analysis, and Ontology-Driven Clustering [0.0]
ウクライナの裁判所決定から抽出された1070万件の訴訟の端は、司法の引用構造が監督なしで法域の境界をコードしていることを示している。
完全SRレジストリから最初の大規模引用グラフ(9950万全文、1.1TB)を構築する。
論文 参考訳(メタデータ) (2026-05-14T19:42:20Z) - LegalCiteBench: Evaluating Citation Reliability in Legal Language Models [14.281332347684872]
LegalCiteBenchは、法律言語モデルにおけるクローズドブックの引用回復、引用検証、ケースマッチングを研究するためのベンチマークである。
このベンチマークは、引用検索、引用完了、引用エラー検出、ケースマッチング、ケース検証と修正の5つの引用中心タスクをカバーしている。
論文 参考訳(メタデータ) (2026-05-11T08:37:54Z) - VERDICT: Verifiable Evolving Reasoning with Directive-Informed Collegial Teams for Legal Judgment Prediction [37.517774304242444]
LJP(Lawal Judgment Prediction)は、事件事実から適用可能な法律記事、告訴、刑罰条件を予測する。
仮想コレギアルパネルをシミュレートする自己修復型協調型マルチエージェントフレームワークであるVERDICTを提案する。
論文 参考訳(メタデータ) (2026-03-13T07:19:08Z) - CiteAudit: You Cited It, But Did You Read It? A Benchmark for Verifying Scientific References in the LLM Era [51.63024682584688]
大規模言語モデル (LLM) は新たなリスクを導入している。
本稿では,科学文献における幻覚的引用のための総合的なベンチマークおよび検出フレームワークについて紹介する。
我々のフレームワークは、精度と解釈可能性の両方において、先行手法を著しく上回っている。
論文 参考訳(メタデータ) (2026-02-26T19:17:39Z) - APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards [61.52322047892064]
テスト時間スケーリング(TTS)は、Large Reasoning Models(LRM)の機能を大幅に強化した。
我々は, LRM が推論過程において最終回答を得た後も, 再検討なしに反復的自己検証を頻繁に行うことを観察した。
本稿では,Anchor-based Process Reward (APR)を提案する。
論文 参考訳(メタデータ) (2026-01-31T14:53:20Z) - Preventing the Collapse of Peer Review Requires Verification-First AI [49.995126139461085]
我々は、真理結合、すなわち、過度に科学的真理をトラックする場所のスコアの厳密さを提案する。
プロキシ・ソブリン評価に向けた相転移を駆動する2つの力の形式化を行う。
論文 参考訳(メタデータ) (2026-01-23T17:17:32Z) - Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation [76.5533899503582]
大規模言語モデル(LLM)は、エージェントのパフォーマンスを評価するために、ますます裁判官として使われている。
このパラダイムは、エージェントのチェーン・オブ・シークレット(CoT)推論が内部の推論と環境状態の両方を忠実に反映していることを暗黙的に仮定している。
我々は、操作された推論だけで、様々なWebタスクにまたがる800の軌跡に対して、最先端のVLM審査員の偽陽性率を最大90%向上させることができることを実証した。
論文 参考訳(メタデータ) (2026-01-21T06:07:43Z) - Reading Between the Timelines: RAG for Answering Diachronic Questions [8.969698902720799]
我々は、時間論理を注入するためにRAGパイプラインを根本的に再設計する新しいフレームワークを提案する。
提案手法は回答精度を大幅に向上し,標準RAG実装を13%から27%上回る結果となった。
この研究はRAGシステムに対する検証された経路を提供し、複雑な現実世界の質問に必要とされるニュアンス付き進化分析を行うことができる。
論文 参考訳(メタデータ) (2025-07-21T05:19:41Z) - CopyrightShield: Enhancing Diffusion Model Security against Copyright Infringement Attacks [61.06621533874629]
拡散モデルは、攻撃者が戦略的に修正された非侵害画像をトレーニングセットに注入する著作権侵害攻撃に弱い。
まず、上記の攻撃に対して防御するための防御フレームワーク、PhiliptyShieldを提案する。
実験により,PhiliptyShieldは2つの攻撃シナリオで有毒なサンプル検出性能を著しく向上することが示された。
論文 参考訳(メタデータ) (2024-12-02T14:19:44Z) - Contrastive Learning to Improve Retrieval for Real-world Fact Checking [84.57583869042791]
ファクト・チェッキング・リランカ(Contrastive Fact-Checking Reranker, CFR)を提案する。
我々はAVeriTeCデータセットを活用し、証拠文書からの人間による回答とクレームのサブクエストを注釈付けする。
データセットの精度は6%向上した。
論文 参考訳(メタデータ) (2024-10-07T00:09:50Z) - ALiiCE: Evaluating Positional Fine-grained Citation Generation [54.19617927314975]
本稿では,微細な引用生成のための最初の自動評価フレームワークであるALiiCEを提案する。
我々のフレームワークはまず、文のクレームを依存性分析によって原子クレームに解析し、次に原子クレームレベルでの引用品質を計算する。
複数大言語モデルの2つの長文QAデータセット上での位置的きめ細かな引用生成性能を評価する。
論文 参考訳(メタデータ) (2024-06-19T09:16:14Z) - Query Performance Prediction using Relevance Judgments Generated by Large Language Models [53.97064615557883]
自動生成関連判定(QPP-GenRE)を用いた新しいクエリ性能予測(QPP)フレームワークを提案する。
QPP-GenREは、QPPを独立したサブタスクに分解し、ランクリスト内の各項目の関連性を所定のクエリに予測する。
我々は,オープンソースの大規模言語モデル (LLM) を用いて,科学的妥当性を確保することにより,項目の関連性を予測する。
論文 参考訳(メタデータ) (2024-04-01T09:33:05Z) - ECtHR-PCR: A Dataset for Precedent Understanding and Prior Case Retrieval in the European Court of Human Rights [1.3723120574076126]
我々は欧州人権裁判所(ECtHR)の判断に基づく事前事例検索データセットを開発する。
我々は、様々な負のサンプリング戦略を用いて、様々な語彙と密度の検索手法をベンチマークする。
PCRでは,難易度に基づく陰性サンプリングが有効でないことがわかった。
論文 参考訳(メタデータ) (2024-03-31T08:06:54Z) - Cross-Validation Conformal Risk Control [40.2365781482563]
コンフォーマルリスク制御(CRC)は、従来の点予測器にポストホックを適用してキャリブレーションを保証する手法である。
本稿では,従来のCRCの検証ではなく,クロスバリデーションに基づく新しいCRC手法を提案する。
CV-CRCは、設定された予測子の平均リスクに関する理論的保証を提供する。
論文 参考訳(メタデータ) (2024-01-22T14:26:02Z) - U-CREAT: Unsupervised Case Retrieval using Events extrAcTion [2.2385755093672044]
本稿では, IL-PCR (Indian Legal Prior Case Retrieval) コーパスのための新しいベンチマーク(英語)を提案する。
判例検索におけるイベントの役割について検討し,教師なし検索手法に基づくパイプラインU-CREATを提案する。
提案手法はBM25に比べて性能が著しく向上し,検索精度が大幅に向上することがわかった。
論文 参考訳(メタデータ) (2023-07-11T13:51:12Z) - ReFIT: Relevance Feedback from a Reranker during Inference [109.33278799999582]
Retrieve-and-Rerankは、ニューラル情報検索の一般的なフレームワークである。
本稿では,リランカを利用してリコールを改善する手法を提案する。
論文 参考訳(メタデータ) (2023-05-19T15:30:33Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。