論文の概要: Fenced Citation-Context Retrieval for Case Law: Temporal Leakage and Degree Control Across Two Jurisdictions
- arxiv url: http://arxiv.org/abs/2607.17142v1
- Date: Sun, 19 Jul 2026 08:57:40 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-21 18:48:37.381229
- Title: Fenced Citation-Context Retrieval for Case Law: Temporal Leakage and Degree Control Across Two Jurisdictions
- Title(参考訳): Fenced Citation-Context Retrieval for Case Law: Temporal Leakage and Degree Control around two Jurisdictions
- Abstract要約: 本研究は, 真に将来的な漏出への緩和効果を生かした時間差の分解を計測する。
我々はこれを、2つの管轄区域にまたがる入出力検索の制御されたデプロイ可能性監査としてインスタンス化する。
- 参考スコア(独自算出の注目度): 4.366904149463058
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Incoming citation context-the text with which later cases describe a case when citing it-is a strong signal for legal precedent retrieval, but it is evaluated without a temporal fence: at query time the target precedent has not yet been cited by future cases, so an unfenced method credits itself with evidence unavailable at deployment. Our central contribution is to measure how much: a temporal-admission decomposition that splits the naive relax-the-fence gain into genuine future-citation leakage, legitimate pre-query admission, and an index effect, reporting the phantom fraction-the share that is future evidence. We instantiate this as a controlled deployability audit of incoming-citation retrieval across two jurisdictions, CLERC (US federal, 1.84M documents) and ECtHR-PCR (European Court of Human Rights), adding a zero-training anchor channel that admits only citers dated before the query. On ECtHR-PCR only 14.9% of the naive gain is genuine future evidence; on CLERC the over-credit grows to +4.95 R@1000 as the fence is relaxed. Under the fence, the zero-training channel gains +16.1 R@1000 over BM25 on CLERC, clears a citation-degree control, and reaches a published R@1000 estimate similar to the strongest trained system on ECtHR-PCR (79.56 vs 79.39) at zero training.
- Abstract(参考訳): 引用文脈-後述の事例を引用するテキストは、法的な前例検索の強いシグナルであるが、時間的制約なしで評価される。
我々の中心的な貢献は、過度な緩和効果を真の未来の引用リークに分割する時間的許容分解、合法的な事前クエリの許可、インデックス効果、そして、将来の証拠である幻の分断シェアを報告することである。
我々は,CLERC (US Federal, 1.84M document) とECtHR-PCR (European Court of Human Rights) の2つの司法管轄区域にまたがる入出力検索の制御されたデプロイ可能性監査としてこれをインスタンス化し,クエリの前にサイターのみを許可するゼロトレーニングアンカーチャネルを追加する。
ECtHR-PCRでは14.9%が真に将来的な証拠であり、CLERCではフェンスが緩めると、過剰累積は+4.95 R@1000に成長する。
フェンスの下では、ゼロトレーニングチャネルは CLERC 上で BM25 上で +16.1 R@1000 を獲得し、励起度制御をクリアし、ゼロトレーニング時のECtHR-PCR (79.56 vs 79.39) 上の最強トレーニングシステムと同様のR@1000推定値に達する。
関連論文リスト
- LegalPincite: Multi-level Legal Information Retrieval Dataset [1.2425910171551517]
我々は、欧州連合司法裁判所(CJEU)の判断に基づいて構築された大規模な法的情報検索データセットに貢献する。
データセットは、 (i) マスクされたケース/パラグラフクエリ、削除された引用情報、 (ii) 全ての段落を含むコーパス、 (iii) ケースレベルおよび段落レベルの接頭辞を含む。
論文 参考訳(メタデータ) (2026-08-04T14:46:19Z) - Dr-CiK: A Testbed for Foresight-Driven Agents [58.303939183596015]
本稿では,文書コーパスから予測関連コンテキストを検索できるかどうかを評価するベンチマークであるDr-CiKを紹介する。
我々は,Dr-CiKの予測性能が,高品質な文脈で大幅に向上することを示す。
我々の研究は、未来を予測するための適切なコンテキストを探索するフォレスト駆動エージェントの研究を動機付けている。
論文 参考訳(メタデータ) (2026-05-27T03:26:42Z) - Temporal Decay of Co-Citation Predictability: A 20-Year Statute Retrieval Benchmark from 396M Ukrainian Court Citations [0.0]
共励構造は法情報システムにおいて安定した検索信号を提供すると広く想定されている。
UA-StatuteRetrievalは20の年次スナップショットにまたがる共励予測可能性を測定するベンチマークである。
その結果,Adamic-Adar MRRは記事の固定セットで33%減少し,列車/テスト時分割で47%減少し,真の時相崩壊が確認された。
論文 参考訳(メタデータ) (2026-05-17T20:15:37Z) - Automatic Construction of a Legal Citation Graph from 100 Million Ukrainian Court Decisions: Large-Scale Extraction, Topological Analysis, and Ontology-Driven Clustering [0.0]
ウクライナの裁判所決定から抽出された1070万件の訴訟の端は、司法の引用構造が監督なしで法域の境界をコードしていることを示している。
完全SRレジストリから最初の大規模引用グラフ(9950万全文、1.1TB)を構築する。
論文 参考訳(メタデータ) (2026-05-14T19:42:20Z) - LegalCiteBench: Evaluating Citation Reliability in Legal Language Models [14.281332347684872]
LegalCiteBenchは、法律言語モデルにおけるクローズドブックの引用回復、引用検証、ケースマッチングを研究するためのベンチマークである。
このベンチマークは、引用検索、引用完了、引用エラー検出、ケースマッチング、ケース検証と修正の5つの引用中心タスクをカバーしている。
論文 参考訳(メタデータ) (2026-05-11T08:37:54Z) - VERDICT: Verifiable Evolving Reasoning with Directive-Informed Collegial Teams for Legal Judgment Prediction [37.517774304242444]
LJP(Lawal Judgment Prediction)は、事件事実から適用可能な法律記事、告訴、刑罰条件を予測する。
仮想コレギアルパネルをシミュレートする自己修復型協調型マルチエージェントフレームワークであるVERDICTを提案する。
論文 参考訳(メタデータ) (2026-03-13T07:19:08Z) - CiteAudit: You Cited It, But Did You Read It? A Benchmark for Verifying Scientific References in the LLM Era [51.63024682584688]
大規模言語モデル (LLM) は新たなリスクを導入している。
本稿では,科学文献における幻覚的引用のための総合的なベンチマークおよび検出フレームワークについて紹介する。
我々のフレームワークは、精度と解釈可能性の両方において、先行手法を著しく上回っている。
論文 参考訳(メタデータ) (2026-02-26T19:17:39Z) - APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards [61.52322047892064]
テスト時間スケーリング(TTS)は、Large Reasoning Models(LRM)の機能を大幅に強化した。
我々は, LRM が推論過程において最終回答を得た後も, 再検討なしに反復的自己検証を頻繁に行うことを観察した。
本稿では,Anchor-based Process Reward (APR)を提案する。
論文 参考訳(メタデータ) (2026-01-31T14:53:20Z) - Preventing the Collapse of Peer Review Requires Verification-First AI [49.995126139461085]
我々は、真理結合、すなわち、過度に科学的真理をトラックする場所のスコアの厳密さを提案する。
プロキシ・ソブリン評価に向けた相転移を駆動する2つの力の形式化を行う。
論文 参考訳(メタデータ) (2026-01-23T17:17:32Z) - Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation [76.5533899503582]
大規模言語モデル(LLM)は、エージェントのパフォーマンスを評価するために、ますます裁判官として使われている。
このパラダイムは、エージェントのチェーン・オブ・シークレット(CoT)推論が内部の推論と環境状態の両方を忠実に反映していることを暗黙的に仮定している。
我々は、操作された推論だけで、様々なWebタスクにまたがる800の軌跡に対して、最先端のVLM審査員の偽陽性率を最大90%向上させることができることを実証した。
論文 参考訳(メタデータ) (2026-01-21T06:07:43Z) - Reading Between the Timelines: RAG for Answering Diachronic Questions [8.969698902720799]
我々は、時間論理を注入するためにRAGパイプラインを根本的に再設計する新しいフレームワークを提案する。
提案手法は回答精度を大幅に向上し,標準RAG実装を13%から27%上回る結果となった。
この研究はRAGシステムに対する検証された経路を提供し、複雑な現実世界の質問に必要とされるニュアンス付き進化分析を行うことができる。
論文 参考訳(メタデータ) (2025-07-21T05:19:41Z) - CopyrightShield: Enhancing Diffusion Model Security against Copyright Infringement Attacks [61.06621533874629]
拡散モデルは、攻撃者が戦略的に修正された非侵害画像をトレーニングセットに注入する著作権侵害攻撃に弱い。
まず、上記の攻撃に対して防御するための防御フレームワーク、PhiliptyShieldを提案する。
実験により,PhiliptyShieldは2つの攻撃シナリオで有毒なサンプル検出性能を著しく向上することが示された。
論文 参考訳(メタデータ) (2024-12-02T14:19:44Z) - Contrastive Learning to Improve Retrieval for Real-world Fact Checking [84.57583869042791]
ファクト・チェッキング・リランカ(Contrastive Fact-Checking Reranker, CFR)を提案する。
我々はAVeriTeCデータセットを活用し、証拠文書からの人間による回答とクレームのサブクエストを注釈付けする。
データセットの精度は6%向上した。
論文 参考訳(メタデータ) (2024-10-07T00:09:50Z) - ALiiCE: Evaluating Positional Fine-grained Citation Generation [54.19617927314975]
本稿では,微細な引用生成のための最初の自動評価フレームワークであるALiiCEを提案する。
我々のフレームワークはまず、文のクレームを依存性分析によって原子クレームに解析し、次に原子クレームレベルでの引用品質を計算する。
複数大言語モデルの2つの長文QAデータセット上での位置的きめ細かな引用生成性能を評価する。
論文 参考訳(メタデータ) (2024-06-19T09:16:14Z) - Query Performance Prediction using Relevance Judgments Generated by Large Language Models [53.97064615557883]
自動生成関連判定(QPP-GenRE)を用いた新しいクエリ性能予測(QPP)フレームワークを提案する。
QPP-GenREは、QPPを独立したサブタスクに分解し、ランクリスト内の各項目の関連性を所定のクエリに予測する。
我々は,オープンソースの大規模言語モデル (LLM) を用いて,科学的妥当性を確保することにより,項目の関連性を予測する。
論文 参考訳(メタデータ) (2024-04-01T09:33:05Z) - ECtHR-PCR: A Dataset for Precedent Understanding and Prior Case Retrieval in the European Court of Human Rights [1.3723120574076126]
我々は欧州人権裁判所(ECtHR)の判断に基づく事前事例検索データセットを開発する。
我々は、様々な負のサンプリング戦略を用いて、様々な語彙と密度の検索手法をベンチマークする。
PCRでは,難易度に基づく陰性サンプリングが有効でないことがわかった。
論文 参考訳(メタデータ) (2024-03-31T08:06:54Z) - Cross-Validation Conformal Risk Control [40.2365781482563]
コンフォーマルリスク制御(CRC)は、従来の点予測器にポストホックを適用してキャリブレーションを保証する手法である。
本稿では,従来のCRCの検証ではなく,クロスバリデーションに基づく新しいCRC手法を提案する。
CV-CRCは、設定された予測子の平均リスクに関する理論的保証を提供する。
論文 参考訳(メタデータ) (2024-01-22T14:26:02Z) - U-CREAT: Unsupervised Case Retrieval using Events extrAcTion [2.2385755093672044]
本稿では, IL-PCR (Indian Legal Prior Case Retrieval) コーパスのための新しいベンチマーク(英語)を提案する。
判例検索におけるイベントの役割について検討し,教師なし検索手法に基づくパイプラインU-CREATを提案する。
提案手法はBM25に比べて性能が著しく向上し,検索精度が大幅に向上することがわかった。
論文 参考訳(メタデータ) (2023-07-11T13:51:12Z) - ReFIT: Relevance Feedback from a Reranker during Inference [109.33278799999582]
Retrieve-and-Rerankは、ニューラル情報検索の一般的なフレームワークである。
本稿では,リランカを利用してリコールを改善する手法を提案する。
論文 参考訳(メタデータ) (2023-05-19T15:30:33Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。