論文の概要: From Validity to Inter-Subjectivity: An Argument for Reliability Signals in Search Environments
- arxiv url: http://arxiv.org/abs/2604.01186v1
- Date: Wed, 01 Apr 2026 17:34:45 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-02 16:44:32.123399
- Title: From Validity to Inter-Subjectivity: An Argument for Reliability Signals in Search Environments
- Title(参考訳): 正当性から主観性へ:探索環境における信頼性信号の一考察
- Abstract要約: 検索エンジンや情報プラットフォームは、偽情報を広める役割について、ますます精査されている。
伝統的な反応は、しばしば虚偽の検出やクレームの最終的な妥当性の検証に焦点を当てる。
本稿では,このような妥当性中心のフレーミングが,検索環境の課題に不十分であると主張している。
- 参考スコア(独自算出の注目度): 1.9628820381177905
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Search engines and information platforms are increasingly scrutinized for their role in spreading misinformation. Traditional responses often focus on detecting falsehoods or verifying the ultimate validity of claims. This paper argues that such a validity-centered framing is inadequate for the epistemic challenges of search environments.
- Abstract(参考訳): 検索エンジンや情報プラットフォームは、偽情報を広める役割について、ますます精査されている。
伝統的な反応は、しばしば虚偽の検出やクレームの最終的な妥当性の検証に焦点を当てる。
本稿では,このような妥当性中心のフレーミングが,検索環境の疫学的課題に不十分であると主張している。
関連論文リスト
- EVAR: Evidence-Validated Hypothesis Admission for Budget-Aware Narrative Reasoning [6.590648135605556]
EVARは、予算を考慮した物語推論のためのエビデンス検証仮説解釈フレームワークである。
EVARは、制御可能な推論コストを維持しながら、タスク性能とエビデンス忠実性の両方を改善していることを示す。
論文 参考訳(メタデータ) (2026-08-30T15:07:27Z) - ReflectFact: Self-Reflective Agents for Improving Comprehension and Reasoning in Multi-Hop Fact Verification [10.886692231174358]
マルチホップ事実検証は、ソーシャルメディア上の誤情報と戦うために重要である。
最近の手法は、事実検証を専門のサブタスクに分解するために、マルチエージェントのコラボレーションに依存している。
マルチホップ事実検証のための新しい自己表現型エージェントフレームワークであるReflectFactを提案する。
論文 参考訳(メタデータ) (2026-08-13T06:41:56Z) - HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research [52.87128503345243]
我々は,Deep Researchにおける階層的エビデンス・アグリゲーションを評価するためのベンチマークであるHiEviDR-Benchを紹介する。
HiEviDR-Benchは、エビデンスの選択、クロスソースリンク、アグリゲーションをキャプチャする明示的なエビデンスグラフを持つ各インスタンスを表す。
報告品質,エビデンストレーサビリティ,引用精度,クレーム検証,回答正当性という5次元のトレーサビリティ指向評価フレームワークを開発した。
論文 参考訳(メタデータ) (2026-07-27T23:50:46Z) - DRNOISE: Benchmarking Deep Research Agents in Misleading Evidence Environments [51.049999642138]
誤解を招く証拠の下で、回答回復のための100タスクのベンチマークであるDRNOISEを紹介する。
それぞれのタスクは、2つの間接的レコードチェーンが支持する固有の金の答えを持ち、ペアのノイズ条件は競合する答えを直接記述する1つのもっともらしい文書を付加する。
強いクリーンタスク性能を持つエージェント全体で、この単一の介入は66-88ポイントの精度低下を引き起こす。
論文 参考訳(メタデータ) (2026-07-19T15:20:40Z) - When Search Agents Should Ask: DiscoBench for Clarification-Aware Deep Search [6.384441153713447]
本稿では,DecoBenchについて紹介する。
探索エージェントが曖昧さを積極的に識別し、効果的な明確化の質問をし、ユーザインタラクションを通じて正しい推論経路を復元できるかどうかを評価するように設計されている。
実験により、あいまいさの検出と効果的な明確化は異なる能力であり、明確化を求める代わりに繰り返し検索することが直接推測よりも悪いことが示されている。
論文 参考訳(メタデータ) (2026-06-26T02:57:15Z) - InfoGatherer: Principled Information Seeking via Evidence Retrieval and Strategic Questioning [50.375547542738055]
InfoGathererは、2つの補完的なソースから行方不明の情報を収集するフレームワークである。
InfoGathererは、法的および医療的タスクのターンを減らしながら、強力なベースラインを上回ります。
論文 参考訳(メタデータ) (2026-03-06T04:55:03Z) - From Fluent to Verifiable: Claim-Level Auditability for Deep Research Agents [8.49451413641847]
研究生成が安価になるにつれて、監査可能性がボトルネックになる、と我々は主張する。
この観点からは,ディープリサーチエージェントの第一級設計および評価対象として,クレームレベルの監査性を提案する。
論文 参考訳(メタデータ) (2026-02-14T19:39:15Z) - Fact in Fragments: Deconstructing Complex Claims via LLM-based Atomic Fact Extraction and Verification [18.20994425756688]
Atomic Fact extract and Verification (AFEV) は、複雑なクレームを原子事実に反復的に分解する新しいフレームワークである。
AFEVは、精度と解釈可能性の両方において最先端のパフォーマンスを達成する。
論文 参考訳(メタデータ) (2025-06-09T05:49:43Z) - Resolving Conflicting Evidence in Automated Fact-Checking: A Study on Retrieval-Augmented LLMs [12.923119372847834]
本稿では,ファクトチェックのためのRAGモデルを初めて体系的に評価する。
実験では、最先端のRAG手法、特にメディアソースの信頼性の違いに起因する紛争の解決において、重大な脆弱性が明らかにされている。
以上の結果から,情報源の信頼性を効果的に取り入れることで,矛盾する証拠を解決し,事実確認性能を向上させるRAGモデルの能力が著しく向上することが示唆された。
論文 参考訳(メタデータ) (2025-05-23T11:35:03Z) - How We Refute Claims: Automatic Fact-Checking through Flaw
Identification and Explanation [4.376598435975689]
本稿では、アスペクト生成や欠陥識別を含む、欠陥指向の事実チェックの新たな課題について検討する。
また、このタスク用に特別に設計された新しいフレームワークであるRefuteClaimを紹介します。
既存のデータセットが存在しないことから、専門家のレビューから洞察を抽出して変換して、関連する側面に変換し、欠陥を特定したデータセットであるFlawCheckを紹介します。
論文 参考訳(メタデータ) (2024-01-27T06:06:16Z) - From Chaos to Clarity: Claim Normalization to Empower Fact-Checking [57.024192702939736]
Claim Normalization(別名 ClaimNorm)は、複雑でノイズの多いソーシャルメディア投稿を、より単純で分かりやすい形式に分解することを目的としている。
本稿では,チェーン・オブ・ソートとクレーム・チェック・バシネス推定を利用した先駆的アプローチであるCACNを提案する。
実験により, CACNは様々な評価尺度において, いくつかの基準値を上回る性能を示した。
論文 参考訳(メタデータ) (2023-10-22T16:07:06Z) - From Relevance to Utility: Evidence Retrieval with Feedback for Fact Verification [118.03466985807331]
我々は、FVの関連性よりも、クレーム検証者が取得した証拠から導出する実用性に焦点を当てる必要があると論じる。
本稿では,エビデンス検索プロセスの最適化に,クレーム検証器からのフィードバックを取り入れたフィードバックベースのエビデンス検索手法(FER)を提案する。
論文 参考訳(メタデータ) (2023-10-18T02:59:38Z) - DialFact: A Benchmark for Fact-Checking in Dialogue [56.63709206232572]
われわれはDialFactという22,245の注釈付き会話クレームのベンチマークデータセットを構築し、ウィキペディアの証拠と組み合わせた。
FEVERのような非対話データでトレーニングされた既存のファクトチェックモデルは、我々のタスクでうまく機能しないことがわかった。
本稿では,対話におけるファクトチェック性能を効果的に向上する,シンプルなデータ効率のソリューションを提案する。
論文 参考訳(メタデータ) (2021-10-15T17:34:35Z) - EviDR: Evidence-Emphasized Discrete Reasoning for Reasoning Machine
Reading Comprehension [39.970232108247394]
R-MRC(Reasoning Machine reading comprehension)は、テキストに基づく離散推論を必要とする複雑な質問に答えることを目的としている。
最先端のパフォーマンスを実現する従来のエンドツーエンドの手法は、証拠のモデリングに十分な注意を払うことで、この問題を解決することはめったにない。
文と節レベルの証拠を遠方からの監視に基づいて最初に検出するエビデンス強調離散推論手法(EviDR)を提案する。
論文 参考訳(メタデータ) (2021-08-18T06:49:58Z) - AmbiFC: Fact-Checking Ambiguous Claims with Evidence [57.7091560922174]
実世界の情報ニーズから10kクレームを抽出したファクトチェックデータセットであるAmbiFCを提示する。
アンビFCの証拠に対する主張を比較する際に,曖昧さから生じる不一致を分析した。
我々は,このあいまいさをソフトラベルで予測するモデルを開発した。
論文 参考訳(メタデータ) (2021-04-01T17:40:08Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。