論文の概要: What Gets Cited: Competitive GEO in AI Answer Engines
- arxiv url: http://arxiv.org/abs/2605.25517v1
- Date: Mon, 25 May 2026 07:20:08 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-26 19:50:19.43797
- Title: What Gets Cited: Competitive GEO in AI Answer Engines
- Title(参考訳): AIアンサーエンジンにおける競争力のあるGEO
- Authors: Rahul Vishwakarma, Shushant Kumar, Ratnesh Jamidar,
- Abstract要約: 検索された2人の候補者が競うと、最初に引用される可能性が高くなるのはなぜか。
モデルコンテキストに正確に2つの候補ソースを注入する2文書検索拡張生成テストベッドを構築した。
各試験において、2つの情報源は、正確に1つの要因で異なる。我々は、位置バイアスからコンテンツ効果を分離するためにブランド匿名化と逆平衡ソースオーダーを使用する。
- 参考スコア(独自算出の注目度): 0.866627581195388
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: AI answer engines generate answers from retrieved pages but cite only a few sources. This makes visibility depend not just on ranking, but on being cited. We study competitive Generative Engine Optimization (GEO): when two retrieved candidates compete, what makes one more likely to be cited first? We build a controlled two-document retrieval-augmented generation (RAG) testbed that injects exactly two candidate sources into the model context and measures which source is referenced by the first citation marker in the output. Across six LLMs we execute 252,000 trials, repeated paired comparisons under one factorial program over 18 content factors. In each trial the two sources differ in exactly one factor; we use brand anonymization and counterbalanced source order to separate content effects from position bias. Mixed-effects models show that topical relevance and list position are the biggest drivers of being cited first. Including explicit price information and a recent timestamp also helps consistently. Completeness and trust cues add smaller gains, while formatting-only edits have little impact. We release a reproducible evaluation protocol and a prioritized GEO checklist for practitioners, and we exercised it in an early internal pilot at Sprinklr, where teams reported positive qualitative feedback on workflow usability.
- Abstract(参考訳): AI回答エンジンは、検索したページから回答を生成するが、いくつかのソースのみを引用する。
これにより、視認性はランキングだけでなく、引用されるものにも依存する。
我々は競争力のあるジェネレーティブエンジン最適化(GEO:Generative Engine Optimization)を研究している。
我々は,モデルコンテキストに正確に2つの候補ソースを注入し,出力の最初の参照マーカーによって参照されるソースを計測する,制御された2文書検索拡張生成(RAG)テストベッドを構築した。
6つのLSMで252,000の試行を行い、18のコンテンツ要素に対して1つの因子プログラムでペア比較を繰り返します。
各試験において、2つの情報源は、正確に1つの要因で異なる。我々は、位置バイアスからコンテンツ効果を分離するためにブランド匿名化と逆平衡ソースオーダーを使用する。
混合効果モデルでは、トピックの関連性とリストの位置が最初に引用される最大の要因であることを示している。
明示的な価格情報と最近のタイムスタンプも一貫して役立ちます。
完全性と信頼の手がかりは、より小さな利益をもたらすが、フォーマッティングのみの編集は、ほとんど影響を与えない。
再現性のある評価プロトコルと、実践者のための優先順位付けされたGEOチェックリストをリリースし、Sprinklrの初期の内部パイロットとして、ワークフローのユーザビリティに関する肯定的なフィードバックを報告しました。
関連論文リスト
- From Citation Selection to Citation Absorption: A Measurement Framework for Generative Engine Optimization Across AI Search Platforms [0.1223474232275842]
本稿では,ジェネレーティブエンジン最適化(GEO)のための2段階計測フレームワークを提案する。
我々は、ChatGPT、Google AI Overview/Gemini、Perplexityにまたがる602のプロンプトをカバーする公開ジオ引用-ラブデータセットを分析した。
PerplexityとGoogleは平均的なソースを引用するが、ChatGPTは少ないソースを引用する。
論文 参考訳(メタデータ) (2026-04-28T14:34:20Z) - CRISP: Characterizing Relative Impact of Scholarly Publications [70.25915589244961]
本稿では,大規模言語モデル(LLM)を用いた引用論文の中で,引用論文の全てを共同でランク付けするCRISPを提案する。
LLMの位置バイアスを軽減するために、ランダムな順序で各リストを3回ランク付けし、多数決によって影響ラベルを集約する。
CRISPは従来の最先端の衝撃分類器の精度を+9.5%、F1を+8.3%で上回っている。
論文 参考訳(メタデータ) (2026-03-25T16:42:30Z) - VeriCite: Towards Reliable Citations in Retrieval-Augmented Generation via Rigorous Verification [107.75781898355562]
証拠を厳格に検証し,回答の帰属性を高めるために設計された,VeriCiteと呼ばれる新しいフレームワークを紹介する。
我々は,5つのオープンソースLCMと4つのデータセットを対象とした実験を行い,VeriCiteが回答の正しさを維持しつつ,引用品質を大幅に向上できることを実証した。
論文 参考訳(メタデータ) (2025-10-13T13:38:54Z) - Generation-Time vs. Post-hoc Citation: A Holistic Evaluation of LLM Attribution [8.691344810384114]
大規模言語モデル (LLMs) は、医療、法律、アカデミア、金融といった高度な領域において、人間の検証可能な情報源を引用しなければならない。
本稿では,一つのパスで応答と引用を生成する生成時間Citation(G-Cite)と,起草後の引用を付加または検証するポストホックCitation(P-Cite)という2つのパラダイムを紹介する。
両パラダイムにおける帰属品質の主要因は検索であり,適用範囲と引用精度の相反するトレードオフを示した。
論文 参考訳(メタデータ) (2025-09-25T20:39:26Z) - List-aware Reranking-Truncation Joint Model for Search and
Retrieval-augmented Generation [80.12531449946655]
本稿では,2つのタスクを同時に実行可能なRe rank-Truncation joint model(GenRT)を提案する。
GenRTは、エンコーダ-デコーダアーキテクチャに基づく生成パラダイムによるリランクとトランケーションを統合している。
提案手法は,Web検索および検索拡張LLMにおけるリランクタスクとトラルケーションタスクの両方においてSOTA性能を実現する。
論文 参考訳(メタデータ) (2024-02-05T06:52:53Z) - CausalCite: A Causal Formulation of Paper Citations [80.82622421055734]
CausalCiteは紙の意義を測定するための新しい方法だ。
これは、従来のマッチングフレームワークを高次元のテキスト埋め込みに適応させる、新しい因果推論手法であるTextMatchに基づいている。
科学専門家が報告した紙衝撃と高い相関性など,各種基準におけるCausalCiteの有効性を実証する。
論文 参考訳(メタデータ) (2023-11-05T23:09:39Z) - Large Language Models are not Fair Evaluators [60.27164804083752]
候補回答の品質ランキングは,文脈の出現順序を変えることで容易にハックできることがわかった。
この操作により、評価結果をスキューし、一方のモデルを他方よりもかなり優れているようにすることができる。
この問題を緩和するための3つのシンプルかつ効果的な戦略を持つフレームワークを提案する。
論文 参考訳(メタデータ) (2023-05-29T07:41:03Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。