論文の概要: TSGR: Taobao Search Generative Retrieval
- arxiv url: http://arxiv.org/abs/2607.18796v2
- Date: Wed, 22 Jul 2026 08:19:23 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-23 16:42:31.673043
- Title: TSGR: Taobao Search Generative Retrieval
- Title(参考訳): TSGR: Taobao Search Generative Retrieval
- Abstract要約: アイテム表現と候補ランキングの両方に価値意識を組み込んだ統合生成検索フレームワークを提案する。
$textbfT$aobao $textbfS$earch $textbfG$enerative $textbfR$etrieval$textbfTSGR$
GRで構築され、共同で最適化された$textbfVRM$により、単一のモデルをレトリバーとプリランカの両方としてシームレスに機能させることができる。
- 参考スコア(独自算出の注目度): 32.4338892898415
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Generative retrieval (GR) has demonstrated strong promise for industrial e-commerce search by training a single autoregressive model to directly generate the Semantic IDs (SIDs) of target items. However, existing GR systems are primarily optimized for semantic matching and remain insensitive to item business value: SID construction is value-unaware, and candidates are ranked without access to item side-info. Consequently, high-value items are often missed or deprioritized at the retrieval stage, limiting downstream business impact. This limitation is particularly critical in industrial settings such as Taobao Search, where business objectives are central to system design. To address this, we propose $\textbf{T}$aobao $\textbf{S}$earch $\textbf{G}$enerative $\textbf{R}$etrieval ($\textbf{TSGR}$), a unified generative retrieval framework that incorporates value awareness into both item representation and candidate ranking. 1) For item representation, TSGR introduces $\textbf{Query-aware Parallel SID (QP-SID)}$, which encodes query-conditioned value orderings into the SID construction by building parallel codebooks derived from query-item statistics, so that higher-value and query-relevant items are assigned better token indices. 2) For candidate ranking, we introduce a $\textbf{Value-aware Ranking Module (VRM)}$ that is built upon and jointly optimized with the GR, enabling a single model to seamlessly serve as both retriever and pre-ranker without a dedicated pre-ranking stage. A progressive training pipeline further aligns the model with semantic relevance, user preferences, and business objectives. Offline experiments show that TSGR achieves a 9.16\% improvement in HR@1000, and online A/B tests further validate its effectiveness, yielding gains of +0.43\% in IPV, +1.12\% in Transaction Count, and +1.64\% in GMV. TSGR has been fully deployed in production.
- Abstract(参考訳): 生成検索(GR)は,単一自己回帰モデルを訓練し,ターゲット項目のセマンティックID(SID)を直接生成することで,産業用eコマース検索に強く期待している。
しかし、既存のGRシステムは、主にセマンティックマッチングに最適化されており、アイテムのビジネス価値に敏感なままである: SIDの構築は価値を意識せず、候補はアイテムのサイドインフォにアクセスせずにランク付けされる。
その結果、検索段階で高価値アイテムが欠落したり、非優先順位化されることが多く、下流のビジネスへの影響が制限される。
この制限は、ビジネス目的がシステム設計の中心となるTaobao Searchのような産業環境において特に重要である。
これを解決するために、アイテム表現と候補ランキングの両方に価値認識を組み込んだ統合生成検索フレームワークである$\textbf{T}$aobao $\textbf{S}$earch $\textbf{G}$enerative $\textbf{R}$etrieval$\textbf{TSGR}$。
1) 項目表現のためにTSGRは$\textbf{Query-aware Parallel SID (QP-SID)}$を導入している。
2) 候補ランキングには,GRをベースとして共同最適化された$\textbf{Value-aware Ranking Module (VRM)$を導入する。
プログレッシブトレーニングパイプラインは、モデルをさらにセマンティックな関連性、ユーザの好み、ビジネス目的と整合させる。
オフライン実験により、TSGRはHR@1000で9.16\%の改善を達成し、オンラインA/Bテストはその効果をさらに検証し、PVで+0.43\%、トランザクションカウントで+1.12\%、GMVで+1.64\%の利得を得た。
TSGRは実運用で完全にデプロイされている。
関連論文リスト
- VARG: Value-Aware and Ranking-Aligned Generative Retrieval for Dynamic E-commerce Search [7.64283018838172]
VARGはTmall App検索用の生成検索システムで、生成したアイテム候補を既存の最終ランク付け者に直接承認する。
3段階の教師による微調整は、アイテム・ツー・アイデンティティーのマッピング、クエリ・セマンティック検索、パーソナライズされた検索を徐々に学習する。
Prefix-GRPOは、出力の合法性、ユーザ行動、ランキングの優位性、検索関連性に基づくゲート報酬とプレフィックス対応トークン重み付けを組み合わせ、候補生成をビジネス価値とランキング目標に整合させる。
論文 参考訳(メタデータ) (2026-09-13T12:59:04Z) - It Takes Two to Match: Co-Evolving Generative Retriever with Reinforcement Learning [3.106071998555287]
CoGRはジェネレータを訓練し、クエリとアイテムの両側で検索表現を構築する。
各ジェネレータは、逆インデックスを通じて直接マッチする、コンパクトなキーワードセットを生成する。
CoGRは、内部のAPP MarketplaceデータセットとパブリックなWANDSベンチマークの両方で最高のパフォーマンスを達成する。
論文 参考訳(メタデータ) (2026-09-01T03:17:02Z) - Preference Shapes Relevance: Cross-component Hierarchical Semantic Alignment for Personalized Generative Retrieval [37.821022474615994]
Generative Retrieval (GR) は、クエリを直接セマンティックID(SID)にマッピングし、候補項目の強力な表現能力を持つ、有望なパラダイムとして登場した。
アイテムコンテンツから派生した既存のSIDはセマンティックギャップを生成し、動的クエリインテントと静的なアイテム表現の整合に失敗する。
本稿では,個別のSIDを合成してユーザ動作をモデル化し,詳細なセマンティック・リファインメントのための構造ガイダンスと連続表現を行う,新しいパーソナライズされたGRフレームワークを提案する。
論文 参考訳(メタデータ) (2026-08-31T10:30:22Z) - ICEGR: An Intent-Coherent End-to-End Generative Retrieval Framework for E-commerce Search [26.387550337217125]
Generative Retrieval (GR)はeコマース検索を約束している。
既存のメソッドは、トレーニングパイプライン全体を通してクエリインテリジェンスを維持するのに苦労している。
本稿では,Eコマース検索のための一貫したエンドツーエンド生成検索フレームワークICEGRを提案する。
論文 参考訳(メタデータ) (2026-08-30T08:28:58Z) - Efficient Generative Retrieval for E-commerce Search with Semantic Cluster IDs and Expert-Guided RL [8.046510111008638]
生成検索は、断片化された多段階検索プロセスを単一のエンドツーエンドモデルに統一することで、有望な代替手段を提供する。
本稿では,実世界のリコールシナリオに適した検索フレームワークを提案し,生成的検索をエンド・ツー・エンドの置き換えではなく,リコール・ステージ・サプリメントとして位置付ける。
論文 参考訳(メタデータ) (2026-05-14T06:27:46Z) - PAR$^2$-RAG: Planned Active Retrieval and Reasoning for Multi-Hop Question Answering [57.89576196160413]
大規模言語モデル (LLM) はマルチホップ質問応答 (MHQA) において脆弱のままである。
textbfPlanned Active Retrieval and Reasoning RAG (PAR$2-RAG)を提案する。
論文 参考訳(メタデータ) (2026-03-30T23:52:54Z) - Multi-Step Semantic Reasoning in Generative Retrieval [50.65947993017158]
生成検索(GR)モデルは、モデルパラメータ内のコーパスを符号化し、所定のクエリに対して関連するドキュメント識別子を生成する。
既存のGRモデルは、財務報告に対するセマンティック推論など、数値的な文脈で複雑なクエリに苦しむ。
GR内の数値文脈における多段階意味推論を強化するためのフレームワークであるReasonGRを提案する。
論文 参考訳(メタデータ) (2026-03-12T18:38:50Z) - TeaRAG: A Token-Efficient Agentic Retrieval-Augmented Generation Framework [62.66056331998838]
TeaRAGは、検索内容と推論ステップの両方を圧縮できるトークン効率のエージェントRAGフレームワークである。
報奨関数は,過剰な推論ステップをペナルティ化しながら,知識マッチング機構によって知識満足度を評価する。
論文 参考訳(メタデータ) (2025-11-07T16:08:34Z) - Understanding Generative Recommendation with Semantic IDs from a Model-scaling View [57.471604518714535]
Generative Recommendation (GR)は、リッチアイテムのセマンティクスと協調フィルタリング信号を統合する。
一般的なアプローチの1つは、セマンティックID(SID)を使用して、自動回帰ユーザーインタラクションシーケンスモデリングのセットアップでアイテムを表現することである。
SIDをベースとしたGRは,モデルをスケールアップしながら大きなボトルネックを示す。
我々は、大規模言語モデル(LLM)を直接レコメンデーションとして使用する別のGRパラダイムを再考する。
論文 参考訳(メタデータ) (2025-09-29T21:24:17Z) - FORGE: Forming Semantic Identifiers for Generative Retrieval in Industrial Datasets [64.51403245281547]
FORGEは、産業データセットを使ったジェネレーティブrEtrievalにおけるFOrmingセマンティック識別のベンチマークである。
現実世界のアプリケーションでは、オンラインコンバージェンスを半減するオフライン事前トレーニングスキーマが導入されている。
論文 参考訳(メタデータ) (2025-09-25T08:44:22Z) - OneSearch: A Preliminary Exploration of the Unified End-to-End Generative Framework for E-commerce Search [43.94443394870866]
OneSearchは、eコマース検索のための最初の産業向けエンドツーエンド生成フレームワークである。
OneSearchは運用費を75.40%削減し、Model FLOPsの利用を3.26%から27.32%に改善した。
このシステムはKuaishouの複数の検索シナリオにまたがって展開され、数百万のユーザーにサービスを提供している。
論文 参考訳(メタデータ) (2025-09-03T11:50:04Z) - ImpRAG: Retrieval-Augmented Generation with Implicit Queries [34.72864597562907]
ImpRAGは、検索と生成を統一モデルに統合するクエリフリーなRAGシステムである。
我々は、ImpRAGが、多様な形式を持つ未確認タスクの正確なマッチスコアを3.6-11.5改善したことを示す。
論文 参考訳(メタデータ) (2025-06-02T21:38:21Z) - CART: A Generative Cross-Modal Retrieval Framework with Coarse-To-Fine Semantic Modeling [53.97609687516371]
クロスモーダル検索は、異なるモーダルデータの相互作用を通じて、クエリと意味的に関連するインスタンスを検索することを目的としている。
従来のソリューションでは、クエリと候補の間のスコアを明示的に計算するために、シングルトウワーまたはデュアルトウワーのフレームワークを使用している。
粗大なセマンティックモデリングに基づく生成的クロスモーダル検索フレームワーク(CART)を提案する。
論文 参考訳(メタデータ) (2024-06-25T12:47:04Z) - Distillation Enhanced Generative Retrieval [96.69326099136289]
生成的検索はテキスト検索において有望な新しいパラダイムであり、関連する通路の識別子文字列を検索対象として生成する。
本研究は, 蒸留による生成的検索をさらに促進するための有効な方向を特定し, DGR という名称の実行可能なフレームワークを提案する。
本研究では,4つの公開データセットに対して実験を行い,DGRが生成的検索手法の最先端性能を達成することを示す。
論文 参考訳(メタデータ) (2024-02-16T15:48:24Z) - Recommender Systems with Generative Retrieval [58.454606442670034]
本稿では,対象候補の識別子を自己回帰的に復号する新たな生成検索手法を提案する。
そのために、各項目のセマンティックIDとして機能するために、意味論的に意味のあるコードワードを作成します。
提案手法を用いて学習した推薦システムは,様々なデータセット上での現在のSOTAモデルよりも大幅に優れていることを示す。
論文 参考訳(メタデータ) (2023-05-08T21:48:17Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。