論文の概要: Multi-Turn Agentic Scientific Literature Search via Workflow Induction
- arxiv url: http://arxiv.org/abs/2607.00597v2
- Date: Fri, 03 Jul 2026 12:21:32 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-07 13:04:58.3822
- Title: Multi-Turn Agentic Scientific Literature Search via Workflow Induction
- Title(参考訳): ワークフロー誘導による多言語エージェント科学文献検索
- Abstract要約: 本稿では,科学検索をワークフロー誘導としてフレーム化する多ターン文献検索エージェントPaperPilotを紹介する。
アンカー紙とユーザクエリが与えられた後、PaperPilotは、キーワード検索、引用拡張、フィルタリング、スコアリング、再ランク付け、エビデンス抽出を含む、ペーパー検索オペレータの実行可能なDAGを構築し、クエリとワークフロー自体を洗練するためにユーザフィードバックを使用する。
実験の結果、PaperPilot-9BはQwen3.5-9B基を多ターン相互作用で改善し、hit@5を58.0から77.0に、MRRを47.5から59.4に、nDCG@を増大させた。
- 参考スコア(独自算出の注目度): 46.48960698773641
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Scientific literature search often requires more than retrieving papers from a single query: users' intents are underspecified, preference-dependent, and evolve through interaction. Existing search agents typically rely on fixed pipelines or implicit language-only reasoning, making their search strategies difficult to control, inspect, and refine. We introduce PaperPilot, a multi-turn literature search agent that frames scientific search as workflow induction. Given an anchor paper and a user query, PaperPilot constructs an executable DAG of paper-search operators, including keyword search, citation expansion, filtering, scoring, reranking, and evidence extraction. User feedback is then used to refine both the query and the workflow itself. We train PaperPilot with supervised workflow imitation and preference optimization over controlled workflow corruptions. Experiments show that PaperPilot-9B improves over the base Qwen3.5-9B toolset agent under multi-turn interaction, increasing Hit@5 from 58.0 to 77.0, MRR from 47.5 to 59.4, and nDCG@10 from 26.8 to 32.5, while reducing workflow execution errors from 9.5% to 0%. These results show that explicit, editable search workflows provide an effective and controllable interface for aligning literature search agents with complex scientific intent.
- Abstract(参考訳): 科学文献検索は、しばしば単一のクエリから論文を検索する以上のものを必要とする:ユーザーの意図は不明確で、好みに依存し、対話を通じて進化する。
既存の検索エージェントは通常、固定パイプラインや暗黙の言語のみの推論に依存しており、検索戦略の制御、検査、洗練が困難である。
本稿では,科学検索をワークフロー誘導としてフレーム化する多ターン文献検索エージェントPaperPilotを紹介する。
アンカー紙とユーザクエリが与えられたPaperPilotは、キーワード検索、引用拡張、フィルタリング、スコアリング、再ランク付け、エビデンス抽出を含む、ペーパー検索オペレータの実行可能なDAGを構築する。
ユーザからのフィードバックは、クエリとワークフロー自体を洗練するために使用される。
制御されたワークフローの破損に対して、教師付きワークフローの模倣と好みの最適化を施してPaperPilotを訓練する。
実験の結果、PaperPilot-9BはベースQwen3.5-9Bツールセットエージェントをマルチターンインタラクションで改善し、Hit@5を58.0から77.0に、MRRを47.5から59.4に、nDCG@10を26.8から32.5に、ワークフローの実行エラーを9.5%から0%に削減した。
これらの結果は、明示的で編集可能な検索ワークフローが、文学検索エージェントを複雑な科学的意図に整合させる効果的な、制御可能なインターフェースを提供することを示している。
関連論文リスト
- Novelty-Aware Agentic Retrieval: Comparing Research Contributions Through Structured Multi-Step Reasoning [0.0]
ノベルティ・アウェア・リサーチ・エージェント(英: Novelty-Aware Research Agent)は、エージェント検索システムのプロトタイプである。
RAGパイプライン上の多段階推論を6つのタイプドコントラクトコンポーネントを通じて階層化する。
論文毎のコントリビューション記録、紙レベルのオーバーラップ、問題xメソッドギャップマトリックスなど、構造化された比較アーティファクトを生成する。
論文 参考訳(メタデータ) (2026-06-20T17:04:02Z) - Is Grep All You Need? How Agent Harnesses Reshape Agentic Search [0.7199239000118145]
本稿では,2つの実験にまとめられた実証的研究を報告する。
実験1では、Chは一般にベクトル検索よりも精度が高いことを示した。
全体的なスコアは、基礎となる会話データが同じであっても、どのハーネスとツール呼び出しスタイルが使用されるかに強く依存する。
論文 参考訳(メタデータ) (2026-05-14T17:58:41Z) - AutoResearch: An Execution-Grounded Multi-Agent Framework for Reliable Research Workflow Automation [8.807417226975081]
AutoResearchは、信頼性の高い研究ワークフロー自動化のための実行基盤のマルチエージェントフレームワークである。
システムは、エラー、引用検証失敗、レビューエージェントフィードバックを、生成された研究成果物の実用的なフィルタリング信号として扱う。
論文 参考訳(メタデータ) (2026-05-04T08:24:21Z) - Beyond Semantic Similarity: Rethinking Retrieval for Agentic Search via Direct Corpus Interaction [127.64173950476702]
エージェントが直接、汎用端末ツールを用いて、生コーパスを直接検索する直接コーパス間相互作用(DCI)について検討する。
このアプローチではオフラインインデックスを必要とせず、ローカルコーパスの進化に自然に適応する。
IRベンチマークとエンドツーエンドのエージェント検索タスク全体にわたって、この単純なセットアップは、強いスパース、密度、リランクベースラインよりも大幅に優れています。
論文 参考訳(メタデータ) (2026-05-03T19:13:11Z) - The Last Human-Written Paper: Agent-Native Research Artifacts [106.47848184955576]
本稿では,物語紙を機械処理可能な研究パッケージに置き換えるプロトコルであるAgent-Native Research Artifact(ARA)を紹介する。
通常の開発において決定と終了をキャプチャするLive Research Manager、レガシPDFとリポジトリをARAに変換するARAコンパイラ、人間レビュアーが重要性、ノベルティ、味にフォーカスできるように客観的チェックを自動化するARAネイティブレビューシステムである。
論文 参考訳(メタデータ) (2026-04-27T16:23:09Z) - Paper Circle: An Open-source Multi-agent Research Discovery and Analysis Framework [82.66443886385125]
ペーパーサークル(Paper Circle)は、学術文献の発見、評価、整理、理解に必要な労力を減らすために設計された発見・分析システムである。
1)複数のソースからのオフラインおよびオンライン検索を統合するディスカバリパイプライン,多エージェントスコアリング,多様性対応ランキング,構造化アウトプット,2)個々の論文を概念,メソッド,数値などの型付きノードで構造化された知識グラフに変換する分析パイプライン,の2つの補完パイプラインで構成されている。
論文 参考訳(メタデータ) (2026-04-07T17:59:58Z) - Revisiting Text Ranking in Deep Research [24.324221566628125]
Black-box Web Search APIは、検索コンポーネントの体系的な分析を妨げる。
我々は、深い研究環境において、IRテキストランキング手法における重要な発見とベストプラクティスの選択を再現する。
論文 参考訳(メタデータ) (2026-02-25T00:18:07Z) - SAGE: Benchmarking and Improving Retrieval for Deep Research Agents [60.53966065867568]
SAGEは4つの科学領域にわたる1200のクエリからなる科学文献検索のためのベンチマークであり、20万の論文検索コーパスを備える。
6つのディープ・リサーチ・エージェントを評価し,全てのシステムが推論集約的な検索に苦しむことを発見した。
BM25は、既存のエージェントがキーワード指向のサブクエリを生成するため、LLMベースのレトリバーを約30%上回っている。
論文 参考訳(メタデータ) (2026-02-05T18:25:24Z) - PaperArena: An Evaluation Benchmark for Tool-Augmented Agentic Reasoning on Scientific Literature [11.804526152911386]
本研究では,大規模言語モデル(LLM)に基づくエージェントの評価ベンチマークであるPaperArenaを提案する。
研究上の疑問から、エージェントは推論や適切なツールとのインタラクションを通じて、複数の論文にまたがる多様なフォーマットを統合する必要がある。
実験の結果、高度に確立されたエージェントを駆動する最も先進的なLCMでさえ、平均精度は38.78%に過ぎなかった。
論文 参考訳(メタデータ) (2025-10-13T02:10:39Z) - BrowseComp-Plus: A More Fair and Transparent Evaluation Benchmark of Deep-Research Agent [74.10138164281618]
BrowseComp-Plus(BrowseComp-Plus)は、BrowseCompから派生したベンチマークである。
このベンチマークは、ディープリサーチエージェントと検索方法の総合的な評価とアンタングル解析を可能にする。
論文 参考訳(メタデータ) (2025-08-08T17:55:11Z) - Collapse of Dense Retrievers: Short, Early, and Literal Biases Outranking Factual Evidence [56.09494651178128]
検索モデルは、Retrieval-Augmented Generation (RAG)のような情報検索(IR)アプリケーションで一般的に使用される。
我々は、Dragon+やContrieverのようなリトリーバーに対する、短いドキュメントの好みなどのバイアスの影響を定量化する。
私たちは大きな脆弱性を発見し、リトリバーが短いドキュメント、早い位置、繰り返しのエンティティ、リテラルマッチを好んで、答えの存在を無視しながら表示します。
論文 参考訳(メタデータ) (2025-03-06T23:23:13Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。