論文の概要: Programmatic Search Agents: Extending Agentic Search Beyond Query Reformulation
- arxiv url: http://arxiv.org/abs/2610.06689v1
- Date: Mon, 05 Oct 2026 16:52:57 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-08 23:36:22.04787
- Title: Programmatic Search Agents: Extending Agentic Search Beyond Query Reformulation
- Title(参考訳): プログラム検索エージェント:クエリのリフォームを超えてエージェント検索を拡張する
- Abstract要約: Programmatic Search Agent (PSA) は、候補に対する局所的な実行可能計算を検索アクションの単位とする。
PSAは、永続的な候補ワークスペース、柔軟な原始構成、選択的エビデンス提示を統一する。
クエリベースのエージェントとは対照的に、PSAはマクロ平均タスクの成功を4.00と7.56ポイント改善する。
- 参考スコア(独自算出の注目度): 15.421250076594484
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Search agents adapt their queries, yet fixed search interfaces leave candidate processing and evidence presentation outside the agent's direct control. Our trajectory analysis shows that supporting passages can be retrieved yet never delivered to the agent; a same-page oracle intervention shows that changing the returned evidence can reduce subsequent search. We introduce Programmatic Search Agent (PSA), which makes a local executable computation over candidates the unit of a search action. PSA unifies a persistent candidate workspace, flexible primitive composition, and selective evidence presentation. It incrementally generates program cells that reuse candidates, execute dependent operations, and select what the agent inspects next. The runtime resolves specified data dependencies within each cell, while the agent adapts its search strategy across cells as new evidence arrives. We compare PSA with the Query-based Agent and Tool-based Agent on InfoSeek-Eval and BrowseComp-Plus using five policy backbones without task-specific training. All three interfaces share the search substrate, and the Tool-based Agent also shares PSA's primitives and persistent workspace. Relative to the Query-based Agent, PSA improves macro-averaged task success by 4.00 and 7.56 percentage points on the two benchmarks, respectively; within-backbone reductions in final-step tokens average 28.3% and 33.9%. These results support extending agent control beyond query reformulation to the processing and presentation of retrieved evidence. Code will be released subject to approval.
- Abstract(参考訳): 検索エージェントはクエリに適応するが、固定された検索インターフェースは、エージェントの直接制御の外で候補処理と証拠提示を行う。
同ページのオラクル介入は、返却された証拠の変更がその後の検索を減少させる可能性があることを示している。
本稿では,プログラム検索エージェント (PSA) を導入し,探索動作の単位として候補に対して局所的に実行可能計算を行う。
PSAは、永続的な候補ワークスペース、柔軟な原始構成、選択的エビデンス提示を統一する。
候補を再利用し、依存した操作を実行し、エージェントが次に検査するものを選択するプログラムセルを段階的に生成する。
ランタイムは各セル内の特定のデータ依存関係を解決し、エージェントは新たなエビデンスが到着すると、セル間の検索戦略に適応する。
PSA と InfoSeek-Eval と BrowseComp-Plus の Query-based Agent および Tool-based Agent を比較した。
ツールベースのエージェントは、PSAのプリミティブと永続的なワークスペースも共有している。
クエリベースのエージェントとは対照的に、PSAは2つのベンチマークでそれぞれ4.00と7.56ポイントのマクロ平均タスク成功を改善し、最終ステップトークンの平均は28.3%と33.9%である。
これらの結果は、検索された証拠の処理および提示に対するクエリ再構成以外のエージェント制御の拡張を支援する。
コードは承認される。
関連論文リスト
- SearchOS-V1: Towards Robust Open-Domain Information-Seeking Agent Collaboration [77.28003194268977]
SearchOSは、脆弱で暗黙的な検索進捗を明示的で永続的で共有状態に変換するシステムレベルのマルチエージェントフレームワークである。
SOCM上に構築されたSearchOSは、サブエージェントの実行を重複させるパイプライン並列スケジューリングメカニズムを適用している。
SearchOSは評価されたシングルエージェントとマルチエージェントのベースラインの中で、すべてのメトリクスをリードする。
論文 参考訳(メタデータ) (2026-07-16T17:51:23Z) - GrepSeek: Training Search Agents for Direct Corpus Interaction [66.69568141699311]
GrepSeekは、コンパクトな検索エージェントを訓練し、大きなテキストコーパスから証拠を見つけ、フィルタリングし、構成する、最適化された直接コーパスインタラクション(DCI)検索エージェントである。
DCIを大規模に実用化するためには、シェルコマンドのシーケンシャルな実行とバイトエクササイズ等価性を保ちながら、シェルベースの検索を最大7.6タイムで高速化するセマンティックス保存のシャード並列実行エンジンを使用する。
論文 参考訳(メタデータ) (2026-05-28T03:37:33Z) - LiveBrowseComp: Are Search Agents Searching, or Just Verifying What They Already Know? [32.434901767447165]
LLMベースの検索エージェントは、外部の証拠よりも本質的な知識に依存している。
LiveBrowseCompは、固有のカバレッジ以上のエージェントを評価するために設計されたベンチマークである。
評価されたすべてのエージェントは、クローズドブックの精度を2%以下に抑え、検索強化されたスコアは、BrowseCompと比較して25~40ポイント減少し、以前のモデルランキングは、もはやパフォーマンスを確実に予測することができない。
論文 参考訳(メタデータ) (2026-05-27T16:39:57Z) - AgentSearchBench: A Benchmark for AI Agent Search in the Wild [21.739444037726418]
本稿では,エージェント検索のための大規模ベンチマークであるAgentSearchBenchを紹介する。
このベンチマークは、エージェント検索を検索として形式化し、実行可能タスククエリと高レベルタスク記述の両方で問題を再分類する。
実行認識型探索を含む軽量な行動信号は、ランキング品質を大幅に向上させることができることを示す。
論文 参考訳(メタデータ) (2026-04-24T10:53:54Z) - AgentSelect: Benchmark for Narrative Query-to-Agent Recommendation [39.61543921719145]
AgentSelectは、エージェントの選択をナラティブクエリからエージェントへのレコメンデーションとして再設計するベンチマークである。
異種評価アーティファクトを、統一された正のみの相互作用データに変換する。
AgentSelectは、エージェントレコメンデーションのための最初の統一データと評価インフラストラクチャを提供する。
論文 参考訳(メタデータ) (2026-03-04T06:17:51Z) - InfoAgent: Advancing Autonomous Information-Seeking Agents [143.15973604285304]
本稿では,革新的なデータ合成パイプラインとWeb検索ツールを駆使したディープリサーチエージェントInfoAgentを紹介する。
我々の方法では、InfoAgentはBrowseCompで15.3%、BrowseComp-ZHで29.2%、Xbench-DSで40.4%の精度を達成した。
論文 参考訳(メタデータ) (2025-09-29T17:59:57Z) - ProductAgent: Benchmarking Conversational Product Search Agent with Asking Clarification Questions [68.81939215223818]
ProductAgentは,戦略的明確化質問生成機能と動的製品検索機能を備えた対話情報探索エージェントである。
我々は,製品特徴の要約,クエリ生成,製品検索のための戦略を持ったエージェントを開発する。
実験の結果,ProductAgentはユーザとポジティブに対話し,対話のターンの増加に伴う検索性能の向上を図っている。
論文 参考訳(メタデータ) (2024-07-01T03:50:23Z) - InfiAgent-DABench: Evaluating Agents on Data Analysis Tasks [84.7788065721689]
本稿では,データ解析タスクにおけるLSMに基づくエージェントの評価に特化して設計された最初のベンチマークであるInfiAgent-DABenchを紹介する。
このベンチマークには52のCSVファイルから得られた257のデータ分析質問からなるデータセットであるDAEvalが含まれている。
エージェントフレームワーク上に構築し,DABench 上で GPT-3.5 を3.9% 上回る特殊エージェント DAAgent を開発した。
論文 参考訳(メタデータ) (2024-01-10T19:04:00Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。