論文の概要: IdeaTrail: Full-Process Agent Trajectories for Scientific Ideation
- arxiv url: http://arxiv.org/abs/2607.10144v2
- Date: Tue, 14 Jul 2026 06:41:48 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-15 12:51:44.543118
- Title: IdeaTrail: Full-Process Agent Trajectories for Scientific Ideation
- Title(参考訳): IdeaTrail:科学的なアイデアのためのフルプロエージェントの軌道
- Abstract要約: 本稿では,科学的思考と提案生成のための1,170個の多ターン軌道のデータセットであるIdeaTrailを紹介する。
IdeaTrailは、人によって選択された研究論文から合成され、Generator-Advisorループを通じてアーティファクトを提案する。
このリバース・ツー・フォワード・デザインは、研究の実践における不確実性、エビデンス・ユース、ステージド・コンバージェンス特性を維持しながら、実際の科学的成果と整合した軌道を維持している。
- 参考スコア(独自算出の注目度): 4.061135251278187
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Scientific ideation unfolds over multiple stages, including literature search, paper reading, tool use, claim checking, cross-paper synthesis, brainstorming, rejection of weak directions, and iterative writing. Yet most existing resources capture isolated components or final artifacts rather than the process connecting them. We introduce IdeaTrail, a dataset of 1,170 multi-turn trajectories for scientific ideation and proposal generation. Each trajectory follows a research process from evidence gathering to either idea selection or proposal construction, jointly recording tool use, acquired evidence, intermediate artifacts, and reasoning. IdeaTrail is synthesized from human-selected research papers and proposal artifacts through a Generator--Advisor loop. The Generator produces the visible sequence of actions, observations, and artifact edits, while the Advisor uses the full generation context to check grounding, causal order, naturalness, and leakage from hidden targets. This reverse-to-forward design keeps trajectories aligned with real scientific artifacts while retaining the uncertainty, evidence use, and staged convergence characteristic of research practice. IdeaTrail provides both reusable process supervision and a general recipe for constructing scientific-research-agent data.
- Abstract(参考訳): 科学的アイデアは、文献検索、論文読解、ツール使用、クレームチェック、クロスペーパー合成、ブレインストーミング、弱い方向の拒絶、反復的な書き込みなど、複数の段階にわたって展開されている。
しかし、既存のリソースのほとんどは、それらを接続するプロセスではなく、独立したコンポーネントや最終アーティファクトをキャプチャします。
本稿では,科学的思考と提案生成のための1,170個の多ターン軌道のデータセットであるIdeaTrailを紹介する。
それぞれの軌道は、エビデンス収集から、アイデアの選択または提案の構築、共同記録ツールの使用、取得されたエビデンス、中間的アーティファクト、推論までの研究プロセスに従う。
IdeaTrailは、人によって選択された研究論文から合成され、Generator-Advisorループを通じてアーティファクトを提案する。
ジェネレータは、アクション、観察、アーティファクト編集の可視シーケンスを生成し、アドバイザは、全世代のコンテキストを使用して、隠れたターゲットからの接地、因果順序、自然性、漏洩をチェックする。
このリバース・ツー・フォワード・デザインは、研究の実践における不確実性、エビデンス・ユース、ステージド・コンバージェンス特性を維持しながら、実際の科学的成果と整合した軌道を維持している。
IdeaTrailは、再利用可能なプロセスの監視と、科学的検索エージェントデータを構築するための一般的なレシピを提供する。
関連論文リスト
- From Final Artifacts to Trajectories: Retrospective Process Supervision for Evidence-Grounded Long-Form Generation [49.496216822640974]
RetroGenは、レトロスペクティブプロセスの監視のための自己改善フレームワークである。
専門の工芸品から潜伏軌跡を再構築し、その工芸品に対して検証し、証拠を裏付け、独自の再建データに基づいて模型を訓練する。
実験の結果、RetroGenは接地、忠実な合成、長期にわたるエビデンス検索のタスクを改善していることがわかった。
論文 参考訳(メタデータ) (2026-08-31T08:47:39Z) - Artifact-centered Claim-aware Observability for Autonomous Scientific Agents [4.403170275941483]
本研究では,個人,オペレータ,フィットネスレコード,系統,アーカイブ,ラン,ストリーム,ステアリングコマンドを中心に構成されたコンパクトな可観測性プロファイルを提案する。
プロファイルは、現在のテレメトリとプロファイランス標準を補完するセマンティックレイヤとして意図されている。
論文 参考訳(メタデータ) (2026-08-18T20:47:24Z) - SciForge: An AI-Native, Multimodal Workbench for Scientific Discovery [48.99744520105086]
SciForgeはマルチモーダルな研究ネイティブAIワークベンチである。
検索、解析、モデルルーティング、ワークフローの実行、プロット、書き込み、プレゼンテーション生成がモジュラーエージェントアクセス可能なサービスとして実行される間、人間の判断のためにグラフィカルインターフェースを予約する。
論文 参考訳(メタデータ) (2026-07-17T15:13:03Z) - XScientist: A Git-Like Research Protocol for Long-Running Autonomous Scientific Discovery [1.1923076571060318]
XScientistは、自律的な研究システムのためのgitライクな研究プロトコルとオペレーティングシステムである。
アイデア生成、実験実行、原稿のドラフト、自己レビュー、修復、品質保証、デーモンスケジューリング、アーティファクトを、継続的に監視可能なパイプラインとしてオーケストレーションする。
Agent-Native Research Artifactプロトコルをエクスポートし、探索DAG、ノード毎のコードと出力、クレーム・ツー・エビデンス・アンカー、コンテンツハッシュ、証明、再実行フックを記録する。
論文 参考訳(メタデータ) (2026-07-14T03:20:11Z) - Rethinking Scientific Discovery in the Agentic Era [69.85050591628048]
SCIONは、Textbfの組織ネクサスとして機能するエージェント科学オペレーティングシステムである。
中心となるのは textbfResearch Execution Plan (REP) であり、これは高いレベルの科学的意図をステージ化された目的、依存関係、検証チェックポイント、ツール要件、期待される成果物、フォールバック条件にコンパイルする。
SCION 下での発見を textbfTarget- Conditioned Inverse Search として定式化し,有限実験予算下でのバッチ能動探索により隠れターゲット設定に拡張する。
論文 参考訳(メタデータ) (2026-07-04T13:09:33Z) - Agentic-Ideation: Sample Efficient Agentic Trajectories Synthesis for Scientific Ideation Agents [9.918296068965665]
科学的な発見において、理想は重要な役割を担っている。
Agentic-Ideationは、自動軌道合成パイプラインと、科学的思考のために訓練された特殊なエージェントLSMからなる新しいフレームワークである。
論文 参考訳(メタデータ) (2026-06-30T07:07:51Z) - Towards Verifiable Multimodal Deep Research: A Multi-Agent Harness for Interleaved Report Generation [74.0621258662676]
レポート生成のためのマルチエージェントハーネスであるPtahを提案する。
Ptahは計画、研究、執筆段階を通じて、ユーザクエリからレンダリングされたWebレポートまでのライフサイクルを編成する。
検証エージェントがハーネスの受け入れ機能として機能し、ワークフロー全体を通して事実的接地、引用の忠実性、相互の整合性を強制する。
論文 参考訳(メタデータ) (2026-05-28T12:40:34Z) - Alien Science: Sampling Coherent but Cognitively Unavailable Research Directions from Idea Atoms [53.907293349123506]
大規模な言語モデルは、しばしば、現在のコミュニティにとって一貫性があり、無関心なアイデアを生み出すのに失敗する。
我々は、このギャップを認知的可用性によって形式化し、研究の方向性が典型的な研究者によって自然に提案される可能性について述べる。
我々は、原子の集合が実行可能な方向を構成するかどうかをスコアするコヒーレンスモデルと、その方向が生成される確率をスコアするアベイラビリティモデルという2つの補完モデルを学ぶ。
論文 参考訳(メタデータ) (2026-03-01T13:05:19Z) - ScholarGym: Benchmarking Deep Research Workflows on Academic Literature Retrieval [11.41528830724814]
本稿では,学術研究の再現性評価のためのシミュレーション環境であるScholarGymを紹介する。
決定論的検索を備えた570K論文の静的コーパス上に構築されたScholarGymは,2,536のクエリと専門家による注釈付き基底真理を提供する。
論文 参考訳(メタデータ) (2026-01-29T12:51:44Z) - DeepSynth-Eval: Objectively Evaluating Information Consolidation in Deep Survey Writing [53.85037373860246]
本稿では,情報統合能力を客観的に評価するためのベンチマークであるDeep Synth-Evalを紹介する。
一般チェックリスト(実例)と制約チェックリスト(構造体)を用いたきめ細かい評価プロトコルを提案する。
その結果,エージェント型プラン・アンド・ライトは単ターン生成よりも大幅に優れていた。
論文 参考訳(メタデータ) (2026-01-07T03:07:52Z) - WebWeaver: Structuring Web-Scale Evidence with Dynamic Outlines for Open-Ended Deep Research [73.58638285105971]
本稿では,AIエージェントが膨大なWebスケール情報を洞察に富むレポートに合成しなければならない複雑な課題であるtextbfopen-ended Deep Research (OEDR) に取り組む。
人間の研究プロセスをエミュレートする新しいデュアルエージェントフレームワークである textbfWebWeaver を紹介する。
私たちのフレームワークは、DeepResearch Bench、DeepConsult、DeepResearchGymなど、主要なOEDRベンチマークにまたがる最先端の新たなベンチマークを確立しています。
論文 参考訳(メタデータ) (2025-09-16T17:57:21Z) - ResearchPulse: Building Method-Experiment Chains through Multi-Document Scientific Inference [19.363580418167114]
我々は、関連論文のモチベーション、方法論、実験結果を抽出し、調整する新しいタスクである、多文書科学的推論を定式化する。
提案するResearchPulseは,指導計画,科学コンテンツ抽出,構造化可視化を統合したエージェントベースのフレームワークである。
このタスクを支援するために、注釈付き紙クラスターの引用対応ベンチマークであるResearchPulse-Benchを紹介する。
論文 参考訳(メタデータ) (2025-09-03T15:45:03Z) - Synthesizing Scientific Summaries: An Extractive and Abstractive Approach [0.5904095466127044]
論文要約のためのハイブリッド手法を提案する。
抽出段階では教師なし学習に基づく2つのモデルとトランスフォーマー言語モデルを用いる。
ハイパーパラメータの特定の組み合わせを用いることで、自動要約システムが人間によって書かれた要約の抽象性を超えることが可能であることが判明した。
論文 参考訳(メタデータ) (2024-07-29T08:21:42Z) - RerrFact: Reduced Evidence Retrieval Representations for Scientific
Claim Verification [4.052777228128475]
本稿では,各予測サブタスクに対して連続的に二項分類を行うモジュラー手法を提案する。
我々は、まず非関連な有理を区別し、与えられた主張に対する支持または反証する有理を識別する2段階のスタンス予測を行う。
実験的に、我々のシステムRerrFactは微調整もシンプルな設計もせず、モデルパラメータのごく一部はリーダーボード上で競争的に公正である。
論文 参考訳(メタデータ) (2022-02-05T21:52:45Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。