論文の概要: XScientist: A Git-Like Research Protocol for Long-Running Autonomous Scientific Discovery
- arxiv url: http://arxiv.org/abs/2607.12301v1
- Date: Tue, 14 Jul 2026 03:20:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-15 17:08:30.020796
- Title: XScientist: A Git-Like Research Protocol for Long-Running Autonomous Scientific Discovery
- Title(参考訳): XScientist: 長期にわたる自律的な科学的発見のためのGitライクな研究プロトコル
- Abstract要約: XScientistは、自律的な研究システムのためのgitライクな研究プロトコルとオペレーティングシステムである。
アイデア生成、実験実行、原稿のドラフト、自己レビュー、修復、品質保証、デーモンスケジューリング、アーティファクトを、継続的に監視可能なパイプラインとしてオーケストレーションする。
Agent-Native Research Artifactプロトコルをエクスポートし、探索DAG、ノード毎のコードと出力、クレーム・ツー・エビデンス・アンカー、コンテンツハッシュ、証明、再実行フックを記録する。
- 参考スコア(独自算出の注目度): 1.1923076571060318
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Autonomous research systems are often evaluated as one-shot paper generators: given a topic, they produce a manuscript and a small set of experiment logs. This framing hides the operational problem that makes such systems difficult to trust: research is long-running, branching, failure-prone, and dependent on auditable handoffs between agents and humans. XScientist is a git-like research protocol and operating system for this setting. It orchestrates idea generation, experiment execution, manuscript drafting, self-review, repair, quality gating, daemon scheduling, and reproducibility artifacts as one continuously observable pipeline. The central design choice is to treat each run as a portable research artifact rather than only as a PDF. XScientist exports an Agent-Native Research Artifact (ARA), a protocol that records an exploration DAG, per-node code and outputs, claim-to-evidence anchors, content hashes, provenance, and re-execution hooks. This makes each generated paper inspectable as a science exploration tree: failed branches, repaired experiments, ablations, and manuscript claims remain connected to the nodes that produced them. The system also includes deterministic integrity forensics, sample gates, truth contracts, reviewer-oriented repair loops, and long-running daemon controls. This paper describes the current XScientist architecture, the ARA protocol surface, and the practical safeguards needed to move autonomous science from single-run demos toward reproducible, reviewable, and forkable research infrastructure. The implementation and manuscript source are maintained in the public GitHub repository at https://github.com/smileformylove/XScientist.
- Abstract(参考訳): 自律的な研究システムは、しばしばワンショットの紙ジェネレータとして評価される: トピックが与えられたら、原稿と実験ログの小さなセットを生成する。
このフレーミングは、そのようなシステムを信頼しにくくする運用上の問題を隠蔽している。研究は長期実行、分岐、障害発生、そしてエージェントと人間の間の監査可能なハンドオフに依存している。
XScientistはgitのような研究プロトコルとオペレーティングシステムである。
アイデア生成、実験実行、原稿のドラフト、自己レビュー、修復、品質ゲーティング、デーモンスケジューリング、再現性アーティファクトを、継続的に監視可能なパイプラインとしてオーケストレーションする。
中心となる設計選択は、各実行をPDFとしてではなく、ポータブルな研究成果物として扱うことである。
XScientistはAgent-Native Research Artifact (ARA)をエクスポートしている。これは探索DAG、ノード毎のコードと出力、クレーム・ツー・エビデンスアンカー、コンテンツハッシュ、証明、再実行フックを記録するプロトコルである。
これにより、各生成された論文は、科学的な探索木として検査可能となり、失敗した枝、修復された実験、改善、および原稿のクレームは、生成したノードに接続されている。
このシステムには、決定論的整合性鑑定、サンプルゲート、真理契約、レビュアー指向の修理ループ、長期にわたるデーモン制御が含まれる。
本稿では,現在のXScientistアーキテクチャ,ARAプロトコルサーフェス,および自律科学を再現性,レビュー性,フォーク可能な研究基盤へと移行させるために必要な実用安全対策について述べる。
実装と原稿のソースはGitHubのhttps://github.com/smileformylove/XScientist.comにある公開リポジトリに保管されている。
関連論文リスト
- Artifact-centered Claim-aware Observability for Autonomous Scientific Agents [4.403170275941483]
本研究では,個人,オペレータ,フィットネスレコード,系統,アーカイブ,ラン,ストリーム,ステアリングコマンドを中心に構成されたコンパクトな可観測性プロファイルを提案する。
プロファイルは、現在のテレメトリとプロファイランス標準を補完するセマンティックレイヤとして意図されている。
論文 参考訳(メタデータ) (2026-08-18T20:47:24Z) - SciForge: An AI-Native, Multimodal Workbench for Scientific Discovery [48.99744520105086]
SciForgeはマルチモーダルな研究ネイティブAIワークベンチである。
検索、解析、モデルルーティング、ワークフローの実行、プロット、書き込み、プレゼンテーション生成がモジュラーエージェントアクセス可能なサービスとして実行される間、人間の判断のためにグラフィカルインターフェースを予約する。
論文 参考訳(メタデータ) (2026-07-17T15:13:03Z) - IdeaTrail: Full-Process Agent Trajectories for Scientific Ideation [4.061135251278187]
本稿では,科学的思考と提案生成のための1,170個の多ターン軌道のデータセットであるIdeaTrailを紹介する。
IdeaTrailは、人によって選択された研究論文から合成され、Generator-Advisorループを通じてアーティファクトを提案する。
このリバース・ツー・フォワード・デザインは、研究の実践における不確実性、エビデンス・ユース、ステージド・コンバージェンス特性を維持しながら、実際の科学的成果と整合した軌道を維持している。
論文 参考訳(メタデータ) (2026-07-11T06:04:29Z) - Rethinking Scientific Discovery in the Agentic Era [69.85050591628048]
SCIONは、Textbfの組織ネクサスとして機能するエージェント科学オペレーティングシステムである。
中心となるのは textbfResearch Execution Plan (REP) であり、これは高いレベルの科学的意図をステージ化された目的、依存関係、検証チェックポイント、ツール要件、期待される成果物、フォールバック条件にコンパイルする。
SCION 下での発見を textbfTarget- Conditioned Inverse Search として定式化し,有限実験予算下でのバッチ能動探索により隠れターゲット設定に拡張する。
論文 参考訳(メタデータ) (2026-07-04T13:09:33Z) - Towards Verifiable Multimodal Deep Research: A Multi-Agent Harness for Interleaved Report Generation [74.0621258662676]
レポート生成のためのマルチエージェントハーネスであるPtahを提案する。
Ptahは計画、研究、執筆段階を通じて、ユーザクエリからレンダリングされたWebレポートまでのライフサイクルを編成する。
検証エージェントがハーネスの受け入れ機能として機能し、ワークフロー全体を通して事実的接地、引用の忠実性、相互の整合性を強制する。
論文 参考訳(メタデータ) (2026-05-28T12:40:34Z) - ResearchLoop: An Evidence-Gated Control Plane for AI-Assisted Research [4.9833735627186435]
ResearchLoopはAI支援型計算研究のためのエビデンス付き制御プレーンである。
ResearchLoopは、リサーチ質問、タスク契約、エビデンスオブジェクト、クレーム台帳、クローズアウト、ペーパーバインディングを耐久性のあるプロジェクトステートとして扱う。
この技術レポートは、完全なプロトコル仕様、状態モデル、トランジションルール、クレーム・アドミッション・アルゴリズム、インサイト・コンポーティングメカニズムを提供する。
論文 参考訳(メタデータ) (2026-05-27T10:29:00Z) - AI for Auto-Research: Roadmap & User Guide [107.0834449839233]
研究ライフサイクル全体にわたってAIをエンドツーエンドに分析する。
我々は、信頼できる援助と信頼できない自律性の間に、鋭くステージに依存した境界を特定できる。
障害モードを排除するのではなく、より大きな自動化が不明瞭であることが示されています。
論文 参考訳(メタデータ) (2026-05-18T17:08:26Z) - AutoResearch: An Execution-Grounded Multi-Agent Framework for Reliable Research Workflow Automation [8.807417226975081]
AutoResearchは、信頼性の高い研究ワークフロー自動化のための実行基盤のマルチエージェントフレームワークである。
システムは、エラー、引用検証失敗、レビューエージェントフィードバックを、生成された研究成果物の実用的なフィルタリング信号として扱う。
論文 参考訳(メタデータ) (2026-05-04T08:24:21Z) - The Last Human-Written Paper: Agent-Native Research Artifacts [106.47848184955576]
本稿では,物語紙を機械処理可能な研究パッケージに置き換えるプロトコルであるAgent-Native Research Artifact(ARA)を紹介する。
通常の開発において決定と終了をキャプチャするLive Research Manager、レガシPDFとリポジトリをARAに変換するARAコンパイラ、人間レビュアーが重要性、ノベルティ、味にフォーカスできるように客観的チェックを自動化するARAネイティブレビューシステムである。
論文 参考訳(メタデータ) (2026-04-27T16:23:09Z) - sciwrite-lint: Verification Infrastructure for the Age of Science Vibe-Writing [0.0]
現在、科学は品質保証に2つの選択肢を提供しているが、どちらも不十分である。
論文自体を測る第3の選択肢を提案する。
sciwrite-lintは、研究者のマシンで完全に動作する科学写本のためのオープンソースライブラリである。
arXivとbioRxivの未確認論文30件について, 誤り注入とLCM適応偽陽性解析を用いてパイプラインの評価を行った。
論文 参考訳(メタデータ) (2026-04-09T17:46:44Z) - From Reproduction to Replication: Evaluating Research Agents with Progressive Code Masking [48.90371827091671]
AutoExperimentは、AIエージェントの機械学習実験の実装と実行能力を評価するベンチマークである。
我々は最先端のエージェントを評価し、n$が増加するにつれて性能が急速に低下することを発見した。
本研究は、長期コード生成、文脈検索、自律的な実験実行における重要な課題を浮き彫りにした。
論文 参考訳(メタデータ) (2025-06-24T15:39:20Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。