論文の概要: Toward Trustworthy Autonomous Science: A Two-Year Community Roadmap
- arxiv url: http://arxiv.org/abs/2607.12113v1
- Date: Mon, 13 Jul 2026 19:40:40 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-15 17:08:29.958393
- Title: Toward Trustworthy Autonomous Science: A Two-Year Community Roadmap
- Title(参考訳): 信頼できる自律科学を目指して - 2年間のコミュニティロードマップ
- Authors: Rafael Ferreira da Silva, Milad Abolhasani, Peter Beaucage, Laura Biven, Michael Bussmann, Kyle Chard, Ryan Coffee, Stephen DeWitt, Sagar Dolas, Carrie Eckert, David Elbert, Ian Foster, Tirthankar Ghosal, Anna Giannakou, Tom Gibbs, Leslie Hamilton, Glenn Lockwood, Theresa Mayer, Ben Mintz, Raffi Nazikian, Sal Nimer, Amanda Randles, Woong Shin, Sreenivas Rangan Sukumar, Frédéric Suter, Mitra Taheri, Michela Taufer, Draguna Vrabie,
- Abstract要約: 1年前、AISLEのロードマップは、自律的な研究所は孤立した島として運営されたと主張した。
ロードマップを7次元で更新し、元の5つを再検討します。
我々は、草の根ネットワークを、リサイロではなく、国家プログラム、国際イニシアチブ、および商用プラットフォームを接続するための相互運用性ファブリックとして位置付けている。
- 参考スコア(独自算出の注目度): 4.632578794601467
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: One year ago, the AISLE roadmap argued that autonomous laboratories operated as isolated islands and proposed a grassroots network organized around five critical dimensions. The field has since moved faster than anticipated. Multi-agent systems have produced experimentally validated hypotheses, self-driving laboratories have grown more interoperable and orchestrated, reasoning-trained and domain foundation models have raised the capability ceiling, and the Genesis Mission has placed autonomous experimentation at the center of U.S. federal science strategy, with industry emerging as a primary actor. Progress has met a sobering counter-current, including a corrected flagship discovery result, benchmarks showing that agents which rival experts on closed-ended questions still complete only a fraction of open-ended research, and fabricated citations surfacing at leading venues. We read this as the defining tension of the field. Producing a candidate discovery is no longer the hard part, but verifying it is, and this asymmetry now limits autonomous science more than raw model capability. We update the roadmap around seven dimensions, revisiting the original five and elevating two former cross-cutting concerns, trust, verification, and reproducibility, and safety, security, and governance, to first-class status. We assess the original milestones (M1 through M14) as achieved, partially achieved, reframed, or open, add four new milestones (M15 through M18), and scope the path forward to a two-year horizon. The first year concentrates on interfaces, protocol adoption, and the scaffolding of verification, and the second targets federation, zero-trust coordination, and governance. Throughout, we position the grassroots network as the interoperability fabric that lets national programs, international initiatives, and commercial platforms connect rather than re-silo.
- Abstract(参考訳): 1年前、AISLEのロードマップは、自律的な研究所が孤立した島として運営され、五つの重要な次元で組織された草の根ネットワークを提案したと主張した。
その後、フィールドは予想より速く移動した。
マルチエージェントシステムは実験的に検証された仮説を生み出し、自動運転研究所はより相互運用可能で組織化され、推論訓練されたドメイン基盤モデルは能力の天井を高くし、ジェネシス・ミッションはアメリカの連邦科学戦略の中心に自律的な実験を配置し、業界が主要な俳優として台頭した。
進捗は、修正された旗艦発見結果や、クローズドエンドの質問の専門家と競合するエージェントがまだ少数のオープンエンドの研究を完了していることを示すベンチマーク、そして主要な会場で見渡される引用など、まじめな反響に遭遇した。
私たちはこれをフィールドの断定的な緊張として読みました。
この非対称性は、現在では生のモデル能力以上の自律科学を制限している。
私たちは7つの側面に関するロードマップを更新し、元の5つを再考し、2つの横断的な関心事、信頼、検証、再現性、安全性、セキュリティ、ガバナンスをファーストクラスに昇格させます。
我々は、最初のマイルストーン(M1からM14)を達成、部分的に達成、再編成、またはオープンとして評価し、新しいマイルストーン(M15からM18)を4つ追加し、2年間の地平線へのパスをスコープする。
1年目はインターフェース、プロトコルの採用、検証の足場に集中し、2年目はフェデレーション、ゼロトラスト調整、ガバナンスを目標としています。
我々は、草の根ネットワークを、リサイロではなく、国家プログラム、国際イニシアチブ、および商用プラットフォームを接続するための相互運用性ファブリックとして位置付ける。
関連論文リスト
- One Reflection Is Not Enough: Self-Correcting Autonomous Research via Multi-Hypothesis Failure Attribution [85.65263343588026]
我々は,自己修正型,自律型,接地型実験機であるSAGEを提案する。
その中核的なメカニズムであるMHFA(Multi-Hypothesis Failure Attribution)は、回復を構造的因果診断として扱う。
12のトピック、5ドメインのベンチマークでは、SAGEは基準リフレクションでメトリクスを含むアウトプットを42%から92%に増やしている。
論文 参考訳(メタデータ) (2026-06-30T10:54:16Z) - Heuresis: Search Strategies for Autonomous AI Research Agents Across Quality, Diversity and Novelty [39.97857268041792]
Heuresisは、研究パイプラインを汎用的で構成可能なプリミティブのセットに抽象化するフレームワークである。
全く新しいアイデアは稀である。得点したアイデアは「オリジナル(Original)」と評価され、前作と比べて「マイナーな類似性(Minor similarity)」しか達成できない。
論文 参考訳(メタデータ) (2026-06-23T21:44:08Z) - COMPOSITE-Stem [32.17652486099204]
COMPOSITE-STEMは、物理学、生物学、化学、数学における70の専門的なタスクのベンチマークである。
我々のベンチマークでは、正確なマッチンググレーティングとクレーターベースのルーリックとアズ・ア・ジャイグリーグレーディングプロトコルを組み合わせる。
トップパフォーマンスモデルは21%を実現し、ComposITE-STEMが現在のエージェントリーチを超える能力をキャプチャすることを示した。
論文 参考訳(メタデータ) (2026-04-10T19:08:50Z) - InternAgent-1.5: A Unified Agentic Framework for Long-Horizon Autonomous Scientific Discovery [138.0404718571971]
InternAgent-1.5は、エンドツーエンドの科学的発見を目的とした統合システムである。
このシステムは、生成、検証、進化のための3つの調整されたサブシステムで構成される構造化アーキテクチャ上に構築されている。
InternAgent-1.5をGAIA,HLE,GPQA,FrontierScienceなどの科学的推論ベンチマークで評価した。
論文 参考訳(メタデータ) (2026-02-09T18:36:06Z) - Towards a Science of Collective AI: LLM-based Multi-Agent Systems Need a Transition from Blind Trial-and-Error to Rigorous Science [70.3658845234978]
大規模言語モデル(LLM)はマルチエージェントシステム(MAS)の機能を大幅に拡張した。
この急速な進歩にもかかわらず、この分野はいまだに実証的な試行錯誤に大きく依存している。
このボトルネックは、帰属の曖昧さに起因している。
本稿では,協調運転要因を体系的に同定する要因帰属パラダイムを提案する。
論文 参考訳(メタデータ) (2026-02-05T04:19:52Z) - Can LLMs Do Rocket Science? Exploring the Limits of Complex Reasoning with GTOC 12 [0.1710384116816033]
LLM(Large Language Models)は、コード生成と一般的な推論において顕著な習熟性を示している。
本研究は、第12回グローバル軌道最適化コンペティション(GTOC 12)に対するAIエージェントの評価により、現在のAIエージェントの限界について検討する。
我々は、MLE-Benchフレームワークを軌道力学の領域に適応させ、AIDEベースのエージェントアーキテクチャをデプロイし、ミッションソリューションを自律的に生成し、洗練する。
論文 参考訳(メタデータ) (2026-02-03T15:18:26Z) - An Anatomy of Vision-Language-Action Models: From Modules to Milestones and Challenges [87.35344276973537]
VLA(Vision-Language-Action)モデルは、ロボット工学の革命を駆動し、機械が指示を理解し、物理的な世界と対話することを可能にする。
この調査は、VLAのランドスケープを明確かつ構造化したガイドを提供する。
論文 参考訳(メタデータ) (2025-12-12T08:22:03Z) - IterResearch: Rethinking Long-Horizon Agents via Markovian State Reconstruction [107.49922328855025]
IterResearchは、マルコフ決定過程として長期研究を再構築する、新しい反復的深層研究パラダイムである。
6つのベンチマークで平均+14.5ppの既存のオープンソースエージェントよりも大幅に改善されている。
これは効果的なプロンプト戦略として機能し、ロングホライゾンタスクにおけるReActよりも19.2ppのフロンティアモデルを改善する。
論文 参考訳(メタデータ) (2025-11-10T17:30:08Z) - Open-ended Scientific Discovery via Bayesian Surprise [63.26412847240136]
AutoDSは、ベイジアン・サプライズを用いた科学探査を駆動する、オープンエンドの科学的発見の方法である。
我々はAutoDSを、生物学、経済学、金融学、行動科学といった21の領域にまたがる実世界のデータセットにまたがるデータ駆動ディスカバリの設定で評価する。
論文 参考訳(メタデータ) (2025-06-30T22:53:59Z) - A Grassroots Network and Community Roadmap for Interconnected Autonomous Science Laboratories for Accelerated Discovery [3.3949455855089616]
自律型相互接続型科学実験室(AISLE)について紹介する。
AISLEは、フラグメント化された機能を統一システムに変換する草の根ネットワークである。
協調的な自律科学へのこのパラダイムシフトは、持続可能なエネルギー、材料開発、公衆衛生のブレークスルーを約束する。
論文 参考訳(メタデータ) (2025-06-20T23:20:28Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。