論文の概要: LabEvolver: Training-Free Experience Evolution for Safe and Grounded Wet-Lab Agents
- arxiv url: http://arxiv.org/abs/2607.27690v2
- Date: Fri, 31 Jul 2026 02:51:45 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-03 14:29:40.327738
- Title: LabEvolver: Training-Free Experience Evolution for Safe and Grounded Wet-Lab Agents
- Title(参考訳): LabEvolver: 安全で接地されたWet-Labエージェントのためのトレーニング不要なエクスペリエンス進化
- Abstract要約: 本稿では,安全かつ接地されたウェットラブエージェントに,実行経験からエピソード記憶を付加したトレーニングフリーフレームワークであるLabEvolverを紹介する。
LabEvolverは、適応認識、オンライン計画、安全性検証のための州立の試験ループと、完成した軌道を再利用可能なスキル、戦略、安全体験に蒸留する外部進化ループを結合する。
- 参考スコア(独自算出の注目度): 55.791551822756524
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: We introduce LabEvolver, a training-free framework that equips safe and grounded wet-lab agents with episodic memory from execution experience. LabEvolver couples a state-grounded inner trial loop for adaptive perception, online planning, and safety validation with an outer evolution loop that distills completed trajectories into reusable skill, strategy, and safety experience. On robotic solution-preparation tasks, LabEvolver demonstrates real-world feasibility, reducing pH-regulation completion time and safety-gate intercepts by 48.2% and 60.0%, respectively. On ALFWorld, it further improves cumulative success rate within 20 steps from 76.2% with ReAct to 91.4% over 500 continual tasks, showing generality beyond wet-lab settings. These results support learn-by-doing experience evolution as a feasible path toward closed-loop automated scientific discovery. The project page is available at https://andygao6186.github.io/LabEvolver/.
- Abstract(参考訳): 本稿では,安全かつ接地されたウェットラブエージェントに,実行経験からエピソード記憶を付加したトレーニングフリーフレームワークであるLabEvolverを紹介する。
LabEvolverは、適応認識、オンライン計画、安全性検証のための州立の試験ループと、完成した軌道を再利用可能なスキル、戦略、安全体験に蒸留する外部進化ループを結合する。
ロボットによるソリューション準備作業では、LabEvolverは実際の実現可能性を示し、pH調整完了時間と安全ゲートインターセプトをそれぞれ48.2%と60.0%削減した。
ALFWorldでは、20ステップ以内の累積成功率をReActで76.2%から500回の連続タスクで91.4%に改善し、ウェットラブ設定以上の一般化を示している。
これらの結果は、クローズドループ自動科学発見への道のりとして、学習による経験進化を支援する。
プロジェクトページはhttps://andygao6186.github.io/LabEvolver/で公開されている。
関連論文リスト
- EvolveNet: Collaborative Harness Evolution for Agent Self-Improvement [70.68218215070745]
既存のアプローチでは、すべての実行エクスペリエンスを単一のハーネスにルーティングできると仮定している。
EvolveNetは、経験抽出をデータに移動させるハーネス進化のパラダイムである。
論文 参考訳(メタデータ) (2026-08-05T15:37:18Z) - LabRobFail: A Benchmark for Robotic Failure Analysis in Chemical Self-driving Laboratory [52.26893354670174]
本稿では,化学実験室におけるロボット故障解析の学習と評価を目的とした,障害中心のフレームワークであるLabRobFailを紹介する。
LabRobFail-Simは制御、物理、意味レベルで制御可能な障害を注入する。
LabRobFail-Benchは、タスク理解、障害検出、時間的ローカライゼーション、重大度評価、障害分類、動作可能な修正の6つの機能を評価する。
論文 参考訳(メタデータ) (2026-07-26T14:56:04Z) - Teaching LLMs to Self-Evolve: Cultivating Core Meta-Skills with Reinforcement Learning [51.17262419591891]
AlphaEvolveが示すように、環境フィードバックによる反復的自己進化によるテスト時間のスケーリングは、顕著なパフォーマンス向上を示している。
本稿では,データ合成パイプライン,進化対応強化学習,推論時進化探索によるメタスキル開発を目的としたMetaEvolveを提案する。
論文 参考訳(メタデータ) (2026-07-24T04:35:29Z) - OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation [71.57258488733974]
メモリは、自己進化エージェントの標準的な基盤になっているが、その経験を維持することは、それを通して進化する方法を学ぶことと同じではない。
OPD-Evolver(英語版)は、政策上の自己蒸留を通じて、そのようなエージェントを進化させる緩やかな共進化フレームワークである。
論文 参考訳(メタデータ) (2026-06-16T07:33:53Z) - AutoScientists: Self-Organizing Agent Teams for Long-Running Scientific Experimentation [28.790523063833376]
AutoScientistsは、長期的な計算科学実験のためのAIエージェントの分散チームである。
エージェントは共有された実験状態を解釈し、実験計算を使用する前に、有望な仮説、批判的な提案に関するチームに自己組織化する。
一致した実験予算の下で、AutoScientistsは、バイオメディカル機械学習、言語モデルトレーニング最適化、タンパク質の適合性予測など、AIエージェントを改良する。
論文 参考訳(メタデータ) (2026-05-27T15:56:12Z) - FLEX: Continuous Agent Evolution via Forward Learning from Experience [54.796367711967754]
大規模言語モデル(LLM)によって駆動される自律エージェントは、推論と問題解決に革命をもたらしたが、訓練後も静的のままである。
我々は,LLMエージェントが蓄積された経験を通して継続的に進化することを可能にする勾配のない学習パラダイムであるFLEX(Forward Learning with Experience)を紹介する。
論文 参考訳(メタデータ) (2025-11-09T16:31:39Z) - On Reward Shaping for Mobile Robot Navigation: A Reinforcement Learning
and SLAM Based Approach [7.488722678999039]
本研究では,未知環境下を走行する移動ロボットを対象とした,深層強化学習(DRL)に基づくマップレス経路計画アルゴリズムを提案する。
プランナーは、トレーニング環境の地図のオンライン知識に基づいて、報酬関数を用いて訓練される。
シミュレーション環境で訓練されたポリシーを直接、実際のロボットに転送し、成功させることができる。
論文 参考訳(メタデータ) (2020-02-10T22:00:16Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。