Fugu-MT 論文翻訳(概要): Crossing The Gap: A Deep Dive into Zero-Shot Sim-to-Real Transfer for Dynamics

論文の概要: Crossing The Gap: A Deep Dive into Zero-Shot Sim-to-Real Transfer for Dynamics

arxiv url: http://arxiv.org/abs/2008.06686v1
Date: Sat, 15 Aug 2020 09:14:42 GMT
ステータス: 翻訳完了
システム内更新日: 2022-10-28 21:09:54.458626
Title: Crossing The Gap: A Deep Dive into Zero-Shot Sim-to-Real Transfer for Dynamics
Title（参考訳）: ギャップを横切る: ダイナミクスのためのゼロショットシミュレートトランスファーへのディープダイブ
Authors: Eugene Valassakis, Zihan Ding and Edward Johns
Abstract要約: 複雑なダイナミクスを持つタスクのシミュレートから現実への移行は、非常に困難で未解決な問題である。近年、多くの解決策が提案されているが、多くの研究が現実世界で徹底的な評価をしていない。そこで本研究では,現実のタスクにまたがる多数のトランスファー手法の客観的評価について述べる。
参考スコア（独自算出の注目度）: 18.020837663286425
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Abstract: Zero-shot sim-to-real transfer of tasks with complex dynamics is a highly challenging and unsolved problem. A number of solutions have been proposed in recent years, but we have found that many works do not present a thorough evaluation in the real world, or underplay the significant engineering effort and task-specific fine tuning that is required to achieve the published results. In this paper, we dive deeper into the sim-to-real transfer challenge, investigate why this is such a difficult problem, and present objective evaluations of a number of transfer methods across a range of real-world tasks. Surprisingly, we found that a method which simply injects random forces into the simulation performs just as well as more complex methods, such as those which randomise the simulator's dynamics parameters, or adapt a policy online using recurrent network architectures.
Abstract（参考訳）: 複雑なダイナミクスを持つタスクのゼロショットシミュレートは、非常に困難で未解決な問題である。近年,多くの手法が提案されているが,多くの研究が実世界において徹底的な評価を行なわず,また,成果の達成に必要な重要な工学的努力やタスク固有の微調整を過小評価している。本稿では,シム・トゥ・リアル・トランスファーの課題を深く掘り下げ,これがなぜ難しい問題なのかを考察し,現実のタスクにまたがる多数のトランスファー手法の客観的評価を提案する。意外なことに、シミュレーションにランダムな力を注入するだけで、シミュレータの動的パラメータをランダム化したり、リカレントネットワークアーキテクチャを使ってオンラインにポリシーを適用するような、より複雑な手法が実現できることがわかった。

関連論文リスト

MultiGen: Using Multimodal Generation in Simulation to Learn Multimodal Policies in Real [128.7629907902049]
MultiGenは、大規模な生成モデルを従来の物理シミュレータに統合するフレームワークである。容器や液体を注ぐ現実世界への効果的なゼロショット転送を実証する。
論文参考訳（メタデータ） (2025-07-03T17:59:58Z)
From Abstraction to Reality: DARPA's Vision for Robust Sim-to-Real Autonomy [6.402441477393285]
TIAMATは、動的および複雑な環境にまたがる自律技術の迅速かつ堅牢な移行に取り組むことを目的としている。現在のシミュレート・トゥ・リアル(シミュレート・トゥ・リアル)転送の方法は、しばしば高忠実度シミュレーションに依存している。 TIAMATのアプローチは、効果的かつ迅速な現実世界適応のための抽象的から現実的移行を実現することを目的としている。
論文参考訳（メタデータ） (2025-03-14T02:06:10Z)
An Real-Sim-Real (RSR) Loop Framework for Generalizable Robotic Policy Transfer with Differentiable Simulation [13.15220962477623]
本稿では,シミュレーションと実環境のギャップを解消する新しいリアルタイムループフレームワークを提案する。我々の研究の重要な貢献は、多様で代表的な実世界のデータの収集を促進する情報的コスト関数の設計である。我々のアプローチは多機能なMJXプラットフォーム上で実装されており、我々のフレームワークは幅広いロボットシステムと互換性がある。
論文参考訳（メタデータ） (2025-03-13T07:27:05Z)
LoopSR: Looping Sim-and-Real for Lifelong Policy Adaptation of Legged Robots [20.715834172041763]
本稿では,生涯にわたるポリシー適応フレームワークであるLoopSRを提案する。さらなる改善のためにシミュレーションで現実世界の環境を再構築する。継続的なトレーニングを活用することで、LoopSRは強力なベースラインに比べて優れたデータ効率を達成する。
論文参考訳（メタデータ） (2024-09-26T16:02:25Z)
Sim-to-Real Transfer of Deep Reinforcement Learning Agents for Online Coverage Path Planning [22.077058792635313]
被覆経路計画は、制限された地域の自由空間全体をカバーする経路を見つける問題である。本稿では,この課題に対する連続空間強化学習の有効性について検討する。提案手法は従来のRLに基づく手法と高度に専門化された手法の両方の性能を上回ることを示す。
論文参考訳（メタデータ） (2024-06-07T13:24:19Z)
DrEureka: Language Model Guided Sim-To-Real Transfer [64.14314476811806]
シミュレーションで学んだ政策を現実世界に伝達することは、ロボットのスキルを大規模に獲得する上で有望な戦略である。本稿では,Large Language Models (LLMs) を用いてシム・トゥ・リアル設計の自動化と高速化を行う。本手法では,ヨガボールの上を歩行する四足歩行や四足歩行など,新しいロボットタスクを解くことができる。
論文参考訳（メタデータ） (2024-06-04T04:53:05Z)
Endogenous Macrodynamics in Algorithmic Recourse [52.87956177581998]
対実説明(CE)とアルゴリズム・リコース(AR)に関する既存の研究は、静的環境における個人に主に焦点を当ててきた。既存の方法論の多くは、一般化されたフレームワークによってまとめて記述できることを示す。次に、既存のフレームワークは、グループレベルでの言論の内在的ダイナミクスを研究する際にのみ明らかとなるような、隠された対外的関係のコストを考慮に入れていないと論じる。
論文参考訳（メタデータ） (2023-08-16T07:36:58Z)
Provable Sim-to-real Transfer in Continuous Domain with Partial Observations [39.18274543757048]
シン・トゥ・リアル・トランスファー(英語版)は、シミュレーション環境でRLエージェントを訓練し、実世界で展開する。実環境における最適政策と競合するシミュレートされた環境から、人気のある頑健な対人訓練アルゴリズムが、ポリシーを学習できることを示す。
論文参考訳（メタデータ） (2022-10-27T16:37:52Z)
Understanding Domain Randomization for Sim-to-real Transfer [41.33483293243257]
本稿では,シミュレータを調整可能なパラメータを持つMDPの集合としてモデル化する,sim-to-realトランスファーの理論的枠組みを提案する。実世界のトレーニングサンプルを使わずに, 穏やかな条件下で, sim-to-realトランスファーが成功できることを実証する。
論文参考訳（メタデータ） (2021-10-07T07:45:59Z)
Multi-intersection Traffic Optimisation: A Benchmark Dataset and a Strong Baseline [85.9210953301628]
交通信号の制御は、都市部の交通渋滞の緩和に必要不可欠である。問題モデリングの複雑さが高いため、現在の作業の実験的な設定はしばしば矛盾する。エンコーダ・デコーダ構造を用いた深層強化学習に基づく新規で強力なベースラインモデルを提案する。
論文参考訳（メタデータ） (2021-01-24T03:55:39Z)
Reactive Long Horizon Task Execution via Visual Skill and Precondition Models [59.76233967614774]
シミュレーションで学習したモデルを用いて、単純なタスクプランナの構成要素をグラウンド化することで、見知らぬロボットタスクを達成できるシミュレート・トゥ・リアル・トレーニングのアプローチについて述べる。シミュレーションでは91.6%から98%,実世界の成功率は10%から80%に増加した。
論文参考訳（メタデータ） (2020-11-17T15:24:01Z)
Point Cloud Based Reinforcement Learning for Sim-to-Real and Partial Observability in Visual Navigation [62.22058066456076]
強化学習(Reinforcement Learning, RL)は、複雑なロボットタスクを解決する強力なツールである。 RL は sim-to-real transfer problem として知られる現実世界では直接作用しない。本稿では,点雲と環境ランダム化によって構築された観測空間を学習する手法を提案する。
論文参考訳（メタデータ） (2020-07-27T17:46:59Z)
From Simulation to Real World Maneuver Execution using Deep Reinforcement Learning [69.23334811890919]
深層強化学習(Deep Reinforcement Learning)は、さまざまな分野における多くの制御タスクを解決できることが証明されている。これは主に、シミュレーションデータと実世界のデータ間のドメイン適応の欠如と、トレインデータセットとテストデータセットの区別の欠如による。本稿では,エージェントが同時に訓練される複数の環境に基づくシステムを提案する。
論文参考訳（メタデータ） (2020-05-13T14:22:20Z)
Sim-to-Real Transfer with Incremental Environment Complexity for Reinforcement Learning of Depth-Based Robot Navigation [1.290382979353427]
段階的環境複雑性を用いたソフト・アクター・クリティカル(SAC)トレーニング戦略を提案し,実世界における追加トレーニングの必要性を大幅に低減した。アプリケーションは深度に基づくマップレスナビゲーションで、移動ロボットは、事前のマッピング情報なしで、散らかった環境で所定の経路点に到達すべきである。
論文参考訳（メタデータ） (2020-04-30T10:47:02Z)
Zero-Shot Reinforcement Learning with Deep Attention Convolutional Neural Networks [12.282277258055542]
本研究では、特定の視覚センサ構成を持つ深層注意畳み込みニューラルネットワーク(DACNN)が、より低い計算複雑性で高いドメインとパラメータの変動を持つデータセット上でトレーニングを行うことを示す。我々の新しいアーキテクチャは、制御対象に対する認識に適応し、知覚ネットワークを事前訓練することなくゼロショット学習を実現する。
論文参考訳（メタデータ） (2020-01-02T19:41:58Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。

指定された論文の情報です。
本サイトの運営者は本サイト（すべての情報・翻訳含む）の品質を保証せず、本サイト（すべての情報・翻訳含む）を使用して発生したあらゆる結果について一切の責任を負いません。