論文の概要: Scenario-Assisted Deep Reinforcement Learning
- arxiv url: http://arxiv.org/abs/2202.04337v1
- Date: Wed, 9 Feb 2022 08:46:13 GMT
- ステータス: 処理完了
- システム内更新日: 2022-02-10 16:32:52.946308
- Title: Scenario-Assisted Deep Reinforcement Learning
- Title(参考訳): シナリオ支援型深層強化学習
- Authors: Raz Yerushalmi, Guy Amir, Achiya Elyasaf, David Harel, Guy Katz and
Assaf Marron
- Abstract要約: 本稿では,強化学習訓練プロセスの強化手法を提案する。
これにより、人間のエンジニアは、専門家の知識を直接貢献することができ、訓練中のエージェントが関連する制約に従う可能性が高まる。
本手法は,インターネット混雑制御領域のケーススタディを用いて評価する。
- 参考スコア(独自算出の注目度): 3.5036351567024275
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Deep reinforcement learning has proven remarkably useful in training agents
from unstructured data. However, the opacity of the produced agents makes it
difficult to ensure that they adhere to various requirements posed by human
engineers. In this work-in-progress report, we propose a technique for
enhancing the reinforcement learning training process (specifically, its reward
calculation), in a way that allows human engineers to directly contribute their
expert knowledge, making the agent under training more likely to comply with
various relevant constraints. Moreover, our proposed approach allows
formulating these constraints using advanced model engineering techniques, such
as scenario-based modeling. This mix of black-box learning-based tools with
classical modeling approaches could produce systems that are effective and
efficient, but are also more transparent and maintainable. We evaluated our
technique using a case-study from the domain of internet congestion control,
obtaining promising results.
- Abstract(参考訳): 深層強化学習は非構造化データからエージェントを訓練するのに非常に有用である。
しかし、製造されたエージェントの不透明さのため、人間のエンジニアが要求するさまざまな要件に確実に準拠することは困難である。
本報告では,強化学習訓練プロセス(特に報奨計算)の強化手法を提案する。これにより,人間技術者が専門家の知識に直接貢献できるようになり,訓練中のエージェントが様々な制約を満たす可能性が高まる。
さらに,シナリオベースモデリングなどの高度なモデル工学手法を用いて,これらの制約を定式化する手法を提案する。
このブラックボックス学習ベースのツールと古典的なモデリングアプローチを組み合わせることで、効率的で効率的なシステムを生み出すことができるが、透明性と保守性も向上する。
提案手法は,インターネット混雑制御領域のケーススタディを用いて評価し,有望な結果を得た。
関連論文リスト
- Training Neural Networks with Internal State, Unconstrained
Connectivity, and Discrete Activations [66.53734987585244]
真のインテリジェンスには、内部状態を管理するマシンラーニングモデルが必要だ。
このようなモデルのトレーニングに最も効果的なアルゴリズムは,まだ発見されていない。
このようなトレーニングアルゴリズムを2進アクティベーションと1つの重みの行列のみを持つアーキテクチャに適用する試みについて述べる。
論文 参考訳(メタデータ) (2023-12-22T01:19:08Z) - RLIF: Interactive Imitation Learning as Reinforcement Learning [61.14928315004026]
オフ・ポリティクス強化学習は、インタラクティブな模倣学習よりも近いが、潜在的にさらに実践的な仮定の下で、パフォーマンスを向上させることができる。
提案手法は,ユーザ介入信号を用いた強化学習を報奨として利用する。
このことは、インタラクティブな模倣学習において介入する専門家がほぼ最適であるべきだという仮定を緩和し、アルゴリズムが潜在的に最適でない人間の専門家よりも改善される行動を学ぶことを可能にする。
論文 参考訳(メタデータ) (2023-11-21T21:05:21Z) - Tactile Active Inference Reinforcement Learning for Efficient Robotic
Manipulation Skill Acquisition [10.072992621244042]
触覚能動推論強化学習(Tactile Active Inference Reinforcement Learning, Tactile-AIRL)と呼ばれるロボット操作におけるスキル学習手法を提案する。
強化学習(RL)の性能を高めるために,モデルに基づく手法と本質的な好奇心をRLプロセスに統合した能動推論を導入する。
本研究では,タスクをプッシュする非包括的オブジェクトにおいて,学習効率が著しく向上することが実証された。
論文 参考訳(メタデータ) (2023-11-19T10:19:22Z) - Self-Destructing Models: Increasing the Costs of Harmful Dual Uses of
Foundation Models [103.71308117592963]
本稿ではメタラーニングと逆学習の技法を活用した自己破壊モデルの学習アルゴリズムを提案する。
小規模な実験では、MLACは、BERTスタイルのモデルが性別識別を行うために再目的化されることをほとんど防ぐことができることを示す。
論文 参考訳(メタデータ) (2022-11-27T21:43:45Z) - Implicit Offline Reinforcement Learning via Supervised Learning [83.8241505499762]
監視学習によるオフライン強化学習(RL)は、さまざまな専門レベルのポリシーによって収集されたデータセットからロボットスキルを学ぶための、シンプルで効果的な方法である。
我々は、暗黙的なモデルが返却情報を利用して、固定されたデータセットからロボットスキルを取得するために、明示的なアルゴリズムにマッチするか、あるいは性能を向上するかを示す。
論文 参考訳(メタデータ) (2022-10-21T21:59:42Z) - Constrained Reinforcement Learning for Robotics via Scenario-Based
Programming [64.07167316957533]
DRLをベースとしたエージェントの性能を最適化し,その動作を保証することが重要である。
本稿では,ドメイン知識を制約付きDRLトレーニングループに組み込む新しい手法を提案する。
我々の実験は、専門家の知識を活用するために我々のアプローチを用いることで、エージェントの安全性と性能が劇的に向上することを示した。
論文 参考訳(メタデータ) (2022-06-20T07:19:38Z) - Rethinking Learning Dynamics in RL using Adversarial Networks [79.56118674435844]
本稿では,スキル埋め込み空間を通じてパラメータ化された,密接に関連するスキルの強化学習のための学習機構を提案する。
本研究の主な貢献は、エントロピー規則化政策勾配定式化の助けを借りて、強化学習のための敵の訓練体制を定式化することである。
論文 参考訳(メタデータ) (2022-01-27T19:51:09Z) - Maximum Entropy Model-based Reinforcement Learning [0.0]
この研究は、探索技術とモデルに基づく強化学習を結びつけている。
モデルベースアプローチの特徴を考慮した新しい探索手法を考案した。
また,本手法がモデルベースアルゴリズムDreamerの性能を大幅に向上させることを示す。
論文 参考訳(メタデータ) (2021-12-02T13:07:29Z) - Constrained-Space Optimization and Reinforcement Learning for Complex
Tasks [42.648636742651185]
Demonstrationからの学習は、オペレータ操作スキルをロボットに転送するためにますます利用されている。
本稿では,複雑なタスクを管理するための制約付き空間最適化と強化学習手法を提案する。
論文 参考訳(メタデータ) (2020-04-01T21:50:11Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。