論文の概要: Safe Whole-Body Loco-Manipulation via Combined Model and Learning-based Control
- arxiv url: http://arxiv.org/abs/2603.02443v1
- Date: Mon, 02 Mar 2026 22:31:12 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-23 08:17:41.835737
- Title: Safe Whole-Body Loco-Manipulation via Combined Model and Learning-based Control
- Title(参考訳): モデルと学習ベース制御による安全な全体ロコマニピュレーション
- Abstract要約: そこで本研究では,マニピュレータアームのモデルベースアプタンス制御と足歩行の強化学習ポリシを組み合わせた全身制御を提案する。
アクセタンスコントローラは、物理的相互作用中に人間によって適用されるような外部レンチを、望ましいエンドエフェクタ速度にマッピングし、従順な振る舞いを可能にする。
6-DoFアームと手首に装着した6-DoF Force/Torqueセンサーを備えたUnitree Go2四足歩行ロボットを用いて,シミュレーションとハードウェアの両方におけるアプローチを検証する。
- 参考スコア(独自算出の注目度): 46.47619556874003
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Simultaneous locomotion and manipulation enables robots to interact with their environment beyond the constraints of a fixed base. However, coordinating legged locomotion with arm manipulation, while considering safety and compliance during contact interaction remains challenging. To this end, we propose a whole-body controller that combines a model-based admittance control for the manipulator arm with a Reinforcement Learning (RL) policy for legged locomotion. The admittance controller maps external wrenches--such as those applied by a human during physical interaction--into desired end-effector velocities, allowing for compliant behavior. The velocities are tracked jointly by the arm and leg controllers, enabling a unified 6-DoF force response. The model-based design permits accurate force control and safety guarantees via a Reference Governor (RG), while robustness is further improved by a Kalman filter enhanced with neural networks for reliable base velocity estimation. We validate our approach in both simulation and hardware using the Unitree Go2 quadruped robot with a 6-DoF arm and wrist-mounted 6-DoF Force/Torque sensor. Results demonstrate accurate tracking of interaction-driven velocities, compliant behavior, and safe, reliable performance in dynamic settings.
- Abstract(参考訳): 移動と操作を同時に行うことで、ロボットは固定基盤の制約を越えて環境と対話することができる。
しかし, 接触時の安全性やコンプライアンスを考慮しつつ, 腕操作による足の移動の調整はいまだに困難である。
そこで本研究では,マニピュレータアームのモデルベースアプタンス制御と足歩行のための強化学習(RL)ポリシーを組み合わせた全身コントローラを提案する。
アクセタンスコントローラは、物理的相互作用中に人間によって適用されるような外部レンチを、望ましいエンドエフェクタ速度にマッピングし、従順な振る舞いを可能にする。
速度はアームと脚のコントローラーによって共同で追跡され、統合された6-DoFの力応答が可能である。
モデルベースの設計では、参照ガバナ(RG)を介して正確な力制御と安全性を保証すると同時に、信頼性の高いベース速度推定のためにニューラルネットワークで強化されたカルマンフィルタにより、ロバスト性をさらに向上する。
6-DoFアームと手首に装着した6-DoF Force/Torqueセンサーを備えたUnitree Go2四足歩行ロボットを用いて,シミュレーションとハードウェアの両方におけるアプローチを検証する。
その結果、動的環境下での相互作用駆動速度、コンプライアンス行動、安全で信頼性の高い性能の正確な追跡が示された。
関連論文リスト
- Force-Aware Reinforcement Learning with Hybrid Sensorless Force Estimation for Wheeled-Legged Loco-Manipulation [14.501012360823886]
力制御されたロコ操作は、移動と腕の動きを協調する全身ポリシーを必要とする。
本報告では,車輪付きレッグ式ロコマニピュレーションのためのハイブリッドセンサレス力推定を用いた力覚強化学習手法を提案する。
論文 参考訳(メタデータ) (2026-09-12T07:46:53Z) - TAC-LOCO: Unified Whole-Body Control for Quadrupedal TACtile-Informed LOCO-Manipulation [13.785492911693098]
動的ロコ操作では、不確実な外力下での把握された物体との安定した物理的相互作用を維持しながら、脚のあるロボットが全身の動きを調整する必要がある。
触覚を付加した統合強化学習フレームワークであるTAC-LOCOを提案する。
We deploy the policy zero-shot on a Unitree Go2 with an Interbotix WidowX 250 arm and tactile gripper, showed dynamic tactile-informed loco-manipulation under various external interaction。
論文 参考訳(メタデータ) (2026-07-11T05:45:24Z) - Closing the Reality Gap: Zero-Shot Sim-to-Real Deployment for Dexterous Force-Based Grasping and Manipulation [17.63466252699545]
人間のような器用な手は人間レベルの操作機能を提供するが、実際のハードウェアにデプロイできるコントロールポリシーを訓練することは困難である。
本稿では,高密度触覚フィードバックと関節トルクセンサを併用したシミュレート・トゥ・リアル強化学習法を提案する。
これは、シミュレーションで完全に訓練され、実際のハードウェア上でゼロショットを転送するマルチフィンガーデキスタラスハンドにおける制御可能なグリップの初めてのデモンストレーションである。
論文 参考訳(メタデータ) (2026-07-06T11:15:36Z) - ULTRA: Unified Multimodal Control for Autonomous Humanoid Whole-Body Loco-Manipulation [55.467742403416175]
本稿では,大規模モーションキャプチャをヒューマノイドに変換する物理駆動型ニューラルネットワークを提案する。
我々は高密度参照とスパースタスク仕様の両方をサポートする統合マルチモーダルコントローラを学習する。
その結果,ULTRAは自我中心の知覚から,自律的,目標条件付き全体ロコ操作に一般化することが示された。
論文 参考訳(メタデータ) (2026-03-03T18:59:29Z) - UniForce: A Unified Latent Force Model for Robot Manipulation with Diverse Tactile Sensors [51.88112610411651]
そこで本研究では,多様な触覚センサにまたがる共用潜在力空間を学習する,新しい統合された触覚表現学習フレームワークを提案する。
UniForceは、逆ダイナミクス(image-to-force)とフォワードダイナミクス(force-to-image)を共同モデリングすることで、クロスセンサー領域シフトを低減する
高価な外部力/トルクセンサ(F/T)への依存を避けるため,静的平衡を利用して直接センサ・オブジェクト・センサ・インタラクションを介して力対効果データを収集する。
論文 参考訳(メタデータ) (2026-02-01T11:03:01Z) - Closing the Reality Gap: Zero-Shot Sim-to-Real Deployment for Dexterous Force-Based Grasping and Manipulation [12.509181374985936]
複数の指を持つ人間のような器用な手は、人間レベルの操作機能を提供する。
しかし、実際のハードウェアに直接デプロイ可能なトレーニングコントロールポリシは、コンタクトリッチな物理のため、依然として難しいままです。
本稿では,高密度触覚フィードバックと関節トルクセンシングを併用して身体的相互作用を調節する実践的枠組みを提案する。
論文 参考訳(メタデータ) (2026-01-06T07:26:39Z) - CHIP: Adaptive Compliance for Humanoid Control through Hindsight Perturbation [70.5382178207975]
hIsight Perturbation (CHIP)は、制御可能なエンドエフェクタ剛性を実現するプラグイン・アンド・プレイモジュールである。
CHIPの実装は簡単で、データ拡張も追加の報酬チューニングも必要ありません。
そこで本研究では,CHIPでトレーニングした汎用モーショントラッキングコントローラが,多種多様な操作タスクを実行できることを示す。
論文 参考訳(メタデータ) (2025-12-16T18:56:04Z) - FACET: Force-Adaptive Control via Impedance Reference Tracking for Legged Robots [23.645867340878574]
インピーダンス参照追跡(FACET)を用いたemphForce-Adaptive Controlを提案する。
インピーダンス制御にインスパイアされた我々は、RLを使って制御ポリシーを訓練し、仮想的な質量ばね減衰系を模倣する。
シミュレーションでは、我々の四足歩行ロボットが大きな衝動に対して堅牢性を向上し、制御可能なコンプライアンスを示すことを示す。
論文 参考訳(メタデータ) (2025-05-11T07:23:26Z) - Reinforcement Learning for Versatile, Dynamic, and Robust Bipedal Locomotion Control [106.32794844077534]
本稿では,二足歩行ロボットのための動的移動制御系を構築するために,深層強化学習を用いた研究について述べる。
本研究では、周期歩行やランニングから周期ジャンプや立位に至るまで、様々な動的二足歩行技術に使用できる汎用的な制御ソリューションを開発する。
この研究は、二足歩行ロボットの俊敏性の限界を、現実世界での広範な実験を通じて押し上げる。
論文 参考訳(メタデータ) (2024-01-30T10:48:43Z) - Kinematically-Decoupled Impedance Control for Fast Object Visual
Servoing and Grasping on Quadruped Manipulators [18.279073092727025]
本稿では,分離アームキネマティックチェーンとインピーダンス制御に基づいて,オブジェクトのSAG(Searching, Approaching, Grasping)の制御パイプラインを提案する。
キネマティックデカップリングは、高速なエンドエフェクター運動と回復を可能にし、堅牢な視覚サーボに繋がる。
7-DoFマニピュレータアームを搭載した140kgのHyQReal四足歩行ロボットにおいて,提案手法の性能とロバスト性を実証した。
論文 参考訳(メタデータ) (2023-07-10T21:51:06Z) - Reinforcement Learning for Robust Parameterized Locomotion Control of
Bipedal Robots [121.42930679076574]
シミュレーションにおけるロコモーションポリシをトレーニングするためのモデルフリー強化学習フレームワークを提案する。
ドメインランダム化は、システムダイナミクスのバリエーションにまたがる堅牢な振る舞いを学ぶためのポリシーを奨励するために使用されます。
本研究では、目標歩行速度、歩行高さ、旋回ヨーなどの多目的歩行行動について示す。
論文 参考訳(メタデータ) (2021-03-26T07:14:01Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。