論文の概要: Pro-HOI: Perceptive Root-guided Humanoid-Object Interaction
- arxiv url: http://arxiv.org/abs/2603.01126v1
- Date: Sun, 01 Mar 2026 14:19:59 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-23 08:17:41.800545
- Title: Pro-HOI: Perceptive Root-guided Humanoid-Object Interaction
- Title(参考訳): Pro-HOI:知覚的根誘導型ヒューマノイドオブジェクトインタラクション
- Abstract要約: 本稿では,知覚根誘導型ヒューマノイドオブジェクトインタラクション,Pro-HOIを紹介する。
Pro-HOIは、堅牢なヒューマノイドロコ操作のための一般化可能なフレームワークである。
ユニツリーG1ロボットの実証検証は、Pro-HOIが一般化と堅牢性においてベースラインを著しく上回っていることを示す。
- 参考スコア(独自算出の注目度): 57.252599851031505
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Executing reliable Humanoid-Object Interaction (HOI) tasks for humanoid robots is hindered by the lack of generalized control interfaces and robust closed-loop perception mechanisms. In this work, we introduce Perceptive Root-guided Humanoid-Object Interaction, Pro-HOI, a generalizable framework for robust humanoid loco-manipulation. First, we collect box-carrying motions that are suitable for real-world deployment and optimize penetration artifacts through a Signed Distance Field loss. Second, we propose a novel training framework that conditions the policy on a desired root-trajectory while utilizing reference motion exclusively as a reward. This design not only eliminates the need for intricate reward tuning but also establishes root trajectory as a universal interface for high-level planners, enabling simultaneous navigation and loco-manipulation. Furthermore, to ensure operational reliability, we incorporate a persistent object estimation module. By fusing real-time detection with Digital Twin, this module allows the robot to autonomously detect slippage and trigger re-grasping maneuvers. Empirical validation on a Unitree G1 robot demonstrates that Pro-HOI significantly outperforms baselines in generalization and robustness, achieving reliable long-horizon execution in complex real-world scenarios.
- Abstract(参考訳): ヒューマノイドロボットのための信頼性の高いHumanoid-Object Interaction (HOI)タスクの実行は、汎用制御インタフェースの欠如と頑健な閉ループ認識機構の欠如によって妨げられる。
本研究では,頑健なヒューマノイド・ロコ・マニピュレーションのための汎用フレームワークであるPro-HOIを提案する。
まず,実世界の展開に適した箱積み動作を収集し,符号付き距離場損失による侵入アーティファクトの最適化を行う。
第2に、目的とするルート軌道のポリシーを規定し、参照運動を報酬としてのみ活用する新しいトレーニングフレームワークを提案する。
この設計は、複雑な報酬調整の必要性をなくすだけでなく、高レベルプランナーのためのユニバーサルインターフェースとしてルート軌道を確立し、同時にナビゲーションとロコ操作を可能にする。
さらに、運用上の信頼性を確保するため、永続的なオブジェクト推定モジュールを組み込む。
このモジュールはDigital Twinとリアルタイム検出を融合することによって、ロボットがスリップを自律的に検出し、再彫刻操作をトリガーする。
ユニツリーG1ロボットの実証検証では、Pro-HOIは一般化とロバスト性においてベースラインを著しく上回り、複雑な現実世界のシナリオにおいて信頼性の高いロングホライゾン実行を実現する。
関連論文リスト
- RGB-D Video Generation for Improving Human-to-Robot Object Handover Prediction [51.76737991200891]
H2R(Human-to-robot)オブジェクトハンドオーバは、人間とロボットのコラボレーションの基本的な能力である。
本稿では,RGB-DビデオデータセットであるHand2Botを紹介する。
ハンドオブジェクトの一貫性を確保しつつ,現実的なハンドオーバシーケンスを合成する生成パイプラインであるPassGenを提案する。
論文 参考訳(メタデータ) (2026-08-13T09:55:59Z) - VAIC: Vision-Guided Humanoid Agile Object Interaction Control via Decoupled Commands [56.029505206531155]
Vision Guided Agile Interaction Control (VAIC)は、現在のコントローラとヒューマノイドロボットのギャップを埋める統合フレームワークである。
まず、特権教師政策は、正確な物体運動学と正確な環境状態を用いて多様な相互作用スキルを習得する。
第二に、デプロイ可能な学生ポリシーは、全体追跡を複数の軸にまたがる速度目標に置き換えることで、これらの能力を蒸留する。
論文 参考訳(メタデータ) (2026-06-08T09:52:55Z) - ManipArena: Comprehensive Real-world Evaluation of Reasoning-Oriented Generalist Robot Manipulation [66.02142169323521]
Vision-Language-ActionモデルとWorld Modelは最近、汎用ロボットインテリジェンスのための有望なパラダイムとして登場した。
既存のベンチマークは、主にシミュレータ中心であり、制御性を提供するが、知覚ノイズによって引き起こされる現実のギャップを捉えることができない。
シミュレーションと実世界の実行を橋渡しする標準化された評価フレームワークであるManipArenaを紹介する。
論文 参考訳(メタデータ) (2026-03-30T15:06:41Z) - Dual-Agent Multiple-Model Reinforcement Learning for Event-Triggered Human-Robot Co-Adaptation in Decoupled Task Spaces [3.349003999623489]
本稿では,カスタム6自由度上肢ロボットのための共有制御型リハビリテーションポリシーを提案する。
患者は二進法で一次到達方向を制御し、ロボットは自律的に矯正動作を管理する。
論文 参考訳(メタデータ) (2026-03-06T11:15:10Z) - ULTRA: Unified Multimodal Control for Autonomous Humanoid Whole-Body Loco-Manipulation [55.467742403416175]
本稿では,大規模モーションキャプチャをヒューマノイドに変換する物理駆動型ニューラルネットワークを提案する。
我々は高密度参照とスパースタスク仕様の両方をサポートする統合マルチモーダルコントローラを学習する。
その結果,ULTRAは自我中心の知覚から,自律的,目標条件付き全体ロコ操作に一般化することが示された。
論文 参考訳(メタデータ) (2026-03-03T18:59:29Z) - PILOT: A Perceptive Integrated Low-level Controller for Loco-manipulation over Unstructured Scenes [18.916978556216097]
PILOTは知覚的ロコ操作に適した単段階強化学習フレームワークである。
知覚的な移動と1つのポリシー内での全身制御をシナジー化する。
PILOTは、既存のベースラインと比較して、安定性、コマンド追跡精度、地形トラバーサビリティが優れている。
論文 参考訳(メタデータ) (2026-01-24T12:25:20Z) - Hiking in the Wild: A Scalable Perceptive Parkour Framework for Humanoids [30.976354277907664]
textitHiking in the Wildは、堅牢なヒューマノイドハイキング用に設計された、スケーラブルでエンドツーエンドのパーサー知覚フレームワークだ。
提案手法では, 外部状態推定に頼ることなく, 単段階強化学習手法, 生深度入力, プロプレセプションを直接協調動作にマッピングする。
論文 参考訳(メタデータ) (2026-01-12T16:50:50Z) - A General Purpose Method for Robotic Interception of Non-Cooperative Dynamic Targets [0.0]
本稿では,動的,非協調的対象の自律的,視覚に基づくインターセプションのための汎用的枠組みを提案する。
このアプローチは、ターゲット追跡のためのフィデューシャルを備えた単眼カメラにのみ依存し、ローカルなオブザーバフレームで完全に動作する。
シミュレーションおよび物理実験の結果は、低いインターセプション誤差で堅牢な性能を示す。
論文 参考訳(メタデータ) (2025-12-23T21:14:03Z) - Sight Over Site: Perception-Aware Reinforcement Learning for Efficient Robotic Inspection [57.37596278863949]
本研究では,認識・認識の観点からの検査を再考する。
本稿では,目標視認性を主目的とするエンドツーエンド強化学習フレームワークを提案する。
提案手法は,既存の古典的および学習的ナビゲーション手法よりも優れていることを示す。
論文 参考訳(メタデータ) (2025-09-22T15:14:02Z) - HOSIG: Full-Body Human-Object-Scene Interaction Generation with Hierarchical Scene Perception [57.37135310143126]
HO SIGは階層的なシーン認識を通じて全体インタラクションを合成するための新しいフレームワークである。
我々のフレームワークは、自己回帰生成による運動長の無制限化をサポートし、手動による介入を最小限に抑える。
この研究は、シーン認識ナビゲーションとデクスタラスオブジェクト操作の間に重要なギャップを埋める。
論文 参考訳(メタデータ) (2025-06-02T12:08:08Z) - GISR: Geometric Initialization and Silhouette-based Refinement for Single-View Robot Pose and Configuration Estimation [0.0]
GISRは、リアルタイムで実行を優先順位付けするロボット対カメラのポーズ推定手法である。
我々は,GISRを公開データ上で評価し,その性能と精度の両面で,同一クラスの既存手法よりも優れていることを示す。
論文 参考訳(メタデータ) (2024-05-08T08:39:25Z) - Goal-driven Self-Attentive Recurrent Networks for Trajectory Prediction [31.02081143697431]
人間の軌道予測は、自動運転車、社会認識ロボット、およびビデオ監視アプリケーションの主要な構成要素である。
本稿では,過去の観測位置のみに作用する軽量な注意型リカレントバックボーンを提案する。
我々はU-Netアーキテクチャに基づく共通のゴールモジュールを使用し、シーン準拠の目的地を予測するために意味情報を抽出する。
論文 参考訳(メタデータ) (2022-04-25T11:12:37Z) - Nonprehensile Riemannian Motion Predictive Control [57.295751294224765]
本稿では,リアル・ツー・シムの報酬分析手法を導入し,リアルなロボット・プラットフォームに対する行動の可能性を確実に予測する。
連続的なアクション空間でオブジェクトを反応的にプッシュするクローズドループコントローラを作成します。
我々は,RMPCが乱雑な環境だけでなく,乱雑な環境においても頑健であり,ベースラインよりも優れていることを観察した。
論文 参考訳(メタデータ) (2021-11-15T18:50:04Z) - SABER: Data-Driven Motion Planner for Autonomously Navigating
Heterogeneous Robots [112.2491765424719]
我々は、データ駆動型アプローチを用いて、異種ロボットチームをグローバルな目標に向けてナビゲートする、エンドツーエンドのオンラインモーションプランニングフレームワークを提案する。
モデル予測制御(SMPC)を用いて,ロボット力学を満たす制御入力を計算し,障害物回避時の不確実性を考慮した。
リカレントニューラルネットワークは、SMPC有限時間地平線解における将来の状態の不確かさを素早く推定するために用いられる。
ディープQ学習エージェントがハイレベルパスプランナーとして機能し、SMPCにロボットを望ましいグローバルな目標に向けて移動させる目標位置を提供する。
論文 参考訳(メタデータ) (2021-08-03T02:56:21Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。