論文の概要: Architecture Is All You Need: Diversity-Enabled Sweet Spots for Robust Humanoid Locomotion
- arxiv url: http://arxiv.org/abs/2510.14947v2
- Date: Sun, 19 Oct 2025 01:29:01 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-10-25 00:56:38.697656
- Title: Architecture Is All You Need: Diversity-Enabled Sweet Spots for Robust Humanoid Locomotion
- Title(参考訳): 多様なスイートスポットでロバストなヒューマノイドロコモーションができるアーキテクチャ
- Abstract要約: 単純な層状制御アーキテクチャ(LCA)はモノリシックなエンド・ツー・エンドの設計よりもはるかに堅牢な性能を実現する。
結果として、ネットワークスケールや複雑性ではなく、時間スケールのアーキテクチャ的な分離が、ロバストな認識条件付きロコモーションの鍵となることが強調された。
- 参考スコア(独自算出の注目度): 20.41490560492412
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Robust humanoid locomotion in unstructured environments requires architectures that balance fast low-level stabilization with slower perceptual decision-making. We show that a simple layered control architecture (LCA), a proprioceptive stabilizer running at high rate, coupled with a compact low-rate perceptual policy, enables substantially more robust performance than monolithic end-to-end designs, even when using minimal perception encoders. Through a two-stage training curriculum (blind stabilizer pretraining followed by perceptual fine-tuning), we demonstrate that layered policies consistently outperform one-stage alternatives in both simulation and hardware. On a Unitree G1 humanoid, our approach succeeds across stair and ledge tasks where one-stage perceptual policies fail. These results highlight that architectural separation of timescales, rather than network scale or complexity, is the key enabler for robust perception-conditioned locomotion.
- Abstract(参考訳): 構造化されていない環境でのロバストなヒューマノイドの移動は、高速な低レベル安定化と知覚的意思決定の遅いバランスをとるアーキテクチャを必要とする。
最小の知覚エンコーダを用いた場合であっても,高速度で動作する簡易層状制御アーキテクチャ (LCA) とコンパクトな低レート知覚ポリシーが組み合わさって, モノリシックなエンド・ツー・エンドの設計よりもはるかに堅牢な性能を実現することを示す。
2段階のトレーニングカリキュラム(ブラインド・スタビライザーの事前訓練と知覚的微調整)を通じて、階層化されたポリシーがシミュレーションとハードウェアの両方において一段階の選択肢を一貫して上回っていることを示す。
ユニツリーG1ヒューマノイドでは、ステップをまたいだアプローチが成功し、1段階の知覚ポリシーが失敗する。
これらの結果は、ネットワークスケールや複雑性ではなく、時間スケールのアーキテクチャ的な分離が、ロバストな認識条件付き移動の鍵となることを浮き彫りにしている。
関連論文リスト
- Mind the Phase: Effective Rank and Representation Health in Legged Locomotion [0.7270112855088836]
我々はジャコビアン政策の効果的なランクを通して移動政策を研究する。
標準的なアーキテクチャの選択は、スタンスよりもスイングに有効なランクの約2つの次元を割り当てていることが分かりました。
実際には、これはシミュレーションから物理スポットに保持される約3倍低いジッタとなる。
論文 参考訳(メタデータ) (2026-09-07T02:56:28Z) - Dual Process Motion Planning [53.570848178455776]
頑健な推論と学習の強みを組み合わせたデュアルプロセスアーキテクチャを導入する。
我々のフレームワークは、経験駆動型System-1'モジュールでSystem-2'コンポーネントとして最先端のシンボルソルバを統合している。
論文 参考訳(メタデータ) (2026-09-01T13:52:12Z) - Mind Your Steps: A General Learning Framework for Accurate Humanoid Foothold Tracking [78.30338456206984]
本稿では,汎用3D足場追跡ポリシーをトレーニングするための新しいフレームワークを提案する。
本手法は, 目標検層による足場支援を動的に行うことにより, 学習方針を特定の地形に依存しないものにする。
我々の新しいターゲット表現は、雑音や不正確なポーズ推定や足の接触推定といった現実の課題を効果的に緩和する。
論文 参考訳(メタデータ) (2026-06-06T16:44:56Z) - Learning Reactive Dexterous Grasping via Hierarchical Task-Space RL Planning and Joint-Space QP Control [50.28263951510334]
本稿では,リアクティブなデクスタリーグルーピングのためのハイブリッド階層型制御フレームワークを提案する。
提案手法は,低レベル共同実行から高レベル空間意図を明示的に分離する。
我々は厳密なシミュレーションと現実のパイプラインを通して提案したフレームワークを広範囲に検証する。
論文 参考訳(メタデータ) (2026-05-05T04:49:38Z) - Reconciling distributed compliance with high-performance control in continuum soft robotics [5.559127468747317]
ハードウェアの離散化や剛性に基づくモード抑制を伴わない,高度に適合した完全連続型ロボットアームを提案する。
このプラットフォームは、直接駆動アクチュエータ、複合曲げおよびねじれを可能にする腱ルーティングスキーム、構造化された非線形制御アーキテクチャを統合している。
提案システムでは,ソフトロボットのタスク実行速度が最速である。
論文 参考訳(メタデータ) (2026-03-17T15:01:04Z) - ULTRA: Unified Multimodal Control for Autonomous Humanoid Whole-Body Loco-Manipulation [55.467742403416175]
本稿では,大規模モーションキャプチャをヒューマノイドに変換する物理駆動型ニューラルネットワークを提案する。
我々は高密度参照とスパースタスク仕様の両方をサポートする統合マルチモーダルコントローラを学習する。
その結果,ULTRAは自我中心の知覚から,自律的,目標条件付き全体ロコ操作に一般化することが示された。
論文 参考訳(メタデータ) (2026-03-03T18:59:29Z) - AIvilization v0: Toward Large-Scale Artificial Social Simulation with a Unified Agent Architecture and Adaptive Agent Profiles [15.355738327147558]
AIvilization v0は、リソース制限されたサンドボックス経済とLLMエージェントアーキテクチャを結合した、一般公開された大規模な人工社会である。
この環境は、生理的生存コスト、置換不可能な多層生産、AMMベースの価格体系、ゲート型教育占領システムを統合している。
我々は、鍵となるスタイル化された事実を再現し、教育やアクセス制限によって構築された富の成層化を生み出す安定した市場を見出した。
論文 参考訳(メタデータ) (2026-02-11T02:18:15Z) - PILOT: A Perceptive Integrated Low-level Controller for Loco-manipulation over Unstructured Scenes [18.916978556216097]
PILOTは知覚的ロコ操作に適した単段階強化学習フレームワークである。
知覚的な移動と1つのポリシー内での全身制御をシナジー化する。
PILOTは、既存のベースラインと比較して、安定性、コマンド追跡精度、地形トラバーサビリティが優れている。
論文 参考訳(メタデータ) (2026-01-24T12:25:20Z) - Structural Induced Exploration for Balanced and Scalable Multi-Robot Path Planning [6.823580643749891]
マルチロボット経路計画は、その複雑さと、ロボット間の公平なタスク割り当てとグローバル効率のバランスをとる必要があるため、基本的な課題である。
従来のSwarmインテリジェンス手法は、小さなインスタンスでは有効だが、しばしば早めに収束し、複雑な環境にスケールするのに苦労する。
アリコロニー最適化(ACO)の探索プロセスに構造先行を組み込んだ構造誘発探索フレームワークを提案する。
論文 参考訳(メタデータ) (2025-12-25T12:53:24Z) - Gait-Adaptive Perceptive Humanoid Locomotion with Real-Time Under-Base Terrain Reconstruction [86.53248703859718]
本研究では,地形認識,歩行制御,全身制御を一つの強化学習ポリシーにマージする知覚的移動フレームワークを提案する。
31-DoF、1.65mのヒューマノイドロボットによる実験は、シミュレーションと実世界の両方で堅牢な移動を実証している。
論文 参考訳(メタデータ) (2025-12-08T11:42:41Z) - Rethinking Autoregressive Models for Lossless Image Compression via Hierarchical Parallelism and Progressive Adaptation [75.58269386927076]
自己回帰(AR)モデルは、しばしば計算コストの禁止のために非現実的に除外される。
この研究は、階層的並列性とプログレッシブ適応に基づくフレームワークを導入して、このパラダイムを再考する。
各種データセット(自然,衛星,医療)の実験により,本手法が新たな最先端圧縮を実現することを確認した。
論文 参考訳(メタデータ) (2025-11-14T06:27:58Z) - ReCoM: Realistic Co-Speech Motion Generation with Recurrent Embedded Transformer [58.49950218437718]
音声に同期した高忠実で一般化可能な人体動作を生成するための効率的なフレームワークであるReCoMを提案する。
Recurrent Embedded Transformer (RET)は、動的埋め込み正規化(DER)をViT(Vit)コアアーキテクチャに統合する。
モデルロバスト性を高めるため,ノイズ抵抗とクロスドメイン一般化の二重性を持つモデルに,提案したDER戦略を取り入れた。
論文 参考訳(メタデータ) (2025-03-27T16:39:40Z) - CAIMAN: Causal Action Influence Detection for Sample-efficient Loco-manipulation [17.94272840532448]
我々は,ロボットが環境内の他のエンティティを制御できるようにする強化学習フレームワークであるCAIMANを提案する。
シミュレーションにおけるCAIMANの優れたサンプル効率と多様なシナリオへの適応性を実証的に実証した。
論文 参考訳(メタデータ) (2025-02-02T16:16:53Z) - STAMP: Scalable Task And Model-agnostic Collaborative Perception [24.890993164334766]
STAMPは、異種エージェントのためのタスクおよびモデルに依存しない協調認識パイプラインである。
計算オーバーヘッドを最小限に抑え、スケーラビリティを高め、モデルのセキュリティを維持する。
第一種フレームワークとしてSTAMPは,スケーラブルでセキュアなモビリティシステムの研究を,レベル5の自律性に向けて進めることを目指している。
論文 参考訳(メタデータ) (2025-01-24T16:27:28Z) - Robotic World Model: A Neural Network Simulator for Robust Policy Optimization in Robotics [50.191655141020505]
この研究は、長期水平予測、エラー蓄積、およびsim-to-real転送の課題に対処することで、モデルに基づく強化学習を前進させる。
スケーラブルでロバストなフレームワークを提供することで、現実のアプリケーションにおいて適応的で効率的なロボットシステムを実現することができる。
論文 参考訳(メタデータ) (2025-01-17T10:39:09Z) - DTC: Deep Tracking Control [16.2850135844455]
本研究では,両世界の強靭性,フット配置精度,地形の一般化を両世界の利点と組み合わせたハイブリッド制御アーキテクチャを提案する。
深層ニューラルネットワークポリシは、最適化された足場を追跡することを目的として、シミュレーションでトレーニングされている。
モデルベースに比べて滑りやすい地盤や変形可能な地盤が存在する場合の強靭性を示す。
論文 参考訳(メタデータ) (2023-09-27T07:57:37Z) - An Adaptive Fuzzy Reinforcement Learning Cooperative Approach for the
Autonomous Control of Flock Systems [4.961066282705832]
この研究は、群集システムの自律制御に適応的な分散ロバスト性技術を導入している。
比較的柔軟な構造は、様々な目的を同時に狙うオンラインファジィ強化学習スキームに基づいている。
動的障害に直面した場合のレジリエンスに加えて、アルゴリズムはフィードバック信号としてエージェントの位置以上のものを必要としない。
論文 参考訳(メタデータ) (2023-03-17T13:07:35Z) - Robust Single Image Dehazing Based on Consistent and Contrast-Assisted
Reconstruction [95.5735805072852]
画像復調モデルのロバスト性を改善するための新しい密度変分学習フレームワークを提案する。
具体的には、デハジングネットワークは、一貫性の規則化されたフレームワークの下で最適化されている。
我々の手法は最先端のアプローチを大きく上回っている。
論文 参考訳(メタデータ) (2022-03-29T08:11:04Z) - CM-NAS: Cross-Modality Neural Architecture Search for Visible-Infrared
Person Re-Identification [102.89434996930387]
VI-ReIDは、暗い環境での単一モダリティ人物ReIDの制限を突破し、クロスモダリティ歩行者のイメージを一致させることを目指しています。
既存の作品は、さまざまな2ストリームアーキテクチャを手動で設計して、モダリティ固有およびモダリティシャーブル表現を別々に学習する。
CM-NAS(Cross-Modality Neural Architecture Search)という手法を提案する。
論文 参考訳(メタデータ) (2021-01-21T07:07:00Z) - First Steps: Latent-Space Control with Semantic Constraints for
Quadruped Locomotion [73.37945453998134]
従来の四重化制御のアプローチでは、単純化された手作りのモデルが採用されている。
これにより、有効な運動範囲が縮小されているため、ロボットの能力が大幅に低下する。
この研究において、これらの課題は、構造化潜在空間における最適化として四重化制御をフレーミングすることによって解決される。
深い生成モデルは、実現可能な関節構成の統計的表現を捉え、一方、複雑な動的および終端的制約は高レベルな意味的指標によって表現される。
実世界とシミュレーションの両方で最適化された移動軌跡の実現可能性を検証する。
論文 参考訳(メタデータ) (2020-07-03T07:04:18Z) - Hierarchically Decoupled Imitation for Morphological Transfer [95.19299356298876]
形態学的に単純なエージェントから学習情報を転送することで、より複雑なエージェントのサンプル効率を大幅に向上させることができることを示す。
まず、より単純なエージェントの低レベルを模倣するために複雑なエージェントの低レベルをインセンティブ化すると、ゼロショット高レベル転送が大幅に改善されることを示す。
第2に,高レベルのKL正規化学習が学習を安定させ,モデム崩壊を防ぐことを示す。
論文 参考訳(メタデータ) (2020-03-03T18:56:49Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。