論文の概要: UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning
- arxiv url: http://arxiv.org/abs/2602.00566v1
- Date: Sat, 31 Jan 2026 07:12:26 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-30 05:16:56.305046
- Title: UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning
- Title(参考訳): UniMotion: シミュレーション、予測、計画のための統一モーションフレームワーク
- Abstract要約: 動作タスク間の共有構造をキャプチャする統合モーションフレームワークUniMotionを提案する。
UniMotionは、これらの動作タスクを同時にサポートするために、専用のインタラクションモードと調整されたトレーニング戦略を採用している。
さらなる微調整により、UniMotionはさまざまな動作タスクにおける最先端のパフォーマンスを達成し、自動運転のための汎用的でスケーラブルなソリューションとして確立する。
- 参考スコア(独自算出の注目度): 60.55873455475112
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Motion simulation, prediction and planning are foundational tasks in autonomous driving, each essential for modeling and reasoning about dynamic traffic scenarios. While often addressed in isolation due to their differing objectives, such as generating diverse motion states or estimating optimal trajectories, these tasks inherently depend on shared capabilities: understanding multi-agent interactions, modeling motion behaviors, and reasoning over temporal and spatial dynamics. Despite this underlying commonality, existing approaches typically adopt specialized model designs, which hinders cross-task generalization and system scalability. More critically, this separation overlooks the potential mutual benefits among tasks. Motivated by these observations, we propose UniMotion, a unified motion framework that captures shared structures across motion tasks while accommodating their individual requirements. Built on a decoder-only Transformer architecture, UniMotion employs dedicated interaction modes and tailored training strategies to simultaneously support these motion tasks. This unified design not only enables joint optimization and representation sharing but also allows for targeted fine-tuning to specialize in individual tasks when needed. Extensive experiments on the Waymo Open Motion Dataset demonstrate that joint training leads to robust generalization and effective task integration. With further fine-tuning, UniMotion achieves state-of-the-art performance across a range of motion tasks, establishing it as a versatile and scalable solution for autonomous driving.
- Abstract(参考訳): 運動シミュレーション、予測、計画は自律運転の基本課題であり、それぞれが動的交通シナリオのモデル化と推論に不可欠である。
多様な運動状態の生成や最適軌道の推定など、異なる目的のために、しばしば分離して対処されるが、これらのタスクは本質的には、多エージェント相互作用の理解、動作のモデル化、時間的および空間的ダイナミクスの推論といった共有機能に依存する。
この基本的な共通性にもかかわらず、既存のアプローチは一般的に、クロスタスクの一般化とシステムのスケーラビリティを妨げる特別なモデル設計を採用する。
より重要なことに、この分離はタスク間の潜在的な相互利益を見落としている。
これらの観測によって動機づけられたUniMotionは、個々の要求を調節しながら、動作タスク間の共有構造をキャプチャする統合モーションフレームワークである。
UniMotionはデコーダのみのTransformerアーキテクチャ上に構築されており、専用の対話モードとトレーニング戦略を採用して、これらの動作タスクを同時にサポートしている。
この統合された設計は、共同最適化と表現共有を可能にするだけでなく、必要に応じて個別のタスクを専門化するための微調整も可能にしている。
Waymo Open Motion Datasetに関する大規模な実験は、共同トレーニングが堅牢な一般化と効果的なタスク統合につながることを実証している。
さらなる微調整により、UniMotionはさまざまな動作タスクにおける最先端のパフォーマンスを達成し、自動運転のための汎用的でスケーラブルなソリューションとして確立する。
関連論文リスト
- Dynamics-Aware Meta-Imitation for Generalization to Unseen Robotic Manipulation [17.382238044141783]
本稿では,ロボットのデモンストレーションからスキルを学ぶためのフレームワークを提案する。
メタラーニングを統合して共有スキルスペースを構築することで、DAMIは新しいタスクに迅速に適応するためのエージェントを提供する。
我々の手法は、目に見えるタスクの直接推論と目に見えないタスクへの適応に関して、最先端のベースラインより優れています。
論文 参考訳(メタデータ) (2026-07-17T11:50:03Z) - M3imic: Learning a Versatile Whole-Body Controller for Multimodal Motion Mimicking [45.636871702422134]
Multi-Modal Mimicはヒューマノイドロボットのための汎用的な全身制御フレームワークである。
ロボットの関節角度、人間のポーズ軌跡、エンドエフェクターのポーズなど、異種動作参照モードを統一する。
モダリティ特異的なリトレーニングを伴わない、複数の運動基準モード間のシミュレート・トゥ・リアル転送を実現する。
論文 参考訳(メタデータ) (2026-06-03T12:52:37Z) - A Task-Driven, Planner-in-the-Loop Computational Design Framework for Modular Manipulators [4.7838192146149225]
本稿では,様々な形態素をまたいだ軌道計画と,形態素の協調最適化と配置ポーズを統合したタスク駆動型計算フレームワークを提案する。
設計最適化のために、CMA-ESは、離散的な形態的構成と連続的なマウントされたポーズからなるハイブリッド検索空間を効率的に探索するために使用される。
仮想モジュール抽象化を導入して、分岐形態を可能とし、補助枝が一次枝からトルクをオフロードし、達成可能なワークスペースを拡張する。
論文 参考訳(メタデータ) (2025-12-18T01:27:34Z) - MotionVerse: A Unified Multimodal Framework for Motion Comprehension, Generation and Editing [53.98607267063729]
MotionVerseは、シングルパーソンとマルチパーソンの両方のシナリオで人間の動作を理解し、生成し、編集するフレームワークである。
我々は、連続的な動き列をマルチストリーム離散トークンに変換する残差量子化を伴う動きトークン化器を用いる。
また、残留トークンストリームの符号化を時間的に停滞させる textitDelay Parallel Modeling 戦略も導入する。
論文 参考訳(メタデータ) (2025-09-28T04:20:56Z) - DeMo++: Motion Decoupling for Autonomous Driving [41.6423398623095]
動作意図を2つの異なるコンポーネントに分離するフレームワークであるDeMo++を提案する。
隣接するシーンにおける動き間の関係を探索するために,クロスシーンの軌道間相互作用機構を導入する。
DeMo++は、モーション予測(Argoverse 2とnuScenes)、モーション計画(nuPlan)、エンドツーエンド計画(SIM)など、さまざまなベンチマークで最先端のパフォーマンスを実現している。
論文 参考訳(メタデータ) (2025-07-23T09:11:25Z) - Learning to Move in Rhythm: Task-Conditioned Motion Policies with Orbital Stability Guarantees [45.137864140049814]
我々は,学習した微分型エンコーダと超臨界ホップ分岐を結合したフレームワークであるOrbitally Stable Motion Primitives (OSMPs)を紹介する。
提案手法は,多種多様なロボットプラットフォームにまたがる広範囲なシミュレーションと実世界の実験によって検証される。
論文 参考訳(メタデータ) (2025-07-12T17:10:03Z) - GENMO: A GENeralist Model for Human MOtion [64.16188966024542]
本稿では,1つのフレームワークで動作推定と生成を橋渡しする汎用人体運動モデル GENMO を提案する。
我々の重要な洞察は、出力運動が観測された条件信号を正確に満たさなければならないような制約された動き生成として運動推定を再構成することである。
我々の新しいアーキテクチャは、可変長動きと混合マルチモーダル条件(テキスト、オーディオ、ビデオ)を異なる時間間隔で処理し、柔軟な制御を提供する。
論文 参考訳(メタデータ) (2025-05-02T17:59:55Z) - DeepInteraction++: Multi-Modality Interaction for Autonomous Driving [80.8837864849534]
我々は,モダリティごとの個別表現を学習し,維持することのできる,新しいモダリティインタラクション戦略を導入する。
DeepInteraction++はマルチモーダルなインタラクション・フレームワークであり、マルチモーダルな表現型インタラクション・エンコーダとマルチモーダルな予測型インタラクション・デコーダを特徴とする。
実験では,3次元物体検出とエンドツーエンドの自律走行の両方において,提案手法の優れた性能を示す。
論文 参考訳(メタデータ) (2024-08-09T14:04:21Z) - Planning-oriented Autonomous Driving [60.93767791255728]
我々は、最終目標、すなわち自動運転車の計画を追求するために、好ましいフレームワークを考案し、最適化すべきであると主張している。
フルスタック運転タスクをひとつのネットワークに組み込んだ総合的なフレームワークであるUnified Autonomous Driving (UniAD)を紹介した。
論文 参考訳(メタデータ) (2022-12-20T10:47:53Z) - AMP: Adversarial Motion Priors for Stylized Physics-Based Character
Control [145.61135774698002]
我々は,与えられたシナリオで追跡するキャラクタの動作を選択するための完全自動化手法を提案する。
キャラクタが実行するべきハイレベルなタスク目標は、比較的単純な報酬関数によって指定できる。
キャラクタの動作の低レベルスタイルは、非構造化モーションクリップのデータセットによって指定できる。
本システムでは,最先端のトラッキング技術に匹敵する高品質な動作を生成する。
論文 参考訳(メタデータ) (2021-04-05T22:43:14Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。