論文の概要: LIDAR-AD: A Decoder-Free Latent-Interaction Dreamer with Action-Residual Chains for Autonomous Driving
- arxiv url: http://arxiv.org/abs/2607.11964v1
- Date: Sun, 12 Jul 2026 16:06:09 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-15 17:08:29.898166
- Title: LIDAR-AD: A Decoder-Free Latent-Interaction Dreamer with Action-Residual Chains for Autonomous Driving
- Title(参考訳): LIDAR-AD: 自律運転のためのアクション・レジデンシャル・チェーンを備えたデコーダフリーラテント・インタラクション・ドリーム
- Authors: Yongzhi Liu, Yang Xiao, Zhong Cao, Zeng Kang, Sunan Zhang, Zhaozhi Dong, Guojun Yu, Weichao Zhuang,
- Abstract要約: LIDAR-ADは、自律運転のためのアクション・レジデンシャル・チェーンを備えたデコーダフリーのラテント・インタラクション・ドリーマーである。
観測再構成を冗長に再現された潜在アライメントに置き換え、リスク関連関係のコンパクトな表現を奨励する。
さらに、車両制御を残留動作更新としてモデル化し、残留動作シーケンスコントラスト学習を使用して、多段階残留駆動ロールアウトを将来の潜在状態と整合させる。
- 参考スコア(独自算出の注目度): 8.326300282526061
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Autonomous driving requires long-horizon closedloop decision making in dynamic traffic environments. Latent world models offer an effective framework for this problem by enabling imagination-based decision making in compact latent spaces. However, multi-source observations contain controlirrelevant redundancy, whereas reliable driving decisions rely on risk-relevant relations, future dynamics, and continuous action adjustments. This mismatch makes observation reconstruction and absolute action modeling suboptimal for learning decisionrelevant latent dynamics. We propose LIDAR-AD, a decoderfree Latent-Interaction Dreamer with Action-Residual Chains for autonomous driving. LIDAR-AD replaces observation reconstruction with redundancy-reduced latent alignment, encouraging compact representations of risk-relevant relations in multi-source driving inputs. It further models vehicle control as residual action updates and uses residual-action sequence contrastive learning to align multi-step residual-driven rollouts with future latent states. A deterministic analysis shows that the latent-tanh residual parameterization preserves interior action reachability while representing smooth long-horizon control as compact local updates. Together, these designs improve risk-aware state abstraction, continuous-control modeling, and long-horizon dynamics prediction. Extensive experiments across diverse simulated driving scenarios demonstrate that LIDAR-AD consistently outperforms world-model baselines, achieving the highest reward and the best success rate among learning-based methods. Evaluations on nuPlan-derived log-reconstructed scenarios further demonstrate the transferability of LIDAR-AD under real-world traffic layouts.
- Abstract(参考訳): 自律運転には、動的交通環境における長距離閉ループ決定が必要である。
ラテント世界モデルは、コンパクトなラテント空間における想像力に基づく決定を可能にすることにより、この問題に効果的なフレームワークを提供する。
しかし、マルチソース観測には制御不能な冗長性が含まれており、信頼性の高い運転決定はリスク関連関係、将来のダイナミクス、継続的な行動調整に依存している。
このミスマッチは、決定関連潜在力学の学習に最適な観察再構成と絶対動作モデリングを実現する。
自律運転のための非復号型ラテント・インタラクション・ドリーマーであるLIDAR-ADを提案する。
LIDAR-ADは、複数ソース駆動入力におけるリスク関連関係のコンパクトな表現を奨励し、冗長に再現された潜在アライメントに置き換える。
さらに、車両制御を残留動作更新としてモデル化し、残留動作シーケンスコントラスト学習を使用して、多段階残留駆動ロールアウトを将来の潜在状態と整合させる。
決定論的解析により、ラテン・タン残差パラメータ化は、コンパクトな局所的な更新としてスムーズな長水平制御を表現しながら、内部動作の到達性を保っていることが示された。
これらの設計は、リスク認識状態の抽象化、連続制御モデリング、長距離ダイナミクス予測を改善する。
多様なシミュレートされた運転シナリオにわたる広範囲な実験により、LIDAR-ADは世界モデルベースラインを一貫して上回り、学習ベースの手法の中で最高の報酬と最高の成功率を達成した。
nuPlan由来のログ再構成シナリオの評価は、現実のトラフィックレイアウト下でのLIDAR-ADの転送可能性をさらに示す。
関連論文リスト
- OWMDrive: Causality-Aware End-to-End Autonomous Driving via 4D Occupancy World Model [2.4196046716427393]
OWMDriveは、マルチステップの3D占有予測のためのOccupancy World Model上に構築された、生成的なエンドツーエンド駆動フレームワークである。
OWMDriveは、現在の観測と将来の予測状態の両方に基づいて、軌道候補を反復的に洗練し、強化された駆動軌道を生成する。
論文 参考訳(メタデータ) (2026-06-29T15:05:41Z) - MAPLE: Latent Multi-Agent Play for End-to-End Autonomous Driving [62.43744546817599]
視覚言語-アクション(VLA)モデルは、エンドツーエンドのモーションプランナーとして有効であるが、クローズドループ設定で評価すると不安定である。
本稿では, VLAモデルの潜在空間における動的駆動シナリオの, リアクティブでマルチエージェントなロールアウトのための新しいフレームワークMAPLEを提案する。
MAPLEはBench2Driveで最先端の駆動性能を実現し、堅牢なE2E自動運転システムのためのスケーラブルでクローズループなマルチエージェントプレイを実演する。
論文 参考訳(メタデータ) (2026-05-13T23:35:14Z) - State-Action Inpainting Diffuser for Continuous Control with Delay [28.10905055038984]
State-Action Inpainting Diffuser (SAID)は、動的学習の帰納バイアスと政策最適化の直接的な意思決定能力を統合するフレームワークである。
本研究は,遅延を伴う継続的制御と強化学習の分野を前進させる新しい手法を提案する。
論文 参考訳(メタデータ) (2026-03-02T07:28:27Z) - AutoDrive-R$^2$: Incentivizing Reasoning and Self-Reflection Capacity for VLA Model in Autonomous Driving [37.260140808367716]
本稿では,自律運転システムの推論能力と自己回帰能力を両立させる新しいVLAフレームワークであるAutoDrive-R$2$を提案する。
まず,教師付き微調整のための新しいCoTデータセット nuScenesR$2$-6K を提案する。
次に, グループ相対政策最適化(GRPO)アルゴリズムを用いて, 信頼性の高い滑らかさと現実的な軌道計画を実現する。
論文 参考訳(メタデータ) (2025-09-02T04:32:24Z) - VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision [17.36342349850825]
教師としての視覚言語モデル(VLM)は、追加の監督を提供することで訓練を強化する。
VLM-ADは、nuScenesデータセットの計画精度と衝突率の大幅な改善を実現している。
論文 参考訳(メタデータ) (2024-12-19T01:53:36Z) - From Imitation to Exploration: End-to-end Autonomous Driving based on World Model [24.578178308010912]
RAMBLEは、意思決定を駆動するエンド・ツー・エンドの世界モデルベースのRL方式である。
複雑な動的トラフィックシナリオを処理できる。
CARLA Leaderboard 1.0では、ルート完了率の最先端のパフォーマンスを達成し、CARLA Leaderboard 2.0では38のシナリオをすべて完了している。
論文 参考訳(メタデータ) (2024-10-03T06:45:59Z) - DiFSD: Ego-Centric Fully Sparse Paradigm with Uncertainty Denoising and Iterative Refinement for Efficient End-to-End Self-Driving [55.53171248839489]
我々は、エンドツーエンドの自動運転のためのエゴ中心の完全スパースパラダイムであるDiFSDを提案する。
特に、DiFSDは主にスパース知覚、階層的相互作用、反復的な運動プランナーから構成される。
nuScenesとBench2Driveデータセットで実施された実験は、DiFSDの優れた計画性能と優れた効率を実証している。
論文 参考訳(メタデータ) (2024-09-15T15:55:24Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。