論文の概要: ACID: Action Consistency via Inverse Dynamics for Planning with World Models
- arxiv url: http://arxiv.org/abs/2607.02403v1
- Date: Thu, 02 Jul 2026 16:38:10 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-03 19:45:08.921594
- Title: ACID: Action Consistency via Inverse Dynamics for Planning with World Models
- Title(参考訳): ACID: 世界モデルによる計画のための逆ダイナミクスによるアクション一貫性
- Abstract要約: ACIDは、サイクルアクションの一貫性を導入する意思決定時計画フレームワークである。
プランニングを一貫して改善し、ベースラインの精度とほぼ少ないプランニング計算とを一致させる。
- 参考スコア(独自算出の注目度): 42.33354357727536
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: Decision-time planning with action-conditioned world models has become a popular paradigm for embodied control. However, the standard planning cost judges a candidate solely by how close its predicted terminal state lies to the goal, leaving the realizability of the intermediate transitions unchecked -- a predicted trajectory can look convincing while the environment rollout drifts away from it. In this paper, we propose ACID, a decision-time planning framework that introduces cycle action consistency: the action inferred backward from a predicted transition by an inverse dynamics model should recover the one that was conditioned on. We fold this per-step residual into the planning cost via a scale-invariant adaptive weight. Across four action-conditioned world models and six tasks spanning rigid and deformable manipulation, articulated control, and visual navigation, ACID consistently improves planning and matches the baseline's accuracy with substantially less planning compute.
- Abstract(参考訳): 行動条件付き世界モデルを用いた決定時間計画は、具体的制御の一般的なパラダイムとなっている。
しかし、標準的な計画コストは、予測された終端状態がどれだけゴールに近づいたかによってのみ候補を判断し、未確認の中間遷移の実現可能性を残す -- 予測された軌道は、環境のロールアウトがそれから離れていく間、説得力があるように見える。
本稿では,サイクル動作の整合性を導入する決定時計画フレームワークであるACIDを提案する。
このステップごとの残余を、スケール不変の適応重みによって計画コストに折り畳みます。
4つのアクション条件付き世界モデルと6つのタスクが厳密で変形可能な操作、調音制御、視覚ナビゲーションにまたがっており、ACIDは一貫して計画を改善し、ベースラインの精度とほぼ少ない計画計算とを一致させる。
関連論文リスト
- AdaJEPA: An Adaptive Latent World Model [42.0759614364807]
モデル予測制御(MPC)の閉ループ内でテスト時間適応を行う適応潜在世界モデルであるAdaJEPAを提案する。
トレーニング後、AdaJEPAは最初のアクションチャンクを計画し、実行し、観察された次の状態遷移を自己教師付き適応信号として使用し、更新されたモデルで再計画する。
このクローズドループアップデートは、さらなる専門家によるデモンストレーションなしに、世界モデルを継続的に再検討する。
論文 参考訳(メタデータ) (2026-06-30T17:53:48Z) - AdaReP:Adaptive Re-Planning under Model Mismatch for Neural World-Model Predictive Control [20.745587519033833]
本研究は, スタイルプランのペナルティが再利用耐性, 最終計画段階から蓄積したミスマッチ, 局所力学感度とともにどのようにスケールするかを解析した。
キャッシュされたロールアウトからの現在の逸脱と局所感度推定を用いて、オンラインのリプランングトレランスに適応するトレーニングフリーラッパーであるAdaRePを提案する。
AdaRePは、画像空間計画、潜時空間制御、実世界のロボット操作全体にわたって、プランナー側の計算を大幅に削減し、50個の物理ロボット研究における80%以上のクエリを含む、同等のタスク性能を維持しながら、プランナー側の計算を大幅に削減する。
論文 参考訳(メタデータ) (2026-06-22T09:27:50Z) - LeapTS: Rethinking Time Series Forecasting as Adaptive Multi-Horizon Scheduling [74.94985663101906]
本稿では,予測地平線上での動的スケジューリングプロセスとして時系列予測を再構成する新しいフレームワーク LeapTSを提案する。
LeapTSは、Transformerベースのモデルよりも2.6$times$から5.3$times$推論スピードアップを実現しつつ、全体的な予測性能を少なくとも7.4%向上させる。
論文 参考訳(メタデータ) (2026-05-11T09:54:02Z) - Uni-World VLA: Interleaved World Modeling and Planning for Autonomous Driving [52.04950569530877]
我々は、将来のフレーム予測と軌道計画の密接なインターリーブを行う統合視覚言語行動モデルUni-World VLAを提案する。
提案手法は,高忠実度将来のフレーム予測を行いながら,競合する閉ループ計画性能を実現する。
論文 参考訳(メタデータ) (2026-03-28T14:39:51Z) - CorrectionPlanner: Self-Correction Planner with Reinforcement Learning in Autonomous Driving [55.88697462014118]
CorrectionPlannerは自己補正を備えた自動回帰プランナーである。
Waymaxでは衝突率を20%以上削減し、nuPlanでは最先端の計画スコアを達成している。
論文 参考訳(メタデータ) (2026-03-16T18:03:21Z) - Agentic Self-Evolutionary Replanning for Embodied Navigation [37.69855672445479]
自己進化的リプランニング(Self-Evolutionary RePlanning、SERP)は、凍結モデルからランタイム学習による進化モデルへのパラダイムシフトである。
既定の静的パラメータにしばしば立ち往生する既存のモデル進化アプローチとは対照的に、エージェント的自己進化アクションモデルを導入する。
SERPは、様々なベンチマークよりもトークン支出が少なく、高い成功率を実現し、様々な環境において優れた堅牢性と効率性を検証している。
論文 参考訳(メタデータ) (2026-03-03T09:12:29Z) - Compositional Planning with Jumpy World Models [70.74595987225908]
我々は、事前訓練されたポリシーを構成するエージェントを時間的に拡張したアクションとして研究し、構成員だけでは解決できない複雑なタスクに対する解決を可能にする。
arXiv:2206.08736で導入された幾何学的ポリシー構成フレームワークをモチベーションとして,多段階力学の予測モデルを学習することにより,これらの課題に対処する。
論文 参考訳(メタデータ) (2026-02-23T09:22:21Z) - TodoEvolve: Learning to Architect Agent Planning Systems [68.48983335970901]
TodoEvolveは、タスク固有の計画を自律的に合成し、動的に修正するメタプランニングパラダイムである。
PlanFactoryは異種計画パターンの共通インターフェースを提供する。
TodoEvolveは、経済的なAPIコストとランタイムオーバーヘッドを維持しながら、慎重に設計された計画モジュールを一貫して上回っている。
論文 参考訳(メタデータ) (2026-02-08T06:37:01Z) - Adaptive Planning with Generative Models under Uncertainty [20.922248169620783]
生成モデルによる計画は、幅広い領域にわたる効果的な意思決定パラダイムとして現れてきた。
最新の環境観測に基づいて決定を下すことができるため、各段階での継続的再計画は直感的に思えるかもしれないが、かなりの計算上の課題をもたらす。
本研究は,長軸状態軌跡を予測できる生成モデルの能力を活用する,シンプルな適応計画手法を導入することで,この問題に対処する。
論文 参考訳(メタデータ) (2024-08-02T18:07:53Z) - Planning as In-Painting: A Diffusion-Based Embodied Task Planning
Framework for Environments under Uncertainty [56.30846158280031]
具体的AIのためのタスクプランニングは、最も難しい問題の1つだ。
In-paintingとしての計画」というタスク非依存の手法を提案する。
提案するフレームワークは,様々な具体的AIタスクにおいて,有望なパフォーマンスを実現する。
論文 参考訳(メタデータ) (2023-12-02T10:07:17Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。