論文の概要: Future Anchored Verification and Online Recovery for World Action Models
- arxiv url: http://arxiv.org/abs/2610.06280v1
- Date: Mon, 05 Oct 2026 13:08:58 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-09 09:34:45.795187
- Title: Future Anchored Verification and Online Recovery for World Action Models
- Title(参考訳): 世界行動モデルの今後の検証とオンライン・リカバリ
- Abstract要約: 世界アクションモデル(WAM)は、ロボット操作のための有望なパラダイムとして登場した。
我々は、WAMが行動する前に予測した未来が、通過する意図のある状態を正確に表現しているのを観察する。
予測フレームをアンカーとして保持し,検証とリカバリに使用する軽量フレームワークであるFAVORを紹介する。
- 参考スコア(独自算出の注目度): 50.72957480806238
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: World action models (WAMs) have emerged as a promising paradigm for robotic manipulation. They act by first predicting how a task should be performed and then decoding the actions from that future. However, the remaining actions are invalid once execution drifts from the prediction. Simply replanning from the already out of distribution state rarely restores what the task still requires; existing execution monitors decide when to stop, but not what to restore. We observe that the answer is already in hand: the future the WAM predicted before acting depicts exactly the states it intended to pass through. We introduce FAVOR (Future Anchored Verification and Online Recovery), a lightweight framework that keeps these predicted frames as anchors and uses them for verification and recovery. An Anchor Verifier compares each observation with its anchor, together with the executed actions, to flag deviations that break the task. Anchor-Guided Recovery uses a vision-language model to turn the flagged anchor into a short corrective instruction. Under strengthened instruction guidance, the WAM executes this instruction to return to the intended future. It then resumes the task. FAVOR raises the task success of the base WAM from 97.85% to 98.10% on LIBERO and from 72.60% to 72.98% on LIBERO-Plus without modifying the policy.
- Abstract(参考訳): 世界アクションモデル(WAM)は、ロボット操作のための有望なパラダイムとして登場した。
彼らはまずタスクがどのように実行されるべきかを予測し、それからその未来からアクションをデコードすることで行動する。
しかし、残りのアクションは、予測から実行がドリフトしたら無効になる。
既存の実行モニターは、いつ停止するかを判断するが、復元するものは決定しない。
われわれは、WAMが予測した未来が、通過する意図のある状態を正確に表現している、という答えがすでに手元にあることを観察している。
FAVOR(Future Anchored Verification and Online Recovery)は,予測フレームをアンカーとして保持し,検証とリカバリに使用する軽量フレームワークである。
Anchor Verifierは、各観測結果をアンカーと比較し、実行されたアクションと合わせて、タスクを壊す逸脱をフラグする。
Anchor-Guided Recoveryは視覚言語モデルを使用してフラグ付きアンカーを短い修正命令に変換する。
強化された指導指導の下で、WAMはこの指示を実行し、意図した未来に戻る。
その後、タスクを再開する。
FAVOR は WAM のタスク成功率を 97.85% から 98.10% に上げ、方針を変更することなく 72.60% から 72.98% に引き上げている。
関連論文リスト
- PerturBot: Breaking Shortcut Priors in Vision-Language-Action Models with Perturbative Training [54.81497176604651]
視覚-言語-アクション(VLA)ポリシーは、その行動を決定する証拠を無視しながら、複雑なタスクを完了することができる。
私たちはこれらの依存関係をモダリティショートカット(Modality shortcuts)と呼んでいる: 成功例の正規性は、専門家の行動を予測するのに十分な視覚的、語彙的、あるいは運動的手がかりを生み出す。
本稿では,タスク関連エビデンスをより使いやすくし,自分でもショートカットが不十分なPerturbotを提案する。
論文 参考訳(メタデータ) (2026-10-03T15:57:51Z) - Learning Skills from Historical Action Trajectories: Action Experience Dictionary for World Action Models [129.76412745258145]
World Action Models(WAM)は、視覚力学予測とアクション生成を結合するが、操作タスク間のアクションエクスペリエンスの再利用を明示的にサポートしていない。
本研究では,歴史的行動軌跡を共有行動埋め込みにエンコードするアクション体験辞書(AED)を開発した。
シミュレーション・ベンチマークと実世界のクロス・エボディメント・セッティングの実験により,AEDの有効性が検証された。
論文 参考訳(メタデータ) (2026-09-30T17:26:38Z) - Does This Action Still Explain the Task? Reverse Scoring for Diffusion Language Model Agents [25.947103954467874]
拡散ベースの大規模言語モデル(dLLM)は、並列デコーディングを通じて自動回帰エージェントのシーケンシャル遅延ボトルネックを壊すことを約束する。
最近の評価では、この効率はエンボディード・エージェント・コンピテンスに移行しない。
我々は、この失敗とトレーニングなしの治療法について、機械学的に説明します。
論文 参考訳(メタデータ) (2026-09-29T20:54:04Z) - Revision, Not Restart: Revisable Visual Plans for Closed-Loop World-Action Models [11.848736377015113]
修正可能な時間計画(Revisable Temporal Planning)は、視覚的未来を永続的な行動条件として維持し、フィードバック後に修正する。
タイムアウェア・ヒストリーは、観測された証拠を供給し、適応的なポリシーは、新しいノイズから保持、ブリッジリビジョン、または新しいリプランニングを選択する。
結果は、フィードバック駆動型視覚計画修正とクローズドループタスクのパフォーマンスを結びつける。
論文 参考訳(メタデータ) (2026-09-28T15:40:11Z) - Recoverability as a System Primitive for Long-Horizon AI Agents [5.008310199603767]
再利用を明示的な決定とするシステムプリミティブとして,リカバリビリティを導入する。
4つの決定論的ファイルと20のペアファイルの課題は、正確な復元と完了が許可されていない開始点を隠蔽できることを示している。
論文 参考訳(メタデータ) (2026-09-12T02:54:33Z) - Rethink Before You Execute: Adaptive Execution for World Action Models [29.76405877028887]
世界行動モデルは、将来の行動と環境の進化を共同で予測する。
この固定された実行の地平線は実行のダイナミクスとあまり一致していないと我々は主張する。
WAMのための軽量なプラグアンドプレイ実行方式であるTempoWAMを提案する。
論文 参考訳(メタデータ) (2026-08-10T11:59:42Z) - BadWAM: When World-Action Models Dream Right but Act Wrong [85.9616441469113]
世界行動モデル(WAM)は、身体制御のための有望な基盤として浮上している。
我々はワールド・アクション・ドリフト・アタックのモデリングと評価のための統合フレームワークであるBadWAMを紹介した。
BadWAMはこの攻撃面を、攻撃強度とステルスネスという2つの自然な基準に沿って特徴付けている。
この攻撃はクローズドループ実行時のタスク成功率を大幅に低下させることを示す。
論文 参考訳(メタデータ) (2026-07-16T17:04:15Z) - See, Plan, Rewind: Progress-Aware Vision-Language-Action Models for Robust Robotic Manipulation [59.07792608884117]
本稿では,See, Plan, Rewind (SPR)について紹介する。
SPRは、現在の状態と今後のマイルストーンを見て、次の2Dウェイポイントに向けて軌道を計画し、障害時に回復可能な状態に戻すという、継続的なコアサイクルを通じて運用される。
SPRは、OpenVLA-OFTとUniVLAを上回る最小のパフォーマンス低下で最先端のロバスト性を達成する。
論文 参考訳(メタデータ) (2026-03-10T07:22:51Z) - Scene Graph-Guided Proactive Replanning for Failure-Resilient Embodied Agent [9.370683025542686]
本稿では,サブタスク境界における障害の検出と修正を行う,アクティブなリプランニングフレームワークを提案する。
AI2-THORシミュレータの実験では,実行障害発生前の意味的および空間的ミスマッチを検出する。
論文 参考訳(メタデータ) (2025-08-15T07:48:51Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。