論文の概要: On the Identifiability of Controlled World Models
- arxiv url: http://arxiv.org/abs/2607.22430v2
- Date: Mon, 27 Jul 2026 09:57:43 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-28 14:56:47.047257
- Title: On the Identifiability of Controlled World Models
- Title(参考訳): 制御された世界モデルの同定可能性について
- Abstract要約: 本稿では,ガウス潜在状態を持つ制御された世界モデルに対する合同識別可能性条件を提案する。
この条件が成立すると、LeJEPAスタイルの予測目標の最小化が潜伏状態と制御力学の両方を回復できることを示す。
また、最も弱い条件-励起マージンで逆スケールする反事実予測誤差の達成可能な増幅を特徴付ける。
- 参考スコア(独自算出の注目度): 34.31084112465058
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: World model serves as a promising tool to infer environment dynamics under high-dimensional observations and candidate actions. Recently, LeCun's JEPA provides a compelling framework for learning such models in representation space. Its action-conditioned extension plays a central role in visual control and latent-space planning, but leaves a fundamental question: can it recover the controlled dynamics from nonlinear observations? This paper presents a joint identifiability condition for controlled world models with Gaussian latent states, which consists of two coupled components: (1) representation identifiability and (2) transition identifiability. The former depends on the spectral separation property while the latter is related to non-degenerate variation of conditional action. We prove that when this condition holds, minimizing the LeJEPA-style predictive objective can recover both latent states and controlled dynamics in the sense of orthogonal transformation. We further prove that the upper bound of transition prediction error is inversely proportional to the spectral separation margin. We also characterize an attainable amplification of counterfactual prediction error that scales inversely with the weakest conditional action-excitation margin. The theoretical predictions are empirically supported across four nonlinear observation settings.
- Abstract(参考訳): 世界モデルは、高次元観測および候補行動の下で環境力学を推測するための有望なツールとして機能する。
最近、LeCunのJEPAは表現空間でそのようなモデルを学習するための魅力的なフレームワークを提供している。
その行動条件拡張は、視覚制御と潜在空間計画において中心的な役割を果たすが、根本的な疑問を残している。
本稿では,(1)表現の識別可能性と(2)遷移の識別可能性の2つの結合成分からなる,ガウス潜在状態を持つ制御世界モデルに対する共同識別可能性条件を提案する。
前者はスペクトル分離特性に依存し、後者は条件作用の非退化変化に関係している。
この条件が成り立つと、LeJEPAスタイルの予測対象を最小化することで、直交変換の意味において潜在状態と制御力学の両方を回復できることを示す。
さらに、遷移予測誤差の上限がスペクトル分離マージンに逆比例することを証明した。
また、最も弱い条件-励起マージンで逆スケールする反事実予測誤差の達成可能な増幅を特徴付ける。
理論的予測は4つの非線形観測条件で実証的に支持される。
関連論文リスト
- Orthogonal JEPA: Factorized Predictive States for Latent World Models [95.20158869896393]
予測因数分解に基づく潜在的世界モデリングフレームワークであるメソッドを導入する。
そこで本研究では,予測構造を弱め,あるいは矛盾する勾配を抑えつつ,冗長なキャパシティを支配的信号に割り当てる手法を提案する。
制御された視覚、単細胞転写学、縦断的な健康記録、連続的な制御、分子動力学の実験は、表現品質、予測、計画、長期安定性を評価する。
論文 参考訳(メタデータ) (2026-08-20T13:59:57Z) - Diagnosing JEPA World Models with Action-Conditioned Predictive Consistency [38.88857369304745]
クリーンな歴史と、前方へ転がった後の視界のゆがみを計測する診断手法を導入する。
この分散は、多段階予測誤差とプランナーコストの摂動によって引き起こされる変化を束縛することを証明する。
4つの視覚制御タスクの実験は、ペアワイズACPCが摂動による予測とコスト変化を予測することを示している。
論文 参考訳(メタデータ) (2026-08-13T08:18:41Z) - DCS: A Unified Conditional Sensitivity Framework for Cross-Modal Copyright Infringement Detection [0.0]
本研究は,著作権侵害の証拠を条件付き分散シフトとして扱う,統合されたポストホック検出フレームワークを開発する。
保護対象は、その目標がトレーニングプロセスに含まれるか、または取り除かれた場合、整列条件下でのモデルの振る舞いが測定可能に変更されるかどうか疑わしい。
このフレームワークは、リッジ規則化線形回帰、条件付き拡散モデル、自己回帰言語モデル、マルチモーダルモデルのためにインスタンス化されている。
論文 参考訳(メタデータ) (2026-07-24T07:00:44Z) - Geometric Collapse: When Vision Models Fail to Verify Physical Causality [52.43819179934414]
スクランブルドエッジ(Scrambled Edges)は、サリアントエッジのようなキューを注入する制御されたカウンターファクトである。
エネルギー整合制御と構造整合制御により, 高周波エネルギーとエッジ間隔から支持エッジエビデンスの効果を分離する。
CNN/ViT/SSL深度予測器を通して、Scrambled Edgesはエネルギー整合ノイズよりもクリーンな予測から最大3.2倍大きな偏差を誘導する。
論文 参考訳(メタデータ) (2026-07-08T00:04:02Z) - Purified OPSD: On-Policy Self-Distillation Without Losing How to Think [52.879387744920415]
オンライン自己蒸留(OPSD)は長いチェーン・オブ・ソート(Long-CoT)推論モデルでは一貫して失敗する。
まず,教師が指導信号の非伝達可能成分を分離するために,参照のみの教師を構築する。
第2に、この残差をよく形成されたPMIターゲット分布に変換するメカニズムとして、ポイントワイズ相互情報(PMI)を用いる。
論文 参考訳(メタデータ) (2026-07-02T14:33:07Z) - Sensorimotor World Models: Perception for Action via Inverse Dynamics [59.121736411156384]
Inverse dynamics regularization で訓練されたエンド・ツー・エンドのセンサモレータ・ワールドモデルを導入する。
表現の崩壊を防ぎ、アクション整列表現を誘導する。
コンパクトで解釈可能な潜在空間を学習し、単純な2Dおよび3D制御タスク間の競合計画性能を実現する。
論文 参考訳(メタデータ) (2026-06-18T11:25:16Z) - Why We Need World Models for AGI: Where LLMs Fail and How World Models May Outperform [1.6746114653388389]
大規模言語モデルは、言語生成と知識集約タスクにおいて強力なパフォーマンスを達成する。
これらの制限は、潜在環境力学に対するシーケンス予測と推論の客観的なミスマッチから生じる可能性がある。
言語とマルチモーダルな観察を基礎となる遷移力学の部分的証拠として解釈する概念的視点である潜在ダイナミクス推論(LDI)を紹介する。
論文 参考訳(メタデータ) (2026-05-13T12:55:34Z) - CellScientist: Dual-Space Hierarchical Orchestration for Closed-Loop Refinement of Virtual Cell Models [62.281480231694]
VCM(Virtual Cell Modeling)は、摂動応答を予測できるだけでなく、予測が失敗した場合にターゲットリビジョンをサポートするモデルを必要とする。
現在のLCM支援モデリングでは、予測誤差が実行可能実装を通して観測されるという改善ルーティング問題に直面している。
提案するCellScientistは,高レベル仮説空間と低レベル実行可能実装空間を結合した,二重空間階層型フレームワークである。
論文 参考訳(メタデータ) (2026-05-08T06:40:24Z) - AGWM: Affordance-Grounded World Models for Environments with Compositional Prerequisites [18.635313325437664]
我々は,行動の動的実行可能性を明確に追跡するために,前提条件依存のDAGとして表される抽象的な空き構造を学習するAGWM(Affordance-Grounded World Model)を提案する。
ゲームベースのシミュレーション環境の実験では、より低いマルチステップ予測誤差、新しい構成へのより良い一般化、解釈可能性の向上により、本手法の有効性が示された。
論文 参考訳(メタデータ) (2026-05-07T18:46:44Z) - Dual-Stage Invariant Continual Learning under Extreme Visual Sparsity [8.16821029459195]
背景駆動の勾配は、連続的なドメインシフトの間、機能のバックボーンを不安定にすることを示す。
連成蒸留による二段階不変連続学習フレームワークを提案する。
高分解能空間ベース RSO 検出データセットの実験は、確立された連続物体検出法よりも一貫した改善を示す。
論文 参考訳(メタデータ) (2026-03-27T09:03:49Z) - Authority-Level Priors: An Under-Specified Constraint in Hierarchical Predictive Processing [0.0]
オーソリティ・レベル優先(英: Authority-Level Priors、ALP)は、アイデンティティレベルの仮説の規制が許容できるサブセットを定義するメタ構造制約である。
ALPは、追加の表現状態や精度よりも高優先度であり、規制制御に許容される仮説を制約している。
計算形式化は、認可された仮説によって生成されるポリシーに対するポリシー最適化を制限する。
論文 参考訳(メタデータ) (2026-03-19T13:27:47Z) - On the Structural Non-Preservation of Epistemic Behaviour under Policy Transformation [51.56484100374058]
このような情報条件の相互作用パターンを振る舞い依存として定式化する。
これにより、$$-behavioural equivalenceというプローブ相対的な概念と、政治内行動距離が導かれる。
その結果、共通政策変換の下でプローブ条件の挙動分離が保存されない構造条件が明らかになった。
論文 参考訳(メタデータ) (2026-02-24T22:55:21Z) - Causal Imitation Learning Under Measurement Error and Distribution Shift [6.038778620145853]
ノイズ測定によってのみ、決定関連状態の一部が観察される場合、オフライン模倣学習(IL)について検討する。
本稿では,変数間の因果関係を明示的にモデル化することによって,測定誤差下でのILの一般的なフレームワークを提案する。
論文 参考訳(メタデータ) (2026-01-29T18:06:53Z) - SIGMA: Scalable Spectral Insights for LLM Collapse [51.863164847253366]
SIGMA(Spectral Inequalities for Gram Matrix Analysis)は,モデル崩壊のための統一的なフレームワークである。
行列のスペクトル上の決定論的境界を導出するベンチマークを利用することで、SIGMAは表現空間の収縮を追跡するために数学的に基底化された計量を提供する。
我々は、SIGMAが状態への遷移を効果的に捉え、崩壊のメカニズムに関する理論的知見の両方を提供することを示した。
論文 参考訳(メタデータ) (2026-01-06T19:47:11Z) - Interpretation of Unfair Sampling in Quantum Annealing by Node Centrality [0.7734726150561088]
退化摂動理論を用いて退化基底状態を解析し、それらの選好を特徴づける。
この分析では、基底状態からなるグラフの隣接行列が自然に現れる。
2次重みは局所的な障壁情報を符号化し、サンプリングフェアネスと局所的なエネルギー景観の平坦度に関連することを示す。
論文 参考訳(メタデータ) (2026-01-05T09:10:47Z) - Interpretable Imitation Learning with Dynamic Causal Relations [65.18456572421702]
得られた知識を有向非巡回因果グラフの形で公開することを提案する。
また、この因果発見プロセスを状態依存的に設計し、潜在因果グラフのダイナミクスをモデル化する。
提案するフレームワークは,動的因果探索モジュール,因果符号化モジュール,予測モジュールの3つの部分から構成され,エンドツーエンドで訓練される。
論文 参考訳(メタデータ) (2023-09-30T20:59:42Z) - Prediction under Latent Subgroup Shifts with High-Dimensional
Observations [30.433078066683848]
遅延シフト適応を用いたグラフィカルモデルにおける新しい予測手法を提案する。
RPMの新規な形態は、ソース環境における因果潜伏構造を特定し、ターゲットの予測に適切に適応する。
論文 参考訳(メタデータ) (2023-06-23T12:26:24Z) - Hallucinated Adversarial Control for Conservative Offline Policy
Evaluation [64.94009515033984]
本研究では,環境相互作用のオフラインデータセットが与えられた場合,政策のパフォーマンスを低く抑えることを目的とした,保守的非政治評価(COPE)の課題について検討する。
本稿では,遷移力学の不確実性を考慮した学習モデルに基づくHAMBOを紹介する。
結果のCOPE推定値が妥当な下界であることを証明し、正則性条件下では、真に期待された戻り値への収束を示す。
論文 参考訳(メタデータ) (2023-03-02T08:57:35Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。