論文の概要: Genie Sim PanoWorld: An Infinite Indoor 3D World Generation Pipeline via Panoramic Scene Modeling and Simulation
- arxiv url: http://arxiv.org/abs/2607.26646v1
- Date: Wed, 29 Jul 2026 09:08:16 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-30 21:06:25.606187
- Title: Genie Sim PanoWorld: An Infinite Indoor 3D World Generation Pipeline via Panoramic Scene Modeling and Simulation
- Title(参考訳): Genie Sim PanoWorld:パノラマシーンモデリングとシミュレーションによる無限の室内3Dワールドジェネレーションパイプライン
- Abstract要約: 既存の方法では、下流の3D再構成を阻害する計量軌道制御が欠如しているか、あるいは長距離カメラの動作下での大規模な排除に苦慮している。
我々は2段階のフィードフォワードパイプラインであるGenie Sim PanoWorldを紹介した。
- 参考スコア(独自算出の注目度): 9.228046414885494
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: We address the problem of reconstructing a high-fidelity, freely navigable 3D scene from a single $360^\circ$ panorama, without per-scene optimization or multi-view capture. Existing methods either lack metric trajectory control, which hinders reliable downstream 3D reconstruction, or struggle with large disocclusions under long-range camera motion while requiring high-end multi-GPU servers.We present Genie Sim PanoWorld, a two-stage feed-forward pipeline that bridges generation and reconstruction via an explicit, trajectory-controllable panoramic video. A NavMesh-planned $\mathrm{SE}(3)$ roaming trajectory is injected into a latent video diffusion model through dense geometry-warped conditioning; long--short trajectory mixed training and a self-consistency objective based on shortcut models together yield high-fidelity video in four CFG-free denoising steps. A feed-forward panoramic reconstructor then lifts the generated video into a high-fidelity 3D Gaussian scene that supports real-time, free-viewpoint roaming and can be directly used as a simulation-ready asset for embodied AI applications. Experiments show that Genie Sim PanoWorld outperforms geometry-conditioned baselines in both panoramic video generation and downstream 3D reconstruction, while generalizing zero-shot to unseen indoor scenes.
- Abstract(参考訳): 本研究では,1枚の360^\circ$ panoramaから高忠実で自由な3Dシーンを,シーンごとの最適化やマルチビューキャプチャなしで再構成する問題に対処する。
既存の手法では、ダウンストリーム3次元再構成の信頼性を損なうメトリックトラジェクトリ制御が欠如しているか、あるいはハイエンドのマルチGPUサーバを必要とする場合、長距離カメラ動作下で大きな非閉塞に苦しむかのいずれかである。
NavMeshで計画された$\mathrm{SE}(3)$ roaming trajectoryは、密度の高い幾何ウォード条件で遅延ビデオ拡散モデルに注入される。
フィードフォワードパノラマ再構成器は、生成されたビデオを高忠実な3Dガウスシーンに持ち上げる。
実験によると、ジェニー・シム・パノワールドはパノラマビデオ生成と下流の3D再構成の両方において、幾何学的に条件付けられたベースラインよりも優れており、ゼロショットを屋内シーンに一般化している。
関連論文リスト
- ABot-3DWorld 0: A Universal World Model to Explore Any 3D Space [49.372892542771886]
ABot-3DWorld 0は、テキスト、画像、ビデオの入力を高忠実で探索可能な3D世界に変換する、普遍的なマルチモーダルな3Dワールドモデルである。
論文 参考訳(メタデータ) (2026-07-13T15:14:48Z) - Lyra 2.0: Explorable Generative 3D Worlds [77.45279013687427]
Lyra 2.0は、永続的で探索可能な3D世界を大規模に生成するためのフレームワークです。
空間的忘れに対処するため、フレームごとの3D形状を維持し、情報ルーティングのみに使用します。
自己拡張された履歴をトレーニングして、モデルを自身の劣化した出力に公開し、それを伝播するのではなく、ドリフトを正すように教えます。
論文 参考訳(メタデータ) (2026-04-14T17:59:44Z) - Rein3D: Reinforced 3D Indoor Scene Generation with Panoramic Video Diffusion Models [38.45163624089566]
Rein3Dは、完全な360度屋内環境を再構築するフレームワークである。
我々は不完全なパノラマ動画のレンダリングに放射状探査戦略を採用している。
これらの配列はパノラマビデオ・ビデオ拡散モデルにより復元され、高忠実度幾何やテクスチャを合成するためにビデオ超解像によりさらに拡張される。
論文 参考訳(メタデータ) (2026-04-12T10:55:14Z) - Genie Sim PanoRecon: Fast Immersive Scene Generation from Single-View Panorama [10.779071888296679]
Genie Sim PanoReconは、ロボット操作シミュレーションのための高忠実で低コストな3Dシーンを提供する、フィードフォワードのガウス型パイプラインである。
システム全体が数秒で写実的なシーンを再構築し、Genie Simに統合された。
論文 参考訳(メタデータ) (2026-04-08T13:57:18Z) - PanoWorld-X: Generating Explorable Panoramic Worlds via Sphere-Aware Video Diffusion [87.13016347332943]
PanoWorld-Xは、多彩なカメラ軌道を持つ高忠実で制御可能なパノラマビデオ生成のための新しいフレームワークである。
動作範囲,制御精度,視覚的品質など,様々な面で優れた性能を示す実験を行った。
論文 参考訳(メタデータ) (2025-09-29T16:22:00Z) - Matrix-3D: Omnidirectional Explorable 3D World Generation [20.568791715708134]
広視野全方位3次元世界生成のためのパノラマ表現を利用するフレームワークMatrix-3Dを提案する。
まず,シーンメッシュレンダリングを条件として,軌跡誘導パノラマ動画拡散モデルを訓練する。
本研究では, パノラマシーン映像を3次元世界へ持ち上げるために, (1) 高速3次元シーン再構成のためのフィードフォワード大パノラマ再構成モデル, (2) 正確かつ詳細な3次元シーン再構成のための最適化ベースパイプラインの2つの方法を提案する。
論文 参考訳(メタデータ) (2025-08-11T15:29:57Z) - Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation [66.95956271144982]
本稿では,単一画像から一貫した3Dポイントクラウドシーケンスを生成する新しいビデオ拡散フレームワークであるVoyagerを紹介する。
既存のアプローチとは異なり、Voyagerはフレーム間で固有の一貫性を持って、エンドツーエンドのシーン生成と再構築を実現している。
論文 参考訳(メタデータ) (2025-06-04T17:59:04Z) - WorldExplorer: Towards Generating Fully Navigable 3D Scenes [48.16064304951891]
WorldExplorerは、幅広い視点で一貫した視覚的品質で、完全にナビゲート可能な3Dシーンを構築する。
私たちは、シーンを深く探求する、短く定義された軌道に沿って、複数のビデオを生成します。
我々の新しいシーン記憶は、各ビデオが最も関連性の高い先行ビューで条件付けされている一方、衝突検出機構は劣化を防止している。
論文 参考訳(メタデータ) (2025-06-02T15:41:31Z) - DreamScene360: Unconstrained Text-to-3D Scene Generation with Panoramic Gaussian Splatting [56.101576795566324]
テキストから3D 360$circ$のシーン生成パイプラインを提示する。
提案手法は, 2次元拡散モデルの生成力を利用して, 自己複製を促進する。
当社の手法は,360ドル(約3万2000円)の視野内で,グローバルに一貫した3Dシーンを提供する。
論文 参考訳(メタデータ) (2024-04-10T10:46:59Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。