論文の概要: SceneFrom3D: Geometry-Conditioned Outdoor 3D Scene Generation via View Scheduling with Object-Level Control
- arxiv url: http://arxiv.org/abs/2607.04540v1
- Date: Sun, 05 Jul 2026 23:07:03 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-07 22:26:29.975069
- Title: SceneFrom3D: Geometry-Conditioned Outdoor 3D Scene Generation via View Scheduling with Object-Level Control
- Title(参考訳): SceneFrom3D: オブジェクトレベル制御によるビュースケジューリングによる幾何学的な屋外3次元シーン生成
- Authors: Geonung Kim, Jeongeun Park, Nuri Ryu, Di Liu, Sunghyun Cho,
- Abstract要約: SceneFrom3Dは、屋外の入力ジオメトリからビューを自動的にスケジュールするフレームワークである。
SceneFrom3Dは、オブジェクトレベルの条件付けによって制御性をさらに改善し、各オブジェクトを外観ガイダンスのアイデンティティイメージに割り当てる。
実験により、SceneFrom3Dは最先端の幾何学条件付き屋外3D生成を実現することが示された。
- 参考スコア(独自算出の注目度): 16.72440328307137
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Geometry-conditioned 3D scene generation enables the creation of 3D environments from user-provided geometry, offering direct control over scene structure and object layout. To generate such 3D scenes, current methods commonly adopt a three-stage design that first defines a view schedule, then synthesizes multi-view observations along the scheduled views, and finally reconstructs a 3D representation from the generated images. However, defining the view schedule becomes a major bottleneck for outdoor scenes, where large, unstructured, and unbounded geometry makes it difficult to obtain views that provide sufficient coverage while supporting stable generation. To address this bottleneck, we present SceneFrom3D, a framework that automatically schedules views from outdoor input geometries. SceneFrom3D constructs a directed generation graph whose nodes represent anchor views and whose edges represent interpolation trajectories, defining which views to synthesize, which view pairs to interpolate, and in which order generation should proceed. Beyond automatic view scheduling, SceneFrom3D further improves controllability through object-level conditioning, assigning each object an identity image for appearance guidance and a geometry-adherence parameter for region-wise control over the input geometry. Experiments demonstrate that SceneFrom3D achieves state-of-the-art geometry-conditioned outdoor 3D scene generation, producing high-quality scenes with controllable object appearance and geometry adherence.
- Abstract(参考訳): 幾何条件付き3Dシーン生成により、ユーザが提供する幾何学から3D環境を作成でき、シーン構造とオブジェクトレイアウトを直接制御できる。
このような3Dシーンを生成するために、現在の手法では、まずビュースケジュールを定義し、次にスケジュールされたビューに沿ってマルチビューの観察を合成し、最終的に生成された画像から3D表現を再構築する3段階の設計が一般的である。
しかし、ビュースケジュールの定義は、大きな、非構造的で、非有界な幾何学が安定した生成をサポートしながら十分なカバレッジを提供するビューを得るのを難しくする屋外シーンにおいて、大きなボトルネックとなる。
このボトルネックに対処するために、屋外の入力ジオメトリからビューを自動的にスケジュールするフレームワークであるSceneFrom3Dを提案する。
SceneFrom3Dは、ノードがアンカービューを表し、エッジが補間軌跡を表す有向生成グラフを構築し、どのビューを合成するか、どのビューペアを補間し、どの順序生成を進めるべきかを定義する。
自動ビュースケジューリング以外にも、SceneFrom3Dはオブジェクトレベルの条件付けにより制御性をさらに改善し、各オブジェクトに外観誘導のためのアイデンティティイメージと入力幾何学を領域的に制御するための幾何学的アジェンスパラメータを割り当てる。
実験により、SceneFrom3Dは、最先端の幾何学条件付き屋外3Dシーン生成を実現し、制御可能なオブジェクトの外観と幾何学的付着を有する高品質なシーンを生成する。
関連論文リスト
- IVGT: Implicit Visual Geometry Transformer for Neural Scene Representation [76.36174247570716]
ポーズレス多視点画像から連続的かつ一貫性のある幾何を暗黙的にモデル化するインプリシトビジュアル幾何変換器IVGTを提案する。
IVGTは標準座標系で連続的なニューラルネットワークシーン表現を学習し、任意の3D位置での連続的な空間クエリをサポートする。
連続的かつコヒーレントな表面形状の直接抽出を可能にし、任意の視点からRGB画像、深度マップ、表面正規写像のレンダリングを可能にする。
論文 参考訳(メタデータ) (2026-05-15T17:59:57Z) - Pano3DComposer: Feed-Forward Compositional 3D Scene Generation from Single Panoramic Image [13.55946265213768]
Pano3DComposerはパノラマ画像のための効率的なフィードフォワードフレームワークである。
このモジュールは、オフザシェルフ画像から3Dモデルに生成された3Dオブジェクトを、局所座標から世界座標に変換する。
論文 参考訳(メタデータ) (2026-03-06T04:54:23Z) - Drag4D: Align Your Motion with Text-Driven 3D Scene Generation [77.79131321983677]
Drag4Dはインタラクティブなフレームワークで、テキスト駆動の3Dシーン生成にオブジェクトの動き制御を統合する。
このフレームワークにより、ユーザーは単一の画像から生成された3Dオブジェクトに対して3Dトラジェクトリを定義し、それらを高品質な3D背景にシームレスに統合することができる。
論文 参考訳(メタデータ) (2025-09-26T05:23:45Z) - Towards Geometric and Textural Consistency 3D Scene Generation via Single Image-guided Model Generation and Layout Optimization [14.673302810271219]
幾何学的表現と高品質なテクスチャ情報を用いた3次元シーン生成のための新しい3段階フレームワークを提案する。
提案手法は, 個々の3次元モデルの幾何学的精度とテクスチャ忠実度の観点から, 最先端の手法よりも優れているだけでなく, シーンレイアウト合成において大きな利点がある。
論文 参考訳(メタデータ) (2025-07-20T06:59:42Z) - SCORP: Scene-Consistent Object Refinement via Proxy Generation and Tuning [46.441761732998536]
プロキシジェネレーションとチューニング(SCORP)によるシーン一貫性オブジェクトリファインメント(Scene-Consistent Object Refinement)について紹介する。
SCORP は、3D 生成に先立って細粒度なオブジェクトの形状と外観を復元する新しい3D拡張フレームワークである。
これは、新しいビュー合成と幾何完成タスクの両方において、最近の最先端のベースラインに対して一貫した利得を達成する。
論文 参考訳(メタデータ) (2025-06-30T13:26:21Z) - Constructing a 3D Scene from a Single Image [31.11317559252235]
SceneFuse-3Dは、単一のトップダウンビューからコヒーレントな3Dシーンを合成するために設計されたトレーニング不要のフレームワークである。
入力画像を重なり合う領域に分解し、事前訓練された3Dオブジェクトジェネレータを用いてそれぞれを生成する。
このモジュラー設計により、3次元の監督や微調整を必要とせず、解像度のボトルネックを克服し、空間構造を維持できる。
論文 参考訳(メタデータ) (2025-05-21T17:10:47Z) - HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation [50.206100327643284]
HiSceneは、2D画像生成と3Dオブジェクト生成のギャップを埋める新しい階層的なフレームワークである。
構成構造を維持しながら2次元表現に整合した3次元コンテンツを生成する。
論文 参考訳(メタデータ) (2025-04-17T16:33:39Z) - SceneWiz3D: Towards Text-guided 3D Scene Composition [134.71933134180782]
既存のアプローチでは、大規模なテキスト・ツー・イメージモデルを使用して3D表現を最適化するか、オブジェクト中心のデータセット上で3Dジェネレータをトレーニングする。
テキストから高忠実度3Dシーンを合成する新しい手法であるSceneWiz3Dを紹介する。
論文 参考訳(メタデータ) (2023-12-13T18:59:30Z) - Graph-to-3D: End-to-End Generation and Manipulation of 3D Scenes Using
Scene Graphs [85.54212143154986]
制御可能なシーン合成は、基本的な仕様を満たす3D情報を生成することで構成される。
シーングラフは、オブジェクト(ノード)とオブジェクト間の関係(エッジ)からなるシーンの表現である
本稿では,シーングラフから形状を直接エンドツーエンドに生成する手法を提案する。
論文 参考訳(メタデータ) (2021-08-19T17:59:07Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。