論文の概要: MultiCube: Compositional 3D Generation With Part-Level Semantic and Spatial Control
- arxiv url: http://arxiv.org/abs/2608.20448v1
- Date: Thu, 20 Aug 2026 17:44:48 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-24 14:49:32.108103
- Title: MultiCube: Compositional 3D Generation With Part-Level Semantic and Spatial Control
- Title(参考訳): MultiCube: 部分レベルセマンティックと空間制御による合成3D生成
- Abstract要約: MultiCubeは、各部分のセマンティクスと空間配置の両方を明示的かつ独立的に制御する構成的な3D生成方法である。
与えられた意味や空間条件に従属する、特定の部分ごとに1つのメッシュで構成された3Dオブジェクトを出力する。
- 参考スコア(独自算出の注目度): 43.67846683430802
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Digital 3D objects used in games and animation are often required to be compositional; that is, decomposed into semantically meaningful parts. Recent 3D generation methods can produce high-quality compositional objects conditioned on image or text prompts. Yet, such global conditioning lacks the precise part-level controllability required for professional creative workflows. To address this, we introduce MultiCube, a novel compositional 3D generation method that provides explicit, independent control over both the semantics and spatial arrangement of each part. MultiCube takes as input a global text prompt, a text schema specifying the desired parts, and a spatial layout indicating the bounding boxes of the parts in the given schema. It outputs a 3D object composed of distinct meshes, one per specified part, that adhere to the given semantic and spatial conditions. Our approach employs a two-stage diffusion process, first generating a schema- and layout-aligned monolithic mesh, then decomposing the mesh into individual parts simultaneously. A novel Part Layout Adapter is used to encode per-part conditions independently of the other parts. Experiments demonstrate that our method can generate high-quality compositional 3D objects with precise part-level control, including those with unique layouts difficult to achieve with text or image prompting alone. Project page: https://multi-cube.github.io
- Abstract(参考訳): ゲームやアニメーションで使用されるデジタル3Dオブジェクトは、しばしば構成を必要とする。
最近の3D生成手法は、画像やテキストのプロンプトに条件付けされた高品質な合成オブジェクトを生成することができる。
しかし、このようなグローバルな条件付けには、プロのクリエイティブワークフローに必要な、正確な部分レベルの制御性がない。
そこで本研究では,各部分のセマンティクスと空間配置の両方を明示的かつ独立的に制御する,新しい合成3D生成手法であるMultiCubeを紹介する。
MultiCubeは、グローバルテキストプロンプト、所望のパーツを指定するテキストスキーマ、および所定のスキーマ内の部品の境界ボックスを示す空間レイアウトを入力として取る。
与えられた意味や空間条件に従属する、特定の部分ごとに1つのメッシュで構成された3Dオブジェクトを出力する。
このアプローチでは、2段階の拡散プロセスを採用し、まずスキーマとレイアウトに整合したモノリシックメッシュを生成し、その後、メッシュを個別に分割する。
新たなPart Layout Adapterは、他の部分とは独立してパーツごとの条件をエンコードするために使用される。
実験により,テキストや画像のプロンプトを単独で行うのが困難な特徴的レイアウトを含む,高精度な部分レベル制御による高品質な合成3Dオブジェクトを生成できることが実証された。
プロジェクトページ:https://multi-cube.github.io
関連論文リスト
- SAM3D-Part: Interactive Part Selection and Generation from 3D Objects [20.379932054770588]
本稿では,入力3Dオブジェクトメッシュから選択部品を生成するためのプロンプト駆動型フレームワークSAM3D-Partを提案する。
SAM3D-Partはソースアライメントを大幅に改善し、コンディショニングコストを低減し、一貫した選択的部分生成を可能にする。
論文 参考訳(メタデータ) (2026-09-14T14:26:34Z) - CubePart: An Open-Vocabulary Part-Controllable 3D Generator [25.37244384706095]
オープン語彙と部分制御可能な3Dメッシュ生成のための生成フレームワークであるCubePartを提案する。
提案手法は,特定の意味構造を尊重しながら,コヒーレントなオブジェクトに集合するメッシュの集合を生成する。
結果の資産をゲームエンジンに直接組み込むことができ、手動の事後処理なしでアニメーションや動作スクリプトによって駆動できることを実証する。
論文 参考訳(メタデータ) (2026-05-27T17:22:38Z) - PartCrafter: Structured 3D Mesh Generation via Compositional Latent Diffusion Transformers [29.52313100024294]
1枚のRGB画像から複数の意味論的および幾何学的に異なる3Dメッシュを共同で合成する最初の構造化3D生成モデルであるPartCrafterを紹介する。
PartCrafterは同時に複数の3Dパーツを識別し、個々のオブジェクトと複雑な複数オブジェクトのシーンの両方をエンドツーエンドで生成する。
実験によると、PartCrafterは分解可能な3Dメッシュの生成において、既存のアプローチよりも優れています。
論文 参考訳(メタデータ) (2025-06-05T20:30:28Z) - PartGen: Part-level 3D Generation and Reconstruction with Multi-View Diffusion Models [63.1432721793683]
テキスト,画像,構造化されていない3Dオブジェクトから意味のある部分からなる3Dオブジェクトを生成する新しいアプローチであるPartGenを紹介する。
提案手法は, 生成された実物および実物の3次元資産に対して評価し, セグメンテーションおよび部分抽出ベースラインを大きなマージンで上回っていることを示す。
論文 参考訳(メタデータ) (2024-12-24T18:59:43Z) - Disentangled 3D Scene Generation with Layout Learning [109.03233745767062]
本稿では,コンポーネントオブジェクトに絡み合った3Dシーンを生成する手法を提案する。
私たちの重要な洞察は、オブジェクトは空間的に再構成された場合、同じシーンの有効な構成を生成する3Dシーンの一部を見つけることで発見できるということです。
単純さにもかかわらず、我々のアプローチは個々のオブジェクトに3Dシーンを生成することに成功している。
論文 参考訳(メタデータ) (2024-02-26T18:54:15Z) - TeMO: Towards Text-Driven 3D Stylization for Multi-Object Meshes [67.5351491691866]
我々は,多目的3Dシーンを解析し,そのスタイルを編集する,TeMOと呼ばれる新しいフレームワークを提案する。
提案手法は,高品質なスタイリングコンテンツを合成し,多目的3Dメッシュで既存手法より優れた性能を発揮する。
論文 参考訳(メタデータ) (2023-12-07T12:10:05Z) - Compositional 3D Scene Generation using Locally Conditioned Diffusion [49.5784841881488]
合成シーン拡散へのアプローチとして,テクスブフォローカライズ条件付き拡散を導入する。
本研究では, スコア蒸留によるテキスト・ツー・3D合成パイプラインを試作し, 関連するベースラインよりも高忠実度で合成3Dシーンを生成できることを示した。
論文 参考訳(メタデータ) (2023-03-21T22:37:16Z) - gCoRF: Generative Compositional Radiance Fields [80.45269080324677]
オブジェクトの3次元生成モデルにより、3次元制御によるフォトリアリスティック画像合成が可能となる。
既存の方法はシーンをグローバルなシーン表現としてモデル化し、シーンの構成的側面を無視します。
本稿では,オブジェクトの各意味部分を独立した3次元表現として表現する合成生成モデルを提案する。
論文 参考訳(メタデータ) (2022-10-31T14:10:44Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。