論文の概要: DisCo-Layout: Disentangling and Coordinating Semantic and Physical Refinement in a Multi-Agent Framework for 3D Indoor Layout Synthesis
- arxiv url: http://arxiv.org/abs/2510.02178v1
- Date: Thu, 02 Oct 2025 16:30:37 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-10-03 14:32:17.289594
- Title: DisCo-Layout: Disentangling and Coordinating Semantic and Physical Refinement in a Multi-Agent Framework for 3D Indoor Layout Synthesis
- Title(参考訳): DisCo-Layout:3次元室内レイアウト合成のためのマルチエージェントフレームワークにおけるセマンティックおよび物理リファインメントの分離とコーディネート
- Abstract要約: 3次元屋内レイアウト合成は仮想環境構築に不可欠である。
DisCoは、物理的および意味的な洗練を歪め、調整する新しいフレームワークである。
- 参考スコア(独自算出の注目度): 76.7196710324494
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: 3D indoor layout synthesis is crucial for creating virtual environments. Traditional methods struggle with generalization due to fixed datasets. While recent LLM and VLM-based approaches offer improved semantic richness, they often lack robust and flexible refinement, resulting in suboptimal layouts. We develop DisCo-Layout, a novel framework that disentangles and coordinates physical and semantic refinement. For independent refinement, our Semantic Refinement Tool (SRT) corrects abstract object relationships, while the Physical Refinement Tool (PRT) resolves concrete spatial issues via a grid-matching algorithm. For collaborative refinement, a multi-agent framework intelligently orchestrates these tools, featuring a planner for placement rules, a designer for initial layouts, and an evaluator for assessment. Experiments demonstrate DisCo-Layout's state-of-the-art performance, generating realistic, coherent, and generalizable 3D indoor layouts. Our code will be publicly available.
- Abstract(参考訳): 3次元屋内レイアウト合成は仮想環境構築に不可欠である。
従来の手法は、固定データセットによる一般化に苦慮している。
最近のLLMとVLMベースのアプローチはセマンティック・リッチネスを改善するが、しばしば堅牢で柔軟な改善が欠如し、最適以下のレイアウトをもたらす。
本研究では,身体的・意味的洗練を解消・調整する新しいフレームワークであるDisCo-Layoutを開発する。
独立した精細化のために,我々のセマンティック精細化ツール(SRT)は抽象オブジェクト関係を補正し,PRT(Physical Refinement Tool)はグリッドマッチングアルゴリズムを用いて具体的な空間問題を解消する。
協調的な改善のために、マルチエージェントフレームワークはこれらのツールをインテリジェントにオーケストレーションし、配置ルールのプランナー、初期レイアウトのデザイナ、評価のための評価器を備えている。
実験では、DisCo-Layoutの最先端のパフォーマンスを実証し、現実的で一貫性があり、一般化可能な3D屋内レイアウトを生成する。
私たちのコードは公開されます。
関連論文リスト
- ThinkBLOX: 3D Indoor Scene Generation with Progressive Reasoning [26.96786747869045]
我々は,3Dシーンを反復的に設計・洗練する進歩的推論フレームワークThinkBLOXを提案する。
ThinkBLOXは、レイアウト生成を状態条件付き、ステップバイステップの推論とアクションプロセスとして扱う。
近年のThinkBLOXは, 物理的妥当性, セマンティックアライメント, インタラクティブな編集性において, ワンショット, 反復ベースラインを著しく上回っている。
論文 参考訳(メタデータ) (2026-07-15T07:42:47Z) - SDesc3D: Towards Layout-Aware 3D Indoor Scene Generation from Short Descriptions [71.54559024212976]
短いテキスト記述を前提とした室内3次元シーン生成は,インタラクティブな3次元環境構築に有望な道を提供する。
既存の作品は、そのような意味的凝縮の場合、身体的妥当性の低下と詳細性の不足に悩まされている。
SDesc3Dは,マルチビュー構造と地域機能を考慮した,短文条件付き屋内シーン生成フレームワークである。
論文 参考訳(メタデータ) (2026-04-02T12:33:01Z) - Intelligent Co-Design: An Interactive LLM Framework for Interior Spatial Design via Multi-Modal Agents [0.0]
クライアントは設計知識を欠いているため、遅れたタイムラインや金銭的損失につながるため、通信ミスが頻繁に発生します。
生成的レイアウトツールの最近の進歩は、3Dビジュアライゼーションの自動化によってギャップを狭めている。
本研究では,自然言語記述や画像を動的に3D設計に変換するLLMベースのマルチモーダルマルチエージェントフレームワークを提案する。
論文 参考訳(メタデータ) (2026-03-16T14:28:51Z) - RoboLayout: Differentiable 3D Scene Generation for Embodied Agents [0.0]
RoboはLayoutVLMの拡張として導入され、エージェント対応推論と安定性の向上によってオリジナルのフレームワークを拡張している。
Roboは、明示的な到達性制約を異なる空間的に可能なレイアウト最適化プロセスに統合し、反復的なレイアウトの生成と、実施エージェントによるアクションを可能にする。
全体としてRoboは、エージェント中心の屋内シーンに適用性を高めながら、強いセマンティックアライメントと物理的妥当性を維持している。
論文 参考訳(メタデータ) (2026-02-18T08:17:05Z) - RoomEditor++: A Parameter-Sharing Diffusion Architecture for High-Fidelity Furniture Synthesis [89.26382925677301]
仮想家具の合成は、ホームデザインと電子商取引の応用を大いに約束する。
RoomEditor++は、パラメータ共有デュアル拡散バックボーンを備えた多用途拡散ベースアーキテクチャである。
RoomEditor++は、定量的メトリクス、質的評価、そして人間の嗜好研究の観点から、最先端のアプローチよりも優れている。
論文 参考訳(メタデータ) (2025-12-19T13:39:43Z) - Light-SQ: Structure-aware Shape Abstraction with Superquadrics for Generated Meshes [60.92139345612904]
我々は、新しいスーパークワッドリックベースの最適化フレームワークLight-SQを提案する。
本稿では,構造対応ボリューム分解によるブロック再配置戦略を提案する。
実験によると、Light-SQはスーパークワッドリックで効率よく、高忠実で、編集可能な形状の抽象化を可能にする。
論文 参考訳(メタデータ) (2025-09-29T16:18:32Z) - RoomCraft: Controllable and Complete 3D Indoor Scene Generation [51.19602078504066]
RoomCraftは、実際の画像、スケッチ、テキスト記述をコヒーレントな3D屋内シーンに変換するマルチステージパイプラインである。
このアプローチでは,シーン生成パイプラインと制約駆動最適化フレームワークを組み合わせる。
RoomCraftは、リアルでセマンティックなコヒーレントで視覚的に魅力的な部屋レイアウトを生成する上で、既存の方法よりもはるかに優れています。
論文 参考訳(メタデータ) (2025-06-27T15:03:17Z) - OptiScene: LLM-driven Indoor Scene Layout Generation via Scaled Human-aligned Data Synthesis and Multi-Stage Preference Optimization [54.60030826635478]
既存の屋内レイアウト生成手法は、プロンプト駆動と学習に基づく2つのカテゴリに分類される。
本稿では,大規模データセットである3D-SynthPlaceについて紹介する。
屋内レイアウト生成に最適化された強力なオープンソースLLMであるOptiSceneを紹介する。
論文 参考訳(メタデータ) (2025-06-09T09:13:06Z) - SceneLCM: End-to-End Layout-Guided Interactive Indoor Scene Generation with Latent Consistency Model [45.648346391757336]
SceneLCMは、レイアウト設計のためにLarge Language Model(LLM)をシーン最適化のためにLatent Consistency Model(LCM)と同期するエンドツーエンドフレームワークである。
SceneLCMは物理シミュレーションを統合することで物理的な編集をサポートし、永続的な物理リアリズムを実現した。
論文 参考訳(メタデータ) (2025-06-08T11:30:31Z) - Direct Numerical Layout Generation for 3D Indoor Scene Synthesis via Spatial Reasoning [27.872834485482276]
3D屋内シーン合成は、AIとデジタルコンテンツ作成の具体化に不可欠である。
既存のメソッドは、オープン語彙であり、きめ細かいユーザー指示に一致したシーンを生成するのに失敗する。
テキスト記述から数値的な3Dレイアウトを直接生成するフレームワークであるDirectを導入する。
論文 参考訳(メタデータ) (2025-06-05T17:59:42Z) - MetaSpatial: Reinforcing 3D Spatial Reasoning in VLMs for the Metaverse [5.745502268935752]
視覚言語モデル(VLM)における3次元空間推論の強化を目的とした,最初の強化学習ベースのフレームワークであるMetaSpatialを提案する。
我々のキーとなる革新はマルチターン RL ベースの最適化機構で、物理認識の制約とレンダリングされた画像評価を統合し、生成した3Dレイアウトが整合的で、物理的に妥当で、審美的に整合していることを保証する。
論文 参考訳(メタデータ) (2025-03-24T09:18:01Z) - LayoutVLM: Differentiable Optimization of 3D Layout via Vision-Language Models [57.92316645992816]
空間的推論は人間の認知の基本的側面であり、三次元空間における物体の直感的な理解と操作を可能にする。
視覚言語モデル(VLM)のセマンティック知識を活用するフレームワークおよびシーンレイアウト表現であるLayoutVLMを紹介する。
本稿では,既存のシーンデータセットから抽出したシーンレイアウト表現を用いた微調整VLMによる推論性能の向上を実証する。
論文 参考訳(メタデータ) (2024-12-03T06:15:04Z) - Mixed Diffusion for 3D Indoor Scene Synthesis [55.94569112629208]
提案するMiDiffusionは,可塑性3次元屋内シーンを合成するための混合離散連続拡散モデルである。
床条件の3次元シーン合成において,最先端の自己回帰モデルおよび拡散モデルより優れることを示す。
論文 参考訳(メタデータ) (2024-05-31T17:54:52Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。