論文の概要: HierRelTriple: Guiding Indoor Layout Generation with Hierarchical Relationship Triplet Losses
- arxiv url: http://arxiv.org/abs/2503.20289v2
- Date: Tue, 16 Sep 2025 03:01:36 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-09-17 15:46:32.603125
- Title: HierRelTriple: Guiding Indoor Layout Generation with Hierarchical Relationship Triplet Losses
- Title(参考訳): HierRelTriple: 階層的三重項損失による屋内レイアウト生成の誘導
- Abstract要約: 本稿では,空間的関係学習に着目した階層型三重項に基づく屋内関係学習手法HierRelTripleを提案する。
階層型リレーショナル三重項モデリングフレームワークであるHierRelTripleを導入する。
非条件レイアウト合成、フロアプラン条件付きレイアウト生成、シーン再構成の実験により、HierRelは空間関係のメトリクスを15%以上改善することを示した。
- 参考スコア(独自算出の注目度): 52.70183252341687
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We present a hierarchical triplet-based indoor relationship learning method, coined HierRelTriple, with a focus on spatial relationship learning. Existing approaches often depend on manually defined spatial rules or simplified pairwise representations, which fail to capture complex, multi-object relationships found in real scenarios and lead to overcrowded or physically implausible arrangements. We introduce HierRelTriple, a hierarchical relational triplets modeling framework that first partitions functional regions and then automatically extracts three levels of spatial relationships: object-to-region (O2R), object-to-object (O2O), and corner-to-corner (C2C). By representing these relationships as geometric triplets and employing approaches based on Delaunay Triangulation to establish spatial priors, we derive IoU loss between denoised and ground truth triplets and integrate them seamlessly into the diffusion denoising process. The introduction of the joint formulation of inter-object distances, angular orientations, and spatial relationships enhances the physical realism of the generated scenes. Extensive experiments on unconditional layout synthesis, floorplan-conditioned layout generation, and scene rearrangement demonstrate that HierRelTriple improves spatial-relation metrics by over 15% and substantially reduces collisions and boundary violations compared to state-of-the-art methods.
- Abstract(参考訳): 本稿では,空間的関係学習に着目した階層型三重項に基づく屋内関係学習手法HierRelTripleを提案する。
既存のアプローチは、しばしば手動で定義された空間規則や単純化されたペアワイズ表現に依存しており、実際のシナリオで見いだされる複雑な多目的関係を捉えず、過密あるいは物理的に不可解な配置に繋がる。
階層型リレーショナル・トリプル・モデリング・フレームワークであるHierRelTripleを導入し,まず機能領域を分割し,次にオブジェクト・ツー・リージョン(O2R),オブジェクト・トゥ・オブジェクト(O2O),コーナー・トゥ・コーナ(C2C)の3段階の空間関係を自動的に抽出する。
これらの関係を幾何学的三重項として表現し,空間的先行性を確立するためにDlaunay Triangulationに基づくアプローチを採用することにより,IoUの減少と地中真理三重項の減少を導出し,拡散復調過程にシームレスに統合する。
オブジェクト間距離、角方向、空間的関係の合同定式化の導入により、生成されたシーンの物理的リアリズムが向上する。
非条件のレイアウト合成, フロアプラン付きレイアウト生成, シーン再構成に関する大規模な実験により, HierRelTriple は空間関係の指標を15%以上改善し, 衝突や境界違反を最先端の手法と比較して大幅に低減することを示した。
関連論文リスト
- USR-Drive: Unified Driving Scene Representation via Joint Denoising of 3D Gaussians and Boxes [57.4583999658488]
自律運転のための空間表現学習は、生の視覚信号を構造化された3次元シーン表現にマッピングすることを目的としている。
既存の方法は動的再構成とインスタンスレベルの認識を別々のタスクとして扱う。
共有シーン表現における高密度な動的幾何とインスタンスレベルのオブジェクトレイアウトを復元する統一条件生成フレームワークUSR-Driveを提案する。
論文 参考訳(メタデータ) (2026-08-19T15:29:06Z) - SeeSE3: Emergence of 3D Space in Vision Features [54.140615953727355]
視覚特徴空間の構造とユークリッド変換群$SE(3)$の関係について検討する。
本研究は、3次元ユークリッド空間と非常に強く相関する潜在部分空間を有する自己監督型視覚モデルについて,原理的に3次元の直接監督やアクティブエージェンシーの訓練を受けていないことを示す。
本稿では,視覚計測と局所化を潜在空間で純粋に行う「潜時空間ナビゲーション」技術について,明示的な3次元再構成の必要性を回避して提案する。
論文 参考訳(メタデータ) (2026-07-15T18:00:31Z) - SpaceEra++: A Unified Framework Towards 3D Spatial Reasoning in Video [88.79625979053873]
事前学習型視覚言語モデル(VLM)のための新しいフレームワークSpaceEraを提案する。
データ構築、モデル設計、トレーニング最適化、推論の促進にまたがる、SpaceEra++と呼ばれる、オリジナルのフレームワークを包括的なシステムに拡張します。
さらに,空間的推論を強化するために,絶対座標と相対空間関係を協調的に利用することにより,対物制約を強制するSpaceAlignを開発した。
論文 参考訳(メタデータ) (2026-07-02T06:56:29Z) - Reinforcing Dual-Path Reasoning in Spatial Vision Language Models [113.86271063627782]
本稿では,空間的VLMにLOR(Language-Only Reasoning)とDTR(Detect-Then-Reason)の2つの相補的推論経路を持つ統一的なフレームワークを提案する。
様々な空間ベンチマークにおいて、SR-REALは空間的VLMベースラインを著しく上回る。
論文 参考訳(メタデータ) (2026-06-16T05:32:39Z) - Beyond Point-Wise Matching: Structural Representation Alignment for Accelerating Diffusion Transformers [93.3976834364707]
本稿では,特徴写像のリレーショナル幾何における整合性を実現する構造的RePresentation AlignmentフレームワークであるsREPAを提案する。
モデルが事前訓練された特徴から全体的空間配置と構造的相関を内包するように促すことにより、sREPAはより高速でより安定した収束を達成する。
論文 参考訳(メタデータ) (2026-05-16T12:01:04Z) - Orchestrating Spatial Semantics via a Zone-Graph Paradigm for Intricate Indoor Scene Generation [18.745553312257503]
自律的な3次元室内合成のための統合フレームワークである ZoneMaestro を提案する。
ZoneMaestroは、新しいトポロジベースのロジックを内部化することによって、高レベルのセマンティックインテントを機能ゾーンと制約に変換する。
ゾーンマエストロは, 密度安全二分法を, 構造的コヒーレンスとインテンションの両面において, 最先端のベースラインを著しく上回っていることを示す。
論文 参考訳(メタデータ) (2026-05-04T12:40:37Z) - INST-Align: Implicit Neural Alignment for Spatial Transcriptomics via Canonical Expression Fields [1.0487944945684993]
INST-Alignは、座標ベースの変形ネットワークと共有カノニカル表現場を結合する。
最先端の平均OT精度(0.702)、NN精度(0.719)、チャンファー距離(94.9%)を実現している。
また、生物学的に意味のある空間埋め込みとコヒーレントな3D組織再構築をもたらす。
論文 参考訳(メタデータ) (2026-04-13T21:44:18Z) - Pair2Scene: Learning Local Object Relations for Procedural Scene Generation [10.247549170637418]
Pair2Sceneは、学習したローカルルールとシーン階層と物理ベースのアルゴリズムを統合する新しい手続き生成フレームワークである。
私たちのフレームワークは、トレーニングデータを超えた複雑な環境を生成する上で、既存の手法よりも優れています。
論文 参考訳(メタデータ) (2026-04-13T17:59:55Z) - Riemannian and Symplectic Geometry for Hierarchical Text-Driven Place Recognition [6.392844932864485]
SympLocは、粗い段階における多レベルアライメントを備えた、新しい粗大な局所化フレームワークである。
既存の最先端のアプローチと比較して、Top-1リコール@10mでは19%改善されている。
論文 参考訳(メタデータ) (2026-04-02T04:13:42Z) - GFLAN: Generative Functional Layouts [1.1458853556386797]
GFLANは、フロアプラン合成を明示的な因子化によって、トポロジカルプランニングと幾何学的実現に再構成する生成フレームワークである。
提案手法は,2段階分解の原理を優先して,直接画素間あるいは壁面追跡生成から逸脱する。
論文 参考訳(メタデータ) (2025-12-18T07:52:47Z) - SVRecon: Sparse Voxel Rasterization for Surface Reconstruction [60.92372415355283]
我々は最近提案されたスパースボキセル化パラダイムをSVReconの統合により高忠実度表面再構成の課題に拡張する。
本手法は, 常に高速な収束を保ちながら, 強い復元精度を実現する。
論文 参考訳(メタデータ) (2025-11-21T16:32:01Z) - Follow My Hold: Hand-Object Interaction Reconstruction through Geometric Guidance [61.41904916189093]
単眼RGB画像から手持ち物体の3次元形状を再構成する拡散法に基づく新しいフレームワークを提案する。
我々は手オブジェクト間相互作用を幾何学的ガイダンスとして使用し、手オブジェクト間相互作用を確実にする。
論文 参考訳(メタデータ) (2025-08-25T17:11:53Z) - Preserving Topological and Geometric Embeddings for Point Cloud Recovery [43.26116605528137]
我々は、サンプリングおよび復元フェーズを通じてこれらの重要な特性を維持する、textbfTopGeoFormer というエンドツーエンドアーキテクチャを提案する。
実験では,従来型および学習型サンプリング/アップ/リカバリアルゴリズムを用いて,環境を包括的に分析する。
論文 参考訳(メタデータ) (2025-07-25T09:58:41Z) - Learning to Align and Refine: A Foundation-to-Diffusion Framework for Occlusion-Robust Two-Hand Reconstruction [50.952228546326516]
単眼画像からの両手再建は、複雑でダイナミックな手の位置が原因で、永続的な課題に直面している。
既存のアプローチはそのようなアライメントの問題に悩まされ、しばしば不整合と侵入の成果物をもたらす。
本稿では,視覚基礎モデルからの2次元事前ガイダンスを正確に整合させる2段階のファンデーション・ツー・ディフュージョンフレームワークを提案する。
論文 参考訳(メタデータ) (2025-03-22T14:42:27Z) - Mitigating Hallucinations in Multimodal Spatial Relations through Constraint-Aware Prompting [7.962140902232628]
空間的関係幻覚は大きな視覚言語モデル(LVLM)において永続的な課題を引き起こす
本研究では,空間的関係の幻覚を減らすための制約対応プロンプトフレームワークを提案する。
論文 参考訳(メタデータ) (2025-02-12T11:32:19Z) - "Set It Up!": Functional Object Arrangement with Compositional Generative Models [64.77941735876452]
未特定命令の解釈を学習するためのフレームワークであるSetItUpを導入する。
研究デスク,ダイニングテーブル,コーヒーテーブルからなるデータセット上で,我々のフレームワークを検証する。
論文 参考訳(メタデータ) (2024-05-20T10:06:33Z) - RTF: Region-based Table Filling Method for Relational Triple Extraction [17.267920424291372]
本稿では,知識グラフからトリプルを抽出する領域ベースのテーブルフィリング手法を提案する。
そこで我々は,各トリプルを関係特化テーブル上の領域とみなし,各領域の2つのエンドポイントを決定することで3つを識別する,新しい領域ベースのタグ付け手法と双方向デコーディング戦略を考案した。
提案手法は,2つの広く使用されているベンチマークデータセットの3変種に対して,より優れた一般化を実現することを示す実験結果を得た。
論文 参考訳(メタデータ) (2024-04-29T23:36:38Z) - Serving Deep Learning Model in Relational Databases [70.53282490832189]
リレーショナルデータ上での深層学習(DL)モデルの実現は、様々な商業分野や科学分野において重要な要件となっている。
最先端のDL中心アーキテクチャは、DL計算を専用のDLフレームワークにオフロードします。
UDF中心アーキテクチャの可能性は、リレーショナルデータベース管理システム(RDBMS)内の1つ以上のテンソル計算をユーザ定義関数(UDF)にカプセル化する。
論文 参考訳(メタデータ) (2023-10-07T06:01:35Z) - LAW-Diffusion: Complex Scene Generation by Diffusion with Layouts [107.11267074981905]
LAW拡散(LAW-Diffusion)と呼ばれる意味制御可能なレイアウト・AWare拡散モデルを提案する。
LAW拡散は、特にコヒーレントな対象関係を持つ最先端の生成性能をもたらすことを示す。
論文 参考訳(メタデータ) (2023-08-13T08:06:18Z) - RE$^2$: Region-Aware Relation Extraction from Visually Rich Documents [18.369611871952667]
本稿では,各ブロック間の領域レベルの空間構造を利用して関係予測を改善するRegion-Aware Relation extract (RE$2$)を提案する。
また、関係抽出タスクの固有の制約との整合性に向けてモデルを規則化するための制約目標も導入する。
論文 参考訳(メタデータ) (2023-05-24T00:07:40Z) - Learning Relation-Specific Representations for Few-shot Knowledge Graph
Completion [24.880078645503417]
本稿では,三重項のグラフコンテキストを利用して関係と実体のセマンティック情報を同時に取得する関係特化文脈学習フレームワークを提案する。
2つの公開データセットの実験結果は、RSCLが最先端のFKGC法より優れていることを示している。
論文 参考訳(メタデータ) (2022-03-22T11:45:48Z) - Few Shot Generative Model Adaption via Relaxed Spatial Structural
Alignment [130.84010267004803]
限られたデータでGAN(Generative Adversarial Network)を訓練することは難しい課題である。
実現可能な解決策は、大規模なソースドメインで十分に訓練されたGANから始め、ターゲットドメインにいくつかのサンプルで適応することである。
本研究では,適応時の対象生成モデルのキャリブレーションを行うための緩和された空間構造アライメント手法を提案する。
論文 参考訳(メタデータ) (2022-03-06T14:26:25Z) - Learning to Compose Visual Relations [100.45138490076866]
我々は,各関係を非正規化密度(エネルギーベースモデル)として表現することを提案する。
このような分解を分解することで、複数の関係を持つシーンをより忠実に生成・編集できることを示す。
論文 参考訳(メタデータ) (2021-11-17T18:51:29Z) - Joint Constrained Learning for Event-Event Relation Extraction [94.3499255880101]
本稿では,イベント・イベント関係をモデル化するための制約付き協調学習フレームワークを提案する。
具体的には、このフレームワークは、複数の時間的および部分的関係内の論理的制約を強制する。
我々は,共同学習手法が,共同ラベル付きデータの欠如を効果的に補うことを示す。
論文 参考訳(メタデータ) (2020-10-13T22:45:28Z) - Intrinsic Relationship Reasoning for Small Object Detection [44.68289739449486]
画像やビデオの小さなオブジェクトは通常、独立した個人ではない。その代わりに、意味的および空間的レイアウトの関係を多かれ少なかれ提示する。
本稿では,オブジェクト間の固有意味と空間的レイアウトの関係をモデル化し,推論する,小さなオブジェクト検出のための新しいコンテキスト推論手法を提案する。
論文 参考訳(メタデータ) (2020-09-02T06:03:05Z) - DensE: An Enhanced Non-commutative Representation for Knowledge Graph
Embedding with Adaptive Semantic Hierarchy [4.607120217372668]
本研究では,関係の複雑な構成パターンをモデル化するための新しい知識グラフ埋め込み手法DensEを開発した。
本手法は,SO(3)群に基づく回転作用素と3次元ユークリッド空間におけるスケーリング作用素に各関係を分解する。
複数のベンチマーク知識グラフの実験結果から、DensEはリンク予測の欠如に対して現在の最先端モデルよりも優れていた。
論文 参考訳(メタデータ) (2020-08-11T06:45:50Z) - Understanding Spatial Relations through Multiple Modalities [78.07328342973611]
オブジェクト間の空間的関係は、空間的前置詞として表されるか、移動、歩行、移動などの空間的動詞によって表される。
画像中の2つの実体間の暗黙的・明示的な空間的関係を推定するタスクを導入する。
本研究では、テキスト情報と視覚情報の両方を用いて空間関係を予測し、物体の位置情報と大きさ情報と画像埋め込みを利用するモデルを設計する。
論文 参考訳(メタデータ) (2020-07-19T01:35:08Z) - On Embeddings in Relational Databases [11.52782249184251]
低次元埋め込みを用いた関係データベースにおけるエンティティの分散表現学習の問題に対処する。
近年の埋め込み学習法は,すべてのテーブルの完全結合をリレーショナル化し,知識グラフとして表すことにより,データベースの完全非正規化を考慮に入れたナイーブな手法である。
本稿では,テーブル内の列の基本的なセマンティクスを利用して表現を学習する上で,関係結合と潜時関係を用いて,より優れた方法論を実証する。
論文 参考訳(メタデータ) (2020-05-13T17:21:27Z) - Local Propagation in Constraint-based Neural Network [77.37829055999238]
ニューラルネットワークアーキテクチャの制約に基づく表現について検討する。
本稿では,いわゆるアーキテクチャ制約を満たすのに適した簡単な最適化手法について検討する。
論文 参考訳(メタデータ) (2020-02-18T16:47:38Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。