論文の概要: Seeing Before Generating: Object Perception Enhances Single-View 3D Reconstruction
- arxiv url: http://arxiv.org/abs/2607.18630v1
- Date: Tue, 21 Jul 2026 01:55:24 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-22 19:05:05.29166
- Title: Seeing Before Generating: Object Perception Enhances Single-View 3D Reconstruction
- Title(参考訳): 生成前を見る: 物体知覚は単一視点の3D再構成を促進する
- Abstract要約: 学習対象の知覚は3次元再構成を著しく向上させることができることを示す。
本研究では,事前学習した知覚モデルから抽出した知覚信号を利用する手法を提案する。
我々のアプローチはモデルに依存しないものであり、プラグアンドプレイ方式で様々な再構成手法に統合することができる。
- 参考スコア(独自算出の注目度): 6.264701896062822
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: The relationship between object perception and reconstruction is well established in human vision, yet remains underexplored in computer vision. In this paper, we demonstrate that learnt object perception can significantly enhance 3D reconstruction. Focusing on the challenging task of single-view 3D object reconstruction, we propose a method that leverages perceptual signals extracted from pretrained perception models capturing semantic and geometric information to drive the reconstruction of an object from its single image. Our approach is model-agnostic and can be integrated into various reconstruction methods in a plug-and-play manner. Experiments with two state-of-the-art single-view 3D reconstruction pipelines in a benchmark dataset show consistent and substantial improvements achieved by our method, validating the effectiveness of incorporating perception into generation. We provide in-depth analysis of various aspects of our method and its application. Our project page is at https://ynhuhuynh.github.io/perception-3d/.
- Abstract(参考訳): 物体認識と再構成の関係は人間の視覚ではよく確立されているが、コンピュータビジョンでは未解明のままである。
本稿では,学習対象の知覚が3次元再構成を著しく向上させることを実証する。
単視点3次元物体再構成の課題に焦点をあて,意味的および幾何学的情報を抽出した事前学習された知覚モデルから抽出した知覚信号を利用して,物体を単一画像から再構成する手法を提案する。
我々のアプローチはモデルに依存しないものであり、プラグアンドプレイ方式で様々な再構成手法に統合することができる。
ベンチマークデータセットにおける2つの最先端シングルビュー3D再構成パイプラインを用いた実験により、本手法により達成された一貫した実質的な改善が示され、認識を生成に組み込むことの有効性が検証された。
提案手法の様々な側面を詳細に解析し,その応用について述べる。
私たちのプロジェクトページはhttps://ynhuynh.github.io/perception-3d/です。
関連論文リスト
- When Does An Extra View Help? Adapting Single-View 3D Reconstruction with Extra Imagery [9.55951636411851]
ASV3Dは、単一ビューの3Dオブジェクト再構成を1つの追加イメージからサポートされたテストタイムデータに適用するためのフレームワークである。
ASV3Dを適用して、ベンチマークと実世界の両方のデータセット上で、最先端の2つのシングルビュー3D再構築パイプラインを改善します。
論文 参考訳(メタデータ) (2026-08-08T13:39:28Z) - Pano3D: Unified 3D Reconstruction and Panoptic Segmentation [68.18993232814061]
統合されたフレームワークで3次元再構成と3次元パノプティクスのセグメンテーションを行う手法を提案する。
既存の3次元再構成モデルを構築し,それをマスクデコーダで拡張する。
提案手法は,ScanNet,ScanNet200,ScanNet++データセット間の3次元パノプティクスセグメンテーションにおける最先端性能を実現する。
論文 参考訳(メタデータ) (2026-06-12T09:43:13Z) - DecoRec: Decomposed 3D Scene Reconstruction from Single-View Images via Object-Level Diffusion [65.65756111062005]
textitDecoRecは、単一のビュー2D画像を分解された3Dシーンメッシュに高めるように設計されたシステムである。
以上の結果から,DecoRecはジオメトリと新規合成の両面において,高品質なワンビューシーン再構築を促進することが示唆された。
論文 参考訳(メタデータ) (2026-05-16T04:23:48Z) - ShapeGraFormer: GraFormer-Based Network for Hand-Object Reconstruction from a Single Depth Map [11.874184782686532]
そこで本研究では, 現実的な3次元物体形状に対する最初のアプローチを提案し, 一つの深度マップから復元する。
我々のパイプラインは、入力されたボキセル化深度に1対1のマッピングを持つ、ボキセル化ハンドオブジェクト形状も予測する。
さらに、手動オブジェクトの相互作用に基づいて再構成された形状を洗練する別のGraFormerコンポーネントを追加する影響を示す。
論文 参考訳(メタデータ) (2023-10-18T09:05:57Z) - 3D-LatentMapper: View Agnostic Single-View Reconstruction of 3D Shapes [0.0]
視覚変換器(ViT)の中間潜時空間と共同画像テキスト表現モデル(CLIP)を高速かつ効率的なシングルビュー再構成(SVR)に活用する新しいフレームワークを提案する。
本研究ではShapeNetV2データセットを用いてSOTA法との比較実験を行い,本手法の有効性を実証する。
論文 参考訳(メタデータ) (2022-12-05T11:45:26Z) - Reconstructing Hand-Held Objects from Monocular Video [95.06750686508315]
本稿では,モノクロ映像から手持ち物体を再構成する手法を提案する。
トレーニングされたネットワークによってオブジェクトの幾何学を直接予測する最近の多くの手法とは対照的に、提案手法ではオブジェクトに先行する学習を一切必要としない。
論文 参考訳(メタデータ) (2022-11-30T09:14:58Z) - State of the Art in Dense Monocular Non-Rigid 3D Reconstruction [100.9586977875698]
モノクル2D画像から変形可能なシーン(または非剛体)の3D再構成は、コンピュータビジョンとグラフィックスの長年、活発に研究されてきた領域である。
本研究は,モノクラー映像やモノクラービューの集合から,様々な変形可能な物体や複合シーンを高密度に非剛性で再現するための最先端の手法に焦点を当てる。
論文 参考訳(メタデータ) (2022-10-27T17:59:53Z) - Single-view 3D Mesh Reconstruction for Seen and Unseen Categories [69.29406107513621]
シングルビュー3Dメッシュ再構成は、シングルビューRGB画像から3D形状を復元することを目的とした、基本的なコンピュータビジョンタスクである。
本稿では,一視点3Dメッシュ再構成に取り組み,未知のカテゴリのモデル一般化について検討する。
我々は、再構築におけるカテゴリ境界を断ち切るために、エンドツーエンドの2段階ネットワークであるGenMeshを提案する。
論文 参考訳(メタデータ) (2022-08-04T14:13:35Z) - Object Wake-up: 3-D Object Reconstruction, Animation, and in-situ
Rendering from a Single Image [58.69732754597448]
椅子の写真があれば、椅子の3次元形状を抽出し、その可愛らしい調音や動きをアニメーション化し、元の画像空間でその場でレンダリングできるだろうか?
単一画像中の調音対象を抽出・操作するための自動アプローチを考案する。
論文 参考訳(メタデータ) (2021-08-05T16:20:12Z) - A Divide et Impera Approach for 3D Shape Reconstruction from Multiple
Views [49.03830902235915]
物体の3次元形状を1つまたは複数の画像から推定することは、最近のディープラーニングによるブレークスルーによって人気を集めている。
本稿では,与えられた視点からの可視情報を統合することで,視点変化の再構築に頼ることを提案する。
提案手法を検証するために,相対的なポーズ推定と3次元形状再構成の観点から,ShapeNet参照ベンチマークの総合評価を行った。
論文 参考訳(メタデータ) (2020-11-17T09:59:32Z) - 3D Reconstruction of Novel Object Shapes from Single Images [23.016517962380323]
提案するSDFNetは,目に見える形状と見えない形状の最先端性能を実現する。
本研究は, 画像形状再構成の大規模評価を行った最初の試みである。
論文 参考訳(メタデータ) (2020-06-14T00:34:26Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。