論文の概要: The Midas Touch for Metric Depth
- arxiv url: http://arxiv.org/abs/2605.11578v1
- Date: Tue, 12 May 2026 06:03:26 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-13 21:48:56.617015
- Title: The Midas Touch for Metric Depth
- Title(参考訳): メートル法深度に対するMidas Touch
- Authors: Yu Ma, Zizhan Guo, Zuyi Xiong, Haoran Zhang, Yi Feng, Hongbo Zhao, Hanli Wang, Rui Fan,
- Abstract要約: 我々は, 相対深度を測度深度に変換する数学的解釈可能なアプローチである textbfDepth (MTD) 用の emphtextbfMidas textbfTouch を提案する。
MTDは, 従来の深度推定法と深度推定法よりも強い一般化と精度の向上を示す。
- 参考スコア(独自算出の注目度): 27.177710456063878
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Recent advances have markedly improved the cross-scene generalization of relative depth estimation, yet its practical applicability remains limited by the absence of metric scale, local inconsistencies, and low computational efficiency. To address these issues, we present \emph{\textbf{M}idas \textbf{T}ouch for \textbf{D}epth} (MTD), a mathematically interpretable approach that converts relative depth into metric depth using only extremely sparse 3D data. To eliminate local scale inconsistencies, it applies a segment-wise recovery strategy via sparse graph optimization, followed by a pixel-wise refinement strategy using a discontinuity-aware geodesic cost. MTD exhibits strong generalization and achieves substantial accuracy improvements over previous depth completion and depth estimation methods. Moreover, its lightweight, plug-and-play design facilitates deployment and integration on diverse downstream 3D tasks. Project page is available at https://mias.group/MTD.
- Abstract(参考訳): 最近の進歩は相対深度推定のクロスシーン一般化を著しく改善しているが、その実用性は計量スケールの欠如、局所的不整合、計算効率の低さによって制限されている。
これらの問題に対処するために、非常にスパースな3Dデータのみを用いて相対深度を計量深度に変換する数学的に解釈可能なアプローチである \textbf{D}epth} (MTD) に対して \emph{\textbf{M}idas \textbf{T}ouch を示す。
局所的なスケールの不整合を解消するため、スパースグラフ最適化によるセグメントワイドリカバリ戦略を適用し、不連続性を考慮した測地コストを用いた画素ワイドリカバリ戦略を適用した。
MTDは強い一般化を示し、従来の深度補完法や深度推定法よりもかなり精度が向上する。
さらに、軽量でプラグアンドプレイなデザインは、様々な下流3Dタスクへの展開と統合を容易にする。
プロジェクトページはhttps://mias.group/MTD.comで公開されている。
関連論文リスト
- Learning Image-Adaptive Scale Fields for Metric Depth Recovery [13.22167540260594]
我々は、画像適応型スケール場モデリングとしてメートル法深度復元を定式化する。
深度を直接補正する代わりに、画像適応基底写像の低次元線形結合として補正を再構成する。
この定式化により、測定深度精度の向上、極端アンカー間隔下での強靭性、空間スケール変動の解釈可能な分解が得られる。
論文 参考訳(メタデータ) (2026-05-08T08:13:02Z) - MDE-VIO: Enhancing Visual-Inertial Odometry Using Learned Depth Priors [8.2208199207543]
本稿では,アフィン不変深度一貫性と対方向順序制約を強制する新しいフレームワークを提案する。
このアプローチは、計量スケールを頑健に回復しながら、エッジデバイスの計算限界に厳密に固執する。
論文 参考訳(メタデータ) (2026-02-11T19:53:06Z) - Revisiting Depth Representations for Feed-Forward 3D Gaussian Splatting [57.43483622778394]
本稿では,事前学習した変圧器によって予測される点マップに基づく新しい正規化損失PM-Lossを紹介する。
改良された深度マップにより,様々なアーキテクチャやシーンのフィードフォワード3DGSを大幅に改善する。
論文 参考訳(メタデータ) (2025-06-05T17:58:23Z) - RDG-GS: Relative Depth Guidance with Gaussian Splatting for Real-time Sparse-View 3D Rendering [13.684624443214599]
本稿では,3次元ガウススプラッティングに基づく相対深度誘導を用いた新しいスパースビュー3DレンダリングフレームワークRDG-GSを提案する。
中心となる革新は、相対的な深度誘導を利用してガウス場を洗練させ、ビュー一貫性のある空間幾何学的表現に向けてそれを操ることである。
Mip-NeRF360, LLFF, DTU, Blenderに関する広範な実験を通じて、RDG-GSは最先端のレンダリング品質と効率を実証している。
論文 参考訳(メタデータ) (2025-01-19T16:22:28Z) - Volumetric Semantically Consistent 3D Panoptic Mapping [77.13446499924977]
非構造環境における自律エージェントに適したセマンティック3Dマップを生成することを目的としたオンライン2次元から3次元のセマンティック・インスタンスマッピングアルゴリズムを提案する。
マッピング中にセマンティック予測の信頼性を統合し、セマンティックおよびインスタンス一貫性のある3D領域を生成する新しい方法を導入する。
提案手法は,パブリックな大規模データセット上での最先端の精度を実現し,多くの広く使用されているメトリクスを改善した。
論文 参考訳(メタデータ) (2023-09-26T08:03:10Z) - Towards 3D Scene Reconstruction from Locally Scale-Aligned Monocular
Video Depth [90.33296913575818]
映像深度推定や映像からの3次元シーン再構成のようなビデオベースのシナリオでは、フレームごとの予測における未知のスケールとシフトが深度の不整合を引き起こす可能性がある。
局所重み付き線形回帰法を提案する。
提案手法は,複数のゼロショットベンチマークにおいて,既存の最先端手法の性能を50%向上させることができる。
論文 参考訳(メタデータ) (2022-02-03T08:52:54Z) - Virtual Normal: Enforcing Geometric Constraints for Accurate and Robust
Depth Prediction [87.08227378010874]
深度予測における高次3次元幾何学的制約の重要性を示す。
単純な幾何学的制約を強制する損失項を設計することにより、単眼深度推定の精度とロバスト性を大幅に改善する。
The-of-the-art results of learning metric depth on NYU Depth-V2 and KITTI。
論文 参考訳(メタデータ) (2021-03-07T00:08:21Z) - Occlusion-Aware Depth Estimation with Adaptive Normal Constraints [85.44842683936471]
カラービデオから多フレーム深度を推定する新しい学習手法を提案する。
本手法は深度推定精度において最先端の手法より優れる。
論文 参考訳(メタデータ) (2020-04-02T07:10:45Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。