論文の概要: WAT3R: Feedforward Underwater 3D Reconstruction
- arxiv url: http://arxiv.org/abs/2607.21023v1
- Date: Thu, 23 Jul 2026 08:07:43 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-24 18:26:25.329747
- Title: WAT3R: Feedforward Underwater 3D Reconstruction
- Title(参考訳): WAT3R:フィードフォワード水中3D再構築
- Abstract要約: WAT3Rは水中画像から直接3Dシーンを再構築するためのフィードフォワードフレームワークである。
幾何学的制約のあるプロセスとして適応を活用することで、WAT3Rは軽量なニューラルネットワーク適応モジュールを統合する。
WAT3Rは3次元再構成作業における最先端の手法よりも一貫して優れていることを示す。
- 参考スコア(独自算出の注目度): 33.441820956688396
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Reliable feedforward underwater 3D reconstruction remains challenging due to severe light attenuation and backscattering, which degrade visual quality and disrupt feature consistency across views, leading to inaccurate multi-view geometry. To address this issue, we propose WAT3R, a feed-forward framework for reconstructing 3D scenes directly from underwater images. By leveraging degradation adaptation as a geometry-constrained process, WAT3R integrates a lightweight neural adaptation module to flexibly account for these underwater imaging effects, thereby improving multi-view reconstruction quality. Implemented in a single forward pass, WAT3R directly and efficiently outputs pixel-aligned 3D point maps and camera poses from underwater videos, allowing a high-quality underwater 3D reconstruction. Experiments conducted on the FLSea, SQUID, and USOD10K datasets show that our method consistently outperforms state-of-the-art approaches on 3D reconstruction tasks, including multi-view/monocular depth estimation and camera pose estimation.
- Abstract(参考訳): 高い光減衰と後方散乱のため、信頼性の高い水中3D再構成は依然として困難であり、視覚的品質を低下させ、ビュー全体の特徴の整合性を損なうため、不正確なマルチビュー幾何をもたらす。
この問題に対処するために,水中画像から直接3Dシーンを再構成するためのフィードフォワードフレームワークであるWAT3Rを提案する。
分解適応を幾何学的に制約されたプロセスとして活用することにより、WAT3Rは軽量なニューラルネットワーク適応モジュールを統合し、これらの水中イメージング効果を柔軟に考慮し、多視点再構成の品質を向上させる。
ワンフォワードパスで実装されたWAT3Rは、水中ビデオからピクセル対応の3Dポイントマップとカメラのポーズを直接効率よく出力し、高品質な水中3D再構築を可能にする。
FLSea, SQUID, USOD10Kデータセットを用いて行った実験により, 多視点・眼深度推定やカメラポーズ推定などの3次元再構成作業における最先端の手法を一貫して上回っていることが示された。
関連論文リスト
- 3D-USE: From Image-Level to Scene-Level Underwater Enhancement [54.11922584483346]
水中のシーンレベル向上(USE)
強化のための信頼性のあるシーン表現と、強化された3Dデータをペア化せずに一貫した拡張ターゲットを使用する。
水中での実際の実験では、視界と視界の整合性が向上し、復元品質が保たれた。
論文 参考訳(メタデータ) (2026-08-28T07:34:13Z) - AquaFlow: A Monocular Gaussian Splatting SLAM for Underwater Streaming Reconstruction [14.336895166294623]
高速かつ高忠実な水中再構成のためのストリーミング再構成フレームワークであるAquaFlowを提案する。
我々は、ロバストポーズとポイントマップ推定のための大規模水中データに基づく3次元視覚基盤モデルを微調整する。
我々は、構造化された距離条件のニューラルガウスと物理に着想を得た光学モデルを統合する、ストリーミング互換なハイブリッドシーン表現を開発する。
論文 参考訳(メタデータ) (2026-08-24T07:39:07Z) - Wat3R: Underwater 3D Geometry Learning without Annotations [58.91163632674025]
水中環境における3D形状の推定は、光の減衰、散乱、大規模で高品質な3Dアノテーションの欠如による固有の課題を示す。
本稿では,空中から水中へのフィードフォワード3D再構成モデルの適用を目的とした,クロスドメイン半教師付き学習フレームワークWat3Rを提案する。
論文 参考訳(メタデータ) (2026-07-09T17:59:58Z) - Geometry-Aware Representation Denoising for Robust Multi-view 3D Reconstruction [36.377286063905395]
フィードフォワード3次元再構成モデルの特徴空間に直接拡散に基づく多視点復元を行う新しいフレームワークであるGeometry-Aware Representation Denoising (GARD)を提案する。
この設計は、3次元再構成器の幾何学的特徴表現を利用して、正確なシーン形状を効果的に復元する。
追加のRGBイメージデコーダを使用することで、高品質なRGBイメージの復元にも使用できる。
論文 参考訳(メタデータ) (2026-05-25T18:01:05Z) - VISO: Robust Underwater Visual-Inertial-Sonar SLAM with Photometric Rendering for Dense 3D Reconstruction [2.095709224275874]
VISOは、ステレオカメラと慣性測定ユニット(IMU)と3Dソナーを融合させる堅牢な水中SLAMシステムである。
我々は,VISOが現在最先端の水中および視覚に基づくSLAMアルゴリズムを,ローカライゼーションの堅牢性と精度の観点から上回っていることを示す。
論文 参考訳(メタデータ) (2026-01-03T10:18:09Z) - From Restoration to Reconstruction: Rethinking 3D Gaussian Splatting for Underwater Scenes [13.730810237133822]
水中画像復元(UIR)を3次元ガウススプラッティング(DGS)でブリッジする統合フレームワークである textbfR-Splatting を提案する。
提案手法は,多様なUIRモデルによって生成された複数の拡張ビューを1つの再構築パイプラインに統合する。
Seathru-NeRFと新しいBlueCoral3Dデータセットの実験により、R-Splattingはレンダリング品質と幾何学的精度の両方において、強いベースラインを上回ります。
論文 参考訳(メタデータ) (2025-09-22T13:50:20Z) - UW-SDF: Exploiting Hybrid Geometric Priors for Neural SDF Reconstruction from Underwater Multi-view Monocular Images [63.32490897641344]
ニューラルSDFに基づく多視点水中画像から対象物を再構成するフレームワークを提案する。
再建過程を最適化するためのハイブリッドな幾何学的先行手法を導入し、神経SDF再建の質と効率を著しく向上させる。
論文 参考訳(メタデータ) (2024-10-10T16:33:56Z) - GEOcc: Geometrically Enhanced 3D Occupancy Network with Implicit-Explicit Depth Fusion and Contextual Self-Supervision [49.839374549646884]
本稿では,視覚のみのサラウンドビュー知覚に適したジオメトリ強化OccupancyネットワークであるGEOccについて述べる。
提案手法は,Occ3D-nuScenesデータセット上で,画像解像度が最小で,画像バックボーンが最大である状態-Of-The-Art性能を実現する。
論文 参考訳(メタデータ) (2024-05-17T07:31:20Z) - Scene 3-D Reconstruction System in Scattering Medium [9.044356059297595]
既存の水中3D再構築システムは、大規模な訓練時間や低効率といった課題に直面している。
本稿では,これらの課題に対処し,高速で高品質な3次元再構成を実現するため,水中3次元再構成システムを提案する。
論文 参考訳(メタデータ) (2023-12-14T14:55:16Z) - R3D3: Dense 3D Reconstruction of Dynamic Scenes from Multiple Cameras [106.52409577316389]
R3D3は高密度3次元再構成とエゴモーション推定のためのマルチカメラシステムである。
提案手法は,複数のカメラからの時空間情報と単眼深度補正を利用する。
この設計により、困難で動的な屋外環境の密集した一貫した3次元再構成が可能になる。
論文 参考訳(メタデータ) (2023-08-28T17:13:49Z) - Towards Non-Line-of-Sight Photography [48.491977359971855]
非視線イメージング(NLOS)は、隠された物体からの多重バウンス間接反射を捉えることに基づいている。
アクティブなNLOSイメージングシステムは、シーンを通しての光の飛行時間の捕捉に依存している。
我々はNLOS写真と呼ばれる新しい問題定式化を提案し、この欠陥に特に対処する。
論文 参考訳(メタデータ) (2021-09-16T08:07:13Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。