論文の概要: A Compact Explicit 4D Representation for Dynamic Scenes
- arxiv url: http://arxiv.org/abs/2610.01229v1
- Date: Thu, 01 Oct 2026 07:31:31 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-03 01:19:23.967087
- Title: A Compact Explicit 4D Representation for Dynamic Scenes
- Title(参考訳): ダイナミックシーンのためのコンパクトな4次元表現
- Abstract要約: Sparc4Dはフィードフォワードのオートエンコーダで、既知のカメラでモノクロ映像をスパース4Dのシーン状態にエンコードする。
Sparc4Dは21.70,dB、MoVieSは20.40,dBに達する。
実際のデータを微調整することなく、Sparc4DはDyCheckとNeu3Dに転送する。
- 参考スコア(独自算出の注目度): 10.690679971109937
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: A compact dynamic-scene representation must retain both the surfaces seen over time and the appearance needed to render them from new viewpoints. We present Sparc4D, a feed-forward autoencoder that encodes a monocular video with known cameras into a sparse 4D scene state. Static features are shared across the clip, while spatially anchored temporal slots compress time-varying features. A sparse decoder produces 2D Gaussian surfels, while stored source pixels preserve fine texture through geometric re-projection. The state includes one full source frame and dynamic-region pixels sampled every fourth frame, alongside learned features and sparse occupancy. For a 32-frame MultiCamVideo clip, it averages 0.95M 32-bit-equivalent values on random windows and 0.92M on the first-32 protocol. On first-32, Sparc4D reaches 21.70\,dB, compared with 20.40\,dB for MoVieS. On randomly placed windows, their PSNR scores are comparable. With stored texture disabled, temporal slots compress the time-varying feature state by a median $4.0\times$ and reduce the mean state from 1.04M to 0.42M values, with essentially unchanged target-view reconstruction quality. Without fine-tuning on real data, Sparc4D transfers to DyCheck and Neu3D, where stored texture improves LPIPS while slightly reducing PSNR.
- Abstract(参考訳): コンパクトな動的シーン表現は、時間とともに見える表面と、それらを新しい視点から表現するのに必要な外観の両方を保持する必要がある。
フィードフォワードのオートエンコーダであるSparc4Dは、既知のカメラでモノクロ映像をスパース4Dシーン状態に符号化する。
静止した特徴はクリップ全体で共有され、空間的に固定された時間スロットは時間変化のある特徴を圧縮する。
スパースデコーダは2次元ガウス波を発生させる一方、記憶された光源画素は幾何学的再投影により微細なテクスチャを保持する。
状態には、学習された特徴とスパース占有とともに、4分の1のフルソースフレームとダイナミック領域ピクセルが含まれている。
32フレームのMultiCamVideoクリップでは、ランダムウィンドウでは0.95Mの32ビット等価値、最初の32プロトコルでは0.92Mとなる。
1位32位では、Sparc4Dは21.70\,dB、MoVieSは20.40\,dBに達した。
ランダムに配置されたウィンドウでは、PSNRスコアは同等である。
記憶されたテクスチャを無効にすることで、時間的スロットは時間的特徴状態を中央値の4.0\times$で圧縮し、平均状態を1.04Mから0.42Mに下げる。
実際のデータを微調整することなく、Sparc4DはDyCheckとNeu3Dに転送する。
関連論文リスト
- Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh [27.530445765032137]
我々は、Wan2.2カメラ制御をシャーカー線のみから共同カメラ+幾何学インタフェースまで拡張する参照誘導レンダリングであるDARを提案する。
Darは、アニメーションメッシュからニューラルな4D Gバッファを投射し、それをワイドコントロールアダプタで注入する。
68ケースのDAR-4Dベンチマークでは、LoRA DARはPSNR 23.22、SSIM 0.895、LPIPS 0.134に達し、市販のWan2.2-Depthを1.54dBPSNRに改善した。
論文 参考訳(メタデータ) (2026-07-30T16:55:28Z) - Instant4D: 4D Gaussian Splatting in Minutes [8.897770973611427]
Instant4Dは、キャリブレーションされたカメラや奥行きセンサーを使わずに、数分でカジュアルな映像シーケンスを処理できる単分子再構成システムである。
我々の設計は、幾何学的整合性を保ちながら冗長性を著しく低減し、モデルのサイズを元のフットプリントの10%以下に削減する。
提案手法は,Dycheckデータセット上で10分以内に,あるいは一般的な200フレームのビデオに対して,単一のビデオを再構成する。
論文 参考訳(メタデータ) (2025-10-01T17:07:21Z) - 4K4D: Real-Time 4D View Synthesis at 4K Resolution [86.6582179227016]
本稿では、4K解像度で動的3Dシーンを高忠実かつリアルタイムに見ることを目的とする。
ハードウェア化をサポートし,前例のないレンダリング速度を実現する4Dポイントクラウド表現を提案する。
私たちの表現は、1080p解像度のDNAレンダリングデータセットで400 FPS、4090 GPUで4K解像度のENeRF-Outdoorデータセットで80 FPSでレンダリングできます。
論文 参考訳(メタデータ) (2023-10-17T17:57:38Z) - Representing Volumetric Videos as Dynamic MLP Maps [46.08087687477586]
本稿では,動的シーンをリアルタイムに見るための新しいラディアンスビデオの表現について紹介する。
提案手法は、3090 GPU上の512倍の512ドルの画像に対して、41.7 fpsの高速なリアルタイムレンダリングを実現するとともに、最先端のレンダリング品質を実現する。
論文 参考訳(メタデータ) (2023-04-13T17:59:33Z) - NeuMap: Neural Coordinate Mapping by Auto-Transdecoder for Camera
Localization [60.73541222862195]
NeuMapは、カメラのローカライゼーションのためのエンドツーエンドのニューラルマッピング手法である。
シーン全体を遅延コードグリッドにエンコードし、Transformerベースのオートデコーダがクエリピクセルの3D座標を回帰する。
論文 参考訳(メタデータ) (2022-11-21T04:46:22Z) - NeRFPlayer: A Streamable Dynamic Scene Representation with Decomposed
Neural Radiance Fields [99.57774680640581]
本稿では、高速な再構成、コンパクトなモデリング、およびストリーム可能なレンダリングが可能な効率的なフレームワークを提案する。
本稿では, 時間特性に応じて4次元空間を分解することを提案する。4次元空間の点は, 静的, 変形, および新しい領域の3つのカテゴリに属する確率に関連付けられている。
論文 参考訳(メタデータ) (2022-10-28T07:11:05Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。