論文の概要: Capture, Canonicalize, Splat: Zero-Shot 3D Gaussian Avatars from Unstructured Phone Images
- arxiv url: http://arxiv.org/abs/2510.14081v2
- Date: Fri, 17 Oct 2025 09:24:28 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-10-20 13:49:08.793197
- Title: Capture, Canonicalize, Splat: Zero-Shot 3D Gaussian Avatars from Unstructured Phone Images
- Title(参考訳): ゼロショット3Dガウスアバター(動画あり)
- Abstract要約: キャプチャー、カノニカライズ、Splat」パイプラインは、非構造化写真から魅力的な現実主義と堅牢なアイデンティティ保存を備えた静的四角形アバターを生産する。
この"Capture, Canonicalize, Splat"パイプラインは、非構造化写真から魅力的な現実主義と堅牢なアイデンティティ保存を備えた静的な四角形アバターを生成する。
- 参考スコア(独自算出の注目度): 20.85870756824163
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: We present a novel, zero-shot pipeline for creating hyperrealistic, identity-preserving 3D avatars from a few unstructured phone images. Existing methods face several challenges: single-view approaches suffer from geometric inconsistencies and hallucinations, degrading identity preservation, while models trained on synthetic data fail to capture high-frequency details like skin wrinkles and fine hair, limiting realism. Our method introduces two key contributions: (1) a generative canonicalization module that processes multiple unstructured views into a standardized, consistent representation, and (2) a transformer-based model trained on a new, large-scale dataset of high-fidelity Gaussian splatting avatars derived from dome captures of real people. This "Capture, Canonicalize, Splat" pipeline produces static quarter-body avatars with compelling realism and robust identity preservation from unstructured photos.
- Abstract(参考訳): 我々は、いくつかの非構造化電話画像から超現実的でアイデンティティを保存する3Dアバターを作成するための、新しいゼロショットパイプラインを提案する。
単一ビューアプローチは幾何学的不整合と幻覚に悩まされ、アイデンティティの保存が低下する一方、合成データで訓練されたモデルは、皮膚のしわや細い毛のような高周波の詳細を捉えず、リアリズムを制限している。
提案手法では,(1)複数の非構造化ビューを標準化された一貫した表現として処理する生成正準化モジュール,(2)実物のドームキャプチャーから派生した高忠実度ガウススプラッティングアバターの大規模データセットをトレーニングしたトランスフォーマーベースモデルを提案する。
この"Capture, Canonicalize, Splat"パイプラインは、非構造化写真から魅力的な現実主義と堅牢なアイデンティティ保存を備えた静的な四角形アバターを生成する。
関連論文リスト
- HumanNOVA: Photorealistic, Universal and Rapid 3D Human Avatar Modeling from a Single Image [84.81016200801153]
我々は,1枚のRGB画像から3次元アバターを生成するための,フォトリアリスティックで普遍的で高速なモデルであるHumanNOVAを提案する。
アーキテクチャの面では、HumanNOVAは1秒未満で高速な推論を可能にする、フィードフォワード、トークン条件付きアバターモデリングフレームワークを採用している。
論文 参考訳(メタデータ) (2026-06-01T17:58:11Z) - Splatshot: 3D Face Avatar Generation from a Single Unconstrained Photo [22.10478800887373]
SplatShot(SplatShot)は,3D表現を記述プロセス内で直接結合する,トレーニング不要のフレームワークである。
SplatShotは3Dアバターを製作し、優れたアイデンティティ保存、フォトリアリズム、マルチビュー整合性を示す。
論文 参考訳(メタデータ) (2026-05-31T23:19:44Z) - Structure-Aware Fine-Grained Gaussian Splatting for Expressive Avatar Reconstruction [27.915439949805876]
本稿では,モノクロビデオシーケンスから表現力とコヒーレントなフルボディの3次元アバターを再構築する手法を提案する。
本手法では,1段階のトレーニングのみが必要であり,定量評価と定性評価の両方において,最先端のベースラインを上回っている。
論文 参考訳(メタデータ) (2026-04-10T13:49:15Z) - DipGuava: Disentangling Personalized Gaussian Features for 3D Head Avatars from Monocular Video [56.39805581764342]
DipGuavaは、モノクロビデオからパーソナライズされた属性を持つアバターを生成する新しい3Dガウスの頭部アバター作成方法である。
顔の外観を2つの相補的な構成要素に明示的に切り離し、構造化された2段階のパイプラインで訓練する最初の方法である。
広汎な実験で示されるように、視覚的品質と量的性能の両方において、従来手法よりも一貫して優れていた。
論文 参考訳(メタデータ) (2026-03-30T03:50:23Z) - OMEGA-Avatar: One-shot Modeling of 360° Gaussian Avatars [54.688420347927725]
OMEGA-Avatarは、単一の画像から一般化可能で360度完全でアニマブルな3Dガウスヘッドを同時に生成する最初のフレームワークである。
OMEGA-Avatarは最先端の性能を達成し,360度フルヘッド完全性において既存のベースラインを著しく上回っていることを示す。
論文 参考訳(メタデータ) (2026-02-12T08:16:38Z) - PFAvatar: Pose-Fusion 3D Personalized Avatar Reconstruction from Real-World Outfit-of-the-Day Photos [24.8968050268664]
PFAvatarは、OOTD(Outfit of the Day)の写真から高品質な3Dアバターを再構築する新しい方法だ。
従来の手法に比べて48倍の高速化を実現し, パーソナライズをわずか5分で完了した。
論文 参考訳(メタデータ) (2025-11-17T03:40:43Z) - MoGA: 3D Generative Avatar Prior for Monocular Gaussian Avatar Reconstruction [65.5412504339528]
MoGAは高忠実度3Dガウスアバターを単一視点画像から再構成する新しい手法である。
提案手法は最先端の手法を超越し,実世界のシナリオを一般化する。
論文 参考訳(メタデータ) (2025-07-31T14:36:24Z) - SEGA: Drivable 3D Gaussian Head Avatar from a Single Image [15.117619290414064]
本稿では,3次元ドライビング可能なガウスヘッドアバターの新規な手法であるSEGAを提案する。
SEGAは、大規模な2Dデータセットから派生した先行データと、マルチビュー、マルチ圧縮、マルチIDデータから得られた3D先行データとをシームレスに結合する。
提案手法は, 一般化能力, アイデンティティ保存, 表現リアリズムにおいて, 最先端の手法よりも優れていることを示す。
論文 参考訳(メタデータ) (2025-04-19T18:23:31Z) - FRESA: Feedforward Reconstruction of Personalized Skinned Avatars from Few Images [74.86864398919467]
数枚の画像からリアルなアニメーションで、パーソナライズされた3Dアバターを再構成する新しい手法を提案する。
我々は、1000人以上の服を着た人間から普遍的な事前学習を行い、即時フィードフォワード生成とゼロショット一般化を実現する。
提案手法は, 最新技術よりも忠実な再構築とアニメーションを生成し, カジュアルに撮影された携帯電話写真からの入力に直接一般化することができる。
論文 参考訳(メタデータ) (2025-03-24T23:20:47Z) - Synthetic Prior for Few-Shot Drivable Head Avatar Inversion [61.51887011274453]
そこで本研究では,合成前駆体に基づく乾燥可能な頭部アバターの少数ショット逆転法であるSynShotを提案する。
合成データのみに基づいて訓練された機械学習モデルに着想を得て,合成頭部の大きなデータセットから先行モデルを学習する手法を提案する。
論文 参考訳(メタデータ) (2025-01-12T19:01:05Z) - Deformable 3D Gaussian Splatting for Animatable Human Avatars [50.61374254699761]
本稿では,デジタルアバターを単一単分子配列で構築する手法を提案する。
ParDy-Humanは、リアルなダイナミックな人間のアバターの明示的なモデルを構成する。
当社のアバター学習には,Splatマスクなどの追加アノテーションが不要であり,ユーザのハードウェア上でも,フル解像度の画像を効率的に推測しながら,さまざまなバックグラウンドでトレーニングすることが可能である。
論文 参考訳(メタデータ) (2023-12-22T20:56:46Z) - Generalizable One-shot Neural Head Avatar [90.50492165284724]
本研究では,1枚の画像から3次元頭部アバターを再構成し,アニメイトする手法を提案する。
本研究では,一視点画像に基づく識別不能な人物を一般化するだけでなく,顔領域内外における特徴的詳細を捉えるフレームワークを提案する。
論文 参考訳(メタデータ) (2023-06-14T22:33:09Z) - PVA: Pixel-aligned Volumetric Avatars [34.929560973779466]
少数の入力から人間の頭部の体積アバターを予測するための新しいアプローチを考案する。
提案手法は,光度再レンダリングによる損失のみを前提としたエンドツーエンドで,明示的な3次元監視を必要とせずに訓練を行う。
論文 参考訳(メタデータ) (2021-01-07T18:58:46Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。