論文の概要: S-Avatar: Diffusion-Guided Gaussian Head Avatars from a Single Image
- arxiv url: http://arxiv.org/abs/2607.28164v1
- Date: Thu, 30 Jul 2026 13:04:03 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-31 21:37:00.572034
- Title: S-Avatar: Diffusion-Guided Gaussian Head Avatars from a Single Image
- Title(参考訳): S-アバター:1枚の画像から拡散誘導型ガウスヘッドアバター
- Authors: Hail Song, Seokhwan Yang, Jiwon Yang, Woojin Cho, Woontack Woo,
- Abstract要約: S-アバター(S-Avatar)は、単一の画像から3Dヘッドアバターを生成する新しい方法である。
提案手法は, 3次元の整合性を高め, 効率的かつ高精度な再構成を実現する。
幅広いVR/ARアプリケーションに適用できる。
- 参考スコア(独自算出の注目度): 11.54723548495768
- License: http://creativecommons.org/licenses/by-nc-sa/4.0/
- Abstract: We propose S-Avatar, a novel method for generating photorealistic 3D head avatars from a single image using a diffusion-guided 3D model generation module and strategies for animating 3D Gaussian Splatting (3DGS). While single-image head avatar reconstruction is crucial for lifelike Virtual Reality (VR) applications, existing approaches often struggle to preserve 3D consistency under unseen viewpoints. S-Avatar addresses this limitation through a three-stage pipeline. First, a high-resolution 3DGS is synthesized directly from a single image using a diffusion-based Gaussian splat generation module. Next, the parametric head model FLAME is aligned with the generated 3DGS by optimizing its parameters and spatial transformations. Finally, to adapt the 3DGS to FLAME variations, we construct a binding template that encodes the spatial relationship between the initial splats and FLAME. The dynamic 3D head avatar can then be rendered in real time by deforming the 3DGS with the binding template. By combining diffusion-guided canonical 3DGS generation with FLAME-based control, our method achieves efficient and accurate reconstruction with enhanced 3D consistency. Evaluations on public datasets demonstrate that S-Avatar outperforms state-of-the-art methods in novel-view and expression generation, achieving superior realism and consistency. Consequently, our approach represents a significant advance in accessible avatar creation, applicable to a wide range of VR/AR applications. The project page is available at https://github.com/hailsong/savatar.
- Abstract(参考訳): 本研究では,拡散誘導型3Dモデル生成モジュールを用いた単一画像からフォトリアリスティックな3Dヘッドアバターを生成する新しい手法であるS-Avatarと,3Dガウススティング(3DGS)のアニメーション手法を提案する。
ライフスタイルのバーチャルリアリティ(VR)アプリケーションでは、単一イメージのアバター再構成が不可欠だが、既存のアプローチは目に見えない視点で3Dの一貫性を維持するのに苦労することが多い。
S-Avatarは3段階のパイプラインを通じてこの制限に対処する。
まず,拡散型ガウスプレート生成モジュールを用いて,単一画像から直接高分解能3DGSを合成する。
次に、パラメータと空間変換を最適化することにより、パラメトリックヘッドモデルFLAMEを生成された3DGSに整合させる。
最後に、3DGSをFLAMEのバリエーションに適応させるために、初期スプラットとFLAMEの空間的関係を符号化するバインディングテンプレートを構築した。
動的3Dヘッドアバターは、バインディングテンプレートで3DGSをデフォームすることで、リアルタイムでレンダリングできる。
拡散誘導型標準3DGS生成とFLAMEに基づく制御を組み合わせることで,3D整合性を高めた効率的な高精度な再構成を実現する。
公開データセットの評価では、S-Avatarはノベルビューと表現生成において最先端の手法よりも優れ、優れたリアリズムと一貫性を実現する。
その結果、我々のアプローチは、幅広いVR/ARアプリケーションに適用可能な、アクセス可能なアバター作成の大幅な進歩を示している。
プロジェクトのページはhttps://github.com/hailsong/savatar.comで公開されている。
関連論文リスト
- MoGA: 3D Generative Avatar Prior for Monocular Gaussian Avatar Reconstruction [65.5412504339528]
MoGAは高忠実度3Dガウスアバターを単一視点画像から再構成する新しい手法である。
提案手法は最先端の手法を超越し,実世界のシナリオを一般化する。
論文 参考訳(メタデータ) (2025-07-31T14:36:24Z) - SEGA: Drivable 3D Gaussian Head Avatar from a Single Image [15.117619290414064]
本稿では,3次元ドライビング可能なガウスヘッドアバターの新規な手法であるSEGAを提案する。
SEGAは、大規模な2Dデータセットから派生した先行データと、マルチビュー、マルチ圧縮、マルチIDデータから得られた3D先行データとをシームレスに結合する。
提案手法は, 一般化能力, アイデンティティ保存, 表現リアリズムにおいて, 最先端の手法よりも優れていることを示す。
論文 参考訳(メタデータ) (2025-04-19T18:23:31Z) - Arc2Avatar: Generating Expressive 3D Avatars from a Single Image via ID Guidance [69.9745497000557]
本稿では,人間の顔の基盤モデルを用いた最初のSDSベースの手法であるArc2Avatarについて述べる。
我々のアバターは人間の顔メッシュテンプレートとの密接な対応を維持しており、ブレンドシェープによる表現生成を可能にしている。
論文 参考訳(メタデータ) (2025-01-09T17:04:33Z) - Generating Editable Head Avatars with 3D Gaussian GANs [57.51487984425395]
従来の3D-Aware Generative Adversarial Network (GAN) は、フォトリアリスティックでビューに一貫性のある3Dヘッド合成を実現する。
本稿では,3次元ガウススプラッティング(3DGS)を明示的な3次元表現として取り入れることで,3次元ヘッドアバターの編集性とアニメーション制御を向上する手法を提案する。
提案手法は,最先端の制御性を備えた高品質な3D認識合成を実現する。
論文 参考訳(メタデータ) (2024-12-26T10:10:03Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。