論文の概要: MegaStyle++: Scaling Image Style Space through Hierarchical Style Definition
- arxiv url: http://arxiv.org/abs/2609.01423v1
- Date: Tue, 01 Sep 2026 15:37:09 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-02 16:31:36.807778
- Title: MegaStyle++: Scaling Image Style Space through Hierarchical Style Definition
- Title(参考訳): MegaStyle++:階層的なスタイル定義によるイメージスタイル空間のスケーリング
- Authors: Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Weidong Zhang, Cairong Zhao, Jun Zhang,
- Abstract要約: 本稿では,全体スタイルのアイデンティティから細かな視覚的属性に至るまでのイメージスタイルを記述した階層型スタイル定義を提案する。
この定義に基づき,MegaStyle++-8Mを構築し,150Kの全体的なスタイル識別,100Mのきめ細かいスタイルプロンプト,8Mのスタイリング画像を含む大規模スタイルデータセットを構築した。
- 参考スコア(独自算出の注目度): 38.5650801771829
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Image style is a highly abstract, human-constructed concept shaped by a range of visual factors and intrinsically entangled with content, yet a unified and explicit definition of image style remains lacking. In this work, we first discuss the fundamental question of what is style and then propose a hierarchical style definition that describes image style from an overall style identity to fine-grained visual attributes, providing a more structured, transferable, and interpretable style representation. Based on this definition, we refine the style annotation pipeline of MegaStyle and construct MegaStyle++-8M, a large-scale style dataset containing 150K overall style identities, 1M fine-grained style prompts, and 8M stylized images. Extensive analyses demonstrate that our hierarchical definition substantially expands the style space in both diversity and semantic breadth, while precisely capturing intrinsic visual style of reference images. The dataset and code will be updated at https://github.com/Tencent/MegaStyle, we hope MegaStyle++ provides a scalable foundation for studying and modeling diverse image styles.
- Abstract(参考訳): イメージスタイルは、非常に抽象的で人間の構成された概念であり、様々な視覚的要因によって形成され、本質的にコンテンツと絡み合っているが、画像スタイルの統一的で明示的な定義はいまだに欠けている。
本稿ではまず,スタイルとは何かという基本的問題について論じるとともに,全体的なスタイルのアイデンティティから,より構造化され,伝達可能で,解釈可能なスタイルの表現を提供する,階層的なスタイル定義を提案する。
この定義に基づいて、MegaStyleのスタイルアノテーションパイプラインを洗練し、MegaStyle++-8Mを構築する。
包括的分析により,我々の階層的定義は多様性と意味的広さの両面でのスタイル空間を大幅に拡張し,本質的な参照画像の視覚的スタイルを的確に捉えた。
データセットとコードはhttps://github.com/Tencent/MegaStyleで更新されます。
関連論文リスト
- MegaStyle: Constructing Diverse and Scalable Style Dataset via Consistent Text-to-Image Style Mapping [42.01890884376506]
私たちは、新しいスケーラブルなデータキュレーションパイプラインであるMegaStyleを紹介します。
我々は170Kスタイルのプロンプトと400Kコンテンツプロンプトを備えた多種多様なバランスの取れたプロンプトギャラリーをキュレートし、大規模スタイルのデータセットMegaStyle-1.4Mを生成する。
実験は、スタイルデータセットにおけるスタイル内の一貫性、スタイル間の多様性、高品質を維持することの重要性と、提案したMegaStyle-1.4Mの有効性を示す。
論文 参考訳(メタデータ) (2026-04-09T15:29:08Z) - Mixture of Style Experts for Diverse Image Stylization [73.7600741657193]
StyleExpertは、Mixture of Experts (MoE)をベースにしたセマンティックアウェアフレームワークである
我々のフレームワークは、コンテンツスタイルのスタイリング三重項の大規模データセットに基づいて訓練された統一型スタイルエンコーダを使用している。
本手法は, 浅いテクスチャから深いセマンティクスまで, 複数のセマンティクスレベルにまたがる多様なスタイルを扱う。
論文 参考訳(メタデータ) (2026-03-17T15:20:19Z) - ReStyle3D: Scene-Level Appearance Transfer with Semantic Correspondences [33.06053818091165]
ReStyle3Dは、シーンレベルの外観を1つのスタイルのイメージから、複数のビューで表現された現実世界のシーンに転送するためのフレームワークである。
明示的な意味対応と多視点整合性を組み合わせることで、正確で一貫性のあるスタイリングを実現する。
私たちのコード、事前訓練されたモデル、データセットは、インテリアデザイン、仮想ステージング、そして3D一貫性のあるスタイリングにおける新しいアプリケーションをサポートするために、公開されます。
論文 参考訳(メタデータ) (2025-02-14T18:54:21Z) - StyleBrush: Style Extraction and Transfer from a Single Image [19.652575295703485]
ビジュアルコンテンツのスティル化は、オリジナルの構造的特徴を保ちながら、ピクセルレベルで特定のスタイルパターンを追加することを目的としている。
本稿では,参照画像からスタイルを正確にキャプチャし,抽出したスタイルを他の入力ビジュアルコンテンツにブラシするStyleBrushを提案する。
論文 参考訳(メタデータ) (2024-08-18T14:27:20Z) - StyleAdapter: A Unified Stylized Image Generation Model [97.24936247688824]
StyleAdapterは、様々なスタイリング画像を生成することができる統一型スタイリング画像生成モデルである。
T2I-adapter や ControlNet のような既存の制御可能な合成手法と統合することができる。
論文 参考訳(メタデータ) (2023-09-04T19:16:46Z) - Domain Enhanced Arbitrary Image Style Transfer via Contrastive Learning [84.8813842101747]
Contrastive Arbitrary Style Transfer (CAST) は、新しいスタイル表現学習法である。
本フレームワークは,スタイルコード符号化のための多層スタイルプロジェクタ,スタイル分布を効果的に学習するためのドメイン拡張モジュール,画像スタイル転送のための生成ネットワークという,3つのキーコンポーネントから構成される。
論文 参考訳(メタデータ) (2022-05-19T13:11:24Z) - Styleverse: Towards Identity Stylization across Heterogeneous Domains [70.13327076710269]
異種ドメイン間のIDS(IDentity Stylization)という課題を提案する。
有効な異種ネットワークベースのフレームワークである$Styleverse$を使用し、単一のドメイン認識ジェネレータを使用します。
$Styleverseは、他の最先端の方法と比較して、より忠実なアイデンティティスタイリングを実現する。
論文 参考訳(メタデータ) (2022-03-02T04:23:01Z) - StyleCLIPDraw: Coupling Content and Style in Text-to-Drawing Translation [10.357474047610172]
本稿では,ユーザが所望の描画スタイルを指定可能なテキスト記述のためのスタイルドローイング生成手法を提案する。
創作過程において、スタイルと内容が分離できないという芸術理論に触発されて、我々はStyleCLIPDrawとして知られる、結合したアプローチを提案する。
人間の評価に基づいて、StyleCLIPDrawによって生成される画像のスタイルは、シーケンシャルアプローチによって強く好まれる。
論文 参考訳(メタデータ) (2022-02-24T21:03:51Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。