論文の概要: GarmentZoom: Generating Zoomable Images from Garment Listings
- arxiv url: http://arxiv.org/abs/2606.29535v2
- Date: Fri, 03 Jul 2026 16:31:32 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-07 13:04:58.239064
- Title: GarmentZoom: Generating Zoomable Images from Garment Listings
- Title(参考訳): GarmentZoom: ガーメントリストからズーム可能なイメージを生成する
- Abstract要約: GarmentZoomは、クローズアップに伴う忠実さに合わせてフルビューの写真を強化するシステムだ。
我々の設定には、空間的に全体像と一致しないクローズアップ参照と、衣服間で大きく異なるスケール要因が含まれています。
- 参考スコア(独自算出の注目度): 18.862003669709363
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Online product listings for garments often include an overview photo and a close-up to show garment details. However, each photo focuses on either field of view or garment detail, forcing users to alternate between views and breaking browsing continuity. We present GarmentZoom, a system that enhances the full-view photo to match the fidelity of its accompanying close-up, enabling seamless zoom-and-pan exploration. Unlike standard reference-based super-resolution, our setting involves close-up references that are spatially unaligned with the full view, and scale factors that vary substantially across garments 3-20$\times$. Prior work typically relies on alignment to transfer details or requires per-instance fine-tuning to memorize them. Instead, we train a single model that supports a continuous range of scales across diverse garments. Our approach synthesizes details without requiring spatial alignment and matches the quality of per-instance methods with a fraction of the training cost.
- Abstract(参考訳): オンラインの衣料品リストには、概観写真と衣服の詳細を示すクローズアップが含まれることが多い。
しかし、それぞれの写真は、ビューのフィールドまたは衣服の詳細に焦点を当てており、ユーザーはビューを切り替え、ブラウジングの連続性を壊さざるを得ない。
GarmentZoomはクローズアップの忠実度に合わせてフルビュー写真を拡張するシステムで、シームレスなズーム・アンド・パン探索を可能にする。
標準の参照ベースのスーパーレゾリューションとは異なり、われわれの設定では、空間的に全ビューと一致しないクローズアップ参照と、3-20$\times$で大きく異なるスケールファクタが関係している。
以前の作業は通常、詳細を転送するためにアライメントに依存するか、あるいはそれらを記憶するためにインスタンスごとの微調整を必要とする。
代わりに、さまざまな衣服にまたがる連続的なスケールをサポートする単一のモデルをトレーニングします。
提案手法は,空間的アライメントを必要とせずに詳細を合成し,トレーニングコストのごく一部でインスタンスごとの手法の品質に適合する。
関連論文リスト
- CompleteMe: Reference-based Human Image Completion [52.93963237043788]
我々は,新しい参照ベースヒューマン画像補完フレームワークであるCompleteMeを提案する。
CompleteMeは2つのU-Netアーキテクチャとリージョン中心の注意(RFA)ブロックを組み合わせている。
提案手法は既存の手法に比べて視覚的品質と意味的整合性に優れる。
論文 参考訳(メタデータ) (2025-04-28T17:59:56Z) - Fine-Grained Controllable Apparel Showcase Image Generation via Garment-Centric Outpainting [39.50293003775675]
潜在拡散モデル(LDM)に基づく新しい衣服中心のアウトペイント(GCO)フレームワークを提案する。
提案フレームワークは,テキストプロンプトと顔画像を用いて,所定の衣服を身に着けたファッションモデルをカスタマイズすることを目的としている。
論文 参考訳(メタデータ) (2025-03-03T08:30:37Z) - AnyDressing: Customizable Multi-Garment Virtual Dressing via Latent Diffusion Models [7.534556848810697]
衣服とパーソナライズされたテキストプロンプトの組み合わせで条件付き文字をカスタマイズする新しいAnyDressing法を提案する。
AnyDressingはGarmentsNetとDressingNetという2つの主要なネットワークで構成されており、それぞれが詳細な衣料品の特徴を抽出することを目的としている。
衣服のきめ細かいテクスチャの詳細を改善するため,ガーメント強化テクスチャ学習戦略を導入する。
論文 参考訳(メタデータ) (2024-12-05T13:16:47Z) - FitDiT: Advancing the Authentic Garment Details for High-fidelity Virtual Try-on [73.13242624924814]
Diffusion Transformer (DiT) を用いた高忠実度仮想試行用ガーメント知覚増強技術FitDiT
布地テクスチャ抽出装置を導入し, 布地や模様, テクスチャなどのリッチな細部を, よりよく捉えられるようにした。
また,クロスカテゴリー試着中にマスク領域全体を埋める衣服の発生を防止し,衣料の正しい長さに適応する拡張緩和マスク戦略を採用した。
論文 参考訳(メタデータ) (2024-11-15T11:02:23Z) - IMAGDressing-v1: Customizable Virtual Dressing [58.44155202253754]
IMAGDressing-v1は、固定された衣服とオプション条件で自由に編集可能な人間の画像を生成する仮想ドレッシングタスクである。
IMAGDressing-v1は、CLIPのセマンティック特徴とVAEのテクスチャ特徴をキャプチャする衣料UNetを組み込んでいる。
本稿では,凍結自己注意とトレーニング可能なクロスアテンションを含むハイブリッドアテンションモジュールを提案する。
論文 参考訳(メタデータ) (2024-07-17T16:26:30Z) - Learning Images Across Scales Using Adversarial Training [64.59447233902735]
本研究では,通常の画像の非構造的コレクションからマグニチュード・オブ・マグニチュード・スケールを捉える表現を学習するための新しいパラダイムを考案する。
筆者らのジェネレータは,マルチスケール生成モデルとして利用でき,非構造化パッチからのスケール空間の再構成にも利用できることを示す。
論文 参考訳(メタデータ) (2024-06-13T08:44:12Z) - AnyFit: Controllable Virtual Try-on for Any Combination of Attire Across Any Scenario [50.62711489896909]
AnyFitは、高解像度のベンチマークと実世界のデータのベースラインを、大きなギャップで上回っている。
AnyFitの高忠実度バーチャル試作品における印象的なパフォーマンスは、あらゆるイメージから見ても、ファッションコミュニティにおける将来の研究の新たな道を切り開くものです。
論文 参考訳(メタデータ) (2024-05-28T13:33:08Z) - Single Stage Virtual Try-on via Deformable Attention Flows [51.70606454288168]
仮想試行は、ショップ内服と基準人物画像が与えられた写真リアルなフィッティング結果を生成することを目的としている。
マルチフロー推定に変形性アテンションスキームを適用した,変形性アテンションフロー(DAFlow)を新たに開発した。
提案手法は,定性的かつ定量的に最先端の性能を実現する。
論文 参考訳(メタデータ) (2022-07-19T10:01:31Z) - Toward Accurate and Realistic Outfits Visualization with Attention to
Details [10.655149697873716]
商用アプリケーションに必要な重要な視覚的詳細を捉えるために,アウトフィット・ビジュアライゼーション・ネットを提案する。
OVNetは,1)意味的レイアウト生成器と2)複数の協調ワープを用いた画像生成パイプラインから構成される。
この手法を利用した対話型インターフェースは,ファッションeコマースのウェブサイトに展開され,圧倒的に肯定的なフィードバックを受けている。
論文 参考訳(メタデータ) (2021-06-11T19:53:34Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。