論文の概要: Virtual Ring Try-On
- arxiv url: http://arxiv.org/abs/2606.28792v1
- Date: Sat, 27 Jun 2026 07:43:54 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-30 18:07:15.691643
- Title: Virtual Ring Try-On
- Title(参考訳): 仮想リングトライオン
- Abstract要約: ユーザは、モバイルアプリケーションのReact NativeベースGUIを使用して、手のイメージをキャプチャする。
このアプローチはMediaPipeハンドポイント検出とYOLO-V8カスタムオブジェクト検出を組み合わせた実装である。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: This paper presents an innovative approach that enables the users to capture their hand and try the jewel ring on their hand. The user captures the image of the hand using the React Native base GUI of the mobile application and selects the ring that the user wants to try, and the output image will have the user's hand with the ring image. This approach is implemented using a combination of MediaPipe hand point detection and YOLO-V8 custom object detection. The hand image uploaded by the user first undergoes mediapipe hand point detection. It will give the hand points and a Region of Interest mask where the ring is going to be placed. Then the ring is passed through YOLO object detection, in which ring points are detected, and background is removed. After that, using vector algebra, the angular discrepancy between the finger's reference axis and the ring's principal axis is computed. Also, ring size is rescaled according to finger thickness, preserving the aspect ratio to maintain perceptual realism. Then the ring is placed on the hand image and the output image is generated and shown on the user screen.
- Abstract(参考訳): 本論文は, ユーザが手を取り, 宝石の指輪を試すことのできる, 革新的なアプローチを提案する。
ユーザは、モバイルアプリケーションのReact NativeベースGUIを使用して手の画像をキャプチャし、ユーザが試したいリングを選択し、出力イメージは、ユーザの手にリングイメージを付与する。
このアプローチはMediaPipeハンドポイント検出とYOLO-V8カスタムオブジェクト検出を組み合わせた実装である。
ユーザがアップロードした手画像は、まず、メディアパイプによる手指検出を行う。
ハンドポイントと、リングが配置されるエリア・オブ・関心マスクが提供される。
そして、リングをYOLOオブジェクト検出に通し、リングポイントを検出し、バックグラウンドを除去する。
その後、ベクトル代数を用いて、指の基準軸と環の主軸との角度差を計算する。
また、指の厚みに応じてリングサイズが再スケールされ、アスペクト比が維持され、知覚リアリズムが維持される。
そして、リングを手画像に置き、出力画像を生成してユーザ画面に表示する。
関連論文リスト
- A simple approach for biometrics: Finger-knuckle prints recognition based on a Sobel filter and similarity measures [0.13999481573773068]
本研究の目的は,指先認識のための新しい手法を提案することである。
我々は、エッジを見つけるために、Sobel演算子に基づくフィルタのような、ビジュアルコンピューティングの非常に単純な概念を採用してきた。
我々は、大きなデータセットで成功した認識の最大17.02%を得ました。
論文 参考訳(メタデータ) (2026-05-17T22:06:28Z) - CAPE: A CLIP-Aware Pointing Ensemble of Complementary Heatmap Cues for Embodied Reference Understanding [56.30142869506262]
身体的参照理解(Embodied Reference Understanding)は、シーンの人物が指し示すジェスチャーと言語の両方を通して参照しているオブジェクトを予測する。
本稿では,2重モデルフレームワークを提案し,一方のモデルが頭指先方向から学習し,他方のモデルが手指先方向から学習する。
我々は、ベンチマークYouRefItデータセットの広範な実験と分析を通じてアプローチを検証し、0.25IoU閾値で約4mAPの改善を実現した。
論文 参考訳(メタデータ) (2025-07-29T15:00:21Z) - Segment Anything Meets Point Tracking [116.44931239508578]
本稿では,SAMと長期点追跡を併用した,ポイント中心の対話型ビデオセグメンテーションの新たな手法を提案する。
ゼロショットオープンワールドUnidentified Video Objects(UVO)ベンチマークで直接評価することで,ポイントベーストラッキングのメリットを強調した。
DAVIS, YouTube-VOS, BDD100Kなどの人気ビデオオブジェクトのセグメンテーションと多目的セグメンテーションのベンチマーク実験により, ポイントベースセグメンテーショントラッカーがより優れたゼロショット性能と効率的なインタラクションをもたらすことが示唆された。
論文 参考訳(メタデータ) (2023-07-03T17:58:01Z) - Real-Time Hand Gesture Identification in Thermal Images [0.0]
我々のシステムは、フレーム内の複数のハンド領域を処理し、リアルタイムアプリケーションで高速に処理することができる。
ジェスチャー10のサーマルイメージデータセットを新たに収集し,手動作認識精度97%を報告した。
論文 参考訳(メタデータ) (2023-03-04T05:02:35Z) - Keypoint Message Passing for Video-based Person Re-Identification [106.41022426556776]
ビデオベースの人物再識別(re-ID)は、異なるカメラで捉えた人々のビデオスニペットをマッチングすることを目的とした、視覚監視システムにおいて重要な技術である。
既存の手法は主に畳み込みニューラルネットワーク(CNN)に基づいており、そのビルディングブロックは近隣のピクセルを一度に処理するか、あるいは3D畳み込みが時間情報のモデル化に使用される場合、人の動きによって生じるミスアライメントの問題に悩まされる。
本稿では,人間指向グラフ法を用いて,通常の畳み込みの限界を克服することを提案する。具体的には,人手指のキーポイントに位置する特徴を抽出し,時空間グラフとして接続する。
論文 参考訳(メタデータ) (2021-11-16T08:01:16Z) - A deep-learning--based multimodal depth-aware dynamic hand gesture
recognition system [5.458813674116228]
深度定量化画像ハンドスケルトン関節点を用いたダイナミックハンドジェスチャ認識(DHG)に着目した。
特に,CNNとリカレントニューラルネットワーク(Recurrent Neural Network, RNN)を用いたマルチモーダル核融合ネットワークにおける深度量子化の効果について検討する。
論文 参考訳(メタデータ) (2021-07-06T11:18:53Z) - Learning to Disambiguate Strongly Interacting Hands via Probabilistic
Per-pixel Part Segmentation [84.28064034301445]
自己相似性と、それぞれの手にピクセル観察を割り当てるあいまいさは、最終的な3Dポーズエラーの大きな原因である。
1つの単眼画像から2つの手の3次元ポーズを推定する新しい手法であるDIGITを提案する。
提案手法は,InterHand2.6Mデータセット上での最先端性能を実現する。
論文 参考訳(メタデータ) (2021-07-01T13:28:02Z) - Scale Normalized Image Pyramids with AutoFocus for Object Detection [75.71320993452372]
スケール正規化画像ピラミッド(SNIP)が生成され、人間の視覚と同様に、異なるスケールで固定されたサイズ範囲内のオブジェクトにのみ参加する。
本研究では,オブジェクトを含む可能性のある固定サイズのサブリージョンのみで動作する,効率的な空間サブサンプリング手法を提案する。
結果のアルゴリズムはAutoFocusと呼ばれ、SNIPを使用する場合の推論では2.5~5倍のスピードアップとなる。
論文 参考訳(メタデータ) (2021-02-10T18:57:53Z) - A Unified Learning Approach for Hand Gesture Recognition and Fingertip
Detection [3.145455301228176]
提案アルゴリズムは1つのネットワークを用いて指のクラスと指先の位置の確率を予測する。
提案手法は, 直接回帰法に比べ, 画素誤差を著しく低減する。
論文 参考訳(メタデータ) (2021-01-06T14:05:13Z) - High-Resolution Image Inpainting with Iterative Confidence Feedback and
Guided Upsampling [122.06593036862611]
既存の画像塗装法は、実アプリケーションで大きな穴を扱う際に、しばしばアーティファクトを生成する。
本稿では,フィードバック機構を備えた反復インペイント手法を提案する。
実験により,本手法は定量評価と定性評価の両方において既存手法よりも有意に優れていた。
論文 参考訳(メタデータ) (2020-05-24T13:23:45Z) - Anchors Based Method for Fingertips Position Estimation from a Monocular
RGB Image using Deep Neural Network [2.4366811507669124]
本稿では,指先の位置を推定するディープニューラルネットワークに基づく手法を提案する。
提案フレームワークは,手の検出結果に限られた依存度で最善を尽くす。
SCUT-Ego-Gestureデータセットの実験では、ビデオフレーム上の2.3552ピクセルの指先検出誤差を640倍の480$で達成した。
論文 参考訳(メタデータ) (2020-05-04T09:45:56Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。