Fugu-MT 論文翻訳(概要): VST-Pose: A Velocity-Integrated Spatiotem-poral Attention Network for Human WiFi Pose Estimation

論文の概要: VST-Pose: A Velocity-Integrated Spatiotem-poral Attention Network for Human WiFi Pose Estimation

arxiv url: http://arxiv.org/abs/2507.09672v1
Date: Sun, 13 Jul 2025 15:11:18 GMT
ステータス: 翻訳完了
システム内更新日: 2025-07-15 18:48:23.678818
Title: VST-Pose: A Velocity-Integrated Spatiotem-poral Attention Network for Human WiFi Pose Estimation
Title（参考訳）: VST-Pose:人間のWiFiポース推定のための速度制御型時空間アテンションネットワーク
Authors: Xinyu Zhang, Zhonghao Ye, Jingwei Zhang, Xiang Tian, Zhisheng Liang, Shipeng Yu,
Abstract要約: VST-Poseは、WiFiチャネルの状態情報を用いた正確なポーズ推定のための新しいフレームワークである。提案手法はPCK@50の精度を92.2%向上し,PCK@50の精度を8.3%向上させた。提案システムは,室内環境下での連続した人間の動作分析のための信頼性とプライバシを意識したソリューションを提供する。
参考スコア（独自算出の注目度）: 10.371863139473456
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Abstract: WiFi-based human pose estimation has emerged as a promising non-visual alternative approaches due to its pene-trability and privacy advantages. This paper presents VST-Pose, a novel deep learning framework for accurate and continuous pose estimation using WiFi channel state information. The proposed method introduces ViSTA-Former, a spatiotemporal attention backbone with dual-stream architecture that adopts a dual-stream architecture to separately capture temporal dependencies and structural relationships among body joints. To enhance sensitivity to subtle human motions, a velocity modeling branch is integrated into the framework, which learns short-term keypoint dis-placement patterns and improves fine-grained motion representation. We construct a 2D pose dataset specifically designed for smart home care scenarios and demonstrate that our method achieves 92.2% accuracy on the PCK@50 metric, outperforming existing methods by 8.3% in PCK@50 on the self-collected dataset. Further evaluation on the public MMFi dataset confirms the model's robustness and effectiveness in 3D pose estimation tasks. The proposed system provides a reliable and privacy-aware solution for continuous human motion analysis in indoor environments. Our codes are available in https://github.com/CarmenQing/VST-Pose.
Abstract（参考訳）: WiFiベースの人間のポーズ推定は、ペイントレーサビリティとプライバシーの優位性のために、将来的な非視覚的アプローチとして浮上している。本稿では,WiFi チャネル状態情報を用いた高精度かつ連続的なポーズ推定のための新しいディープラーニングフレームワーク VST-Pose を提案する。提案手法では,2重ストリームアーキテクチャを併用した時空間的注目バックボーンであるViSTA-Formerを導入し,時間的依存関係と身体関節の構造的関係を別々に把握する。微妙な人間の動きに対する感度を高めるために、ベロシティモデリングブランチをフレームワークに統合し、短期的なキーポイント変位パターンを学習し、きめ細かい動きの表現を改善する。スマートホームケアのシナリオに特化して設計された2次元ポーズデータセットを構築し,PCK@50で92.2%の精度を実現し,PCK@50で既存手法を8.3%上回った。公開MMFiデータセットのさらなる評価は、3次元ポーズ推定タスクにおけるモデルの堅牢性と有効性を確認する。提案システムは,室内環境下での連続した人間の動作分析のための信頼性とプライバシを意識したソリューションを提供する。私たちのコードはhttps://github.com/CarmenQing/VST-Pose.comで利用可能です。

関連論文リスト

StarPose: 3D Human Pose Estimation via Spatial-Temporal Autoregressive Diffusion [29.682018018059043]
StarPoseは3次元人間のポーズ推定のための自己回帰拡散フレームワークである。歴史的3Dポーズの予測と空間的物理的ガイダンスが組み込まれている。人間の3次元ポーズ推定における精度と時間的一貫性を向上する。
論文参考訳（メタデータ） (2025-08-04T04:50:05Z)
ALOcc: Adaptive Lifting-based 3D Semantic Occupancy and Cost Volume-based Flow Prediction [89.89610257714006]
既存の手法は、これらのタスクの要求に応えるために高い精度を優先する。本稿では,3次元セマンティック占有率予測とフロー推定のための一連の改善点を紹介する。私たちの純粋な時間的アーキテクチャフレームワークであるALOccは、速度と精度の最適なトレードオフを実現しています。
論文参考訳（メタデータ） (2024-11-12T11:32:56Z)
UPose3D: Uncertainty-Aware 3D Human Pose Estimation with Cross-View and Temporal Cues [55.69339788566899]
UPose3Dは多視点人間のポーズ推定のための新しいアプローチである。直接的な3Dアノテーションを必要とせずに、堅牢性と柔軟性を向上させる。
論文参考訳（メタデータ） (2024-04-23T00:18:00Z)
Kinematic-aware Hierarchical Attention Network for Human Pose Estimation in Videos [17.831839654593452]
従来の人間のポーズ推定手法は, 連続するフレームの特徴を活用することで, 有望な結果を示した。ほとんどのアプローチでは、ジッターに精度を妥協し、人間の動きの時間的側面を理解しない。キネマティックなキーポイント機能を利用するアーキテクチャを設計する。
論文参考訳（メタデータ） (2022-11-29T01:46:11Z)
CPPF++: Uncertainty-Aware Sim2Real Object Pose Estimation by Vote Aggregation [67.12857074801731]
そこで本研究では,シミュレートからリアルなポーズ推定のための新しい手法であるCPPF++を提案する。投票衝突による課題に対処するため,投票の不確実性をモデル化する新たなアプローチを提案する。ノイズの多いペアフィルタリング、オンラインアライメント最適化、機能アンサンブルなど、いくつかの革新的なモジュールを組み込んでいます。
論文参考訳（メタデータ） (2022-11-24T03:27:00Z)
(Fusionformer):Exploiting the Joint Motion Synergy with Fusion Network Based On Transformer for 3D Human Pose Estimation [1.52292571922932]
多くの従来手法では、局所的な関節情報の理解が欠けていた。提案手法では,グローバル・テンポラル・セルフ・トラジェクトリ・モジュールとクロス・テンポラル・セルフ・トラジェクトリ・モジュールを導入する。その結果、Human3.6Mデータセットでは2.4%のMPJPEと4.3%のP-MPJPEが改善された。
論文参考訳（メタデータ） (2022-10-08T12:22:10Z)
An Online Semantic Mapping System for Extending and Enhancing Visual SLAM [2.538209532048867]
本稿では,2次元から3次元の物体検出パイプラインと,生成されたランドマークの高速なデータアソシエーションを用いた,移動型視覚システムのためのリアルタイムセマンティックマッピング手法を提案する。我々のシステムは,65msの平均反復時間でリアルタイムに到達し,公開データセット上での最先端SLAMのポーズ推定を最大68%向上させることができる。
論文参考訳（メタデータ） (2022-03-08T09:14:37Z)
Improving Robustness and Accuracy via Relative Information Encoding in 3D Human Pose Estimation [59.94032196768748]
位置および時間的拡張表現を出力する相対情報符号化法を提案する。提案手法は2つの公開データセット上で最先端の手法より優れている。
論文参考訳（メタデータ） (2021-07-29T14:12:19Z)
Self-Attentive 3D Human Pose and Shape Estimation from Videos [82.63503361008607]
3D人間のポーズと形状推定のためのビデオベースの学習アルゴリズムを紹介します。ビデオの時間情報を利用して自己着脱モジュールを提案する。本手法を3DPW, MPI-INF-3DHP, Human3.6Mデータセット上で評価した。
論文参考訳（メタデータ） (2021-03-26T00:02:19Z)
Enhanced 3D Human Pose Estimation from Videos by using Attention-Based Neural Network with Dilated Convolutions [12.900524511984798]
従来のネットワークや制約の形式が、どのように注意の枠組みに組み込むことができるのかを体系的な設計で示します。拡張畳み込みのマルチスケール構造により,時間受容場を適応させることにより,これを実現する。提案手法は,Human3.6Mデータセット上での関節位置誤差の平均を33.4mmに減らし,最先端性能を達成し,既存の手法よりも優れる。
論文参考訳（メタデータ） (2021-03-04T17:26:51Z)
InfoFocus: 3D Object Detection for Autonomous Driving with Dynamic Information Modeling [65.47126868838836]
動的情報モデリングを用いた新しい3次元オブジェクト検出フレームワークを提案する。粗い予測は、ボクセルベースの領域提案ネットワークを介して第1段階で生成される。大規模なnuScenes 3D検出ベンチマークで実験を行った。
論文参考訳（メタデータ） (2020-07-16T18:27:08Z)
A Graph Attention Spatio-temporal Convolutional Network for 3D Human Pose Estimation in Video [7.647599484103065]
我々は,アテンション機構を用いた局所的グローバル空間情報のモデリングにより,人間の骨格における制約の学習を改善する。提案手法は, 奥行きのあいまいさと自己閉塞性を効果的に軽減し, 半上半身推定を一般化し, 2次元から3次元映像のポーズ推定における競合性能を実現する。
論文参考訳（メタデータ） (2020-03-11T14:54:40Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。

指定された論文の情報です。
本サイトの運営者は本サイト（すべての情報・翻訳含む）の品質を保証せず、本サイト（すべての情報・翻訳含む）を使用して発生したあらゆる結果について一切の責任を負いません。