論文の概要: PCSTracker: Long-Term Scene Flow Estimation for Point Cloud Sequences
- arxiv url: http://arxiv.org/abs/2603.19762v1
- Date: Fri, 20 Mar 2026 08:45:27 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-23 19:48:39.060971
- Title: PCSTracker: Long-Term Scene Flow Estimation for Point Cloud Sequences
- Title(参考訳): PCSTracker:ポイントクラウドシーケンスの長期フロー推定
- Abstract要約: PCSTrackerは、ポイントクラウドシーケンスにおける一貫したシーンフロー推定のために特別に設計されたエンドツーエンドフレームワークである。
PCSTrackerは、長期のシーンフロー推定において最高の精度を達成し、32.5 FPSでリアルタイム性能を維持する。
- 参考スコア(独自算出の注目度): 20.800932584993706
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Point cloud scene flow estimation is fundamental to long-term and fine-grained 3D motion analysis. However, existing methods are typically limited to pairwise settings and struggle to maintain temporal consistency over long sequences as geometry evolves, occlusions emerge, and errors accumulate. In this work, we propose PCSTracker, the first end-to-end framework specifically designed for consistent scene flow estimation in point cloud sequences. Specifically, we introduce an iterative geometry motion joint optimization module (IGMO) that explicitly models the temporal evolution of point features to alleviate correspondence inconsistencies caused by dynamic geometric changes. In addition, a spatio-temporal point trajectory update module (STTU) is proposed to leverage broad temporal context to infer plausible positions for occluded points, ensuring coherent motion estimation. To further handle long sequences, we employ an overlapping sliding-window inference strategy that alternates cross-window propagation and in-window refinement, effectively suppressing error accumulation and maintaining stable long-term motion consistency. Extensive experiments on the synthetic PointOdyssey3D and real-world ADT3D datasets show that PCSTracker achieves the best accuracy in long-term scene flow estimation and maintains real-time performance at 32.5 FPS, while demonstrating superior 3D motion understanding compared to RGB-D-based approaches.
- Abstract(参考訳): 点雲のシーンフロー推定は, 長期的, 微粒な3次元運動解析の基礎となる。
しかし、既存の手法は概してペアワイズな設定に限られており、幾何が進化し、オクルージョンが出現し、エラーが蓄積するにつれて、長いシーケンスの時間的一貫性を維持するのに苦労する。
そこで本研究では,ポイントクラウドシーケンスにおける一貫したシーンフロー推定に特化して設計された,最初のエンドツーエンドフレームワークであるPCSTrackerを提案する。
具体的には、動的幾何変化による対応の不整合を軽減するために、点特徴の時間的進化を明示的にモデル化する反復幾何運動関節最適化モジュール(IGMO)を導入する。
さらに、広時空間を利用して、閉塞点に対する可視位置を推定し、コヒーレントな動き推定を保証するために、時空間軌跡更新モジュール(STTU)を提案する。
さらに長周期の処理には、クロスウィンドウ伝播とインウィンドウ改善を交互に行い、エラーの蓄積を効果的に抑制し、長期動作の一貫性を安定的に維持するオーバーラップ・スライディング・ウインドウ推論戦略を用いる。
合成 PointOdyssey3D と実世界の ADT3D データセットの大規模な実験により、PCSTracker は長期のシーンフロー推定において最高の精度を達成し、32.5 FPS でのリアルタイム性能を維持しつつ、RGB-D ベースのアプローチよりも優れた3次元動作理解を実証している。
関連論文リスト
- GemDepth: Geometry-Embedded Features for 3D-Consistent Video Depth [12.866152238833104]
ビデオ深度推定は、一眼的予測を時間領域に拡張し、コヒーレンスを確保する。
現在のアプローチは主にトランスフォーマーによる時間的平滑化に依存しており、厳密な3次元幾何学的整合性を維持するのに苦労している。
GemDepthは,カメラモーションとグローバル3D構造を明確に認識することが3D一貫性の前提条件である,という知見に基づいて構築されたフレームワークである。
論文 参考訳(メタデータ) (2026-05-11T13:11:54Z) - QueST: Persistent Queries as Semantic Monitors for Drift Suppression in Long-Horizon Tracking [2.064813317204182]
QueSTは、インタラクション関連エンティティを永続的なセマンティッククエリとして扱う、モニタリング・バイ・デザインのフレームワークである。
ローカルなプロパゲーションの代わりに、各クエリは、各ステップ毎のグローバルなオーバータイムビデオ機能に出席する。
QueSTは67.7%の絶対点誤差(APE)を達成するための終端ドリフトを大幅に削減する
以上の結果から, セマンティックモニタリングを直接知覚に組み込むことにより, より信頼性の高い長距離追跡が可能であることが示唆された。
論文 参考訳(メタデータ) (2026-05-10T12:48:01Z) - UST-SSM: Unified Spatio-Temporal State Space Models for Point Cloud Video Modeling [53.199942923818206]
ポイントクラウドビデオは、光と視点の変化の影響を低減しつつ3Dの動きを捉え、微妙で連続した人間の行動を認識するのに非常に効果的である。
SSM(Selective State Space Models)は、線形複雑性を伴うシーケンスモデリングにおいて優れた性能を示す。
我々は,SSMの最新の進歩をクラウドビデオに向け,統一時空間モデル(UST-SSM)を提案する。
論文 参考訳(メタデータ) (2025-08-20T10:46:01Z) - Delving into Dynamic Scene Cue-Consistency for Robust 3D Multi-Object Tracking [16.366398265001422]
3D多目的追跡は、自動運転分野において重要かつ困難な課題である。
本稿では,この原理を実現するために動的シーンCue-Consistency Tracker(DSC-Track)を提案する。
論文 参考訳(メタデータ) (2025-08-15T08:48:13Z) - EMoTive: Event-guided Trajectory Modeling for 3D Motion Estimation [59.33052312107478]
イベントカメラは、シーン変化に対する連続的適応ピクセルレベル応答による3次元モーション推定の可能性を提供する。
本稿では,イベント誘導パラメトリック曲線を用いた一様軌道をモデル化するイベントベースフレームワークであるEMoveについて述べる。
動作表現には,事象誘導下での空間的特徴と時間的特徴を融合する密度認識適応機構を導入する。
最終3次元運動推定は、パラメトリック軌道、流れ、深度運動場の多時間サンプリングによって達成される。
論文 参考訳(メタデータ) (2025-03-14T13:15:54Z) - Online Dense Point Tracking with Streaming Memory [54.22820729477756]
デンスポイントトラッキングは、ビデオのかなりの部分を通して、初期フレーム内のすべてのポイントの連続的な追跡を必要とする、困難なタスクである。
最近の点追跡アルゴリズムは、通常、最初のフレームから現在のフレームへの間接的な情報伝達のためにスライドウィンドウに依存する。
我々は、高密度のtextbfPOint textbfTracking とオンラインビデオ処理のための textbfStreaming メモリを備えた軽量で高速なモデルを提案する。
論文 参考訳(メタデータ) (2025-03-09T06:16:49Z) - PTT: Point-Trajectory Transformer for Efficient Temporal 3D Object Detection [66.94819989912823]
時間的3次元物体検出を効率的に行うために,長期記憶が可能な点トラジェクトリ変換器を提案する。
私たちは、メモリバンクのストレージ要件を最小限に抑えるために、現在のフレームオブジェクトのポイントクラウドとその履歴トラジェクトリを入力として使用します。
大規模データセットに対する広範な実験を行い、我々のアプローチが最先端の手法に対してうまく機能することを実証した。
論文 参考訳(メタデータ) (2023-12-13T18:59:13Z) - Learning Monocular Depth in Dynamic Environment via Context-aware
Temporal Attention [9.837958401514141]
マルチフレーム単眼深度推定のためのコンテキスト対応テンポラルアテンション誘導ネットワークであるCTA-Depthを提案する。
提案手法は,3つのベンチマークデータセットに対する最先端アプローチよりも大幅に改善されている。
論文 参考訳(メタデータ) (2023-05-12T11:48:32Z) - Modeling Continuous Motion for 3D Point Cloud Object Tracking [54.48716096286417]
本稿では,各トラックレットを連続ストリームとみなす新しいアプローチを提案する。
各タイムスタンプでは、現在のフレームだけがネットワークに送られ、メモリバンクに格納された複数フレームの履歴機能と相互作用する。
頑健な追跡のためのマルチフレーム機能の利用性を高めるために,コントラッシブシーケンス強化戦略を提案する。
論文 参考訳(メタデータ) (2023-03-14T02:58:27Z) - IDEA-Net: Dynamic 3D Point Cloud Interpolation via Deep Embedding
Alignment [58.8330387551499]
我々は、点方向軌跡(すなわち滑らかな曲線)の推定として問題を定式化する。
本稿では,学習した時間的一貫性の助けを借りて問題を解消する,エンドツーエンドのディープラーニングフレームワークであるIDEA-Netを提案する。
各種点群における本手法の有効性を実証し, 定量的かつ視覚的に, 最先端の手法に対する大幅な改善を観察する。
論文 参考訳(メタデータ) (2022-03-22T10:14:08Z) - 3DMotion-Net: Learning Continuous Flow Function for 3D Motion Prediction [12.323767993152968]
本研究では,従来の2つの連続したフレームから3次元物体の3次元運動を予測する問題に対処する。
本稿では,ディープニューラルネットワークのパワーを活用して3次元点雲の連続流れ関数を学習する自己教師型アプローチを提案する。
D-FAUST,SCAPE,TOSCAベンチマークデータセットについて広範な実験を行い,本手法が時間的に一貫性のない入力を処理可能であることを示す。
論文 参考訳(メタデータ) (2020-06-24T17:39:19Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。