論文の概要: Geometric Retargeting: A Principled, Ultrafast Neural Hand Retargeting Algorithm
- arxiv url: http://arxiv.org/abs/2503.07541v1
- Date: Mon, 10 Mar 2025 17:10:21 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-03-11 20:09:45.058668
- Title: Geometric Retargeting: A Principled, Ultrafast Neural Hand Retargeting Algorithm
- Title(参考訳): 幾何学的リターゲティング - 原理的, 超高速なニューラルハンドリターゲティングアルゴリズム
- Abstract要約: 遠隔操作のための超高速・原理的ハンドアルゴリズムGeoRTを紹介する。
GeoRTは、人間の指のキーポイントを1KHzでロボットの手のキーポイントに変換し、最先端のスピードと精度を達成する。
- 参考スコア(独自算出の注目度): 50.52643618961044
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: We introduce Geometric Retargeting (GeoRT), an ultrafast, and principled neural hand retargeting algorithm for teleoperation, developed as part of our recent Dexterity Gen (DexGen) system. GeoRT converts human finger keypoints to robot hand keypoints at 1KHz, achieving state-of-the-art speed and accuracy with significantly fewer hyperparameters. This high-speed capability enables flexible postprocessing, such as leveraging a foundational controller for action correction like DexGen. GeoRT is trained in an unsupervised manner, eliminating the need for manual annotation of hand pairs. The core of GeoRT lies in novel geometric objective functions that capture the essence of retargeting: preserving motion fidelity, ensuring configuration space (C-space) coverage, maintaining uniform response through high flatness, pinch correspondence and preventing self-collisions. This approach is free from intensive test-time optimization, offering a more scalable and practical solution for real-time hand retargeting.
- Abstract(参考訳): 我々は,最新のDexterity Gen(DexGen)システムの一部として開発された,遠隔操作のための超高速で原理化されたニューラルネットワーク再ターゲットアルゴリズムであるGeoRTを紹介した。
GeoRTは人間の指のキーポイントを1KHzでロボットの手のキーポイントに変換する。
この高速機能は、DexGenのようなアクション修正に基本的なコントローラを活用するなど、柔軟な後処理を可能にする。
GeoRTは教師なしの方法でトレーニングされており、ハンドペアの手動アノテーションを不要にしている。
GeoRTのコアは、動きの忠実さの保存、構成空間(C空間)の確保、高平坦性による一様応答の維持、ピンチ対応、自己衝突の防止といった、リターゲティングの本質を捉える新しい幾何学的目的関数にある。
このアプローチは、リアルタイムハンドリターゲティングのための、よりスケーラブルで実用的なソリューションを提供する、集中的なテストタイム最適化から解放されている。
関連論文リスト
- CosmoH2G: A Hand-to-Gripper Transfer Dataset and Baseline Method for Object Manipulation with Complex Spatial Movements [63.40365657068892]
ロボットグリップに人手によるデモンストレーションを移すことは、最近、ロボット学習の費用対効果の高いソリューションとして浮上した。
このギャップに触発された我々は、きめ細かい手の動きによって導かれる暗黙的なデータ駆動アプローチを採用した。
シミュレーションと実ロボット実験の両方において、我々のフレームワークは複雑な空間操作の安定かつ高精度なハンド・トゥ・グルーパー転送を可能にする。
論文 参考訳(メタデータ) (2026-09-07T13:47:22Z) - MANGO-Grasp: Mahalanobis Fields over Geometry-Oriented 3D Gaussians for Cross-Embodiment Dexterous Grasping [82.63833405368159]
クロス・エボディメント・デキスタラス・グルーピングは、異種多指ハンド間の安定したグルーピングを、エンボディメント固有のチューニングをほとんど、あるいは全く行わずに合成することを目的としている。
物体を幾何学指向の3Dガウスプリミティブとして、ロボットハンドをモルフォキネマティックな記述子に符号化した表面キーポイントとして表現する異方性相互作用フレームワークであるMANGO-Graspを提案する。
論文 参考訳(メタデータ) (2026-08-03T10:12:15Z) - AnyDexRT: Calibration-Free Dexterous Hand Retargeting with Few-Shot Human Guidance [52.973947477815614]
AnyDexRT は人のような器用な手間で直感的な器用な遠隔操作を行うキャリブレーションのない手法である。
実験によると、AnyDexRTは品質を改善し、手動チューニングを減らし、従来の方法よりも直感的で効率的な制御を提供する。
論文 参考訳(メタデータ) (2026-07-09T10:29:53Z) - LCPNet: Latent Consistent Proximal Unfolding Network for Infrared Small Target Detection [50.3892176822492]
赤外線小目標検出(IRSTD)は、複雑な赤外背景から長距離小目標を特定することを目的としている。
深層学習法は、識別的画像-マスクマッピングを学習することでIRSTDを改善した。
深層展開法は、モデル駆動イテレーションをニューラルネットワークに埋め込むことによって、この問題に部分的に対処する。
これらの制約に対処するために,Latent Consistent Proximal Unfolding Network (LCPNet)を提案する。
論文 参考訳(メタデータ) (2026-07-06T02:15:09Z) - ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients [10.858081539985577]
自己教師型微調整によるデータ効率適応のためのフレームワークELMPを提案する。
これは専門家のデータ生成を急激な問題サンプリングに置き換え、サンプルごとの適応コストを約2桁削減する。
提案手法はミリ秒レベルの推論遅延を維持し,Franka Emika Pandaロボットを用いて検証する。
論文 参考訳(メタデータ) (2026-06-30T21:47:09Z) - TopoRetarget: Interaction-Preserving Retargeting for Dexterous Manipulation [32.317349412479885]
人手オブジェクトのデモは、参照トラッキングを通じて、デクスタラスラーニング(RL)ポリシーをトレーニングするための高密度な参照動作を提供する。
このような実演をRL政策学習に利用するためには、強化は手ポーズとタスク関連手オブジェクト接触構造を保たなければならない。
TopoRetargetは、さまざまな条件にまたがって単一のパラメータセットを使用するインタラクション保存フレームワークである。
TopoRetargetは、ContactPoseデータセット上のすべてのベースラインに対して、最高のコンタクト精度とアライメントを達成する。
論文 参考訳(メタデータ) (2026-06-15T06:20:46Z) - Make Tracking Easy: Neural Motion Retargeting for Humanoid Whole-body Control [43.01629060165596]
本稿では,不均一な動きを潜在モチーフにグループ化するニューラルモーション・リターゲティング・フレームワークを提案する。
この戦略により、計算の並列学習の専門家は大幅に削減される。
参照は、全身制御ポリシーの収束を加速する。
論文 参考訳(メタデータ) (2026-03-23T16:59:00Z) - Dual-Agent Multiple-Model Reinforcement Learning for Event-Triggered Human-Robot Co-Adaptation in Decoupled Task Spaces [3.349003999623489]
本稿では,カスタム6自由度上肢ロボットのための共有制御型リハビリテーションポリシーを提案する。
患者は二進法で一次到達方向を制御し、ロボットは自律的に矯正動作を管理する。
論文 参考訳(メタデータ) (2026-03-06T11:15:10Z) - ULTRA: Unified Multimodal Control for Autonomous Humanoid Whole-Body Loco-Manipulation [55.467742403416175]
本稿では,大規模モーションキャプチャをヒューマノイドに変換する物理駆動型ニューラルネットワークを提案する。
我々は高密度参照とスパースタスク仕様の両方をサポートする統合マルチモーダルコントローラを学習する。
その結果,ULTRAは自我中心の知覚から,自律的,目標条件付き全体ロコ操作に一般化することが示された。
論文 参考訳(メタデータ) (2026-03-03T18:59:29Z) - GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR [10.820638016337869]
RL更新部分空間の異方性と圧縮性を利用したGeoRAを提案する。
GeoRAは、幾何学的ミスアライメントによる最適化ボトルネックを緩和する。
主要な数学ベンチマークで確立された低ランクのベースラインを一貫して上回る。
論文 参考訳(メタデータ) (2026-01-14T10:41:34Z) - Towards Efficient General Feature Prediction in Masked Skeleton Modeling [59.46799426434277]
マスクスケルトンモデリングのための新しい汎用特徴予測フレームワーク(GFP)を提案する。
我々の重要な革新は、局所的な動きパターンからグローバルな意味表現にまたがる、従来の低レベルな再構築を高レベルな特徴予測に置き換えることです。
論文 参考訳(メタデータ) (2025-09-03T18:05:02Z) - Proximal Algorithm Unrolling: Flexible and Efficient Reconstruction Networks for Single-Pixel Imaging [45.39911367007956]
ディープ・アンロールとプラグ・アンド・プレイのアプローチは、単画素イメージング(SPI)逆問題におけるデファクトとなっている。
本稿では,両クラスの解き手の強みを統合するという課題に対処する。
論文 参考訳(メタデータ) (2025-05-29T07:16:57Z) - Motion Matters: Compact Gaussian Streaming for Free-Viewpoint Video Reconstruction [57.76758872762516]
3D Gaussian Splatting (3DGS)は、オンライン自由視点ビデオ(FVV)再構成のための高忠実で効率的なパラダイムとして登場した。
本研究では,動的シーンにおける動きの局所性と一貫性を活かした,コンパクトガウスストリーミング(ComGS)フレームワークを提案する。
ComGS は 3DGStream や 14X に比べて 159 X 以上のストレージ削減を実現している。
論文 参考訳(メタデータ) (2025-05-22T11:22:09Z) - ReCoM: Realistic Co-Speech Motion Generation with Recurrent Embedded Transformer [58.49950218437718]
音声に同期した高忠実で一般化可能な人体動作を生成するための効率的なフレームワークであるReCoMを提案する。
Recurrent Embedded Transformer (RET)は、動的埋め込み正規化(DER)をViT(Vit)コアアーキテクチャに統合する。
モデルロバスト性を高めるため,ノイズ抵抗とクロスドメイン一般化の二重性を持つモデルに,提案したDER戦略を取り入れた。
論文 参考訳(メタデータ) (2025-03-27T16:39:40Z) - Split-Boost Neural Networks [1.1549572298362787]
本稿では,スプリットブートと呼ばれるフィードフォワードアーキテクチャの革新的なトレーニング戦略を提案する。
このような新しいアプローチは、最終的に正規化項を明示的にモデル化することを避けることができる。
提案した戦略は、ベンチマーク医療保険設計問題内の実世界の(匿名化された)データセットでテストされる。
論文 参考訳(メタデータ) (2023-09-06T17:08:57Z) - EventTransAct: A video transformer-based framework for Event-camera
based action recognition [52.537021302246664]
イベントカメラは、RGBビデオの標準アクション認識と比較して、新しい機会を提供する。
本研究では,最初にイベントフレーム当たりの空間埋め込みを取得するビデオトランスフォーマーネットワーク(VTN)という,計算効率のよいモデルを用いる。
イベントデータのスパースできめ細かい性質にVTNをよりよく採用するために、イベントコントラストロス(mathcalL_EC$)とイベント固有の拡張を設計する。
論文 参考訳(メタデータ) (2023-08-25T23:51:07Z) - GIFD: A Generative Gradient Inversion Method with Feature Domain
Optimization [52.55628139825667]
Federated Learning(FL)は、クライアントのプライバシを保護するための有望な分散機械学習フレームワークとして登場した。
近年の研究では、事前学習された生成逆ネットワーク(GAN)を事前知識として活用することにより、攻撃者が共有勾配を逆転し、FLシステムに対する機密データを回復できることが示されている。
textbfGradient textbfInversion over textbfFeature textbfDomains (GIFD)を提案する。
論文 参考訳(メタデータ) (2023-08-09T04:34:21Z) - SDR-GAIN: A High Real-Time Occluded Pedestrian Pose Completion Method for Autonomous Driving [2.6663666678221376]
我々は,SDR-GAIN(Generative Adrial Imputation Nets)の分離と次元化に基づく新しいリアルタイム閉鎖型歩行者ポーズ補完フレームワークを提案する。
SDR-GAINは、キーポイント座標の数値分布から直接人間のポーズを学習し、行方不明位置を補間することを目的としている。
COCOとJAADデータセットで実施された実験は、SDR-GAINが従来の機械学習とTransformerベースの欠落データアルゴリズムを上回ることを示した。
論文 参考訳(メタデータ) (2023-06-06T09:35:56Z) - A Distance-Geometric Method for Recovering Robot Joint Angles From an
RGB Image [7.971699294672282]
本稿では,ロボットマニピュレータの関節角度を現在の構成の1つのRGB画像のみを用いて検索する手法を提案する。
提案手法は,構成空間の距離幾何学的表現に基づいて,ロボットの運動モデルに関する知識を活用する。
論文 参考訳(メタデータ) (2023-01-05T12:57:45Z) - FPGA-optimized Hardware acceleration for Spiking Neural Networks [69.49429223251178]
本研究は,画像認識タスクに適用したオフライントレーニングによるSNN用ハードウェアアクセラレータの開発について述べる。
この設計はXilinx Artix-7 FPGAをターゲットにしており、利用可能なハードウェアリソースの40%を合計で使用している。
分類時間を3桁に短縮し、ソフトウェアと比較すると精度にわずか4.5%の影響を与えている。
論文 参考訳(メタデータ) (2022-01-18T13:59:22Z) - Real-time Pose and Shape Reconstruction of Two Interacting Hands With a
Single Depth Camera [79.41374930171469]
本稿では,2つの強く相互作用する手の位置と形状をリアルタイムに再現する新しい手法を提案する。
われわれのアプローチは、有利なプロパティの広範なリスト、すなわちマーカーレスを組み合わせている。
過去の研究で示された複雑性レベルを超える場面で、最先端の結果を示す。
論文 参考訳(メタデータ) (2021-06-15T11:39:49Z) - Parameter-free Locally Accelerated Conditional Gradients [91.19349793915615]
私たちは小説を紹介します。
自由局所加速cg(pf-lacg)アルゴリズムは,厳密な収束保証を提供する。
我々の理論結果は,局所加速度を実証し,非加速アルゴリズムに対するPF-LaCGの実用的改善を示す数値実験によって補完される。
論文 参考訳(メタデータ) (2021-02-12T22:50:01Z) - Randomized Automatic Differentiation [22.95414996614006]
我々は、ランダム化自動微分(RAD)のための一般的なフレームワークとアプローチを開発する。
RADは、分散の見返りにメモリを減らし、バイアスのない見積もりを計算できる。
本稿では,フィードフォワードネットワークのバッチサイズを小さくし,繰り返しネットワークの場合と同様の回数でRADが収束することを示す。
論文 参考訳(メタデータ) (2020-07-20T19:03:44Z) - Overlap Local-SGD: An Algorithmic Approach to Hide Communication Delays
in Distributed SGD [32.03967072200476]
We propose a algorithmic approach named OverlapLocal-Local-Local-SGD (Local momentum variant)。
各ノードにアンカーモデルを追加することでこれを実現する。
複数のローカルアップデートの後、ローカルにトレーニングされたモデルは、他の人と通信するのではなく、アンカーモデルへと引き戻される。
論文 参考訳(メタデータ) (2020-02-21T20:33:49Z) - LE-HGR: A Lightweight and Efficient RGB-based Online Gesture Recognition
Network for Embedded AR Devices [8.509059894058947]
本稿では,低消費電力な組込みデバイス上でのリアルタイムジェスチャー認識を実現するために,軽量で計算効率のよいHGRフレームワークLE-HGRを提案する。
提案手法は高精度でロバスト性があり,様々な複雑な相互作用環境において,高性能な性能を実現することができることを示す。
論文 参考訳(メタデータ) (2020-01-16T05:23:24Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。