論文の概要: Smooth Operator: A Real-Time Sampling-Based Algorithm for Kinematic Hand Retargeting
- arxiv url: http://arxiv.org/abs/2607.07491v1
- Date: Wed, 08 Jul 2026 14:50:17 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-09 22:50:30.42623
- Title: Smooth Operator: A Real-Time Sampling-Based Algorithm for Kinematic Hand Retargeting
- Title(参考訳): Smooth Operator: Kinematic Hand Retargetingのためのリアルタイムサンプリングベースアルゴリズム
- Abstract要約: SBRは,低ジッタ,リアルタイムな運動操作のための新しい勾配のない手法である。
SBRは全体の作業成功率(54.1%)を最高に達成し、操作者の認知疲労を著しく低減した。
- 参考スコア(独自算出の注目度): 6.262208498687923
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Advances in learning-based robotic manipulation, such as Vision-Language-Action (VLA) models and Video Action Models (VAMs), heavily rely on high-quality teleoperation data. Their capabilities are strictly upper-bounded by the quality of the underlying human demonstrations. Current gradient-based retargeting algorithms often converge to different local minima, resulting in jitter that affects data quality and teleoperation experience. To address this, we introduce the Sampling-Based Retargeter (SBR), a novel gradient-free retargeting method drawn from the rich literature of sampling-based control and explicitly designed for low-jitter, real-time kinematic retargeting. We evaluate SBR both in simulation and through a rigorous real-world user study involving 18 participants performing 3 complex manipulation tasks. Compared to gradient-based baselines, SBR achieved the highest overall task success rate (54.1%) while significantly reducing operator cognitive fatigue, recording the lowest NASA-TLX workload score (36.4 out of 100). Ultimately, we establish SBR as a highly effective, intuitive retargeter for dexterous manipulation, providing the community with a rigorous benchmarking methodology to guide future retargeting research.
- Abstract(参考訳): VLA(Vision-Language-Action)モデルやVAM(Video Action Models)など、学習に基づくロボット操作の進歩は、高品質な遠隔操作データに大きく依存している。
彼らの能力は、基礎となる人間のデモの質によって厳密に上界している。
現在の勾配に基づくリターゲティングアルゴリズムは、しばしば異なる局所的なミニマに収束し、結果としてデータ品質と遠隔操作エクスペリエンスに影響を与えるジッタとなる。
そこで本研究では,サンプリングベース制御の豊富な文献から得られた,低ジッタかつリアルタイムなキネマティックリターゲティングのための新しい勾配自由リターゲティング手法であるサンプリングベースリターゲティング(SBR)を提案する。
SBRのシミュレーションと,3つの複雑な操作作業を行う18人の参加者を対象とした厳密な実世界のユーザスタディを通じて,SBRの評価を行った。
勾配に基づくベースラインと比較すると、SBRは全体のタスク成功率(54.1%)が最も高く、オペレータの認知疲労を著しく低減し、NASA-TLXのワークロードスコア(100点中36.4点)は最低であった。
最終的に、我々はSBRを、厳密な操作のための非常に効果的で直感的な再ターゲッターとして確立し、将来的な再ターゲティング研究のガイドとなる厳密なベンチマーク手法をコミュニティに提供する。
関連論文リスト
- Self-Correcting VLA: Online Action Refinement via Sparse World Imagination [55.982504915794514]
本稿では, 自己補正VLA (SC-VLA) を提案する。
SC-VLAは最先端のパフォーマンスを達成し、最高タスクスループットを16%削減し、最高パフォーマンスのベースラインよりも9%高い成功率を得る。
論文 参考訳(メタデータ) (2026-02-25T06:58:06Z) - Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation [95.89924101984566]
GPM(Global Prior Memory)とLCM(Local Consistency Memory)を備えたデュアルメモリVLAフレームワークOptimusVLAを紹介する。
GPMはガウスノイズを意味論的に類似した軌道から取得したタスクレベルの先行値に置き換える。
LCMは、時間的コヒーレンスと軌道の滑らかさを強制する学習された一貫性制約を注入する。
論文 参考訳(メタデータ) (2026-02-22T15:39:34Z) - RFM-Pose:Reinforcement-Guided Flow Matching for Fast Category-Level 6D Pose Estimation [8.3336796041978]
我々は,サンプル仮説を積極的に評価しながら,カテゴリレベルの6次元オブジェクトポーズ生成を加速する新しいフレームワーク RFM-Pose を提案する。
REAL275ベンチマークの実験では、RAM-Poseは計算コストを大幅に削減し、良好な性能を発揮することが示された。
論文 参考訳(メタデータ) (2026-02-05T03:26:15Z) - IRPO: Boosting Image Restoration via Post-training GRPO [59.588079259093035]
我々は低レベルのGRPOベースのポストトレーニングパラダイムIRPOを提案する。
まず,低レベルのポストトレーニングパラダイムのデータ定式化原理について検討する。
次に、客観的精度と人間の知覚的嗜好のバランスをとる報酬レベル基準をモデル化する。
論文 参考訳(メタデータ) (2025-11-30T09:42:24Z) - SRPO: Self-Referential Policy Optimization for Vision-Language-Action Models [42.89413870143421]
VLA(Vision-Language-Action)モデルはロボット操作に優れるが、専門家によるデモンストレーションに大きく依存している。
グループベースの最適化手法を含む現在のVLA-RL法は、深刻な報酬の分散によって損なわれている。
本稿では,新しいVLA-RLフレームワークである自己参照ポリシー最適化(SRPO)を提案する。
論文 参考訳(メタデータ) (2025-11-19T16:52:23Z) - RESample: A Robust Data Augmentation Framework via Exploratory Sampling for Robotic Manipulation [35.01431111972725]
VLA(Vision-Language-Action Model)は、模倣学習を通じて複雑なロボット操作タスクにおいて顕著な性能を示す。
探索サンプリングにより,RESample という自動 OOD データ拡張フレームワークを提案する。
LIBEROベンチマークと実世界のロボット操作タスクについて広範な実験を行い、resampleがVLAモデルの安定性と一般化能力を一貫して改善することを実証した。
論文 参考訳(メタデータ) (2025-10-20T15:21:12Z) - NatureGAIA: Pushing the Frontiers of GUI Agents with a Challenging Benchmark and High-Quality Trajectory Dataset [16.676904484703]
本稿ではCausal Pathwaysの原理に基づく新しいベンチマークであるNaturalGAIAを紹介する。
このパラダイムは複雑なタスクを検証可能な一連の原子ステップに構造化し、厳密で完全に自動化され、再現可能な評価基準を保証する。
次に、このデータセットを用いて、Q2.5-VL-7Bモデル上でReinforcement FineTuning(RFT)を行う。
論文 参考訳(メタデータ) (2025-08-02T11:53:41Z) - DARS: Dynamic Action Re-Sampling to Enhance Coding Agent Performance by Adaptive Tree Traversal [55.13854171147104]
大規模言語モデル(LLM)は、自然言語処理、データ分析、ソフトウェア開発など、さまざまな領域に革命をもたらした。
符号化エージェントのための新しい推論時間計算スケーリングアプローチである動的アクション再サンプリング(DARS)を提案する。
我々は、SWE-Bench Liteベンチマークに対する我々のアプローチを評価し、このスケーリング戦略がClude 3.5 Sonnet V2で55%のパス@kスコアを達成したことを実証した。
論文 参考訳(メタデータ) (2025-03-18T14:02:59Z) - MENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement Learning [17.437573206368494]
視覚深部強化学習(RL)は、ロボットが非構造化タスクの視覚入力からスキルを習得することを可能にする。
本稿では,RLエージェントのアーキテクチャと最適化の両方を改善する手法であるMENTORを提案する。
MenTORは3つのシミュレーションベンチマークで最先端の手法を上回り、挑戦的な3つの現実世界のロボット操作タスクで平均83%の成功率を達成した。
論文 参考訳(メタデータ) (2024-10-19T04:31:54Z) - ACTRESS: Active Retraining for Semi-supervised Visual Grounding [52.08834188447851]
前回の研究であるRefTeacherは、疑似自信と注意に基づく監督を提供するために教師学生の枠組みを採用することで、この課題に取り組むための最初の試みである。
このアプローチは、Transformerベースのパイプラインに従う現在の最先端のビジュアルグラウンドモデルと互換性がない。
本稿では, ACTRESS を略したセミスーパービジョン視覚グラウンドのためのアクティブ・リトレーニング手法を提案する。
論文 参考訳(メタデータ) (2024-07-03T16:33:31Z) - A Practical Contrastive Learning Framework for Single-Image
Super-Resolution [51.422185656787285]
コントラスト学習に基づく単一画像の超解像を2つの視点から検討する。
SISR のための実践的コントラスト学習フレームワーク PCL-SR を提案する。
既存のベンチマーク手法と比較して,提案手法をPCL-SRフレームワークで再学習し,優れた性能を実現する。
論文 参考訳(メタデータ) (2021-11-27T15:42:12Z) - Domain Adaptive Robotic Gesture Recognition with Unsupervised
Kinematic-Visual Data Alignment [60.31418655784291]
本稿では,マルチモダリティ知識,すなわちキネマティックデータとビジュアルデータを同時にシミュレータから実ロボットに伝達できる,教師なしドメイン適応フレームワークを提案する。
ビデオの時間的手がかりと、ジェスチャー認識に対するマルチモーダル固有の相関を用いて、トランスファー可能な機能を強化したドメインギャップを修復する。
その結果, 本手法は, ACCでは最大12.91%, F1scoreでは20.16%と, 実際のロボットではアノテーションを使わずに性能を回復する。
論文 参考訳(メタデータ) (2021-03-06T09:10:03Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。