論文の概要: Certified Gradient-Based Contact-Rich Manipulation via Smoothing-Error Reachable Tubes
- arxiv url: http://arxiv.org/abs/2602.09368v1
- Date: Tue, 10 Feb 2026 03:19:42 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-23 08:17:41.311176
- Title: Certified Gradient-Based Contact-Rich Manipulation via Smoothing-Error Reachable Tubes
- Title(参考訳): Smoothing-Error Reachable tubeによるグラディエントベースコンタクトリッチマニピュレーション
- Abstract要約: 我々は接触リッチな操作のための新しい勾配に基づくポリシー合成法を開発した。
提案手法は,平面プッシュ,オブジェクト回転,手動操作など,複数の接触に富むタスクに対して評価する。
定値ロバスト制御で微分可能な物理をブリッジすることにより,接触リッチな操作を行うための,初めて証明可能な勾配式ポリシー合成法である。
- 参考スコア(独自算出の注目度): 5.119652071085673
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Gradient-based methods can efficiently optimize controllers using physical priors and differentiable simulators, but contact-rich manipulation remains challenging due to discontinuous or vanishing gradients from hybrid contact dynamics. Smoothing the dynamics yields continuous gradients, but the resulting model mismatch can cause controller failures when executed on real systems. We address this trade-off by planning with smoothed dynamics while explicitly quantifying and compensating for the induced errors, providing formal guarantees of constraint satisfaction and goal reachability on the true hybrid dynamics. Our method smooths both contact dynamics and geometry via a novel differentiable simulator based on convex optimization, which enables us to characterize the discrepancy from the true dynamics as a set-valued deviation. This deviation constrains the optimization of time-varying affine feedback policies through analytical bounds on the system's reachable set, enabling robust constraint satisfaction guarantees for the true closed-loop hybrid dynamics, while relying solely on informative gradients from the smoothed dynamics. We evaluate our method on several contact-rich tasks, including planar pushing, object rotation, and in-hand dexterous manipulation, achieving guaranteed constraint satisfaction with lower safety violation and goal error than baselines. By bridging differentiable physics with set-valued robust control, our method is the first certifiable gradient-based policy synthesis method for contact-rich manipulation.
- Abstract(参考訳): グラディエントベースの手法は、物理的先行と微分可能なシミュレータを使ってコントローラーを効率的に最適化することができるが、ハイブリッド接触ダイナミクスからの勾配の不連続や消失のため、コンタクトリッチな操作は依然として困難である。
ダイナミックスを滑らかにすると連続的な勾配が生じるが、実際のシステムで実行された場合、モデルミスマッチがコントローラの故障を引き起こす可能性がある。
このトレードオフは、スムーズな力学を用いて計画し、引き起こされたエラーを明示的に定量化し補償し、真のハイブリッド力学における制約満足度と目標到達可能性の正式な保証を提供することによって解決する。
本手法は,凸最適化に基づく新しい微分可能シミュレータを用いて,接触力学と幾何学の両方を円滑に表現し,実際の力学との相違を,集合値の偏差として特徴付ける。
この偏差は、システムの到達可能な集合に対する解析的境界による時間変化アフィンフィードバックポリシーの最適化を制約し、スムーズな力学からの情報勾配のみに依存しながら、真の閉ループハイブリッド力学に対する堅牢な制約満足度を保証する。
提案手法は, 平面押下, オブジェクト回転, 手動手動操作などの接触に富むタスクにおいて, 安全違反の少ない制約満足度と目標誤差を基準線よりも低く達成し, 評価する。
定値ロバスト制御で微分可能な物理をブリッジすることにより,接触リッチな操作を行うための,初めて証明可能な勾配式ポリシー合成法である。
関連論文リスト
- AdaDexGrasp: Adaptive Dexterous Grasping via 3D Visuo-Tactile Representation Fusion [60.79507611737292]
人間は視覚知覚と触覚フィードバックをシームレスに統合することで、安定的で適応的な把握を実現する。
既存のロボットグルーピングアプローチは、視覚入力と接触後の触覚誘導適応機構の欠如に依存している。
本稿では, 把握生成, 実現可能性予測, 適応的改善を統合した統合型ビジュオタクティル・フュージョン・グリーティング・フレームワークを提案する。
論文 参考訳(メタデータ) (2026-08-06T16:29:11Z) - Policy Optimization in Hybrid Discrete-Continuous Action Spaces via Mixed Gradients [3.1698277542519997]
ハイブリッド離散連続行動空間における強化学習について検討する。
本研究では,スムーズさが許す限り,シミュレータをバックプロパゲートするHybrid Policy Optimization (HPO)を提案する。
HPOは在庫管理においてPPOを大幅に上回り、リニアクアクラティックレギュレータの問題に切り替えた。
論文 参考訳(メタデータ) (2026-05-14T02:59:45Z) - Adaptive Smooth Tchebycheff Attention for Multi-Objective Policy Optimization [55.338784037660474]
ドメインにおける多曲率強化学習は、矛盾する目的間の複雑な非脆弱な干渉トレードオフのバランスを必要とする。
本稿では,生態系をモニタリングするプロキシであるロボットビジュアルを用いた,新しいリアルタイムなリアルタイム最適化を提案する。
論文 参考訳(メタデータ) (2026-05-12T21:32:57Z) - GraspADMM: Improving Dexterous Grasp Synthesis via ADMM Optimization [31.34069902255588]
本稿では,新しいグリップ合成フレームワークであるGraspADMMを提案する。
サンプリングベースの多様性を保ちつつ、運動可能性と動的安定性を改善している。
本手法は, 極低摩擦条件下においても, 頑健で, 物理的に安定なグリップ生成を維持できる。
論文 参考訳(メタデータ) (2026-03-14T08:32:13Z) - Coordinated Manipulation of Hybrid Deformable-Rigid Objects in Constrained Environments [3.915966095774856]
本研究は, ひずみに基づくコッサートロッドモデルを用いた準静電最適化に基づく操作プランナを提案する。
これは、厳密なツールで到達不能なオブジェクトに対して、タスク空間の目的を達成する一方で、制約を通して操作するための変形可能なリンクのコンプライアンスを利用する。
提案アルゴリズムは、様々なhDLOシステム上でのシミュレーションや、双腕ロボットシステムを用いた制約環境で操作された3リンクhDLOの実験で検証される。
論文 参考訳(メタデータ) (2026-03-13T12:34:49Z) - Adaptive Manipulation Potential and Haptic Estimation for Tool-Mediated Interaction [14.888648782445694]
本稿では,ツール間相互作用の統一表現として,パラメータ化された平衡マニフォールド(EM)を提案する。
我々は,ハプティック推定,オンライン計画,適応剛性制御を統合したクローズドループフレームワークを開発した。
このフレームワークはシミュレーションと260以上の現実世界のスクリューロージング試験によって検証されている。
論文 参考訳(メタデータ) (2026-03-11T02:57:55Z) - Optimizing Control-Friendly Trajectories with Self-Supervised Residual Learning [10.551597725130675]
現実世界の物理学は、現代の複雑なロボットシステムに対して、一定の精度で解析的にのみモデル化できる。
本稿では、上記の課題に対処するために、自己教師付き残差学習と軌道最適化の枠組みを提案する。
論文 参考訳(メタデータ) (2026-01-06T06:01:58Z) - Dynamic Manipulation of Deformable Objects in 3D: Simulation, Benchmark and Learning Strategy [88.8665000676562]
従来の手法は、しばしば問題を低速または2D設定に単純化し、現実の3Dタスクに適用性を制限する。
データ不足を軽減するため、新しいシミュレーションフレームワークと、低次ダイナミクスに基づくベンチマークを導入する。
本研究では,シミュレーション前トレーニングと物理インフォームドテスト時間適応を統合するフレームワークであるDynamics Informed Diffusion Policy (DIDP)を提案する。
論文 参考訳(メタデータ) (2025-05-23T03:28:25Z) - Certified Neural Approximations of Nonlinear Dynamics [51.01318247729693]
安全クリティカルな文脈では、神経近似の使用は、基礎となるシステムとの密接性に公式な境界を必要とする。
本稿では,認証された一階述語モデルに基づく新しい,適応的で並列化可能な検証手法を提案する。
論文 参考訳(メタデータ) (2025-05-21T13:22:20Z) - Is Linear Feedback on Smoothed Dynamics Sufficient for Stabilizing Contact-Rich Plans? [26.26239969660602]
本稿では,接触平滑化に基づく微分シミュレータを用いた線形制御器合成の有効性を解析する。
我々は300以上の軌道上で実証実験を行い、なぜLQRがコンタクトリッチプランの安定化に不十分なように見えるのかを分析した。
論文 参考訳(メタデータ) (2024-11-10T17:48:26Z) - Guaranteed Conservation of Momentum for Learning Particle-based Fluid
Dynamics [96.9177297872723]
本稿では,学習物理シミュレーションにおける線形運動量を保証する新しい手法を提案する。
我々は、強い制約で運動量の保存を強制し、反対称的な連続的な畳み込み層を通して実現する。
提案手法により,学習シミュレータの物理的精度を大幅に向上させることができる。
論文 参考訳(メタデータ) (2022-10-12T09:12:59Z) - Differentiable Simulation of Soft Multi-body Systems [99.4302215142673]
我々は、Projective Dynamics内でトップダウン行列アセンブリアルゴリズムを開発する。
筋肉,関節トルク,空気圧管によって駆動される軟口蓋体に対して,異なる制御機構を導出する。
論文 参考訳(メタデータ) (2022-05-03T20:03:22Z) - Improper Learning with Gradient-based Policy Optimization [62.50997487685586]
未知のマルコフ決定過程に対して学習者がmベースコントローラを与えられる不適切な強化学習設定を考える。
制御器の不適切な混合のクラス上で動作する勾配に基づくアプローチを提案する。
論文 参考訳(メタデータ) (2021-02-16T14:53:55Z) - ADD: Analytically Differentiable Dynamics for Multi-Body Systems with
Frictional Contact [26.408218913234872]
剛体および変形可能な物体に対する摩擦接触を処理できる微分可能な動的解法を提案する。
本手法は, 摩擦接触の非平滑な性質に起因した主な困難を回避できる。
論文 参考訳(メタデータ) (2020-07-02T09:51:36Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。