論文の概要: SURE: Safe Uncertainty-Aware Robot-Environment Interaction using Trajectory Optimization
- arxiv url: http://arxiv.org/abs/2602.06864v1
- Date: Fri, 06 Feb 2026 16:50:59 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-23 08:17:41.240067
- Title: SURE: Safe Uncertainty-Aware Robot-Environment Interaction using Trajectory Optimization
- Title(参考訳): SURE:軌道最適化を用いた安全不確実性を考慮したロボット環境相互作用
- Abstract要約: SUREは、接触タイミングの不確実性を明確に説明する堅牢な軌道最適化フレームワークである。
影響時間不明の2つの代表的な課題についてSUREを評価した。
SUREは従来の定式化よりも頑健性を大幅に向上させる。
- 参考スコア(独自算出の注目度): 8.712271005822256
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Robotic tasks involving contact interactions pose significant challenges for trajectory optimization due to discontinuous dynamics. Conventional formulations typically assume deterministic contact events, which limit robustness and adaptability in real-world settings. In this work, we propose SURE, a robust trajectory optimization framework that explicitly accounts for contact timing uncertainty. By allowing multiple trajectories to branch from possible pre-impact states and later rejoin a shared trajectory, SURE achieves both robustness and computational efficiency within a unified optimization framework. We evaluate SURE on two representative tasks with unknown impact times. In a cart-pole balancing task involving uncertain wall location, SURE achieves an average improvement of 21.6% in success rate when branch switching is enabled during control. In an egg-catching experiment using a robotic manipulator, SURE improves the success rate by 40%. These results demonstrate that SURE substantially enhances robustness compared to conventional nominal formulations.
- Abstract(参考訳): 接触相互作用を含むロボットタスクは、不連続力学による軌道最適化に重大な課題をもたらす。
従来の定式化では、現実の環境での堅牢性と適応性を制限する決定論的接触イベントが想定される。
本研究では,接触タイミングの不確かさを明示的に考慮した頑健な軌道最適化フレームワークSUREを提案する。
複数の軌道を衝突前の状態から分岐させ、後に共有軌道に再結合させることで、SUREは統一最適化フレームワーク内で堅牢性と計算効率の両方を達成する。
影響時間不明の2つの代表的な課題についてSUREを評価した。
壁位置の不確実性を伴うカートポールバランスタスクにおいて、SUREは、制御中に分岐切替が可能となると、平均21.6%の成功率の向上を達成する。
ロボットマニピュレータを用いた卵捕獲実験では、SUREは成功率を40%向上させる。
これらの結果から,SUREは従来の定式化に比べて頑健性を大幅に向上することが示された。
関連論文リスト
- Dual Process Motion Planning [53.570848178455776]
頑健な推論と学習の強みを組み合わせたデュアルプロセスアーキテクチャを導入する。
我々のフレームワークは、経験駆動型System-1'モジュールでSystem-2'コンポーネントとして最先端のシンボルソルバを統合している。
論文 参考訳(メタデータ) (2026-09-01T13:52:12Z) - Optimal Reward Shaping: Autonomous Car Parking Case Study [1.1458853556386799]
本稿では、アライメントフィードバック、ドライブ方向スイッチの正規化、および自律並列駐車タスクで評価されたアライメントエピソード終了機構を特徴とするパラメータ化報酬形成フレームワークを提案する。
共最適化されたディープQネットワーク(DQN)エージェントは,サロゲートに基づくベイズ最適化を用いて特性制御障害モードを解く。
論文 参考訳(メタデータ) (2026-07-26T11:49:23Z) - World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning [60.88859946006306]
Adversa World Modeling(英語版)は理論上基礎を成すマルチエージェント・セルフプレイ・ファインチューニングフレームワークである。
内的最小化においては、プランナーの予測世界モデルは、スパースでシーン適応的なアタック・アタック・アライアンスを学ぶロール条件の敵に変換される。
nuPlan と InterPlan のベンチマーク実験により,本手法が伝達可能な対角相互作用を生成することを示す。
論文 参考訳(メタデータ) (2026-07-12T07:44:16Z) - PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control [8.882504398064087]
PPO-EALは、新しい一階制約付きポリシー最適化フレームワークである。
高度に強化されたラグランジアン最適化を、安全なロボット制御のためのポリシー最適化に統合する。
致命的な大きなペナルティ要因を必要とせず、理論的に根拠づけられた制約執行を達成する。
論文 参考訳(メタデータ) (2026-06-26T08:59:38Z) - Towards Pareto-Optimal Tool-Integrated Agents with Pareto Ranking Policy Optimization [54.855135506924775]
ツールを用いた大規模言語モデル(LLM)を競合する目的の下で整列するための2段階多目的最適化フレームワークを提案する。
この設計は、複数の矛盾する目的に対してきめ細かいアクションレベルの最適化を可能にする。
論文 参考訳(メタデータ) (2026-06-15T01:58:07Z) - E$^2$DT: Efficient and Effective Decision Transformer with Experience-Aware Sampling for Robotic Manipulation [12.326967455610536]
Decision Transformer (DT) は、長期タスクに対処するための効果的なフレームワークとして登場した。
E$2$DTはDT誘導k-Determinantal Point Processサンプリングフレームワークである。
私たちのフレームワークはエクスペリエンスを意識しており、E$2$DTの両方を効率的にできます。
論文 参考訳(メタデータ) (2026-04-30T19:28:44Z) - Synergizing Efficiency and Reliability for Continuous Mobile Manipulation [14.763845074065019]
人間は予測計画と即時フィードバックを融合し、停止することなく連続した移動操作タスクを実行する。
本稿では,モバイル操作の効率化と信頼性を両立させる統合フレームワークを提案する。
論文 参考訳(メタデータ) (2026-04-07T04:55:16Z) - Proactive Rejection and Grounded Execution: A Dual-Stage Intent Analysis Paradigm for Safe and Efficient AIoT Smart Homes [37.92248202525651]
本稿では,低レベルの物理的実行から高レベルのユーザ意図理解を分離するためのDual-Stage Intent-Aware (DS-IA)フレームワークを提案する。
試験の結果、DS-IAは58.56%(ベースラインを28%以上上回る)のエクサクトマッチ(EM)を達成し、無効命令の拒否率を87.04%に改善した。
論文 参考訳(メタデータ) (2026-03-17T07:38:39Z) - Dual-Agent Multiple-Model Reinforcement Learning for Event-Triggered Human-Robot Co-Adaptation in Decoupled Task Spaces [3.349003999623489]
本稿では,カスタム6自由度上肢ロボットのための共有制御型リハビリテーションポリシーを提案する。
患者は二進法で一次到達方向を制御し、ロボットは自律的に矯正動作を管理する。
論文 参考訳(メタデータ) (2026-03-06T11:15:10Z) - Intent-Context Synergy Reinforcement Learning for Autonomous UAV Decision-Making in Air Combat [2.9612776591672443]
本稿では、競合環境における自律型UAV侵入のためのIntent-Context Synergy Reinforcement Learning(ICS-RL)フレームワークを提案する。
LSTMベースのIntent Prediction Moduleは、将来の敵ユニットの軌跡を予測し、決定パラダイムをリアクティブ回避から積極的に計画に変換する。
コンテキスト分析合成機構は、ミッションを階層的なサブタスク(安全なクルーズ、ステルス計画、敵対的なブレークスルー)に分解する
Max-Advantage値に基づく動的スイッチングコントローラはこれらのエージェントをシームレスに統合し、UAVはハードコードされたルールなしで最適なポリシーを適応的に選択できる。
論文 参考訳(メタデータ) (2026-03-01T08:05:32Z) - RISER: Orchestrating Latent Reasoning Skills for Adaptive Activation Steering [62.63376387138257]
本稿では,アクティベーション空間における大規模言語モデル(LLM)推論を適応的に制御するプラグイン・アンド・プレイ介入フレームワークを提案する。
RISERは再利用可能な推論ベクトルのライブラリを構築し、軽量ルータを使用して各入力に対して動的に構成する。
ルーターは、タスクレベルの報酬の下で強化学習を通じて最適化され、緊急かつ構成的な方法で潜在する認知的プリミティブを活性化する。
論文 参考訳(メタデータ) (2026-01-14T08:04:33Z) - Optimization-Guided Diffusion for Interactive Scene Generation [52.23368750264419]
本稿では,拡散型サンプリングにおける構造的一貫性と相互作用認識を実現するための,最適化誘導型トレーニングフリーフレームワークであるOMEGAを提案する。
OMEGAは生成リアリズム,一貫性,可制御性を向上し,身体的および行動学的に有効なシーンの比率を増大させることを示す。
当社のアプローチでは,3秒未満の時間対コリションで,より近いコリジョンフレームを5ドル(約5,500円)で生成することも可能だ。
論文 参考訳(メタデータ) (2025-12-08T15:56:18Z) - Sycophancy Mitigation Through Reinforcement Learning with Uncertainty-Aware Adaptive Reasoning Trajectories [58.988535279557546]
適応推論トラジェクトリを用いたtextbf sycophancy Mitigation を提案する。
SMARTは,分布外の入力に対して強い性能を維持しながら,サイコファンティクスの挙動を著しく低下させることを示した。
論文 参考訳(メタデータ) (2025-09-20T17:09:14Z) - Active Test-time Vision-Language Navigation [60.69722522420299]
ATENAは、不確実なナビゲーション結果に対するエピソードフィードバックを通じて、実用的な人間とロボットのインタラクションを可能にする、テスト時のアクティブな学習フレームワークである。
特にATENAは、成功エピソードにおける確実性を高め、失敗エピソードにおいてそれを減らすことを学び、不確実性の校正を改善している。
さらに,自信ある予測に基づいて,エージェントがナビゲーション結果を評価することができる自己学習戦略を提案する。
論文 参考訳(メタデータ) (2025-06-07T02:24:44Z) - Towards Robust Spacecraft Trajectory Optimization via Transformers [17.073280827888226]
我々は,非最適制御問題をリアルタイムに解くための自律生成モデルを開発した。
我々はARTの能力を拡張し、確率制約のある最適制御問題に対処する。
この作業は、宇宙船のような安全クリティカルな自律システムにAI駆動のソリューションを確実に展開するための最初のステップである。
論文 参考訳(メタデータ) (2024-10-08T00:58:42Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。