論文の概要: XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment
- arxiv url: http://arxiv.org/abs/2608.09892v2
- Date: Tue, 11 Aug 2026 17:41:52 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-12 16:08:30.751754
- Title: XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment
- Title(参考訳): XPolicyLab: ロボットポリシー評価とデプロイのための統一された標準とオープンなエコシステム
- Abstract要約: XPolicyLabは、ロボットポリシーの評価とデプロイのための統一された標準でオープンなエコシステムである。
XPolicyLabは42のロボットポリシーを統合し、インストール、デバッグ、サービス、アダプタ、評価を標準化する。
コントロールされた研究では、標準に従って、代表政策の統合の労力を5時間以上から2時間に短縮する。
- 参考スコア(独自算出の注目度): 110.47421789797546
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Robot policy evaluation and deployment remain fragmented by model-specific software dependencies, data representations, and runtime interfaces, so that connecting N policies to M evaluation environments requires O(NM) separate integrations. We present XPolicyLab, a unified standard and open ecosystem that reduces this cost to O(N+M). XPolicyLab specifies common observation, action, and trajectory schemas together with a minimal adapter interface for observation updates, action prediction, batched execution, and episode reset, while a dependency-isolated client/server architecture separates policy inference from environment execution, so that each side retains its native software stack and may run locally or remotely. The ecosystem integrates 42 robot policies and standardizes their installation, debugging, serving, and evaluation workflows. Across these adapters, model-specific code varies by an order of magnitude while the environment-facing loop stays within a few lines of a fixed reference, confirming that the contract confines heterogeneity to the policy side. In a controlled study, conforming to the standard reduces the integration effort of a representative policy from over five hours to two hours, and packaged agent skills reduce it further to thirty minutes. The same adapters serve RoboTwin, RoboDojo simulation, and standardized real-robot evaluation through one interface. XPolicyLab is released as shared infrastructure for reproducible policy comparison and standardized deployment across simulation and physical platforms. Project website: https://xpolicylab.github.io/.
- Abstract(参考訳): ロボットポリシーの評価と展開は、モデル固有のソフトウェア依存関係、データ表現、ランタイムインターフェースによって断片化されているため、NポリシーをM評価環境に接続するにはO(NM)個別の統合が必要である。
このコストをO(N+M)に削減する統一された標準でオープンなエコシステムであるXPolicyLabを紹介します。
XPolicyLabは、監視更新、アクション予測、バッチ実行、エピソードリセットのための最小限のアダプタインターフェースとともに、共通の監視、アクション、トラジェクトリスキーマを定義している。
このエコシステムは42のロボットポリシーを統合し、インストール、デバッグ、サービス、評価ワークフローを標準化する。
これらのアダプタ全体において、モデル固有のコードは桁違いに変化し、環境に面したループは固定参照数行以内に留まり、契約がポリシー側で不均一性を保持することを確認する。
コントロールされた研究では、標準に従って、代表政策の統合作業を5時間以上から2時間に短縮し、パッケージ化されたエージェントスキルによりさらに30分に短縮する。
同じアダプタは、RoboTwin、RoboDojoシミュレーション、および1つのインターフェイスによる標準化されたリアルタイムロボット評価を提供する。
XPolicyLabは、再現可能なポリシ比較とシミュレーションと物理プラットフォーム間の標準化されたデプロイメントのための共有インフラストラクチャとしてリリースされた。
プロジェクトウェブサイト: https://xpolicylab.github.io/.com
関連論文リスト
- LMSM: LLM Security Framework Inspired by Linux Security Modules [56.93644694627783]
大規模言語モデル(LLM)は階層化されたディフェンスでデプロイされることが多いが、悪意のあるプロンプトはそれらをバイパスすることができる。
我々は,Language Model Security Modules (LMSM) という,Linux Security Modules (LSM) の背後にある分離を LLM サービスに適応させるセキュリティフレームワークを提案する。
論文 参考訳(メタデータ) (2026-08-26T12:13:05Z) - RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies [121.35821705538768]
汎用的なロボット操作ポリシーは急速に進歩しているが、既存のベンチマークは、その能力を体系的に評価することに制限されている。
本稿では,汎用ロボット操作ポリシーの総合的な評価のための統一型sim-and-realベンチマークであるRoboDojoを紹介する。
RoboDojoには42のシミュレーションタスクと18の現実世界タスクが含まれており、多様な補完的な操作機能を備えている。
論文 参考訳(メタデータ) (2026-07-05T17:58:02Z) - Agentic-V2X: Small Language Model Agents for Deadline-Aware V2X Scheduling in 5G/6G Networks [42.13843953705695]
大言語モデル(LLM)は次世代ネットワークの制御インタフェースとして提案されているが、そのレイテンシ、幻覚、制御保証の欠如により、ほぼリアルタイムのパケットスケジューラには適さない。
本稿では,Agentic-V2Xについて紹介する。Agentic-V2Xは,小規模でローカルにデプロイされた言語モデルが,周期的非リアルタイムなrAppにインスパイアされたポリシー作成者として機能するアーキテクチャである。
軽量のxAppライクなコントローラは、スケジューリングに適した間隔で検証済みのポリシーを実行する。
論文 参考訳(メタデータ) (2026-07-05T13:05:48Z) - EVA-Client: A Unified Data Collection, Inference, and Deployment Framework for Embodied Policies on Real Robots [22.010881443693336]
EVA-Clientは、実際のロボットに対してトレーニングされた操作ポリシーをデプロイ、データ収集、評価するためのオープンソースのフレームワークである。
すべての評価はデータ収集として2倍になり、トレーニング対応の形式で完全なロールアウトを記録します。
EVA-Clientは、主要なリアルタイム推論戦略、同期および非同期実行、ACTスタイルのテンポラルアンサンブル、リアルタイムチャンキング、ナイーブ非同期アブレーションベースラインを統合する。
論文 参考訳(メタデータ) (2026-07-02T17:59:52Z) - Nautilus: From One Prompt to Plug-and-Play Robot Learning [32.048440678131676]
NAUTILUSはオープンソースのハーネスで、単一のユーザプロンプトを準備可能な複製、評価、デプロイに変換する。
既存の実装に必要なアダプタやコンテナを自動的に生成するだけでなく、新規あるいはユーザが提供するポリシ、シミュレータ/ベンチマーク、ロボットをラップしてオンボードすることも可能だ。
成長を続けるロボット学習エコシステムにおいて、家族間の複製と評価の工学的負担を軽減することを目的としている。
論文 参考訳(メタデータ) (2026-05-12T07:26:39Z) - Replacing Parameters with Preferences: Federated Alignment of Heterogeneous Vision-Language Models [63.70401095689976]
VLM(Vision-Language Models)は、医療や金融といったプライバシに敏感な分野において大きな可能性を秘めている。
ヘテロジニアスVLMのためのGRPOとMixture-of-Rewardsを組み合わせた協調アライメントフレームワークであるMoRを提案する。
MoRは、一般化とクロスクライアント適応性において、フェデレートされたアライメントベースラインを一貫して上回る。
論文 参考訳(メタデータ) (2026-05-05T07:02:50Z) - Contact-Anchored Policies: Contact Conditioning Creates Strong Robot Utility Models [19.175143015013308]
Contact-Anchored Policiesは、空間における物理的な接触点で言語条件を置き換える。
CAPは3つの基本的な操作技術に基づいて,新しい環境や実施環境に一般化することを示す。
すべてのモデルチェックポイント、イテレーション、ハードウェア、シミュレーション、データセットがオープンソース化される。
論文 参考訳(メタデータ) (2026-02-09T18:58:50Z) - Learning Policy Representations for Steerable Behavior Synthesis [80.4542176039074]
マルコフ決定プロセス(MDP)を前提として,テスト時の行動ステアリングを促進するために,さまざまなポリシーの表現を学習する。
これらの表現は、セットベースアーキテクチャを用いて、様々なポリシーに対して均一に近似できることを示す。
変動生成法を用いてスムーズな潜伏空間を導出し,さらにコントラスト学習により、潜伏距離が値関数の差と一致するように形成する。
論文 参考訳(メタデータ) (2026-01-29T21:52:06Z) - Adaptive Policy Synchronization for Scalable Reinforcement Learning [0.0]
ClusterEnvは、分散環境実行のための軽量インターフェースである。
オンプレミスとオフラインの両方をサポートし、最小限の変更で既存のトレーニングコードに統合され、クラスタ上で効率的に実行される。
論文 参考訳(メタデータ) (2025-07-15T05:07:12Z) - Evaluating Real-World Robot Manipulation Policies in Simulation [91.55267186958892]
実環境と模擬環境の制御と視覚的格差は、信頼性のある模擬評価の鍵となる課題である。
実環境に完全忠実なデジタル双生児を作らなくても、これらのギャップを軽減できる手法を提案する。
シミュレーション環境の集合体であるSIMPLERを作成した。
論文 参考訳(メタデータ) (2024-05-09T17:30:16Z) - Decision Making in Non-Stationary Environments with Policy-Augmented
Search [9.000981144624507]
textitPolicy-Augmented Monte Carlo Tree Search (PA-MCTS)を紹介する。
行動価値の推定は、最新のポリシーと、その環境の最新のモデルを用いたオンライン検索を組み合わせる。
PA-MCTSが1ステップの最適動作を選択し、PA-MCTSをポリシーとして追従しながら発生した誤差を拘束する条件を示す理論的結果を示す。
論文 参考訳(メタデータ) (2024-01-06T11:51:50Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。