論文の概要: GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs
- arxiv url: http://arxiv.org/abs/2608.18292v2
- Date: Sun, 23 Aug 2026 07:34:12 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-25 13:29:42.807855
- Title: GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs
- Title(参考訳): GuideFetch: 補助ロボット犬におけるコンカレントナビゲーションとオブジェクト検索のためのタスクコーディネートフレームワーク
- Abstract要約: textscGuideFetchは異種ロボットによる同時ガイド・アンド・フェッチミッションをコーディネートするためのフレームワークである。
我々は、スクリプトとオンラインの計画立案条件下で、90以上のシーンシードの組み合わせを実行している360シミュレータを記録している。
スケジュール、シーケンシャル、並列実行毎の90のシーンセットケースは、72/90ドル、71/90ドルの運用成功を達成する。
- 参考スコア(独自算出の注目度): 38.9772084779486
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Consider one robot guide dog escorting a blind user to a seat while a second retrieves and delivers an object. We introduce \textsc{GuideFetch}, a framework for coordinating this concurrent guide-and-fetch mission with heterogeneous robots. A large language model (LLM) instantiates a schedule-conditioned four-action schema; deterministic normalization and validation enforce registered targets, robot capabilities, and the selected schedule, while robot and object states govern execution and completion. We record 360 simulator runs over 90 scene--seed combinations under scripted and online plan-provenance conditions. All 180 online responses validate on the first request and match their scripted references, so the plan-provenance comparison tests normalized-plan agreement rather than a distinct execution factor. A simulator-free mutation test accepts two valid controls and rejects all 32 rule-violating variants. Across 90 scene--seed cases per schedule, sequential and parallel execution achieve $72/90$ and $71/90$ operational successes. Among 56 common successes, the implemented role-reassigned parallel protocol reduces mean makespan by 41.3\%. This system-level gain combines role assignment, action overlap, and scene geometry; state checks distinguish plan validity from verified mission completion.
- Abstract(参考訳): 視覚障害者を座席まで護衛するロボットガイド犬を1匹考えてみましょう。
異種ロボットと同時進行するガイド・アンド・フェッチ・ミッションを協調するためのフレームワークである。
決定論的正規化と検証は、登録された目標、ロボット能力、選択されたスケジュールを強制し、ロボットとオブジェクト状態は実行と完了を管理する。
我々は、スクリプトとオンラインの計画立案条件下で、90以上のシーンシードの組み合わせを実行している360シミュレータを記録している。
180のオンライン応答は、最初の要求で検証され、スクリプト化された参照と一致している。
シミュレータフリーの突然変異テストは2つの有効な制御を受け取り、32のルール違反の変種をすべて拒絶する。
スケジュール、シーケンシャル、並列実行毎の90のシーンセットケースは、72/90ドル、71/90ドルの運用成功を達成する。
56の一般的な成功の中で、実装されたロールレサインの並列プロトコルは平均メイクパンを41.3\%削減する。
このシステムレベルのゲインは、ロール割り当て、アクションオーバーラップ、シーン幾何学を組み合わせたもので、状態チェックは、計画の妥当性を検証されたミッション完了と区別する。
関連論文リスト
- Earth-Agent-Pro: Towards Real-World Full-Chain Earth Observation with Agents [41.45703910271276]
実世界の地球観測(EO)エージェントは、高レベルの科学的質問を実行可能なものに翻訳しなければならない。
Earth-Bench-Proは、専門家による248のタスクコアを、マッチした3つの体制の下で744の質問としてインスタンス化する。
GPT-5のバックボーンを共有することで、Earth-Agent-Proは66.13%のLDM-as-Judge精度を達成している。
論文 参考訳(メタデータ) (2026-09-11T07:41:36Z) - A Brain-inspired Hierarchical Framework for Zero-Shot Robot Task Reasoning and Execution [9.745144598922584]
メソッドは、人間の脳における役割の分割にインスパイアされたゼロショット階層的なフレームワークである。
コマンドを明示的なオブジェクト状態に基底付け、再利用可能なアトミックアクションをタスク条件付きシーケンスに構成し、実行コストで代替シーケンスをランク付けする。
メソッドは、ReKep、Dream2Flow、および$_0.5$ベンチマークよりも高い成功率を達成する。
論文 参考訳(メタデータ) (2026-09-05T08:59:04Z) - EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA Agents [56.25120535601186]
視覚言語アクション(VLA)モデルは、視覚観察と言語指示を直接ロボットアクションにマッピングする。
本稿では,各スキル決定を実行提案として扱うフレームワークであるEmbodiedSkillsを提案する。
共有可能スキルインタフェースは、ハイレベルスキル選択、バウンドローレベルVLA実行、ポストアクション検証を接続する。
論文 参考訳(メタデータ) (2026-09-01T14:14:47Z) - Physical Agentic AI: An Architecture for Orchestrating a Robot Crew with LLMs [6.2312877626161205]
本稿では,スキルグラウンドロボットエージェントオーケストレーションのためのフレームワークであるPhysical Agentic AIを紹介する。
ロボットオーケストレーションレイヤは、スキルライブラリ、ロボット状態、名前付きロケーション、ワークフローコントラクトを非アクチュエータミッションプランナに公開する。
我々は,ガゼボで全条件で全ミッションが実行され,ドローン-UGV検索・ディスパッチミッションを評価する。
論文 参考訳(メタデータ) (2026-08-23T23:35:31Z) - PhyAgentOS: A Self-Evolving Operating System for Embodied Agents with Decoupled Cognitive Planning and Physical Execution [49.776611937968]
我々は、スケジューリング、検証、メモリ、ベンチマーク、安全性をシステムレベルのサービスとして提供するPhyAgentOSを紹介します。
セッション中心のセッションは、スケジューリング、互換性、監督された実行、エビデンス収集、受け入れの最小単位として、アクションではなくセッションを扱う。
SessionVerifierは、実行終了とセマンティックタスク完了を、成功、失敗、または再計画のエビデンスに基づいて判断する。
ベンチマークはデプロイメントセッションと検証パスを再利用するので、結果は実際の実行に遡る。
論文 参考訳(メタデータ) (2026-07-18T04:46:53Z) - DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation [14.193285862278913]
World Action Models (WAMs) は、VLA(Vision-Language-Action) ポリシーに代わる有望な代替手段を提供する。
既存のWAMは、物理的に基盤化された実行では優れているが、言語レベルの明確な計画インターフェースが欠如している。
DSWAM(Dual-System World Action Foundation Model)を紹介する。
論文 参考訳(メタデータ) (2026-07-06T10:57:01Z) - Efficient Visual Pointing for Embodied AI:Agent-Driven Data Synthesis, Cross-Block Attention, and Iterative Correction [55.11480729304395]
PointArena 2026は77.2%の精度でベンチマークで2位である。
ap proachは3つの障害モードをターゲットにしている。第一に、エージェント駆動のシンセシスは大きなセマンティクスとアンカー相対的な候補プールを構築する。
次に、determinis tic steerable-dataパイプラインは、認証された10,000サンプルのメインセットと、マスク、テンプレート、パス検証を使用するリザーブサンプルを生成する。
論文 参考訳(メタデータ) (2026-06-29T06:39:03Z) - WatchAct: A Benchmark for Behavior-Grounded Robot Manipulation [49.31386176285509]
WatchActは、観察された人間の行動に基づくロボット操作のベンチマークである。
WatchActは4つの機能ドメインで14タスクにわたる3,000のロングホライゾンインスタンスで構成されている。
シミュレーションとFranka Research 3ロボットの両方で、現在のシステムはWatchActの解決には程遠い。
論文 参考訳(メタデータ) (2026-06-24T23:13:56Z) - OSDAG: Online Scheduling for Efficient Multi-Robot Collaboration [2.2726869886741383]
本稿では, LLMに基づくタスク推論と, Directed Acyclic Graph表現と制約対応オンラインスケジューリングを統合した新しいフレームワークOSDAGを提案する。
5つのベンチマークシナリオの実験では、OSDAGは対話ベースの手法に比べて5~15倍高速な推論時間を実現し、シーケンシャルベースラインよりも最大38%のペースパンを削減し、競争的な成功率を維持している。
論文 参考訳(メタデータ) (2026-06-13T11:22:34Z) - NovaPlan: Zero-Shot Long-Horizon Manipulation via Closed-Loop Video Language Planning [36.20611975009607]
クローズドループVLMとビデオプランニングを統合した階層型フレームワークであるNovaPlanを紹介する。
高いレベルでは、VLMプランナーはタスクをサブゴールに分解し、クローズドループでロボットの実行を監視する。
低レベルのロボット動作を計算するために,タスク関連オブジェクトキーポイントと人手ポーズの両方を抽出し,活用する。
論文 参考訳(メタデータ) (2026-02-23T18:35:18Z) - Instruct2Act: From Human Instruction to Actions Sequencing and Execution via Robot Action Network for Robotic Manipulation [14.833622989644352]
我々は、自然言語コマンドを信頼性の高い操作に変換する軽量で完全なオンデバイスパイプラインを開発した。
Instruct2Actは91.5%のサブアクション予測精度を達成し、フットプリントは小さい。
その結果, DATRNに基づく軌道生成と視覚誘導グラウンド化と相まって, 決定論的, リアルタイムな操作を行うための実践的な経路が得られた。
論文 参考訳(メタデータ) (2026-02-10T16:25:39Z) - Intent-Driven LLM Ensemble Planning for Flexible Multi-Robot Disassembly: Demonstration on EV Batteries [2.3564175619410803]
本稿では,複雑な操作タスクを計画する上での問題に対処する。
このようなアクションシーケンスを堅牢に構築できる意図駆動型計画パイプラインを提案する。
このパイプラインは、2つのロボットアームが協力して電気自動車のバッテリーを解体する例に基づいて評価される。
論文 参考訳(メタデータ) (2025-10-20T14:24:39Z) - REMAC: Self-Reflective and Self-Evolving Multi-Agent Collaboration for Long-Horizon Robot Manipulation [57.628771707989166]
本稿では,ReMACと呼ばれる適応型マルチエージェント計画フレームワークを提案する。
ReMACには2つの重要なモジュールが組み込まれており、ループ内で事前条件と後条件チェックを実行し、進捗と計画の洗練を評価する。
論文 参考訳(メタデータ) (2025-03-28T03:51:40Z) - COHERENT: Collaboration of Heterogeneous Multi-Robot System with Large Language Models [49.24666980374751]
COHERENTは、異種マルチロボットシステムの協調のための新しいLCMベースのタスク計画フレームワークである。
提案-実行-フィードバック-調整機構は,個々のロボットに対して動作を分解・割り当てするように設計されている。
実験の結果,我々の研究は,成功率と実行効率の面で,従来の手法をはるかに上回っていることが明らかとなった。
論文 参考訳(メタデータ) (2024-09-23T15:53:41Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。