論文の概要: LifelongCrossNav: Persistent 3D Semantic Memory for Cross-Floor Multi-Object Navigation
- arxiv url: http://arxiv.org/abs/2608.07079v1
- Date: Fri, 07 Aug 2026 10:31:20 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-10 16:21:25.466565
- Title: LifelongCrossNav: Persistent 3D Semantic Memory for Cross-Floor Multi-Object Navigation
- Title(参考訳): LifelongCrossNav: クロスフローマルチオブジェクトナビゲーションのための永続的な3次元セマンティックメモリ
- Abstract要約: LifelongCrossNavは、未知のマルチフロア屋内環境において、シーケンシャルなマルチオブジェクトObjectNavのためのフレームワークである。
LifelongCrossNavは、HM3D-MFMON上で、永続的なセマンティックマップベースラインを一貫して上回る。
- 参考スコア(独自算出の注目度): 9.284792832233
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Object-goal navigation has made substantial progress in semantic perception and exploration, yet persistent memory for multi-object navigation and cross-floor navigation are still commonly addressed separately. We present LifelongCrossNav, a framework for sequential multi-object ObjectNav in unknown multi-floor indoor environments. Within each episode, the agent receives an ordered sequence of object-goal queries while continuously maintaining a shared sparse 3D semantic voxel memory. This memory incrementally accumulates geometric structure, traversability states, and vision-language features, allowing subsequent object-goal queries to retrieve previously acquired scene information without rebuilding the map. To support persistent search across floors, LifelongCrossNav combines support-aware 3D traversability mapping, stair-specific perception, and direction-aware stair traversal. A unified navigation policy coordinates same-floor frontier exploration, live and historical point-of-interest retrieval, stair navigation, and target-object search and approach. We further introduce HM3D-MFMON, a benchmark for sequential Multi-Floor Multi-Object Navigation built on HM3D scenes, including a dedicated subset in which completing the full sequence of object-goal subtasks requires at least one floor transition. Experimental results show that LifelongCrossNav consistently outperforms a representative planar persistent semantic-map baseline on HM3D-MFMON, demonstrating that persistent 3D semantic memory and cross-floor traversability modeling effectively support sequential multi-object navigation in multi-floor environments. Project page: https://flageval-baai.github.io/LifelongCrossNavPage.
- Abstract(参考訳): オブジェクトゴールナビゲーションはセマンティックな認識と探索においてかなりの進歩を遂げているが、マルチオブジェクトナビゲーションとクロスフロアナビゲーションのための永続メモリは、いまだに個別に扱うことが一般的である。
We present LifelongCrossNav, a framework for sequence multi-object ObjectNav in unknown multi-floor indoor environment。
各エピソードにおいて、エージェントは、共有されたスパース3Dセマンティックボクセルメモリを維持しながら、順序付けられたオブジェクトゴールクエリのシーケンスを受信する。
このメモリは、幾何構造、トラバータビリティ状態、視覚言語の特徴を段階的に蓄積し、その後のオブジェクトゴールクエリがマップを再構築することなく、以前取得したシーン情報を検索することができる。
LifelongCrossNavは、フロア間の永続的な検索をサポートするために、サポート対応の3Dトラバーサビリティマッピング、階段固有の知覚、方向対応の階段トラバーサルを組み合わせている。
統合ナビゲーションポリシーは、同じフロアフロンティア探索、ライブおよび歴史的関心点探索、階段ナビゲーション、ターゲットオブジェクト探索とアプローチを調整する。
さらに,HM3Dシーン上に構築された逐次マルチフローマルチオブジェクトナビゲーションのベンチマークであるHM3D-MFMONについても紹介する。
実験結果から、LifelongCrossNavは、HM3D-MFMON上の代表的平面的永続的セマンティックマップベースラインを一貫して上回り、永続的な3次元セマンティックメモリとクロスフロア・トラバーサビリティ・モデリングがマルチフロア環境におけるシーケンシャル・マルチオブジェクト・ナビゲーションを効果的にサポートすることを示した。
プロジェクトページ: https://flageval-baai.github.io/LifelongCrossNavPage.com
関連論文リスト
- VTM-Nav: Hierarchical Visual-Topological Memory for Cross-Episode Object-Goal Navigation [55.45263611374435]
エージェントが同じシーンで繰り返し操作し、自己獲得経験のみを保持し、モデルパラメータを固定するクロスエポソードオブジェクトゴールナビゲーションを提案する。
経験の再利用を支援するために,永続的階層型ビジュアルトポロジカルメモリ(VTM)を用いたトレーニング不要なVLMナビゲーションフレームワークを提案する。
提案手法は,3つのベンチマークすべてで最高のパフォーマンスを実現し,データセット間の構造化視覚トポロジカルエクスペリエンスの再利用の有効性と堅牢性を示す。
論文 参考訳(メタデータ) (2026-07-16T03:11:37Z) - TravExplorer: Cross-Floor Embodied Exploration via Traversability-Aware 3-D Planning [17.54520943622758]
この記事では、クロスフロアで具体化された探索フレームワークであるTravExplorerを紹介します。
ゼロショットセマンティックガイダンスとトラバーサビリティを意識した3Dプランニングを結合する。
ユニツリーGo2の現実世界での50の試行は、シングルフロアとクロスフロアの屋内環境におけるオープンボキャブラリターゲット探索をさらに検証している。
論文 参考訳(メタデータ) (2026-05-19T15:11:29Z) - FOM-Nav: Frontier-Object Maps for Object Goal Navigation [65.76906445210112]
FOM-Navはフロンティアオブジェクトマップと視覚言語モデルによる探索効率を高めるフレームワークである。
FOM-Navをトレーニングするために,実環境から大規模ナビゲーションデータセットを自動構築する。
FOM-NavはMP3DとHM3Dのベンチマーク、特にナビゲーション効率の指標SPLで最先端のパフォーマンスを達成する。
論文 参考訳(メタデータ) (2025-11-30T18:16:09Z) - HM3D-OVON: A Dataset and Benchmark for Open-Vocabulary Object Goal Navigation [39.54854283833085]
Habitat-Matterport 3D Open Vocabulary Object Goal Navigation データセット(HM3D-OVON)を提案する。
HM3D-OVONは、379の異なるカテゴリにわたる15k以上の注釈付きオブジェクトのインスタンスを組み込んでいる。
我々は,HM3D-OVONを用いて,オープン語彙のObjectNavエージェントを訓練し,高い性能を実現し,最先端のObjectNavアプローチよりもローカライゼーションやアクティベーションノイズに頑健であることを確認した。
論文 参考訳(メタデータ) (2024-09-22T02:12:29Z) - GaussNav: Gaussian Splatting for Visual Navigation [92.13664084464514]
インスタンスイメージゴールナビゲーション(IIN)では、エージェントが探索されていない環境で、目標画像に描かれた特定のオブジェクトを見つける必要がある。
視覚ナビゲーションのためのガウススティング(GaussNav)であるIINの新しいフレームワークを提案し、3次元ガウススティング(DGS)に基づく新しい地図表現を構築した。
当社のGaussNavフレームワークは,Habitat-Matterport 3D(HM3D)データセットにおいて,SPL(Path Length)によるSuccessの重み付けを0.347から0.578に増加させ,大幅なパフォーマンス向上を実現している。
論文 参考訳(メタデータ) (2024-03-18T09:56:48Z) - MemoNav: Working Memory Model for Visual Navigation [47.011190883888446]
イメージゴールナビゲーションは、不慣れな環境でイメージによって示されるゴールにエージェントがナビゲートする必要がある、困難なタスクである。
様々な場面の記憶を利用する既存の手法は、すべての歴史的観察を意思決定に用いているため、非効率な探索に苦しむ。
動作メモリにインスパイアされたパイプラインを用いてナビゲーション性能を向上させる,イメージゴールナビゲーションのための新しいメモリモデルであるMemoNavを提案する。
論文 参考訳(メタデータ) (2024-02-29T13:45:13Z) - Instance-aware Exploration-Verification-Exploitation for Instance ImageGoal Navigation [88.84058353659107]
インスタンスイメージゴールナビゲーション(IIN)は、探索されていない環境でゴールイメージによって表現された指定されたオブジェクトにナビゲートすることを目的としている。
本稿では、インスタンスレベルの画像目標ナビゲーションのための新しいモジュール型ナビゲーションフレームワーク、Exploration-Verification-Exploitation (IEVE)を提案する。
我々の手法は従来の最先端の手法を超越し、古典的セグメンテーションモデル(0.684対0.561成功)またはロバストモデル(0.702対0.561成功)を用いる。
論文 参考訳(メタデータ) (2024-02-25T07:59:10Z) - Object Goal Navigation with Recursive Implicit Maps [92.6347010295396]
対象目標ナビゲーションのための暗黙的な空間マップを提案する。
提案手法は, 挑戦的なMP3Dデータセット上での技量を著しく上回る。
我々は、実際のロボットにモデルをデプロイし、実際のシーンでオブジェクトゴールナビゲーションの結果を奨励する。
論文 参考訳(メタデータ) (2023-08-10T14:21:33Z) - Object Memory Transformer for Object Goal Navigation [10.359616364592075]
本稿では,物体目標ナビゲーション(Nav)のための強化学習手法を提案する。
エージェントは3次元屋内環境をナビゲートし、対象物やシーンの長期観察に基づいて対象物に到達する。
私たちの知る限りでは、ゴール指向ナビゲーションタスクにおけるオブジェクトセマンティクスの長期記憶を利用する最初の作業である。
論文 参考訳(メタデータ) (2022-03-24T09:16:56Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。