Fugu-MT 論文翻訳(概要): UdeerLID+: Integrating LiDAR, Image, and Relative Depth with Semi-Supervised

論文の概要: UdeerLID+: Integrating LiDAR, Image, and Relative Depth with Semi-Supervised

arxiv url: http://arxiv.org/abs/2409.06197v1
Date: Tue, 10 Sep 2024 03:57:30 GMT
ステータス: 翻訳完了
システム内更新日: 2024-09-11 19:10:55.556435
Title: UdeerLID+: Integrating LiDAR, Image, and Relative Depth with Semi-Supervised
Title（参考訳）: UdeerLID+:半監督によるLiDAR、画像、相対深さの統合
Authors: Tao Ni, Xin Zhan, Tao Luo, Wenbin Liu, Zhan Shi, JunBo Chen,
Abstract要約: 道路分割は自動運転システムにとって重要な課題である。我々の研究は、LiDARポイントクラウドデータ、ビジュアルイメージ、および相対深度マップを統合する革新的なアプローチを導入している。主な課題の1つは、大規模で正確にラベル付けされたデータセットの不足である。
参考スコア（独自算出の注目度）: 12.440461420762265
License: http://creativecommons.org/licenses/by/4.0/
Abstract: Road segmentation is a critical task for autonomous driving systems, requiring accurate and robust methods to classify road surfaces from various environmental data. Our work introduces an innovative approach that integrates LiDAR point cloud data, visual image, and relative depth maps derived from images. The integration of multiple data sources in road segmentation presents both opportunities and challenges. One of the primary challenges is the scarcity of large-scale, accurately labeled datasets that are necessary for training robust deep learning models. To address this, we have developed the [UdeerLID+] framework under a semi-supervised learning paradigm. Experiments results on KITTI datasets validate the superior performance.
Abstract（参考訳）: 道路セグメンテーションは自動運転システムにとって重要な課題であり、様々な環境データから道路表面を分類するために正確で堅牢な方法を必要とする。我々の研究は、LiDARポイントクラウドデータ、視覚画像、および画像から派生した相対深度マップを統合する革新的なアプローチを導入している。道路分割における複数のデータソースの統合は、機会と課題の両方を示します。主な課題の1つは、堅牢なディープラーニングモデルのトレーニングに必要な、大規模で正確なラベル付きデータセットの不足である。そこで我々は,半教師付き学習パラダイムに基づく[UdeerLID+]フレームワークを開発した。 KITTIデータセットの実験により、優れた性能が検証された。

関連論文リスト

Scaling Up Occupancy-centric Driving Scene Generation: Dataset and Method [54.461213497603154]
作業中心の手法は、最近、フレームとモダリティをまたいだ一貫した条件付けを提供することで、最先端の結果を得た。 Nuplan-Occは、広く使われているNuplanベンチマークから構築された、これまでで最大の占有率データセットである。高品質な占有、多視点ビデオ、LiDAR点雲を共同で合成する統合フレームワークを開発した。
論文参考訳（メタデータ） (2025-10-27T03:52:45Z)
ROVR-Open-Dataset: A Large-Scale Depth Dataset for Autonomous Driving [62.9051914830949]
実世界の運転の複雑さを捉えるために設計された,大規模で多様で費用効率のよい深度データセットであるROVRを提案する。軽量な取得パイプラインは、スケーラブルなコレクションを保証すると同時に、統計的に十分な基礎的真実は堅牢なトレーニングをサポートする。最先端の単分子深度モデルによるベンチマークでは、厳密なクロスデータセットの一般化失敗が示される。
論文参考訳（メタデータ） (2025-08-19T16:13:49Z)
Multimodal HD Mapping for Intersections by Intelligent Roadside Units [21.3691460430126]
複素交叉のハイデフィニション(HD)意味マッピングは、車両ベースのアプローチに重大な課題をもたらす。本稿では,高度インテリジェントロードサイドユニット(IRU)を活用したカメラ-LiDAR融合フレームワークを提案する。本稿では,V2X-Seqデータセットの体系的拡張とアノテーションを通じて開発された包括的データセットであるRS-seqを提案する。
論文参考訳（メタデータ） (2025-07-11T08:45:56Z)
What Really Matters for Robust Multi-Sensor HD Map Construction? [9.108124985480046]
高精度かつ包括的な静的環境情報の提供には,HDマップ構築法が不可欠である。既存のアプローチは主にモデルの精度の向上に重点を置いており、知覚モデルの堅牢性を無視していることが多い。高精度を維持しつつ,HDマップ構築のためのマルチモーダル融合法のロバスト性を高める戦略を提案する。
論文参考訳（メタデータ） (2025-07-02T08:46:27Z)
Multi-label Scene Classification for Autonomous Vehicles: Acquiring and Accumulating Knowledge from Diverse Datasets [13.41074576587372]
本稿では,知識獲得・蓄積(KAA)と一貫性に基づくアクティブラーニング(CAL)を統合した新しいディープラーニング手法を提案する。新たに開発されたドライビングシーン識別(DSI)データセットのアブレーション調査では、ImageNetで事前トレーニングされたベースラインよりも56.1%改善されている。 KAA-CALはBDD100KとHSDデータセットの最先端のマルチラベル分類手法より優れている。
論文参考訳（メタデータ） (2025-06-20T16:06:53Z)
Active Learning from Scene Embeddings for End-to-End Autonomous Driving [30.667451458189902]
エンドツーエンドのディープラーニングモデルのトレーニングには、大量のラベル付きデータが必要です。本稿では,SEADと呼ばれるベクトル化シーンレベルの特徴に依存する能動的学習フレームワークを提案する。実験によると、完全なデータセットで達成できることに近いパフォーマンスを達成するには、nuScenesトレーニングデータの30%しか必要ありません。
論文参考訳（メタデータ） (2025-03-14T03:56:22Z)
Multiple data sources and domain generalization learning method for road surface defect classification [2.9109581496560044]
本稿では,カメラ画像を用いた路面欠陥の分類手法を提案する。一般化モデルを開発するための領域一般化学習アルゴリズムを提案する。その結果,従来は見つからなかったデータに基づいて,道路表面の欠陥を効率的に分類できることが示唆された。
論文参考訳（メタデータ） (2024-07-14T13:37:47Z)
Enhancing Generalizability of Representation Learning for Data-Efficient 3D Scene Understanding [50.448520056844885]
本研究では,実世界のパターンを持つ多様な合成シーンを生成可能なベイズネットワークを提案する。一連の実験は、既存の最先端の事前学習手法に比べて、我々の手法が一貫した優位性を示す。
論文参考訳（メタデータ） (2024-06-17T07:43:53Z)
Multi-Modal Multi-Task (3MT) Road Segmentation [0.8287206589886879]
我々は、多くのSOTA作業で通常行われているように、代わりに生のセンサー入力を使用することに重点を置いており、高い事前処理コストを必要とするアーキテクチャを活用している。本研究では,複数センサからのデータをマルチタスク学習アーキテクチャに組み込むことにより,道路セグメンテーションの費用対効果,高精度なソリューションを提案する。
論文参考訳（メタデータ） (2023-08-23T08:15:15Z)
SynDrone -- Multi-modal UAV Dataset for Urban Scenarios [11.338399194998933]
ピクセルレベルのアノテーションを持つ大規模な実際のデータセットの不足は、研究者にとって大きな課題となっている。本研究では,複数の飛行高度で撮影された画像と3次元データを含むマルチモーダル合成データセットを提案する。データセットは、UAVアプリケーションをターゲットにした新しいコンピュータビジョンメソッドの開発をサポートするために公開されます。
論文参考訳（メタデータ） (2023-08-21T06:22:10Z)
Scaling Data Generation in Vision-and-Language Navigation [116.95534559103788]
本稿では,学習のための大規模データ生成に有効なパラダイムを提案する。我々は、HM3DとGibsonのデータセットから1200以上のフォトリアリスティック環境を適用し、490万の命令軌道対を合成する。我々の大規模データセットのおかげで、既存のエージェントの性能は(以前のSoTAでは+11%絶対)、単純な模倣学習によってR2Rテストの分割で80%の単ラン成功率で大幅に向上できる。
論文参考訳（メタデータ） (2023-07-28T16:03:28Z)
LVLane: Deep Learning for Lane Detection and Classification in Challenging Conditions [2.5641096293146712]
本稿では,ディープラーニング手法に基づくエンドツーエンドの車線検出・分類システムを提案する。本研究では,最新技術(SOTA)レーンローカライゼーションモデルにおいて重要な課題を提起するシナリオを包含する,厳密にキュレートされたユニークなデータセットを提案する。そこで本研究では,CNNをベースとした検知器とシームレスに統合し,異なるレーンの識別を容易にする分類手法を提案する。
論文参考訳（メタデータ） (2023-07-13T16:09:53Z)
PreTraM: Self-Supervised Pre-training via Connecting Trajectory and Map [58.53373202647576]
軌道予測のための自己教師付き事前学習方式であるPreTraMを提案する。 1) トラジェクティブ・マップ・コントラクティブ・ラーニング(トラジェクティブ・コントラクティブ・ラーニング)、(2) トラジェクティブ・ラーニング(トラジェクティブ・コントラクティブ・ラーニング)、(2) トラジェクティブ・ラーニング(トラジェクティブ・ラーニング)、(2) トラジェクティブ・コントラクティブ・ラーニング(トラジェクティブ・ラーニング)、(2) トラジェクティブ・コントラクティブ・ラーニング(トラジェクティブ・ラーニング)の2つのパートから構成される。 AgentFormerやTrajectron++といった一般的なベースラインに加えて、PreTraMは、挑戦的なnuScenesデータセット上で、FDE-10でパフォーマンスを5.5%と6.9%向上させる。
論文参考訳（メタデータ） (2022-04-21T23:01:21Z)
Towards Scale Consistent Monocular Visual Odometry by Learning from the Virtual World [83.36195426897768]
仮想データから絶対スケールを取得するための新しいフレームワークであるVRVOを提案する。まず、モノクロ実画像とステレオ仮想データの両方を用いて、スケール対応の異種ネットワークをトレーニングする。結果として生じるスケール一貫性の相違は、直接VOシステムと統合される。
論文参考訳（メタデータ） (2022-03-11T01:51:54Z)
Aerial Images Meet Crowdsourced Trajectories: A New Approach to Robust Road Extraction [110.61383502442598]
我々は、Cross-Modal Message Propagation Network (CMMPNet)と呼ばれる新しいニューラルネットワークフレームワークを紹介する。 CMMPNetは、モダリティ固有の表現学習のための2つのディープオートエンコーダと、クロスモーダル表現洗練のためのテーラー設計のデュアルエンハンスメントモジュールで構成されている。実世界の3つのベンチマーク実験により, CMMPNetによる堅牢な道路抽出の有効性が示された。
論文参考訳（メタデータ） (2021-11-30T04:30:10Z)
Salient Objects in Clutter [130.63976772770368]
本稿では,既存の正当性オブジェクト検出(SOD)データセットの重大な設計バイアスを特定し,対処する。この設計バイアスは、既存のデータセットで評価した場合、最先端のSODモデルのパフォーマンスの飽和につながった。我々は,新しい高品質データセットを提案し,前回のsaliencyベンチマークを更新する。
論文参考訳（メタデータ） (2021-05-07T03:49:26Z)
RELLIS-3D Dataset: Data, Benchmarks and Analysis [16.803548871633957]
RELLIS-3Dはオフロード環境で収集されたマルチモーダルデータセットである。データはテキサスA&M大学のRellis Campusで収集されました。
論文参考訳（メタデータ） (2020-11-17T18:28:01Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。