論文の概要: Mind the Hitch: Dynamic Calibration and Articulated Perception for Autonomous Trucks
- arxiv url: http://arxiv.org/abs/2603.23711v1
- Date: Tue, 24 Mar 2026 20:55:16 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-26 21:06:11.023084
- Title: Mind the Hitch: Dynamic Calibration and Articulated Perception for Autonomous Trucks
- Title(参考訳): Mind the Hitch: 自律トラックの動的校正とArticulated Perception
- Abstract要約: dCAPは、トラクタとトレーラーカメラの間の6自由度(自由度)の相対的なポーズを継続的に推定するビジョンベースのフレームワークである。
BEVFormerと統合されたdCAPは、静的キャリブレーションを動的に予測外在物に置き換えることで、3Dオブジェクトの検出を改善する。
実験では、自律トラックにおける静的キャリブレーションの限界に対処しながら、dCAPが安定かつ正確な知覚を達成することを示した。
- 参考スコア(独自算出の注目度): 7.0536813329377
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Autonomous trucking poses unique challenges due to articulated tractor-trailer geometry, and time-varying sensor poses caused by the fifth-wheel joint and trailer flex. Existing perception and calibration methods assume static baselines or rely on high-parallax and texture-rich scenes, limiting their reliability under real-world settings. We propose dCAP (dynamic Calibration and Articulated Perception), a vision-based framework that continuously estimates the 6-DoF (degree of freedom) relative pose between tractor and trailer cameras. dCAP employs a transformer with cross-view and temporal attention to robustly aggregate spatial cues while maintaining temporal consistency, enabling accurate perception under rapid articulation and occlusion. Integrated with BEVFormer, dCAP improves 3D object detection by replacing static calibration with dynamically predicted extrinsics. To facilitate evaluation, we introduce STT4AT, a CARLA-based benchmark simulating semi-trailer trucks with synchronized multi-sensor suites and time-varying inter-rig geometry across diverse environments. Experiments demonstrate that dCAP achieves stable, accurate perception while addressing the limitations of static calibration in autonomous trucking. The dataset, development kit, and source code will be publicly released.
- Abstract(参考訳): 自動トラックはトラクタ・トレーラーの形状と、第5車輪の関節とトレーラーの屈曲によって引き起こされる時間変化センサーのポーズによって、独特な課題を生んでいる。
既存の知覚と校正法は静的なベースラインを前提とするか、高パララックスとテクスチャに富んだシーンに依存し、現実の環境での信頼性を制限している。
トラクタとトレーラーカメラ間の6自由度(自由度)相対的なポーズを連続的に推定する視覚ベースのフレームワークであるdCAP(dynamic Calibration and Articulated Perception)を提案する。
dCAPは、時間的一貫性を維持しながら空間的手がかりを頑健に集約し、迅速な調音と閉塞の下で正確な知覚を可能にする。
BEVFormerと統合されたdCAPは、静的キャリブレーションを動的に予測外在物に置き換えることで、3Dオブジェクトの検出を改善する。
評価を容易にするため,CARLAをベースとしたセミトレーラトラックを模擬したベンチマークであるSTT4ATを導入する。
実験では、自律トラックにおける静的キャリブレーションの限界に対処しながら、dCAPが安定かつ正確な知覚を達成することを示した。
データセット、開発キット、ソースコードが公開される。
関連論文リスト
- RECO: Region-Aware Compensation for Extrinsic Perturbations in Roadside 3D Detection [13.05494342638977]
道路沿いの3D物体検出は、交通理解、協調早期警戒、安全な自動運転に不可欠な広域認識を提供する。
既存の方法は、カメラ外在物に対する高い感度に悩まされており、わずかな偏差でさえ射影幾何学によって増幅することができる。
部分的6-DoFポーズオフセットを用いて外因性を修正する地域対応外因性補償フレームワークRECOを提案する。
論文 参考訳(メタデータ) (2026-07-23T05:56:42Z) - A Task-Space Receding Horizon Controller for Fast Collision Avoidance [0.08594140167290099]
ロボットマニピュレータのリアルタイム衝突回避には、予期せぬ障害物運動に対する迅速な反応が必要である。
完全なモデル予測制御は、この展望を提供することができるが、オンラインコストは、水平線長、モデル忠実度、アクティブな幾何学的制約の数とともに急速に増大する可能性がある。
本稿では, 短時間の接触一貫性を持つロールアウトを用いて, 終端キネマティック参照を生成するタスクスペースリテーディング・ホライゾンコントローラを提案する。
論文 参考訳(メタデータ) (2026-07-17T08:13:12Z) - QuadVerse: An Integrated Framework Aligning Visual-Physical Reality for Quadruped Simulation [31.92788136725977]
映像認識,物理インタラクション,アクチュエータダイナミクスを調整するための校正基板として,再構成シーンを利用する統合フレームワークであるQuadVerseを紹介した。
ここでは,QuadVerseが関連するベースライン上での復元品質と移動追跡を改善したことを示す。
論文 参考訳(メタデータ) (2026-06-05T10:18:24Z) - Deformable Gaussian Occupancy: Decoupling Rigid and Nonrigid Motion with Factorized Distillation [81.44955493339835]
DeGOは変形可能なガウスの占有機構であり、分解したガウスの変形と分解された4次元基礎モデル蒸留を統一する。
Occ3D-NuScenesベンチマーク実験により,本手法が弱い監督下での最先端性能を実現することを示す。
論文 参考訳(メタデータ) (2026-05-27T15:09:55Z) - Asset Harvester: Extracting 3D Assets from Autonomous Driving Logs for Simulation [63.01022057888141]
Asset Harvesterはイメージ・ツー・3Dモデルとエンドツーエンドのパイプラインで、実際の運転ログからスパース・イン・ザ・ワン・オブジェクトの観察を完全なシミュレーション可能なアセットに変換する。
SparseViewDiTは、限定角度ビューやその他の実世界のデータ課題に対処するように明示的に設計されている。
論文 参考訳(メタデータ) (2026-04-20T16:20:57Z) - InCaRPose: In-Cabin Relative Camera Pose Estimation Model and Dataset [7.117236435809274]
InCaRPoseはトランスフォーマーをベースとしたアーキテクチャで、画像ペア間の相対的ポーズを堅牢に予測するように設計されている。
DINOv3やTransformerベースのデコーダのようなフリーズバックボーン機能を利用することで,参照とターゲットビューの幾何学的関係を効果的に捉えることができる。
本手法は、キャビン内カメラマウントの物理的に妥当な調整範囲内で絶対的なメートル法スケールの変換を実現する。
論文 参考訳(メタデータ) (2026-04-04T17:40:25Z) - Resonance4D: Frequency-Domain Motion Supervision for Preset-Free Physical Parameter Learning in 4D Dynamic Physical Scene Simulation [53.141181758015186]
Resonance4Dは3次元ガウス散乱と物質点法を結合した物理駆動4次元動的シミュレーションフレームワークである。
我々の重要な洞察は、動的整合性は、相補的領域における共同的拘束運動によって、高密度時間発生なしに強制できるということである。
Resonance4Dは、ピークGPUメモリを35,GB以上から20GB程度に削減しつつ、強力な物理忠実性と運動の整合性を実現する。
論文 参考訳(メタデータ) (2026-04-02T13:00:22Z) - Model Optimization for Multi-Camera 3D Detection and Tracking [13.756560739163362]
室内環境におけるマルチカメラの外部認識の重要性はますます高まっている。
クエリベースの3D検出・追跡フレームワークであるSparse4Dを評価した。
我々は,入力フレームレートの低減,学習後の量子化,WILDTRACKベンチマークへの転送,およびトランスフォーマーエンジンの混合精度の微調整について検討した。
論文 参考訳(メタデータ) (2026-01-31T01:51:30Z) - Delving into Dynamic Scene Cue-Consistency for Robust 3D Multi-Object Tracking [16.366398265001422]
3D多目的追跡は、自動運転分野において重要かつ困難な課題である。
本稿では,この原理を実現するために動的シーンCue-Consistency Tracker(DSC-Track)を提案する。
論文 参考訳(メタデータ) (2025-08-15T08:48:13Z) - NOVA: Navigation via Object-Centric Visual Autonomy for High-Speed Target Tracking in Unstructured GPS-Denied Environments [56.35569661650558]
我々はNOVAというオブジェクト中心のフレームワークを導入し、ロバストな目標追跡と衝突認識ナビゲーションを可能にした。
グローバルマップを構築するのではなく、NOVAはターゲットの参照フレーム内での知覚、推定、制御を定式化する。
我々は,都市迷路や森林の小道,間欠的なGPS損失を伴う建物内の繰り返し遷移など,現実の挑戦的なシナリオにまたがってNOVAを検証する。
論文 参考訳(メタデータ) (2025-06-23T14:28:30Z) - MTGS: Multi-Traversal Gaussian Splatting [51.22657444433942]
マルチトラバースデータは、道路ブロック内のシーン再構築のための複数の視点を提供する。
任意に収集したマルチトラバーサルデータから高品質な運転シーンを再構成する新しい手法であるマルチトラバーサル・ガウス・スプラッティング(MTGS)を提案する。
その結果、MTGSはLPIPSを23.5%改善し、幾何学的精度は46.3%向上した。
論文 参考訳(メタデータ) (2025-03-16T15:46:12Z) - Universal Online Temporal Calibration for Optimization-based Visual-Inertial Navigation Systems [13.416013522770905]
最適化に基づくビジュアル慣性ナビゲーションシステムのための汎用的なオンライン時間的キャリブレーション戦略を提案する。
我々は、最適化残差モデルにおいて、タイムオフセットtdを状態パラメータとして使用し、IMU状態を対応する画像のタイムスタンプに整列させる。
我々のアプローチは、特にノイズの多いセンサデータの存在下で、より正確な時間オフセット推定とより高速な収束を提供する。
論文 参考訳(メタデータ) (2025-01-03T12:41:25Z) - LiDAR-based End-to-end Temporal Perception for Vehicle-Infrastructure Cooperation [16.465037559349323]
LET-VICはLiDARをベースとした車両・インフラ協調のためのエンド・ツー・エンドトラッキングフレームワークである。
車両とインフラの両面から時間的・空間的な情報を統合するために,時間的自己認識モジュールとVICクロスアテンションモジュールを用いている。
実験により、エンドツーエンドトレーニングにおける多視点視点、時間シーケンス、またはCECの統合は、検出と追跡の両方のパフォーマンスを著しく改善することが示された。
論文 参考訳(メタデータ) (2024-11-22T13:34:29Z) - ALOcc: Adaptive Lifting-Based 3D Semantic Occupancy and Cost Volume-Based Flow Predictions [91.55655961014027]
シーン理解には3次元セマンティック占有とフロー予測が不可欠である。
本稿では,3つの改善点を目標とした視覚ベースのフレームワークを提案する。
我々の純粋な畳み込みアーキテクチャは、セマンティック占有率とジョイントセマンティックフロー予測の両方のために、複数のベンチマーク上で新しいSOTA性能を確立する。
論文 参考訳(メタデータ) (2024-11-12T11:32:56Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。