跳到主要导航 跳到搜索 跳到主要内容

Velocity First? Rethinking 3D Object Detection with 4D Millimeter Wave Radar

  • Changxian Zeng
  • , Wenbo Chu*
  • , Lili Fan
  • , Yulong Ding
  • , Yue Tian
  • , Xiaolin Tang
  • , Keqiang Li
  • *此作品的通讯作者
  • Chongqing University
  • Chongqing Institute of Technology
  • Ltd.
  • National Innovation Center of Intelligent and Connected Vehicles
  • Tsinghua University

科研成果: 期刊稿件文章同行评审

摘要

Propelled by advances in autonomous driving, accurate vehicle perception is essential for reliable decision-making. Compared with LiDAR, 4D millimeter-wave radar (4D MMW) provides stronger robustness under adverse conditions, lower deployment cost, and direct velocity measurements, motivating increasing research. However, its sparse point clouds limit scene description. This work presents Velo3DF (3D Velocity-aware Multimodal Fusion Network), a radar-camera fusion model that incorporates 3D velocity vectors into 4D MMW-based 3D detection. To mitigate positional redundancy and better utilize velocity information, a lightweight Velocity-Component-Aware module is introduced, compatible with backbones such as PointPillars. For cross-modal integration, an Alignment-Fusion module performs geometric alignment and deep fusion of image and point-cloud features. A single-modality variant, Velo3DF-R, contains 0.702M parameters and runs at 74.02 FPS while maintaining competitive accuracy.

源语言英语
期刊IEEE Transactions on Multimedia
DOI
出版状态已接受/待刊 - 2026

指纹

探究 'Velocity First? Rethinking 3D Object Detection with 4D Millimeter Wave Radar' 的科研主题。它们共同构成独一无二的指纹。

引用此