Skip to main navigation Skip to search Skip to main content

ST-CFNet: A Spatio-Temporal Enhanced Network for Real-Time 4d Panoptic Segmentation

Ye Xie, Hui Li, Hao Li, Zhao Huang

Research output: Chapter in Book/Report/Conference proceedingConference contributionpeer-review

Abstract

Real-time scene understanding is vital for autonomous driving, robotics, and augmented reality. 4D panoptic LiDAR segmentation extends 3D segmentation by adding temporal consistency of instance IDs over sequential point clouds. Recent transformer-based methods often fail to achieve real-time performance due to their high computational complexity. To address this, we propose ST-CFNet, a spatio-temporal extension of CFNet. It processes spatio-temporal point cloud to capture temporal and geometric features, employs a 2D feature projection backbone with the TWA-P2G module for efficient temporal feature aggregation, and generates predicted results with a 4D panoptic segmentation head. Finally, a center–box deduplication module is adopted to select the center for each detected instance. ST-CFNet achieves a score of 70.2 LSTQ on the SemanticKITTI validation set, outperforming most existing methods while enabling real-time 4D panoptic segmentation. The code is available at https://github.com/ny823/ST-CFNet.
Original languageEnglish
Title of host publicationICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)
Place of PublicationPiscataway, United States
PublisherIEEE
Pages3216-3220
Number of pages5
ISBN (Electronic)9798331567019
ISBN (Print)9798331567026
DOIs
Publication statusPublished - 3 May 2026
EventICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) - Barcelona, Spain
Duration: 3 May 20268 May 2026

Publication series

NameIEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)
PublisherIEEE
ISSN (Print)1520-6149
ISSN (Electronic)2379-190X

Conference

ConferenceICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)
Country/TerritorySpain
CityBarcelona
Period3/05/268/05/26

Keywords

  • 4DPLS
  • ST-CFNet
  • feature fusion
  • real-time segmentation

Fingerprint

Dive into the research topics of 'ST-CFNet: A Spatio-Temporal Enhanced Network for Real-Time 4d Panoptic Segmentation'. Together they form a unique fingerprint.
  • MoDE: A Dynamic Expert Aggregation Framework for Sleep Stage Classification with Contextual Factors

    Luo, J., Li, J., Li, W., Degenaar, P., Wang, Y. & Li, J., 3 May 2026, ICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP). Piscataway, United States: IEEE, p. 8002-8006 5 p. (IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)).

    Research output: Chapter in Book/Report/Conference proceedingConference contributionpeer-review

  • RMSSC: A Robust Multimodal Framework for Sleep Stage Classification with Noisy Labels and Missing Modalities

    Luo, J., Miao, L., Guan, Q., Li, J., Huang, Z. & Li, J., 3 May 2026, ICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP). Piscataway, United States: IEEE, p. 6866-6870 5 p. (IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)).

    Research output: Chapter in Book/Report/Conference proceedingConference contributionpeer-review

  • VKTNet: A Hybrid Visual Kolmogorov-Arnold Transformer Network for Pedestrian Intention and Trajectory Prediction

    Huang, Z., Zhang, J., Song, S., Zhang, J., Li, J., Zhao, L., Zeng, Y. & Li, J., 3 May 2026, ICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP). Piscataway, United States: IEEE, p. 10222-10226 5 p. (IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)).

    Research output: Chapter in Book/Report/Conference proceedingConference contributionpeer-review

Cite this