SegRGB-X: General RGB-X Semantic Segmentation Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Jiong, Xu, Yingjie, Zhou, Xingcheng, Song, Rui, Zimmer, Walter, Knoll, Alois, Cao, Hu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TUMTraf V2X Cooperative Perception Dataset
par: Zimmer, Walter, et autres
Publié: (2024)
par: Zimmer, Walter, et autres
Publié: (2024)
SGTA: Scene-Graph Based Multi-Modal Traffic Agent for Video Understanding
par: Zhou, Xingcheng, et autres
Publié: (2026)
par: Zhou, Xingcheng, et autres
Publié: (2026)
CCTVBench: Contrastive Consistency Traffic VideoQA Benchmark for Multimodal LLMs
par: Zhou, Xingcheng, et autres
Publié: (2026)
par: Zhou, Xingcheng, et autres
Publié: (2026)
GPT-4V as Traffic Assistant: An In-depth Look at Vision Language Model on Complex Traffic Events
par: Zhou, Xingcheng, et autres
Publié: (2024)
par: Zhou, Xingcheng, et autres
Publié: (2024)
BiSeg-SAM: Weakly-Supervised Post-Processing Framework for Boosting Binary Segmentation in Segment Anything Models
par: Su, Encheng, et autres
Publié: (2025)
par: Su, Encheng, et autres
Publié: (2025)
Energy-Aware Imitation Learning for Steering Prediction Using Events and Frames
par: Cao, Hu, et autres
Publié: (2026)
par: Cao, Hu, et autres
Publié: (2026)
PointCompress3D: A Point Cloud Compression Framework for Roadside LiDARs in Intelligent Transportation Systems
par: Zimmer, Walter, et autres
Publié: (2024)
par: Zimmer, Walter, et autres
Publié: (2024)
Vision Language Models in Autonomous Driving: A Survey and Outlook
par: Zhou, Xingcheng, et autres
Publié: (2023)
par: Zhou, Xingcheng, et autres
Publié: (2023)
TUMTraf Event: Calibration and Fusion Resulting in a Dataset for Roadside Event-Based and RGB Cameras
par: Creß, Christian, et autres
Publié: (2024)
par: Creß, Christian, et autres
Publié: (2024)
Collaborative Semantic Occupancy Prediction with Hybrid Feature Fusion in Connected Automated Vehicles
par: Song, Rui, et autres
Publié: (2024)
par: Song, Rui, et autres
Publié: (2024)
SegFly: A 2D-3D-2D Paradigm for Aerial RGB-Thermal Semantic Segmentation at Scale
par: Gross, Markus, et autres
Publié: (2026)
par: Gross, Markus, et autres
Publié: (2026)
TUMTraf EMOT: Event-Based Multi-Object Tracking Dataset and Baseline for Traffic Scenarios
par: Li, Mengyu, et autres
Publié: (2025)
par: Li, Mengyu, et autres
Publié: (2025)
WARM-3D: A Weakly-Supervised Sim2Real Domain Adaptation Framework for Roadside Monocular 3D Object Detection
par: Zhou, Xingcheng, et autres
Publié: (2024)
par: Zhou, Xingcheng, et autres
Publié: (2024)
Enhancing Highway Safety: Accident Detection on the A9 Test Stretch Using Roadside Sensors
par: Zimmer, Walter, et autres
Publié: (2025)
par: Zimmer, Walter, et autres
Publié: (2025)
Safety-Critical Learning for Long-Tail Events: The TUM Traffic Accident Dataset
par: Zimmer, Walter, et autres
Publié: (2025)
par: Zimmer, Walter, et autres
Publié: (2025)
Context-Aware Interaction Network for RGB-T Semantic Segmentation
par: Lv, Ying, et autres
Publié: (2024)
par: Lv, Ying, et autres
Publié: (2024)
TUMTraffic-VideoQA: A Benchmark for Unified Spatio-Temporal Video Understanding in Traffic Scenes
par: Zhou, Xingcheng, et autres
Publié: (2025)
par: Zhou, Xingcheng, et autres
Publié: (2025)
CoDa-4DGS: Dynamic Gaussian Splatting with Context and Deformation Awareness for Autonomous Driving
par: Song, Rui, et autres
Publié: (2025)
par: Song, Rui, et autres
Publié: (2025)
Bimodal SegNet: Instance Segmentation Fusing Events and RGB Frames for Robotic Grasping
par: Kachole, Sanket, et autres
Publié: (2023)
par: Kachole, Sanket, et autres
Publié: (2023)
Towards Vision Zero: The TUM Traffic Accid3nD Dataset
par: Zimmer, Walter, et autres
Publié: (2025)
par: Zimmer, Walter, et autres
Publié: (2025)
A Survey on Autonomous Driving Datasets: Statistics, Annotation Quality, and a Future Outlook
par: Liu, Mingyu, et autres
Publié: (2024)
par: Liu, Mingyu, et autres
Publié: (2024)
PDDM: Pseudo Depth Diffusion Model for RGB-PD Semantic Segmentation Based in Complex Indoor Scenes
par: Xu, Xinhua, et autres
Publié: (2025)
par: Xu, Xinhua, et autres
Publié: (2025)
Frequency-Guided Fusion For RGB-Thermal Semantic Segmentation
par: Canıtez, İsmail Emre, et autres
Publié: (2026)
par: Canıtez, İsmail Emre, et autres
Publié: (2026)
CSFNet: A Cosine Similarity Fusion Network for Real-Time RGB-X Semantic Segmentation of Driving Scenes
par: Qashqai, Danial, et autres
Publié: (2024)
par: Qashqai, Danial, et autres
Publié: (2024)
Cross-modal State Space Modeling for Real-time RGB-thermal Wild Scene Semantic Segmentation
par: Guo, Xiaodong, et autres
Publié: (2025)
par: Guo, Xiaodong, et autres
Publié: (2025)
DepthVision: Enabling Robust Vision-Language Models with GAN-Based LiDAR-to-RGB Synthesis for Autonomous Driving
par: Kirchner, Sven, et autres
Publié: (2025)
par: Kirchner, Sven, et autres
Publié: (2025)
GraphRelate3D: Context-Dependent 3D Object Detection with Inter-Object Relationship Graphs
par: Liu, Mingyu, et autres
Publié: (2024)
par: Liu, Mingyu, et autres
Publié: (2024)
RAFT -- A Domain Adaptation Framework for RGB & LiDAR Semantic Segmentation
par: Humes, Edward, et autres
Publié: (2025)
par: Humes, Edward, et autres
Publié: (2025)
TASeg: Text-aware RGB-T Semantic Segmentation based on Fine-tuning Vision Foundation Models
par: Yu, Meng, et autres
Publié: (2025)
par: Yu, Meng, et autres
Publié: (2025)
Towards Balanced RGB-TSDF Fusion for Consistent Semantic Scene Completion by 3D RGB Feature Completion and a Classwise Entropy Loss Function
par: Ding, Laiyan, et autres
Publié: (2024)
par: Ding, Laiyan, et autres
Publié: (2024)
Learning Flow-Guided Registration for RGB-Event Semantic Segmentation
par: Yao, Zhen, et autres
Publié: (2025)
par: Yao, Zhen, et autres
Publié: (2025)
Spectral-Aware Global Fusion for RGB-Thermal Semantic Segmentation
par: Zhang, Ce, et autres
Publié: (2025)
par: Zhang, Ce, et autres
Publié: (2025)
LightFC-X: Lightweight Convolutional Tracker for RGB-X Tracking
par: Li, Yunfeng, et autres
Publié: (2025)
par: Li, Yunfeng, et autres
Publié: (2025)
OpenDriveVLA: Towards End-to-end Autonomous Driving with Large Vision Language Action Model
par: Zhou, Xingcheng, et autres
Publié: (2025)
par: Zhou, Xingcheng, et autres
Publié: (2025)
ShareCMP: Polarization-Aware RGB-P Semantic Segmentation
par: Liu, Zhuoyan, et autres
Publié: (2023)
par: Liu, Zhuoyan, et autres
Publié: (2023)
HDBFormer: Efficient RGB-D Semantic Segmentation with A Heterogeneous Dual-Branch Framework
par: Wei, Shuobin, et autres
Publié: (2025)
par: Wei, Shuobin, et autres
Publié: (2025)
Diffusion-based RGB-D Semantic Segmentation with Deformable Attention Transformer
par: Bui, Minh, et autres
Publié: (2024)
par: Bui, Minh, et autres
Publié: (2024)
URNet: Uncertainty-aware Refinement Network for Event-based Stereo Depth Estimation
par: Cheng, Yifeng, et autres
Publié: (2025)
par: Cheng, Yifeng, et autres
Publié: (2025)
SkySeg: Collaborative Onboard Semantic Segmentation with Heterogeneous UAVs in the Wild
par: Lu, Anqi, et autres
Publié: (2026)
par: Lu, Anqi, et autres
Publié: (2026)
UniTriGen: Unified Triplet Generation of Aligned Visible-Infrared-Label for Few-Shot RGB-T Semantic Segmentation
par: Zhou, Ping, et autres
Publié: (2026)
par: Zhou, Ping, et autres
Publié: (2026)
Documents similaires
-
TUMTraf V2X Cooperative Perception Dataset
par: Zimmer, Walter, et autres
Publié: (2024) -
SGTA: Scene-Graph Based Multi-Modal Traffic Agent for Video Understanding
par: Zhou, Xingcheng, et autres
Publié: (2026) -
CCTVBench: Contrastive Consistency Traffic VideoQA Benchmark for Multimodal LLMs
par: Zhou, Xingcheng, et autres
Publié: (2026) -
GPT-4V as Traffic Assistant: An In-depth Look at Vision Language Model on Complex Traffic Events
par: Zhou, Xingcheng, et autres
Publié: (2024) -
BiSeg-SAM: Weakly-Supervised Post-Processing Framework for Boosting Binary Segmentation in Segment Anything Models
par: Su, Encheng, et autres
Publié: (2025)