TurboTrain: Towards Efficient and Balanced Multi-Task Learning for Multi-Agent Perception and Prediction
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Zewei, Zhao, Seth Z., Cai, Tianhui, Huang, Zhiyu, Zhou, Bolei, Ma, Jiaqi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning
by: Zhou, Zewei, et al.
Published: (2025)
by: Zhou, Zewei, et al.
Published: (2025)
V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction
by: Zhou, Zewei, et al.
Published: (2024)
by: Zhou, Zewei, et al.
Published: (2024)
RelMap: Enhancing Online Map Construction with Class-Aware Spatial Relation and Semantic Priors
by: Cai, Tianhui, et al.
Published: (2025)
by: Cai, Tianhui, et al.
Published: (2025)
MDG: Masked Denoising Generation for Multi-Agent Behavior Modeling in Traffic Environments
by: Huang, Zhiyu, et al.
Published: (2025)
by: Huang, Zhiyu, et al.
Published: (2025)
QuantV2X: A Fully Quantized Multi-Agent System for Cooperative Perception
by: Zhao, Seth Z., et al.
Published: (2025)
by: Zhao, Seth Z., et al.
Published: (2025)
MIC-BEV: Multi-Infrastructure Camera Bird's-Eye-View Transformer with Relation-Aware Fusion for 3D Object Detection
by: Zhang, Yun, et al.
Published: (2025)
by: Zhang, Yun, et al.
Published: (2025)
ConFixGS: Learning to Fix Feedforward 3D Gaussian Splatting with Confidence-Aware Diffusion Priors in Driving Scenes
by: Song, Rui, et al.
Published: (2026)
by: Song, Rui, et al.
Published: (2026)
V2X-ReaLO: An Open Online Framework and Dataset for Cooperative Perception in Reality
by: Xiang, Hao, et al.
Published: (2025)
by: Xiang, Hao, et al.
Published: (2025)
CooPre: Cooperative Pretraining for V2X Cooperative Perception
by: Zhao, Seth Z., et al.
Published: (2024)
by: Zhao, Seth Z., et al.
Published: (2024)
Driving with Regulation: Trustworthy and Interpretable Decision-Making for Autonomous Driving with Retrieval-Augmented Reasoning
by: Cai, Tianhui, et al.
Published: (2024)
by: Cai, Tianhui, et al.
Published: (2024)
CooperRisk: A Driving Risk Quantification Pipeline with Multi-Agent Cooperative Perception and Prediction
by: Lei, Mingyue, et al.
Published: (2025)
by: Lei, Mingyue, et al.
Published: (2025)
MDrive: Benchmarking Closed-Loop Cooperative Driving for End-to-End Multi-agent Systems
by: Coscoy, Marco, et al.
Published: (2026)
by: Coscoy, Marco, et al.
Published: (2026)
AgentAlign: Misalignment-Adapted Multi-Agent Perception for Resilient Inter-Agent Sensor Correlations
by: Meng, Zonglin, et al.
Published: (2024)
by: Meng, Zonglin, et al.
Published: (2024)
Towards Pixel-Level VLM Perception via Simple Points Prediction
by: Song, Tianhui, et al.
Published: (2026)
by: Song, Tianhui, et al.
Published: (2026)
Learning Sidewalk Autopilot from Multi-Scale Imitation with Corrective Behavior Expansion
by: He, Honglin, et al.
Published: (2026)
by: He, Honglin, et al.
Published: (2026)
BEVCon: Advancing Bird's Eye View Perception with Contrastive Learning
by: Leng, Ziyang, et al.
Published: (2025)
by: Leng, Ziyang, et al.
Published: (2025)
EnerGS: Energy-Based Gaussian Splatting with Partial Geometric Priors
by: Song, Rui, et al.
Published: (2026)
by: Song, Rui, et al.
Published: (2026)
Towards Autonomous Micromobility through Scalable Urban Simulation
by: Wu, Wayne, et al.
Published: (2025)
by: Wu, Wayne, et al.
Published: (2025)
Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning
by: Zhong, Hanwen, et al.
Published: (2025)
by: Zhong, Hanwen, et al.
Published: (2025)
nuReasoning: A Reasoning-Centric Dataset and Benchmark for Long-Tail Autonomous Driving
by: Huang, Zhiyu, et al.
Published: (2026)
by: Huang, Zhiyu, et al.
Published: (2026)
SceneStreamer: Continuous Scenario Generation as Next Token Group Prediction
by: Peng, Zhenghao, et al.
Published: (2025)
by: Peng, Zhenghao, et al.
Published: (2025)
Breaking Data Silos: Cross-Domain Learning for Multi-Agent Perception from Independent Private Sources
by: Li, Jinlong, et al.
Published: (2024)
by: Li, Jinlong, et al.
Published: (2024)
TurboReg: TurboClique for Robust and Efficient Point Cloud Registration
by: Yan, Shaocheng, et al.
Published: (2025)
by: Yan, Shaocheng, et al.
Published: (2025)
Multi-Expert Adaptive Selection: Task-Balancing for All-in-One Image Restoration
by: Yu, Xiaoyan, et al.
Published: (2024)
by: Yu, Xiaoyan, et al.
Published: (2024)
From Seeing to Experiencing: Scaling Navigation Foundation Models with Reinforcement Learning
by: He, Honglin, et al.
Published: (2025)
by: He, Honglin, et al.
Published: (2025)
$\mathcal{B}^{3}$-Net: Controlled Posterior Bridge Learning for Multi-Task Dense Prediction
by: Zhou, Meihua, et al.
Published: (2026)
by: Zhou, Meihua, et al.
Published: (2026)
FlowTurbo: Towards Real-time Flow-Based Image Generation with Velocity Refiner
by: Zhao, Wenliang, et al.
Published: (2024)
by: Zhao, Wenliang, et al.
Published: (2024)
Path-GPTOmic: A Balanced Multi-modal Learning Framework for Survival Outcome Prediction
by: Wang, Hongxiao, et al.
Published: (2024)
by: Wang, Hongxiao, et al.
Published: (2024)
Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis
by: Ren, Jingjing, et al.
Published: (2025)
by: Ren, Jingjing, et al.
Published: (2025)
Enhancing Mamba Decoder with Bidirectional Interaction in Multi-Task Dense Prediction
by: Cao, Mang, et al.
Published: (2025)
by: Cao, Mang, et al.
Published: (2025)
S2R-ViT for Multi-Agent Cooperative Perception: Bridging the Gap from Simulation to Reality
by: Li, Jinlong, et al.
Published: (2023)
by: Li, Jinlong, et al.
Published: (2023)
Efficiently Disentangling CLIP for Multi-Object Perception
by: Rawlekar, Samyak, et al.
Published: (2025)
by: Rawlekar, Samyak, et al.
Published: (2025)
LiSD: An Efficient Multi-Task Learning Framework for LiDAR Segmentation and Detection
by: Xu, Jiahua, et al.
Published: (2024)
by: Xu, Jiahua, et al.
Published: (2024)
Co-MTP: A Cooperative Trajectory Prediction Framework with Multi-Temporal Fusion for Autonomous Driving
by: Zhang, Xinyu, et al.
Published: (2025)
by: Zhang, Xinyu, et al.
Published: (2025)
Multi-Task Learning for Robot Perception with Imbalanced Data
by: Erkent, Ozgur
Published: (2026)
by: Erkent, Ozgur
Published: (2026)
A Simple Framework Towards Vision-based Traffic Signal Control with Microscopic Simulation
by: He, Pan, et al.
Published: (2024)
by: He, Pan, et al.
Published: (2024)
GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents
by: V Team, et al.
Published: (2026)
by: V Team, et al.
Published: (2026)
Glass Segmentation with Multi Scales and Primary Prediction Guiding
by: Xu, Zhiyu, et al.
Published: (2024)
by: Xu, Zhiyu, et al.
Published: (2024)
Contrastive Imitation Learning for Language-guided Multi-Task Robotic Manipulation
by: Ma, Teli, et al.
Published: (2024)
by: Ma, Teli, et al.
Published: (2024)
Towards Balanced Multi-Modal Learning in 3D Human Pose Estimation
by: Qi, Mengshi, et al.
Published: (2025)
by: Qi, Mengshi, et al.
Published: (2025)
Similar Items
-
AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning
by: Zhou, Zewei, et al.
Published: (2025) -
V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction
by: Zhou, Zewei, et al.
Published: (2024) -
RelMap: Enhancing Online Map Construction with Class-Aware Spatial Relation and Semantic Priors
by: Cai, Tianhui, et al.
Published: (2025) -
MDG: Masked Denoising Generation for Multi-Agent Behavior Modeling in Traffic Environments
by: Huang, Zhiyu, et al.
Published: (2025) -
QuantV2X: A Fully Quantized Multi-Agent System for Cooperative Perception
by: Zhao, Seth Z., et al.
Published: (2025)