TurboTrain: Towards Efficient and Balanced Multi-Task Learning for Multi-Agent Perception and Prediction
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Zewei, Zhao, Seth Z., Cai, Tianhui, Huang, Zhiyu, Zhou, Bolei, Ma, Jiaqi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning
por: Zhou, Zewei, et al.
Publicado: (2025)
por: Zhou, Zewei, et al.
Publicado: (2025)
V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction
por: Zhou, Zewei, et al.
Publicado: (2024)
por: Zhou, Zewei, et al.
Publicado: (2024)
RelMap: Enhancing Online Map Construction with Class-Aware Spatial Relation and Semantic Priors
por: Cai, Tianhui, et al.
Publicado: (2025)
por: Cai, Tianhui, et al.
Publicado: (2025)
MDG: Masked Denoising Generation for Multi-Agent Behavior Modeling in Traffic Environments
por: Huang, Zhiyu, et al.
Publicado: (2025)
por: Huang, Zhiyu, et al.
Publicado: (2025)
QuantV2X: A Fully Quantized Multi-Agent System for Cooperative Perception
por: Zhao, Seth Z., et al.
Publicado: (2025)
por: Zhao, Seth Z., et al.
Publicado: (2025)
MIC-BEV: Multi-Infrastructure Camera Bird's-Eye-View Transformer with Relation-Aware Fusion for 3D Object Detection
por: Zhang, Yun, et al.
Publicado: (2025)
por: Zhang, Yun, et al.
Publicado: (2025)
ConFixGS: Learning to Fix Feedforward 3D Gaussian Splatting with Confidence-Aware Diffusion Priors in Driving Scenes
por: Song, Rui, et al.
Publicado: (2026)
por: Song, Rui, et al.
Publicado: (2026)
V2X-ReaLO: An Open Online Framework and Dataset for Cooperative Perception in Reality
por: Xiang, Hao, et al.
Publicado: (2025)
por: Xiang, Hao, et al.
Publicado: (2025)
CooPre: Cooperative Pretraining for V2X Cooperative Perception
por: Zhao, Seth Z., et al.
Publicado: (2024)
por: Zhao, Seth Z., et al.
Publicado: (2024)
Driving with Regulation: Trustworthy and Interpretable Decision-Making for Autonomous Driving with Retrieval-Augmented Reasoning
por: Cai, Tianhui, et al.
Publicado: (2024)
por: Cai, Tianhui, et al.
Publicado: (2024)
CooperRisk: A Driving Risk Quantification Pipeline with Multi-Agent Cooperative Perception and Prediction
por: Lei, Mingyue, et al.
Publicado: (2025)
por: Lei, Mingyue, et al.
Publicado: (2025)
MDrive: Benchmarking Closed-Loop Cooperative Driving for End-to-End Multi-agent Systems
por: Coscoy, Marco, et al.
Publicado: (2026)
por: Coscoy, Marco, et al.
Publicado: (2026)
AgentAlign: Misalignment-Adapted Multi-Agent Perception for Resilient Inter-Agent Sensor Correlations
por: Meng, Zonglin, et al.
Publicado: (2024)
por: Meng, Zonglin, et al.
Publicado: (2024)
Towards Pixel-Level VLM Perception via Simple Points Prediction
por: Song, Tianhui, et al.
Publicado: (2026)
por: Song, Tianhui, et al.
Publicado: (2026)
Learning Sidewalk Autopilot from Multi-Scale Imitation with Corrective Behavior Expansion
por: He, Honglin, et al.
Publicado: (2026)
por: He, Honglin, et al.
Publicado: (2026)
BEVCon: Advancing Bird's Eye View Perception with Contrastive Learning
por: Leng, Ziyang, et al.
Publicado: (2025)
por: Leng, Ziyang, et al.
Publicado: (2025)
EnerGS: Energy-Based Gaussian Splatting with Partial Geometric Priors
por: Song, Rui, et al.
Publicado: (2026)
por: Song, Rui, et al.
Publicado: (2026)
Towards Autonomous Micromobility through Scalable Urban Simulation
por: Wu, Wayne, et al.
Publicado: (2025)
por: Wu, Wayne, et al.
Publicado: (2025)
Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning
por: Zhong, Hanwen, et al.
Publicado: (2025)
por: Zhong, Hanwen, et al.
Publicado: (2025)
nuReasoning: A Reasoning-Centric Dataset and Benchmark for Long-Tail Autonomous Driving
por: Huang, Zhiyu, et al.
Publicado: (2026)
por: Huang, Zhiyu, et al.
Publicado: (2026)
SceneStreamer: Continuous Scenario Generation as Next Token Group Prediction
por: Peng, Zhenghao, et al.
Publicado: (2025)
por: Peng, Zhenghao, et al.
Publicado: (2025)
Breaking Data Silos: Cross-Domain Learning for Multi-Agent Perception from Independent Private Sources
por: Li, Jinlong, et al.
Publicado: (2024)
por: Li, Jinlong, et al.
Publicado: (2024)
TurboReg: TurboClique for Robust and Efficient Point Cloud Registration
por: Yan, Shaocheng, et al.
Publicado: (2025)
por: Yan, Shaocheng, et al.
Publicado: (2025)
Multi-Expert Adaptive Selection: Task-Balancing for All-in-One Image Restoration
por: Yu, Xiaoyan, et al.
Publicado: (2024)
por: Yu, Xiaoyan, et al.
Publicado: (2024)
From Seeing to Experiencing: Scaling Navigation Foundation Models with Reinforcement Learning
por: He, Honglin, et al.
Publicado: (2025)
por: He, Honglin, et al.
Publicado: (2025)
$\mathcal{B}^{3}$-Net: Controlled Posterior Bridge Learning for Multi-Task Dense Prediction
por: Zhou, Meihua, et al.
Publicado: (2026)
por: Zhou, Meihua, et al.
Publicado: (2026)
FlowTurbo: Towards Real-time Flow-Based Image Generation with Velocity Refiner
por: Zhao, Wenliang, et al.
Publicado: (2024)
por: Zhao, Wenliang, et al.
Publicado: (2024)
Path-GPTOmic: A Balanced Multi-modal Learning Framework for Survival Outcome Prediction
por: Wang, Hongxiao, et al.
Publicado: (2024)
por: Wang, Hongxiao, et al.
Publicado: (2024)
Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis
por: Ren, Jingjing, et al.
Publicado: (2025)
por: Ren, Jingjing, et al.
Publicado: (2025)
Enhancing Mamba Decoder with Bidirectional Interaction in Multi-Task Dense Prediction
por: Cao, Mang, et al.
Publicado: (2025)
por: Cao, Mang, et al.
Publicado: (2025)
S2R-ViT for Multi-Agent Cooperative Perception: Bridging the Gap from Simulation to Reality
por: Li, Jinlong, et al.
Publicado: (2023)
por: Li, Jinlong, et al.
Publicado: (2023)
Efficiently Disentangling CLIP for Multi-Object Perception
por: Rawlekar, Samyak, et al.
Publicado: (2025)
por: Rawlekar, Samyak, et al.
Publicado: (2025)
LiSD: An Efficient Multi-Task Learning Framework for LiDAR Segmentation and Detection
por: Xu, Jiahua, et al.
Publicado: (2024)
por: Xu, Jiahua, et al.
Publicado: (2024)
Co-MTP: A Cooperative Trajectory Prediction Framework with Multi-Temporal Fusion for Autonomous Driving
por: Zhang, Xinyu, et al.
Publicado: (2025)
por: Zhang, Xinyu, et al.
Publicado: (2025)
Multi-Task Learning for Robot Perception with Imbalanced Data
por: Erkent, Ozgur
Publicado: (2026)
por: Erkent, Ozgur
Publicado: (2026)
A Simple Framework Towards Vision-based Traffic Signal Control with Microscopic Simulation
por: He, Pan, et al.
Publicado: (2024)
por: He, Pan, et al.
Publicado: (2024)
GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents
por: V Team, et al.
Publicado: (2026)
por: V Team, et al.
Publicado: (2026)
Glass Segmentation with Multi Scales and Primary Prediction Guiding
por: Xu, Zhiyu, et al.
Publicado: (2024)
por: Xu, Zhiyu, et al.
Publicado: (2024)
Contrastive Imitation Learning for Language-guided Multi-Task Robotic Manipulation
por: Ma, Teli, et al.
Publicado: (2024)
por: Ma, Teli, et al.
Publicado: (2024)
Towards Balanced Multi-Modal Learning in 3D Human Pose Estimation
por: Qi, Mengshi, et al.
Publicado: (2025)
por: Qi, Mengshi, et al.
Publicado: (2025)
Ejemplares similares
-
AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning
por: Zhou, Zewei, et al.
Publicado: (2025) -
V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction
por: Zhou, Zewei, et al.
Publicado: (2024) -
RelMap: Enhancing Online Map Construction with Class-Aware Spatial Relation and Semantic Priors
por: Cai, Tianhui, et al.
Publicado: (2025) -
MDG: Masked Denoising Generation for Multi-Agent Behavior Modeling in Traffic Environments
por: Huang, Zhiyu, et al.
Publicado: (2025) -
QuantV2X: A Fully Quantized Multi-Agent System for Cooperative Perception
por: Zhao, Seth Z., et al.
Publicado: (2025)