STELLAR: Scaling 3D Perception Large Models for Autonomous Driving
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Yingwei, Huang, Xin, Liu, Yang, Fu, Yang, Zhu, Alex Zihao, Song, Chen, Yao, Junwen, Subramanian, Anant, Xiang, Hao, Shi, Weijing, Zou, Yuliang, Hoddes, Tom, Leng, Zhaoqi, Thattai, Govind, Anguelov, Dragomir, Tan, Mingxing |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Scene Reconstruction as Mapping Priors for 3D Detection
by: Fu, Yang, et al.
Published: (2026)
by: Fu, Yang, et al.
Published: (2026)
PVTransformer: Point-to-Voxel Transformer for Scalable 3D Object Detection
by: Leng, Zhaoqi, et al.
Published: (2024)
by: Leng, Zhaoqi, et al.
Published: (2024)
Drive&Gen: Co-Evaluating End-to-End Driving and Video Generation Models
by: Wang, Jiahao, et al.
Published: (2025)
by: Wang, Jiahao, et al.
Published: (2025)
SceneCrafter: Controllable Multi-View Driving Scene Editing
by: Zhu, Zehao, et al.
Published: (2025)
by: Zhu, Zehao, et al.
Published: (2025)
S4-Driver: Scalable Self-Supervised Driving Multimodal Large Language Modelwith Spatio-Temporal Visual Representation
by: Xie, Yichen, et al.
Published: (2025)
by: Xie, Yichen, et al.
Published: (2025)
EMMA: End-to-End Multimodal Model for Autonomous Driving
by: Hwang, Jyh-Jing, et al.
Published: (2024)
by: Hwang, Jyh-Jing, et al.
Published: (2024)
Enhanced Motion Forecasting with Plug-and-Play Multimodal Large Language Models
by: Luo, Katie, et al.
Published: (2025)
by: Luo, Katie, et al.
Published: (2025)
WOD-E2E: Waymo Open Dataset for End-to-End Driving in Challenging Long-tail Scenarios
by: Xu, Runsheng, et al.
Published: (2025)
by: Xu, Runsheng, et al.
Published: (2025)
Sensor2Sensor: Cross-Embodiment Sensor Conversion for Autonomous Driving
by: Wang, Jiahao, et al.
Published: (2026)
by: Wang, Jiahao, et al.
Published: (2026)
WOMD-LiDAR: Raw Sensor Dataset Benchmark for Motion Forecasting
by: Chen, Kan, et al.
Published: (2023)
by: Chen, Kan, et al.
Published: (2023)
SceneDiffuser++: City-Scale Traffic Simulation via a Generative World Model
by: Tan, Shuhan, et al.
Published: (2025)
by: Tan, Shuhan, et al.
Published: (2025)
DAIRHuM: A Platform for Directly Aligning AI Representations with Human Musical Judgments applied to Carnatic Music
by: Ravikumar, Prashanth Thattai
Published: (2024)
by: Ravikumar, Prashanth Thattai
Published: (2024)
SceneDiffuser: Efficient and Controllable Driving Simulation Initialization and Rollout
by: Jiang, Chiyu Max, et al.
Published: (2024)
by: Jiang, Chiyu Max, et al.
Published: (2024)
Scaling laws in wearable human activity recognition
by: Hoddes, Tom, et al.
Published: (2025)
by: Hoddes, Tom, et al.
Published: (2025)
State‐owned Enterprises and the Politics of Financializing Infrastructure Development in Indonesia: De‐risking at the Limit?
by: Dimitar Anguelov
Published: (2024)
by: Dimitar Anguelov
Published: (2024)
LET-3D-AP: Longitudinal Error Tolerant 3D Average Precision for Camera-Only 3D Detection
by: Hung, Wei-Chih, et al.
Published: (2022)
by: Hung, Wei-Chih, et al.
Published: (2022)
Stabilizing Information Flow Entropy: Regularization for Safe and Interpretable Autonomous Driving Perception
by: Yang, Haobo, et al.
Published: (2025)
by: Yang, Haobo, et al.
Published: (2025)
Perception-Guided Fuzzing for Simulated Scenario-Based Testing of Autonomous Driving Systems
by: Pham, Tri Minh Triet, et al.
Published: (2024)
by: Pham, Tri Minh Triet, et al.
Published: (2024)
DrivePI: Spatial-aware 4D MLLM for Unified Autonomous Driving Understanding, Perception, Prediction and Planning
by: Liu, Zhe, et al.
Published: (2025)
by: Liu, Zhe, et al.
Published: (2025)
Pre-Trained Vision Models as Perception Backbones for Safety Filters in Autonomous Driving
by: Yang, Yuxuan, et al.
Published: (2024)
by: Yang, Yuxuan, et al.
Published: (2024)
Collaborative Perception Datasets for Autonomous Driving: A Review
by: Wang, Naibang, et al.
Published: (2025)
by: Wang, Naibang, et al.
Published: (2025)
LeGo-Drive: Language-enhanced Goal-oriented Closed-Loop End-to-End Autonomous Driving
by: Paul, Pranjal, et al.
Published: (2024)
by: Paul, Pranjal, et al.
Published: (2024)
CurricuVLM: Towards Safe Autonomous Driving via Personalized Safety-Critical Curriculum Learning with Vision-Language Models
by: Sheng, Zihao, et al.
Published: (2025)
by: Sheng, Zihao, et al.
Published: (2025)
Grid-Centric Traffic Scenario Perception for Autonomous Driving: A Comprehensive Review
by: Shi, Yining, et al.
Published: (2023)
by: Shi, Yining, et al.
Published: (2023)
Conversational Code Generation: a Case Study of Designing a Dialogue System for Generating Driving Scenarios for Testing Autonomous Vehicles
by: Rubavicius, Rimvydas, et al.
Published: (2024)
by: Rubavicius, Rimvydas, et al.
Published: (2024)
Stationary states of aggregation-diffusion equations with compactly supported attraction kernels: radial symmetry and mass-independent boundedness
by: Anguelov, Roumen, et al.
Published: (2024)
by: Anguelov, Roumen, et al.
Published: (2024)
PriorFusion: Unified Integration of Priors for Robust Road Perception in Autonomous Driving
by: Tang, Xuewei, et al.
Published: (2025)
by: Tang, Xuewei, et al.
Published: (2025)
VLM-SAFE: Vision-Language Model-Guided Safety-Aware Reinforcement Learning with World Models for Autonomous Driving
by: Qu, Yansong, et al.
Published: (2025)
by: Qu, Yansong, et al.
Published: (2025)
TrajDiff: End-to-end Autonomous Driving without Perception Annotation
by: Gui, Xingtai, et al.
Published: (2025)
by: Gui, Xingtai, et al.
Published: (2025)
DyRoNet: Dynamic Routing and Low-Rank Adapters for Autonomous Driving Streaming Perception
by: Huang, Xiang, et al.
Published: (2024)
by: Huang, Xiang, et al.
Published: (2024)
VLDrive: Vision-Augmented Lightweight MLLMs for Efficient Language-grounded Autonomous Driving
by: Zhang, Ruifei, et al.
Published: (2025)
by: Zhang, Ruifei, et al.
Published: (2025)
From Static to Dynamic: a Survey of Topology-Aware Perception in Autonomous Driving
by: Chen, Yixiao, et al.
Published: (2025)
by: Chen, Yixiao, et al.
Published: (2025)
GUIDE: Gaussian Unified Instance Detection for Enhanced Obstacle Perception in Autonomous Driving
by: Hu, Chunyong, et al.
Published: (2025)
by: Hu, Chunyong, et al.
Published: (2025)
nuPlan-R: A Closed-Loop Planning Benchmark for Autonomous Driving via Reactive Multi-Agent Simulation
by: Peng, Mingxing, et al.
Published: (2025)
by: Peng, Mingxing, et al.
Published: (2025)
Vehicle-to-Everything Cooperative Perception for Autonomous Driving
by: Huang, Tao, et al.
Published: (2023)
by: Huang, Tao, et al.
Published: (2023)
Panoptic Perception for Autonomous Driving: A Survey
by: Li, Yunge, et al.
Published: (2024)
by: Li, Yunge, et al.
Published: (2024)
Efficient Visual Question Answering Pipeline for Autonomous Driving via Scene Region Compression
by: Cai, Yuliang, et al.
Published: (2026)
by: Cai, Yuliang, et al.
Published: (2026)
V2X-UniPool: Unifying Multimodal Perception and Knowledge Reasoning for Autonomous Driving
by: Luo, Xuewen, et al.
Published: (2025)
by: Luo, Xuewen, et al.
Published: (2025)
STT: Stateful Tracking with Transformers for Autonomous Driving
by: Jing, Longlong, et al.
Published: (2024)
by: Jing, Longlong, et al.
Published: (2024)
Perception in Plan: Coupled Perception and Planning for End-to-End Autonomous Driving
by: Zhang, Bozhou, et al.
Published: (2025)
by: Zhang, Bozhou, et al.
Published: (2025)
Similar Items
-
Scene Reconstruction as Mapping Priors for 3D Detection
by: Fu, Yang, et al.
Published: (2026) -
PVTransformer: Point-to-Voxel Transformer for Scalable 3D Object Detection
by: Leng, Zhaoqi, et al.
Published: (2024) -
Drive&Gen: Co-Evaluating End-to-End Driving and Video Generation Models
by: Wang, Jiahao, et al.
Published: (2025) -
SceneCrafter: Controllable Multi-View Driving Scene Editing
by: Zhu, Zehao, et al.
Published: (2025) -
S4-Driver: Scalable Self-Supervised Driving Multimodal Large Language Modelwith Spatio-Temporal Visual Representation
by: Xie, Yichen, et al.
Published: (2025)