World knowledge-enhanced Reasoning Using Instruction-guided Interactor in Autonomous Driving
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhai, Mingliang, Li, Cheng, Guo, Zengyuan, Yang, Ningrui, Qin, Xiameng, Zhao, Sanyuan, Han, Junyu, Tao, Ji, Wu, Yuwei, Jia, Yunde |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Memory-Centric Embodied Question Answering
por: Zhai, Mingliang, et al.
Publicado: (2025)
por: Zhai, Mingliang, et al.
Publicado: (2025)
TextFormer: A Query-based End-to-End Text Spotter with Mixed Supervision
por: Zhai, Yukun, et al.
Publicado: (2023)
por: Zhai, Yukun, et al.
Publicado: (2023)
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention
por: Lu, Hannan, et al.
Publicado: (2024)
por: Lu, Hannan, et al.
Publicado: (2024)
Multi-Step Reasoning for Embodied Question Answering via Tool Augmentation
por: Zhai, Mingliang, et al.
Publicado: (2025)
por: Zhai, Mingliang, et al.
Publicado: (2025)
Temporally Consistent Stereo Matching
por: Zeng, Jiaxi, et al.
Publicado: (2024)
por: Zeng, Jiaxi, et al.
Publicado: (2024)
Collaborative Position Reasoning Network for Referring Image Segmentation
por: Cao, Jianjian, et al.
Publicado: (2024)
por: Cao, Jianjian, et al.
Publicado: (2024)
Large-Scale Riemannian Meta-Optimization via Subspace Adaptation
por: Yu, Peilin, et al.
Publicado: (2025)
por: Yu, Peilin, et al.
Publicado: (2025)
Residual Hyperbolic Graph Convolution Networks
por: Xue, Yangkai, et al.
Publicado: (2024)
por: Xue, Yangkai, et al.
Publicado: (2024)
Curvature Learning for Generalization of Hyperbolic Neural Networks
por: Fan, Xiaomeng, et al.
Publicado: (2025)
por: Fan, Xiaomeng, et al.
Publicado: (2025)
Multi-Label Stereo Matching for Transparent Scene Depth Estimation
por: Liu, Zhidan, et al.
Publicado: (2025)
por: Liu, Zhidan, et al.
Publicado: (2025)
Multi-Sourced Compositional Generalization in Visual Question Answering
por: Li, Chuanhao, et al.
Publicado: (2025)
por: Li, Chuanhao, et al.
Publicado: (2025)
Open 3D World in Autonomous Driving
por: Cheng, Xinlong, et al.
Publicado: (2024)
por: Cheng, Xinlong, et al.
Publicado: (2024)
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
por: Hu, Xiaotao, et al.
Publicado: (2024)
por: Hu, Xiaotao, et al.
Publicado: (2024)
MIRROR: Multimodal Iterative Reasoning via Reflection on Visual Regions
por: Zhang, Haoyu, et al.
Publicado: (2026)
por: Zhang, Haoyu, et al.
Publicado: (2026)
Reason2Drive: Towards Interpretable and Chain-based Reasoning for Autonomous Driving
por: Nie, Ming, et al.
Publicado: (2023)
por: Nie, Ming, et al.
Publicado: (2023)
Diving into the Fusion of Monocular Priors for Generalized Stereo Matching
por: Yao, Chengtang, et al.
Publicado: (2025)
por: Yao, Chengtang, et al.
Publicado: (2025)
Hyperbolic Dual Feature Augmentation for Open-Environment
por: Yu, Peilin, et al.
Publicado: (2025)
por: Yu, Peilin, et al.
Publicado: (2025)
Composition-Incremental Learning for Compositional Generalization
por: Li, Zhen, et al.
Publicado: (2025)
por: Li, Zhen, et al.
Publicado: (2025)
Adaptive Model Ensemble for Continual Learning
por: Mao, Yuchuan, et al.
Publicado: (2025)
por: Mao, Yuchuan, et al.
Publicado: (2025)
Beyond the Seen: Bounded Distribution Estimation for Open-Vocabulary Learning
por: Fan, Xiaomeng, et al.
Publicado: (2025)
por: Fan, Xiaomeng, et al.
Publicado: (2025)
3D Visual Illusion Depth Estimation
por: Yao, Chengtang, et al.
Publicado: (2025)
por: Yao, Chengtang, et al.
Publicado: (2025)
Fine-Grained 3D Facial Reconstruction for Micro-Expressions
por: Sun, Che, et al.
Publicado: (2026)
por: Sun, Che, et al.
Publicado: (2026)
Quantum repeaters enhanced by vacuum beam guides
por: Gan, Yu, et al.
Publicado: (2025)
por: Gan, Yu, et al.
Publicado: (2025)
World Models for Autonomous Driving: An Initial Survey
por: Guan, Yanchen, et al.
Publicado: (2024)
por: Guan, Yanchen, et al.
Publicado: (2024)
StageInteractor: Query-based Object Detector with Cross-stage Interaction
por: Teng, Yao, et al.
Publicado: (2023)
por: Teng, Yao, et al.
Publicado: (2023)
DynVLA: Learning World Dynamics for Action Reasoning in Autonomous Driving
por: Shang, Shuyao, et al.
Publicado: (2026)
por: Shang, Shuyao, et al.
Publicado: (2026)
AdaptMMBench: Benchmarking Adaptive Multimodal Reasoning for Mode Selection and Reasoning Process
por: Zhang, Xintong, et al.
Publicado: (2026)
por: Zhang, Xintong, et al.
Publicado: (2026)
Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs
por: Zhang, Xintong, et al.
Publicado: (2025)
por: Zhang, Xintong, et al.
Publicado: (2025)
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
por: jia, Feiyang, et al.
Publicado: (2026)
por: jia, Feiyang, et al.
Publicado: (2026)
DreamerAD: Efficient Reinforcement Learning via Latent World Model for Autonomous Driving
por: Yang, Pengxuan, et al.
Publicado: (2026)
por: Yang, Pengxuan, et al.
Publicado: (2026)
NaviDriveVLM: Decoupling High-Level Reasoning and Motion Planning for Autonomous Driving
por: Tao, Ximeng, et al.
Publicado: (2026)
por: Tao, Ximeng, et al.
Publicado: (2026)
Synthesis of isobutyl cinnamate based on DESs catalyst: Optimization and kinetics
por: Jumei Xu, et al.
Publicado: (2024)
por: Jumei Xu, et al.
Publicado: (2024)
Progressive enhancement and restoration for mural images under low-light and defected conditions based on multi-receptive field strategy
por: Wei, Xiameng, et al.
Publicado: (2024)
por: Wei, Xiameng, et al.
Publicado: (2024)
DriveCombo: Benchmarking Compositional Traffic Rule Reasoning in Autonomous Driving
por: Ma, Enhui, et al.
Publicado: (2026)
por: Ma, Enhui, et al.
Publicado: (2026)
ReSim: Reliable World Simulation for Autonomous Driving
por: Yang, Jiazhi, et al.
Publicado: (2025)
por: Yang, Jiazhi, et al.
Publicado: (2025)
Magnetic field‐guided hollow mesoporous magnetite nanoparticles for enhanced sonodynamic therapy
por: Bin Li, et al.
Publicado: (2025)
por: Bin Li, et al.
Publicado: (2025)
Consistency of Compositional Generalization across Multiple Levels
por: Li, Chuanhao, et al.
Publicado: (2024)
por: Li, Chuanhao, et al.
Publicado: (2024)
LongSplat: Online Generalizable 3D Gaussian Splatting from Long Sequence Images
por: Huang, Guichen, et al.
Publicado: (2025)
por: Huang, Guichen, et al.
Publicado: (2025)
Modality Alignment across Trees on Heterogeneous Hyperbolic Manifolds
por: Wu, Wei, et al.
Publicado: (2025)
por: Wu, Wei, et al.
Publicado: (2025)
Morphology-Independent Facial Expression Imitation for Human-Face Robots
por: Chen, Xu, et al.
Publicado: (2026)
por: Chen, Xu, et al.
Publicado: (2026)
Ejemplares similares
-
Memory-Centric Embodied Question Answering
por: Zhai, Mingliang, et al.
Publicado: (2025) -
TextFormer: A Query-based End-to-End Text Spotter with Mixed Supervision
por: Zhai, Yukun, et al.
Publicado: (2023) -
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention
por: Lu, Hannan, et al.
Publicado: (2024) -
Multi-Step Reasoning for Embodied Question Answering via Tool Augmentation
por: Zhai, Mingliang, et al.
Publicado: (2025) -
Temporally Consistent Stereo Matching
por: Zeng, Jiaxi, et al.
Publicado: (2024)