World knowledge-enhanced Reasoning Using Instruction-guided Interactor in Autonomous Driving
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhai, Mingliang, Li, Cheng, Guo, Zengyuan, Yang, Ningrui, Qin, Xiameng, Zhao, Sanyuan, Han, Junyu, Tao, Ji, Wu, Yuwei, Jia, Yunde |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Memory-Centric Embodied Question Answering
par: Zhai, Mingliang, et autres
Publié: (2025)
par: Zhai, Mingliang, et autres
Publié: (2025)
TextFormer: A Query-based End-to-End Text Spotter with Mixed Supervision
par: Zhai, Yukun, et autres
Publié: (2023)
par: Zhai, Yukun, et autres
Publié: (2023)
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention
par: Lu, Hannan, et autres
Publié: (2024)
par: Lu, Hannan, et autres
Publié: (2024)
Multi-Step Reasoning for Embodied Question Answering via Tool Augmentation
par: Zhai, Mingliang, et autres
Publié: (2025)
par: Zhai, Mingliang, et autres
Publié: (2025)
Temporally Consistent Stereo Matching
par: Zeng, Jiaxi, et autres
Publié: (2024)
par: Zeng, Jiaxi, et autres
Publié: (2024)
Collaborative Position Reasoning Network for Referring Image Segmentation
par: Cao, Jianjian, et autres
Publié: (2024)
par: Cao, Jianjian, et autres
Publié: (2024)
Large-Scale Riemannian Meta-Optimization via Subspace Adaptation
par: Yu, Peilin, et autres
Publié: (2025)
par: Yu, Peilin, et autres
Publié: (2025)
Residual Hyperbolic Graph Convolution Networks
par: Xue, Yangkai, et autres
Publié: (2024)
par: Xue, Yangkai, et autres
Publié: (2024)
Curvature Learning for Generalization of Hyperbolic Neural Networks
par: Fan, Xiaomeng, et autres
Publié: (2025)
par: Fan, Xiaomeng, et autres
Publié: (2025)
Multi-Label Stereo Matching for Transparent Scene Depth Estimation
par: Liu, Zhidan, et autres
Publié: (2025)
par: Liu, Zhidan, et autres
Publié: (2025)
Multi-Sourced Compositional Generalization in Visual Question Answering
par: Li, Chuanhao, et autres
Publié: (2025)
par: Li, Chuanhao, et autres
Publié: (2025)
Open 3D World in Autonomous Driving
par: Cheng, Xinlong, et autres
Publié: (2024)
par: Cheng, Xinlong, et autres
Publié: (2024)
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
par: Hu, Xiaotao, et autres
Publié: (2024)
par: Hu, Xiaotao, et autres
Publié: (2024)
MIRROR: Multimodal Iterative Reasoning via Reflection on Visual Regions
par: Zhang, Haoyu, et autres
Publié: (2026)
par: Zhang, Haoyu, et autres
Publié: (2026)
Reason2Drive: Towards Interpretable and Chain-based Reasoning for Autonomous Driving
par: Nie, Ming, et autres
Publié: (2023)
par: Nie, Ming, et autres
Publié: (2023)
Diving into the Fusion of Monocular Priors for Generalized Stereo Matching
par: Yao, Chengtang, et autres
Publié: (2025)
par: Yao, Chengtang, et autres
Publié: (2025)
Hyperbolic Dual Feature Augmentation for Open-Environment
par: Yu, Peilin, et autres
Publié: (2025)
par: Yu, Peilin, et autres
Publié: (2025)
Composition-Incremental Learning for Compositional Generalization
par: Li, Zhen, et autres
Publié: (2025)
par: Li, Zhen, et autres
Publié: (2025)
Adaptive Model Ensemble for Continual Learning
par: Mao, Yuchuan, et autres
Publié: (2025)
par: Mao, Yuchuan, et autres
Publié: (2025)
Beyond the Seen: Bounded Distribution Estimation for Open-Vocabulary Learning
par: Fan, Xiaomeng, et autres
Publié: (2025)
par: Fan, Xiaomeng, et autres
Publié: (2025)
3D Visual Illusion Depth Estimation
par: Yao, Chengtang, et autres
Publié: (2025)
par: Yao, Chengtang, et autres
Publié: (2025)
Fine-Grained 3D Facial Reconstruction for Micro-Expressions
par: Sun, Che, et autres
Publié: (2026)
par: Sun, Che, et autres
Publié: (2026)
Quantum repeaters enhanced by vacuum beam guides
par: Gan, Yu, et autres
Publié: (2025)
par: Gan, Yu, et autres
Publié: (2025)
World Models for Autonomous Driving: An Initial Survey
par: Guan, Yanchen, et autres
Publié: (2024)
par: Guan, Yanchen, et autres
Publié: (2024)
StageInteractor: Query-based Object Detector with Cross-stage Interaction
par: Teng, Yao, et autres
Publié: (2023)
par: Teng, Yao, et autres
Publié: (2023)
DynVLA: Learning World Dynamics for Action Reasoning in Autonomous Driving
par: Shang, Shuyao, et autres
Publié: (2026)
par: Shang, Shuyao, et autres
Publié: (2026)
AdaptMMBench: Benchmarking Adaptive Multimodal Reasoning for Mode Selection and Reasoning Process
par: Zhang, Xintong, et autres
Publié: (2026)
par: Zhang, Xintong, et autres
Publié: (2026)
Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs
par: Zhang, Xintong, et autres
Publié: (2025)
par: Zhang, Xintong, et autres
Publié: (2025)
DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving
par: jia, Feiyang, et autres
Publié: (2026)
par: jia, Feiyang, et autres
Publié: (2026)
DreamerAD: Efficient Reinforcement Learning via Latent World Model for Autonomous Driving
par: Yang, Pengxuan, et autres
Publié: (2026)
par: Yang, Pengxuan, et autres
Publié: (2026)
NaviDriveVLM: Decoupling High-Level Reasoning and Motion Planning for Autonomous Driving
par: Tao, Ximeng, et autres
Publié: (2026)
par: Tao, Ximeng, et autres
Publié: (2026)
Synthesis of isobutyl cinnamate based on DESs catalyst: Optimization and kinetics
par: Jumei Xu, et autres
Publié: (2024)
par: Jumei Xu, et autres
Publié: (2024)
Progressive enhancement and restoration for mural images under low-light and defected conditions based on multi-receptive field strategy
par: Wei, Xiameng, et autres
Publié: (2024)
par: Wei, Xiameng, et autres
Publié: (2024)
DriveCombo: Benchmarking Compositional Traffic Rule Reasoning in Autonomous Driving
par: Ma, Enhui, et autres
Publié: (2026)
par: Ma, Enhui, et autres
Publié: (2026)
ReSim: Reliable World Simulation for Autonomous Driving
par: Yang, Jiazhi, et autres
Publié: (2025)
par: Yang, Jiazhi, et autres
Publié: (2025)
Magnetic field‐guided hollow mesoporous magnetite nanoparticles for enhanced sonodynamic therapy
par: Bin Li, et autres
Publié: (2025)
par: Bin Li, et autres
Publié: (2025)
Consistency of Compositional Generalization across Multiple Levels
par: Li, Chuanhao, et autres
Publié: (2024)
par: Li, Chuanhao, et autres
Publié: (2024)
LongSplat: Online Generalizable 3D Gaussian Splatting from Long Sequence Images
par: Huang, Guichen, et autres
Publié: (2025)
par: Huang, Guichen, et autres
Publié: (2025)
Modality Alignment across Trees on Heterogeneous Hyperbolic Manifolds
par: Wu, Wei, et autres
Publié: (2025)
par: Wu, Wei, et autres
Publié: (2025)
Morphology-Independent Facial Expression Imitation for Human-Face Robots
par: Chen, Xu, et autres
Publié: (2026)
par: Chen, Xu, et autres
Publié: (2026)
Documents similaires
-
Memory-Centric Embodied Question Answering
par: Zhai, Mingliang, et autres
Publié: (2025) -
TextFormer: A Query-based End-to-End Text Spotter with Mixed Supervision
par: Zhai, Yukun, et autres
Publié: (2023) -
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention
par: Lu, Hannan, et autres
Publié: (2024) -
Multi-Step Reasoning for Embodied Question Answering via Tool Augmentation
par: Zhai, Mingliang, et autres
Publié: (2025) -
Temporally Consistent Stereo Matching
par: Zeng, Jiaxi, et autres
Publié: (2024)