Translating Images to Road Network: A Sequence-to-Sequence Perspective
Fuente:
arXiv
Salvato in:
| Autori principali: | Lu, Jiachen, Nie, Ming, Zhang, Bozhou, Peng, Reyuan, Cai, Xinyue, Xu, Hang, Wen, Feng, Zhang, Wei, Zhang, Li |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LaneGraph2Seq: Lane Topology Extraction with Language Model via Vertex-Edge Encoding and Connectivity Enhancement
di: Peng, Renyuan, et al.
Pubblicazione: (2024)
di: Peng, Renyuan, et al.
Pubblicazione: (2024)
LaneCorrect: Self-supervised Lane Detection
di: Nie, Ming, et al.
Pubblicazione: (2024)
di: Nie, Ming, et al.
Pubblicazione: (2024)
Deep Non-rigid Structure-from-Motion: A Sequence-to-Sequence Translation Perspective
di: Deng, Hui, et al.
Pubblicazione: (2022)
di: Deng, Hui, et al.
Pubblicazione: (2022)
Reason2Drive: Towards Interpretable and Chain-based Reasoning for Autonomous Driving
di: Nie, Ming, et al.
Pubblicazione: (2023)
di: Nie, Ming, et al.
Pubblicazione: (2023)
Text-Promptable Propagation for Referring Medical Image Sequence Segmentation
di: Yuan, Runtian, et al.
Pubblicazione: (2025)
di: Yuan, Runtian, et al.
Pubblicazione: (2025)
ID-Align: RoPE-Conscious Position Remapping for Dynamic High-Resolution Adaptation in Vision-Language Models
di: Li, Bozhou, et al.
Pubblicazione: (2025)
di: Li, Bozhou, et al.
Pubblicazione: (2025)
DeMo: Decoupling Motion Forecasting into Directional Intentions and Dynamic States
di: Zhang, Bozhou, et al.
Pubblicazione: (2024)
di: Zhang, Bozhou, et al.
Pubblicazione: (2024)
KFFocus: Highlighting Keyframes for Enhanced Video Understanding
di: Nie, Ming, et al.
Pubblicazione: (2025)
di: Nie, Ming, et al.
Pubblicazione: (2025)
USF-Net: A Unified Spatiotemporal Fusion Network for Ground-Based Remote Sensing Cloud Image Sequence Extrapolation
di: Niu, Penghui, et al.
Pubblicazione: (2025)
di: Niu, Penghui, et al.
Pubblicazione: (2025)
Insertion Network for Image Sequence Correspondence
di: Su, Dingjie, et al.
Pubblicazione: (2026)
di: Su, Dingjie, et al.
Pubblicazione: (2026)
Perception in Plan: Coupled Perception and Planning for End-to-End Autonomous Driving
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
ColorFlow: Retrieval-Augmented Image Sequence Colorization
di: Zhuang, Junhao, et al.
Pubblicazione: (2024)
di: Zhuang, Junhao, et al.
Pubblicazione: (2024)
Dual-frequency Selected Knowledge Distillation with Statistical-based Sample Rectification for PolSAR Image Classification
di: Xin, Xinyue, et al.
Pubblicazione: (2025)
di: Xin, Xinyue, et al.
Pubblicazione: (2025)
DeMo++: Motion Decoupling for Autonomous Driving
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
Motion Forecasting in Continuous Driving
di: Song, Nan, et al.
Pubblicazione: (2024)
di: Song, Nan, et al.
Pubblicazione: (2024)
Unified Sequence-to-Sequence Learning for Single- and Multi-Modal Visual Object Tracking
di: Chen, Xin, et al.
Pubblicazione: (2023)
di: Chen, Xin, et al.
Pubblicazione: (2023)
Uncertainty-Aware Normal-Guided Gaussian Splatting for Surface Reconstruction from Sparse Image Sequences
di: Tan, Zhen, et al.
Pubblicazione: (2025)
di: Tan, Zhen, et al.
Pubblicazione: (2025)
MedSG-Bench: A Benchmark for Medical Image Sequences Grounding
di: Yue, Jingkun, et al.
Pubblicazione: (2025)
di: Yue, Jingkun, et al.
Pubblicazione: (2025)
PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking
di: Zou, Quanchen, et al.
Pubblicazione: (2025)
di: Zou, Quanchen, et al.
Pubblicazione: (2025)
Towards Unified Multimodal Interleaved Generation via Group Relative Policy Optimization
di: Nie, Ming, et al.
Pubblicazione: (2026)
di: Nie, Ming, et al.
Pubblicazione: (2026)
Relative Position Matters: Trajectory Prediction and Planning with Polar Representation
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
Bridging Past and Future: End-to-End Autonomous Driving with Historical Prediction and Planning
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
Learning Sequence Descriptor based on Spatio-Temporal Attention for Visual Place Recognition
di: Zhao, Junqiao, et al.
Pubblicazione: (2023)
di: Zhao, Junqiao, et al.
Pubblicazione: (2023)
Sequence Length Scaling in Vision Transformers for Scientific Images on Frontier
di: Tsaris, Aristeidis, et al.
Pubblicazione: (2024)
di: Tsaris, Aristeidis, et al.
Pubblicazione: (2024)
Autoregressive Sequence Modeling for 3D Medical Image Representation
di: Wang, Siwen, et al.
Pubblicazione: (2024)
di: Wang, Siwen, et al.
Pubblicazione: (2024)
Unsupervised Online 3D Instance Segmentation with Synthetic Sequences and Dynamic Loss
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
LMAD: Integrated End-to-End Vision-Language Model for Explainable Autonomous Driving
di: Song, Nan, et al.
Pubblicazione: (2025)
di: Song, Nan, et al.
Pubblicazione: (2025)
Personalized Image Descriptions from Attention Sequences
di: Xue, Ruoyu, et al.
Pubblicazione: (2025)
di: Xue, Ruoyu, et al.
Pubblicazione: (2025)
Mode-as-Sequence: Translating Multimodal Motion Prediction into Unified Sequential Mode Modeling
di: Zhou, Zikang, et al.
Pubblicazione: (2026)
di: Zhou, Zikang, et al.
Pubblicazione: (2026)
Bridging the Gap between Text, Audio, Image, and Any Sequence: A Novel Approach using Gloss-based Annotation
di: Fang, Sen, et al.
Pubblicazione: (2024)
di: Fang, Sen, et al.
Pubblicazione: (2024)
OptiCorNet: Optimizing Sequence-Based Context Correlation for Visual Place Recognition
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
ImagiDrive: A Unified Imagination-and-Planning Framework for Autonomous Driving
di: Li, Jingyu, et al.
Pubblicazione: (2025)
di: Li, Jingyu, et al.
Pubblicazione: (2025)
Future-Aware End-to-End Driving: Bidirectional Modeling of Trajectory Planning and Scene Evolution
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
di: Zhang, Bozhou, et al.
Pubblicazione: (2025)
LiSTAR: Ray-Centric World Models for 4D LiDAR Sequences in Autonomous Driving
di: Liu, Pei, et al.
Pubblicazione: (2025)
di: Liu, Pei, et al.
Pubblicazione: (2025)
Skywork UniPic 3.0: Unified Multi-Image Composition via Sequence Modeling
di: Wei, Hongyang, et al.
Pubblicazione: (2026)
di: Wei, Hongyang, et al.
Pubblicazione: (2026)
MovieDreamer: Hierarchical Generation for Coherent Long Visual Sequence
di: Zhao, Canyu, et al.
Pubblicazione: (2024)
di: Zhao, Canyu, et al.
Pubblicazione: (2024)
KeyGS: A Keyframe-Centric Gaussian Splatting Method for Monocular Image Sequences
di: Chang, Keng-Wei, et al.
Pubblicazione: (2024)
di: Chang, Keng-Wei, et al.
Pubblicazione: (2024)
Asynchronous Multimodal Video Sequence Fusion via Learning Modality-Exclusive and -Agnostic Representations
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
Drawing2CAD: Sequence-to-Sequence Learning for CAD Generation from Vector Drawings
di: Qin, Feiwei, et al.
Pubblicazione: (2025)
di: Qin, Feiwei, et al.
Pubblicazione: (2025)
See Tomorrow, Act Today: Foresight-Driven Autonomous Driving
di: Zhang, Bozhou, et al.
Pubblicazione: (2026)
di: Zhang, Bozhou, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LaneGraph2Seq: Lane Topology Extraction with Language Model via Vertex-Edge Encoding and Connectivity Enhancement
di: Peng, Renyuan, et al.
Pubblicazione: (2024) -
LaneCorrect: Self-supervised Lane Detection
di: Nie, Ming, et al.
Pubblicazione: (2024) -
Deep Non-rigid Structure-from-Motion: A Sequence-to-Sequence Translation Perspective
di: Deng, Hui, et al.
Pubblicazione: (2022) -
Reason2Drive: Towards Interpretable and Chain-based Reasoning for Autonomous Driving
di: Nie, Ming, et al.
Pubblicazione: (2023) -
Text-Promptable Propagation for Referring Medical Image Sequence Segmentation
di: Yuan, Runtian, et al.
Pubblicazione: (2025)