Behavior-Grounded Lane Representation Learning for Multi-Task Traffic Digital Twins
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tamaru, Rei, Li, Pei, Ran, Bin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Geo-ORBIT: A Federated Digital Twin Framework for Scene-Adaptive Lane Geometry Detection
par: Tamaru, Rei, et autres
Publié: (2025)
par: Tamaru, Rei, et autres
Publié: (2025)
Enhancing Pedestrian Trajectory Prediction with Crowd Trip Information
par: Tamaru, Rei, et autres
Publié: (2024)
par: Tamaru, Rei, et autres
Publié: (2024)
Fine-Grained Representation for Lane Topology Reasoning
par: Xu, Guoqing, et autres
Publié: (2025)
par: Xu, Guoqing, et autres
Publié: (2025)
Decoupling the Image Perception and Multimodal Reasoning for Reasoning Segmentation with Digital Twin Representations
par: Li, Yizhen, et autres
Publié: (2025)
par: Li, Yizhen, et autres
Publié: (2025)
Progressive Language-guided Visual Learning for Multi-Task Visual Grounding
par: Wang, Jingchao, et autres
Publié: (2025)
par: Wang, Jingchao, et autres
Publié: (2025)
Fine-Grained Traffic Inference from Road to Lane via Spatio-Temporal Graph Node Generation
par: Li, Shuhao, et autres
Publié: (2025)
par: Li, Shuhao, et autres
Publié: (2025)
CrashSight: A Phase-Aware, Infrastructure-Centric Video Benchmark for Traffic Crash Scene Understanding and Reasoning
par: Gan, Rui, et autres
Publié: (2026)
par: Gan, Rui, et autres
Publié: (2026)
TwinMixing: A Shuffle-Aware Feature Interaction Model for Multi-Task Segmentation
par: Do, Minh-Khoi, et autres
Publié: (2026)
par: Do, Minh-Khoi, et autres
Publié: (2026)
Neural Implicit Representation for Building Digital Twins of Unknown Articulated Objects
par: Weng, Yijia, et autres
Publié: (2024)
par: Weng, Yijia, et autres
Publié: (2024)
Image-based Deep Learning for Smart Digital Twins: a Review
par: Islam, Md Ruman, et autres
Publié: (2024)
par: Islam, Md Ruman, et autres
Publié: (2024)
Automated Lane Change Behavior Prediction and Environmental Perception Based on SLAM Technology
par: Lei, Han, et autres
Publié: (2024)
par: Lei, Han, et autres
Publié: (2024)
Deep Extrinsic Manifold Representation for Vision Tasks
par: Zhang, Tongtong, et autres
Publié: (2024)
par: Zhang, Tongtong, et autres
Publié: (2024)
Representation Surgery for Multi-Task Model Merging
par: Yang, Enneng, et autres
Publié: (2024)
par: Yang, Enneng, et autres
Publié: (2024)
LaneDiffusion: Improving Centerline Graph Learning via Prior Injected BEV Feature Generation
par: Wang, Zijie, et autres
Publié: (2025)
par: Wang, Zijie, et autres
Publié: (2025)
A Comprehensive Survey on Surgical Digital Twin
par: Khan, Afsah Sharaf, et autres
Publié: (2025)
par: Khan, Afsah Sharaf, et autres
Publié: (2025)
Complementarity-driven Representation Learning for Multi-modal Knowledge Graph Completion
par: Li, Lijian
Publié: (2025)
par: Li, Lijian
Publié: (2025)
Decouple-Then-Merge: Finetune Diffusion Models as Multi-Task Learning
par: Ma, Qianli, et autres
Publié: (2024)
par: Ma, Qianli, et autres
Publié: (2024)
Digital Twin Catalog: A Large-Scale Photorealistic 3D Object Digital Twin Dataset
par: Dong, Zhao, et autres
Publié: (2025)
par: Dong, Zhao, et autres
Publié: (2025)
Adaptive Disentangled Representation Learning for Incomplete Multi-View Multi-Label Classification
par: Li, Quanjiang, et autres
Publié: (2026)
par: Li, Quanjiang, et autres
Publié: (2026)
Learning to Detect Multi-class Anomalies with Just One Normal Image Prompt
par: Gao, Bin-Bin
Publié: (2025)
par: Gao, Bin-Bin
Publié: (2025)
MMEarth: Exploring Multi-Modal Pretext Tasks For Geospatial Representation Learning
par: Nedungadi, Vishal, et autres
Publié: (2024)
par: Nedungadi, Vishal, et autres
Publié: (2024)
Multi-Point Positional Insertion Tuning for Small Object Detection
par: Goto, Kanoko, et autres
Publié: (2024)
par: Goto, Kanoko, et autres
Publié: (2024)
FileGram: Grounding Agent Personalization in File-System Behavioral Traces
par: Liu, Shuai, et autres
Publié: (2026)
par: Liu, Shuai, et autres
Publié: (2026)
Prompt When the Animal is: Temporal Animal Behavior Grounding with Positional Recovery Training
par: Yan, Sheng, et autres
Publié: (2024)
par: Yan, Sheng, et autres
Publié: (2024)
FENet: Focusing Enhanced Network for Lane Detection
par: Wang, Liman, et autres
Publié: (2023)
par: Wang, Liman, et autres
Publié: (2023)
TopoStreamer: Temporal Lane Segment Topology Reasoning in Autonomous Driving
par: Yang, Yiming, et autres
Publié: (2025)
par: Yang, Yiming, et autres
Publié: (2025)
ToG-Bench: Task-Oriented Spatio-Temporal Grounding in Egocentric Videos
par: Xu, Qi'ao, et autres
Publié: (2025)
par: Xu, Qi'ao, et autres
Publié: (2025)
Towards Visual-Prompt Temporal Answering Grounding in Medical Instructional Video
par: Li, Bin, et autres
Publié: (2022)
par: Li, Bin, et autres
Publié: (2022)
Empowering Bridge Digital Twins by Bridging the Data Gap with a Unified Synthesis Framework
par: Wang, Wang, et autres
Publié: (2025)
par: Wang, Wang, et autres
Publié: (2025)
Learning Emergent Modular Representations in Multi-modality Medical Vision Foundation Models
par: He, Yuting, et autres
Publié: (2026)
par: He, Yuting, et autres
Publié: (2026)
SafePLUG: Empowering Multimodal LLMs with Pixel-Level Insight and Temporal Grounding for Traffic Accident Understanding
par: Sheng, Zihao, et autres
Publié: (2025)
par: Sheng, Zihao, et autres
Publié: (2025)
Fine-Grained Urban Flow Inference with Multi-scale Representation Learning
par: Yuan, Shilu, et autres
Publié: (2024)
par: Yuan, Shilu, et autres
Publié: (2024)
Multi-modal Relation Distillation for Unified 3D Representation Learning
par: Wang, Huiqun, et autres
Publié: (2024)
par: Wang, Huiqun, et autres
Publié: (2024)
TaskGround: Structured Executable Task Inference for Full-Scene Household Reasoning
par: Feng, ZhiYuan, et autres
Publié: (2026)
par: Feng, ZhiYuan, et autres
Publié: (2026)
Spatial Blindness in Whole-Slide Multiple Instance Learning
par: Li, Xiangyu, et autres
Publié: (2026)
par: Li, Xiangyu, et autres
Publié: (2026)
TaskGalaxy: Scaling Multi-modal Instruction Fine-tuning with Tens of Thousands Vision Task Types
par: Chen, Jiankang, et autres
Publié: (2025)
par: Chen, Jiankang, et autres
Publié: (2025)
DEEGITS: Deep Learning based Framework for Measuring Heterogenous Traffic State in Challenging Traffic Scenarios
par: Islam, Muttahirul, et autres
Publié: (2024)
par: Islam, Muttahirul, et autres
Publié: (2024)
TimeScope: Towards Task-Oriented Temporal Grounding In Long Videos
par: Liu, Xiangrui, et autres
Publié: (2025)
par: Liu, Xiangrui, et autres
Publié: (2025)
GRASP: Learning to Ground Social Reasoning in Multi-Person Non-Verbal Interactions
par: Kim, Junho, et autres
Publié: (2026)
par: Kim, Junho, et autres
Publié: (2026)
Progressive Homeostatic and Plastic Prompt Tuning for Audio-Visual Multi-Task Incremental Learning
par: Yin, Jiong, et autres
Publié: (2025)
par: Yin, Jiong, et autres
Publié: (2025)
Documents similaires
-
Geo-ORBIT: A Federated Digital Twin Framework for Scene-Adaptive Lane Geometry Detection
par: Tamaru, Rei, et autres
Publié: (2025) -
Enhancing Pedestrian Trajectory Prediction with Crowd Trip Information
par: Tamaru, Rei, et autres
Publié: (2024) -
Fine-Grained Representation for Lane Topology Reasoning
par: Xu, Guoqing, et autres
Publié: (2025) -
Decoupling the Image Perception and Multimodal Reasoning for Reasoning Segmentation with Digital Twin Representations
par: Li, Yizhen, et autres
Publié: (2025) -
Progressive Language-guided Visual Learning for Multi-Task Visual Grounding
par: Wang, Jingchao, et autres
Publié: (2025)