Seeing Clearly, Forgetting Deeply: Revisiting Fine-Tuned Video Generators for Driving Simulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chang, Chun-Peng, Wang, Chen-Yu, Schmidt, Julian, Caesar, Holger, Pagani, Alain |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Probing the Reliability of Driving VLMs: From Inconsistent Responses to Grounded Temporal Reasoning
par: Chang, Chun-Peng, et autres
Publié: (2026)
par: Chang, Chun-Peng, et autres
Publié: (2026)
Invaria: Learning Scale and Density Invariance in Point Clouds via Next-Resolution Prediction
par: Chang, Chun-Peng, et autres
Publié: (2026)
par: Chang, Chun-Peng, et autres
Publié: (2026)
3D Spatial Understanding in MLLMs: Disambiguation and Evaluation
par: Chang, Chun-Peng, et autres
Publié: (2024)
par: Chang, Chun-Peng, et autres
Publié: (2024)
nuScenes Revisited: Progress and Challenges in Autonomous Driving
par: Fong, Whye Kit, et autres
Publié: (2025)
par: Fong, Whye Kit, et autres
Publié: (2025)
Seeing Clearly and Deeply: An RGBD Imaging Approach with a Bio-inspired Monocentric Design
par: Yu, Zongxi, et autres
Publié: (2025)
par: Yu, Zongxi, et autres
Publié: (2025)
MiKASA: Multi-Key-Anchor & Scene-Aware Transformer for 3D Visual Grounding
par: Chang, Chun-Peng, et autres
Publié: (2024)
par: Chang, Chun-Peng, et autres
Publié: (2024)
Seeing the Scene Matters: Revealing Forgetting in Video Understanding Models with a Scene-Aware Long-Video Benchmark
par: Chen, Seng Nam, et autres
Publié: (2026)
par: Chen, Seng Nam, et autres
Publié: (2026)
VLPrompt: Vision-Language Prompting for Panoptic Scene Graph Generation
par: Zhou, Zijian, et autres
Publié: (2023)
par: Zhou, Zijian, et autres
Publié: (2023)
ICP-Flow: LiDAR Scene Flow Estimation with ICP
par: Lin, Yancong, et autres
Publié: (2024)
par: Lin, Yancong, et autres
Publié: (2024)
Offline Tracking with Object Permanence
par: Liu, Xianzhong, et autres
Publié: (2023)
par: Liu, Xianzhong, et autres
Publié: (2023)
4D-RaDiff: Latent Diffusion for 4D Radar Point Cloud Generation
par: Kwok, Jimmie, et autres
Publié: (2025)
par: Kwok, Jimmie, et autres
Publié: (2025)
SeeClear: Semantic Distillation Enhances Pixel Condensation for Video Super-Resolution
par: Tang, Qi, et autres
Publié: (2024)
par: Tang, Qi, et autres
Publié: (2024)
Overcoming Catastrophic Forgetting in Visual Continual Learning with Reinforcement Fine-Tuning
par: Lou, Meng, et autres
Publié: (2026)
par: Lou, Meng, et autres
Publié: (2026)
See Further When Clear: Curriculum Consistency Model
par: Liu, Yunpeng, et autres
Publié: (2024)
par: Liu, Yunpeng, et autres
Publié: (2024)
BikeScenes: Online LiDAR Semantic Segmentation for Bicycles
par: Goren, Denniz, et autres
Publié: (2025)
par: Goren, Denniz, et autres
Publié: (2025)
Uni-SLAM: Uncertainty-Aware Neural Implicit SLAM for Real-Time Dense Indoor Scene Reconstruction
par: Wang, Shaoxiang, et autres
Publié: (2024)
par: Wang, Shaoxiang, et autres
Publié: (2024)
SeeClear: Reliable Transparent Object Depth Estimation via Generative Opacification
par: Wang, Xiaoying, et autres
Publié: (2026)
par: Wang, Xiaoying, et autres
Publié: (2026)
Deeply Supervised Flow-Based Generative Models
par: Shin, Inkyu, et autres
Publié: (2025)
par: Shin, Inkyu, et autres
Publié: (2025)
Unveiling the Ignorance of MLLMs: Seeing Clearly, Answering Incorrectly
par: Liu, Yexin, et autres
Publié: (2024)
par: Liu, Yexin, et autres
Publié: (2024)
OpenPSG: Open-set Panoptic Scene Graph Generation via Large Multimodal Models
par: Zhou, Zijian, et autres
Publié: (2024)
par: Zhou, Zijian, et autres
Publié: (2024)
The Blind Spot of Adaptation: Quantifying and Mitigating Forgetting in Fine-tuned Driving Models
par: Mao, Runhao, et autres
Publié: (2026)
par: Mao, Runhao, et autres
Publié: (2026)
BaSAL: Size-Balanced Warm Start Active Learning for LiDAR Semantic Segmentation
par: Wei, Jiarong, et autres
Publié: (2023)
par: Wei, Jiarong, et autres
Publié: (2023)
DPFT: Dual Perspective Fusion Transformer for Camera-Radar-based Object Detection
par: Fent, Felix, et autres
Publié: (2024)
par: Fent, Felix, et autres
Publié: (2024)
4DRC-OCC: Robust Semantic Occupancy Prediction Through Fusion of 4D Radar and Camera
par: Ninfa, David, et autres
Publié: (2026)
par: Ninfa, David, et autres
Publié: (2026)
AsyncBEV: Cross-modal Flow Alignment in Asynchronous 3D Object Detection
par: Wang, Shiming, et autres
Publié: (2026)
par: Wang, Shiming, et autres
Publié: (2026)
Fine Tuning without Catastrophic Forgetting via Selective Low Rank Adaptation
par: Bafghi, Reza Akbarian, et autres
Publié: (2025)
par: Bafghi, Reza Akbarian, et autres
Publié: (2025)
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention
par: Lu, Hannan, et autres
Publié: (2024)
par: Lu, Hannan, et autres
Publié: (2024)
Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models
par: Zhang, Linghao, et autres
Publié: (2026)
par: Zhang, Linghao, et autres
Publié: (2026)
Bridging Clear and Adverse Driving Conditions
par: Shapiro, Yoel, et autres
Publié: (2025)
par: Shapiro, Yoel, et autres
Publié: (2025)
NeuroNCAP: Photorealistic Closed-loop Safety Testing for Autonomous Driving
par: Ljungbergh, William, et autres
Publié: (2024)
par: Ljungbergh, William, et autres
Publié: (2024)
Seeing Far and Clearly: Mitigating Hallucinations in MLLMs with Attention Causal Decoding
par: Tang, Feilong, et autres
Publié: (2025)
par: Tang, Feilong, et autres
Publié: (2025)
Sparse Fine-Tuning of Transformers for Generative Tasks
par: Chen, Wei, et autres
Publié: (2025)
par: Chen, Wei, et autres
Publié: (2025)
GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning
par: Bao, Xiaoyi, et autres
Publié: (2025)
par: Bao, Xiaoyi, et autres
Publié: (2025)
LeAP: Consistent multi-domain 3D labeling using Foundation Models
par: Gebraad, Simon, et autres
Publié: (2025)
par: Gebraad, Simon, et autres
Publié: (2025)
UniBEV: Multi-modal 3D Object Detection with Uniform BEV Encoders for Robustness against Missing Sensor Modalities
par: Wang, Shiming, et autres
Publié: (2023)
par: Wang, Shiming, et autres
Publié: (2023)
OpenViGA: Video Generation for Automotive Driving Scenes by Streamlining and Fine-Tuning Open Source Models with Public Data
par: Möller, Björn, et autres
Publié: (2025)
par: Möller, Björn, et autres
Publié: (2025)
Mixed Text Recognition with Efficient Parameter Fine-Tuning and Transformer
par: Chang, Da, et autres
Publié: (2024)
par: Chang, Da, et autres
Publié: (2024)
ForgetMe: Evaluating Selective Forgetting in Generative Models
par: Yu, Zhenyu, et autres
Publié: (2025)
par: Yu, Zhenyu, et autres
Publié: (2025)
RB-FT: Rationale-Bootstrapped Fine-Tuning for Video Classification
par: Xu, Meilong, et autres
Publié: (2025)
par: Xu, Meilong, et autres
Publié: (2025)
Seeing Clearly without Training: Mitigating Hallucinations in Multimodal LLMs for Remote Sensing
par: Liu, Yi, et autres
Publié: (2026)
par: Liu, Yi, et autres
Publié: (2026)
Documents similaires
-
Probing the Reliability of Driving VLMs: From Inconsistent Responses to Grounded Temporal Reasoning
par: Chang, Chun-Peng, et autres
Publié: (2026) -
Invaria: Learning Scale and Density Invariance in Point Clouds via Next-Resolution Prediction
par: Chang, Chun-Peng, et autres
Publié: (2026) -
3D Spatial Understanding in MLLMs: Disambiguation and Evaluation
par: Chang, Chun-Peng, et autres
Publié: (2024) -
nuScenes Revisited: Progress and Challenges in Autonomous Driving
par: Fong, Whye Kit, et autres
Publié: (2025) -
Seeing Clearly and Deeply: An RGBD Imaging Approach with a Bio-inspired Monocentric Design
par: Yu, Zongxi, et autres
Publié: (2025)