Continual Forgetting for Pre-trained Vision Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Hongbo, Ni, Bolin, Wang, Haochen, Fan, Junsong, Zhu, Fei, Wang, Yuxi, Chen, Yuntao, Meng, Gaofeng, Zhang, Zhaoxiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Practical Continual Forgetting for Pre-trained Vision Models
por: Zhao, Hongbo, et al.
Publicado: (2025)
por: Zhao, Hongbo, et al.
Publicado: (2025)
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
por: Zhao, Hongbo, et al.
Publicado: (2025)
por: Zhao, Hongbo, et al.
Publicado: (2025)
Enhancing Visual Continual Learning with Language-Guided Supervision
por: Ni, Bolin, et al.
Publicado: (2024)
por: Ni, Bolin, et al.
Publicado: (2024)
OpenSatMap: A Fine-grained High-resolution Satellite Dataset for Large-scale Map Construction
por: Zhao, Hongbo, et al.
Publicado: (2024)
por: Zhao, Hongbo, et al.
Publicado: (2024)
MLLM-CL: Continual Learning for Multimodal Large Language Models
por: Zhao, Hongbo, et al.
Publicado: (2025)
por: Zhao, Hongbo, et al.
Publicado: (2025)
Using Unreliable Pseudo-Labels for Label-Efficient Semantic Segmentation
por: Wang, Haochen, et al.
Publicado: (2023)
por: Wang, Haochen, et al.
Publicado: (2023)
Defying Imbalanced Forgetting in Class Incremental Learning
por: Xu, Shixiong, et al.
Publicado: (2024)
por: Xu, Shixiong, et al.
Publicado: (2024)
HLG: Comprehensive 3D Room Construction via Hierarchical Layout Generation
por: Wang, Xiping, et al.
Publicado: (2025)
por: Wang, Xiping, et al.
Publicado: (2025)
Enhancing Sound Source Localization via False Negative Elimination
por: Song, Zengjie, et al.
Publicado: (2024)
por: Song, Zengjie, et al.
Publicado: (2024)
A Curriculum-style Self-training Approach for Source-Free Semantic Segmentation
por: Wang, Yuxi, et al.
Publicado: (2021)
por: Wang, Yuxi, et al.
Publicado: (2021)
DrivingGPT: Unifying Driving World Modeling and Planning with Multi-modal Autoregressive Transformers
por: Chen, Yuntao, et al.
Publicado: (2024)
por: Chen, Yuntao, et al.
Publicado: (2024)
CoMP: Continual Multimodal Pre-training for Vision Foundation Models
por: Chen, Yitong, et al.
Publicado: (2025)
por: Chen, Yitong, et al.
Publicado: (2025)
Pulling Target to Source: A New Perspective on Domain Adaptive Semantic Segmentation
por: Wang, Haochen, et al.
Publicado: (2023)
por: Wang, Haochen, et al.
Publicado: (2023)
Reusable Architecture Growth for Continual Stereo Matching
por: Zhang, Chenghao, et al.
Publicado: (2024)
por: Zhang, Chenghao, et al.
Publicado: (2024)
Semi-parametric Memory Consolidation: Towards Brain-like Deep Continual Learning
por: Liu, Geng, et al.
Publicado: (2025)
por: Liu, Geng, et al.
Publicado: (2025)
Revisiting Continual Semantic Segmentation with Pre-trained Vision Models
por: Zhang, Duzhen, et al.
Publicado: (2025)
por: Zhang, Duzhen, et al.
Publicado: (2025)
GoClick: Lightweight Element Grounding Model for Autonomous GUI Interaction
por: Li, Hongxin, et al.
Publicado: (2026)
por: Li, Hongxin, et al.
Publicado: (2026)
FreeVS: Generative View Synthesis on Free Driving Trajectory
por: Wang, Qitai, et al.
Publicado: (2024)
por: Wang, Qitai, et al.
Publicado: (2024)
Exploring Pre-trained Text-to-Video Diffusion Models for Referring Video Object Segmentation
por: Zhu, Zixin, et al.
Publicado: (2024)
por: Zhu, Zixin, et al.
Publicado: (2024)
Unified Vision-Language-Action Model
por: Wang, Yuqi, et al.
Publicado: (2025)
por: Wang, Yuqi, et al.
Publicado: (2025)
SAGD: Boundary-Enhanced Segment Anything in 3D Gaussian via Gaussian Decomposition
por: Hu, Xu, et al.
Publicado: (2024)
por: Hu, Xu, et al.
Publicado: (2024)
Weakly Supervised 3D Object Detection with Multi-Stage Generalization
por: He, Jiawei, et al.
Publicado: (2023)
por: He, Jiawei, et al.
Publicado: (2023)
Monocular Occupancy Prediction for Scalable Indoor Scenes
por: Yu, Hongxiao, et al.
Publicado: (2024)
por: Yu, Hongxiao, et al.
Publicado: (2024)
A Survey of Low-shot Vision-Language Model Adaptation via Representer Theorem
por: Ding, Kun, et al.
Publicado: (2024)
por: Ding, Kun, et al.
Publicado: (2024)
Efficient and Effective Universal Adversarial Attack against Vision-Language Pre-training Models
por: Yang, Fan, et al.
Publicado: (2024)
por: Yang, Fan, et al.
Publicado: (2024)
Enhancing End-to-End Autonomous Driving with Latent World Model
por: Li, Yingyan, et al.
Publicado: (2024)
por: Li, Yingyan, et al.
Publicado: (2024)
MAA: Meticulous Adversarial Attack against Vision-Language Pre-trained Models
por: Zhang, Peng-Fei, et al.
Publicado: (2025)
por: Zhang, Peng-Fei, et al.
Publicado: (2025)
Understanding the Multi-modal Prompts of the Pre-trained Vision-Language Model
por: Ma, Shuailei, et al.
Publicado: (2023)
por: Ma, Shuailei, et al.
Publicado: (2023)
General Geometry-aware Weakly Supervised 3D Object Detection
por: Zhang, Guowen, et al.
Publicado: (2024)
por: Zhang, Guowen, et al.
Publicado: (2024)
Split Adaptation for Pre-trained Vision Transformers
por: Wang, Lixu, et al.
Publicado: (2025)
por: Wang, Lixu, et al.
Publicado: (2025)
Mind the Interference: Retaining Pre-trained Knowledge in Parameter Efficient Continual Learning of Vision-Language Models
por: Tang, Longxiang, et al.
Publicado: (2024)
por: Tang, Longxiang, et al.
Publicado: (2024)
Vision Model Pre-training on Interleaved Image-Text Data via Latent Compression Learning
por: Yang, Chenyu, et al.
Publicado: (2024)
por: Yang, Chenyu, et al.
Publicado: (2024)
AddressCLIP: Empowering Vision-Language Models for City-wide Image Address Localization
por: Xu, Shixiong, et al.
Publicado: (2024)
por: Xu, Shixiong, et al.
Publicado: (2024)
Fully Sparse Fusion for 3D Object Detection
por: Li, Yingyan, et al.
Publicado: (2023)
por: Li, Yingyan, et al.
Publicado: (2023)
EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models
por: Zhang, Yixuan, et al.
Publicado: (2025)
por: Zhang, Yixuan, et al.
Publicado: (2025)
CLIP4STR: A Simple Baseline for Scene Text Recognition with Pre-trained Vision-Language Model
por: Zhao, Shuai, et al.
Publicado: (2023)
por: Zhao, Shuai, et al.
Publicado: (2023)
DriveDPO: Policy Learning via Safety DPO For End-to-End Autonomous Driving
por: Shang, Shuyao, et al.
Publicado: (2025)
por: Shang, Shuyao, et al.
Publicado: (2025)
DrivingDojo Dataset: Advancing Interactive and Knowledge-Enriched Driving World Model
por: Wang, Yuqi, et al.
Publicado: (2024)
por: Wang, Yuqi, et al.
Publicado: (2024)
VisionTS++: Cross-Modal Time Series Foundation Model with Continual Pre-trained Vision Backbones
por: Shen, Lefei, et al.
Publicado: (2025)
por: Shen, Lefei, et al.
Publicado: (2025)
Do Pre-trained Vision-Language Models Encode Object States?
por: Newman, Kaleb, et al.
Publicado: (2024)
por: Newman, Kaleb, et al.
Publicado: (2024)
Ejemplares similares
-
Practical Continual Forgetting for Pre-trained Vision Models
por: Zhao, Hongbo, et al.
Publicado: (2025) -
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
por: Zhao, Hongbo, et al.
Publicado: (2025) -
Enhancing Visual Continual Learning with Language-Guided Supervision
por: Ni, Bolin, et al.
Publicado: (2024) -
OpenSatMap: A Fine-grained High-resolution Satellite Dataset for Large-scale Map Construction
por: Zhao, Hongbo, et al.
Publicado: (2024) -
MLLM-CL: Continual Learning for Multimodal Large Language Models
por: Zhao, Hongbo, et al.
Publicado: (2025)