Recent Advances of Continual Learning in Computer Vision: An Overview
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qu, Haoxuan, Rahmani, Hossein, Xu, Li, Williams, Bryan, Liu, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
An Image-like Diffusion Method for Human-Object Interaction Detection
par: Hui, Xiaofei, et autres
Publié: (2025)
par: Hui, Xiaofei, et autres
Publié: (2025)
DisC-GS: Discontinuity-aware Gaussian Splatting
par: Qu, Haoxuan, et autres
Publié: (2024)
par: Qu, Haoxuan, et autres
Publié: (2024)
Towards Adaptive Pseudo-label Learning for Semi-Supervised Temporal Action Localization
par: Zhou, Feixiang, et autres
Publié: (2024)
par: Zhou, Feixiang, et autres
Publié: (2024)
Learning to Generate Cross-Task Unexploitable Examples
par: Qu, Haoxuan, et autres
Publié: (2025)
par: Qu, Haoxuan, et autres
Publié: (2025)
Translating Signals to Languages for sEMG-Based Activity Recognition
par: Wang, Ming, et autres
Publié: (2026)
par: Wang, Ming, et autres
Publié: (2026)
When Visual Privacy Protection Meets Multimodal Large Language Models
par: Hui, Xiaofei, et autres
Publié: (2026)
par: Hui, Xiaofei, et autres
Publié: (2026)
A Mixed-Primitive-based Gaussian Splatting Method for Surface Reconstruction
par: Qu, Haoxuan, et autres
Publié: (2025)
par: Qu, Haoxuan, et autres
Publié: (2025)
ToolFG: Towards Well-Grounded Fine-Grained Image Classification
par: Xue, Yu, et autres
Publié: (2026)
par: Xue, Yu, et autres
Publié: (2026)
Weakly Supervised Co-training with Swapping Assignments for Semantic Segmentation
par: Yang, Xinyu, et autres
Publié: (2024)
par: Yang, Xinyu, et autres
Publié: (2024)
MicroscopyMatching: Towards a Ready-to-use Framework for Microscopy Image Analysis in Diverse Conditions
par: Hui, Xiaofei, et autres
Publié: (2026)
par: Hui, Xiaofei, et autres
Publié: (2026)
CMMLoc: Advancing Text-to-PointCloud Localization with Cauchy-Mixture-Model Based Framework
par: Xu, Yanlong, et autres
Publié: (2025)
par: Xu, Yanlong, et autres
Publié: (2025)
TSTMotion: Training-free Scene-aware Text-to-motion Generation
par: Guo, Ziyan, et autres
Publié: (2025)
par: Guo, Ziyan, et autres
Publié: (2025)
6D-Diff: A Keypoint Diffusion Framework for 6D Object Pose Estimation
par: Xu, Li, et autres
Publié: (2023)
par: Xu, Li, et autres
Publié: (2023)
Answering from Sure to Uncertain: Uncertainty-Aware Curriculum Learning for Video Question Answering
par: Li, Haopeng, et autres
Publié: (2024)
par: Li, Haopeng, et autres
Publié: (2024)
LongDiff: Training-Free Long Video Generation in One Go
par: Li, Zhuoling, et autres
Publié: (2025)
par: Li, Zhuoling, et autres
Publié: (2025)
Diff-Tracker: Text-to-Image Diffusion Models are Unsupervised Trackers
par: Zhang, Zhengbo, et autres
Publié: (2024)
par: Zhang, Zhengbo, et autres
Publié: (2024)
AI-Generated Content (AIGC) for Various Data Modalities: A Survey
par: Foo, Lin Geng, et autres
Publié: (2023)
par: Foo, Lin Geng, et autres
Publié: (2023)
LLMs are Good Action Recognizers
par: Qu, Haoxuan, et autres
Publié: (2024)
par: Qu, Haoxuan, et autres
Publié: (2024)
GPT-Connect: Interaction between Text-Driven Human Motion Generator and 3D Scenes in a Training-free Manner
par: Qu, Haoxuan, et autres
Publié: (2024)
par: Qu, Haoxuan, et autres
Publié: (2024)
Action Detection via an Image Diffusion Process
par: Foo, Lin Geng, et autres
Publié: (2024)
par: Foo, Lin Geng, et autres
Publié: (2024)
HyLiFormer: Hyperbolic Linear Attention for Skeleton-based Human Action Recognition
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
Advancing Cross-domain Discriminability in Continual Learning of Vision-Language Models
par: Xu, Yicheng, et autres
Publié: (2024)
par: Xu, Yicheng, et autres
Publié: (2024)
TSkel-Mamba: Temporal Dynamic Modeling via State Space Model for Human Skeleton-based Action Recognition
par: Liu, Yanan, et autres
Publié: (2025)
par: Liu, Yanan, et autres
Publié: (2025)
Advancing Multiple Instance Learning with Continual Learning for Whole Slide Imaging
par: Li, Xianrui, et autres
Publié: (2025)
par: Li, Xianrui, et autres
Publié: (2025)
Off-the-shelf ChatGPT is a Good Few-shot Human Motion Predictor
par: Qu, Haoxuan, et autres
Publié: (2024)
par: Qu, Haoxuan, et autres
Publié: (2024)
xAI-CV: An Overview of Explainable Artificial Intelligence in Computer Vision
par: Van Tu, Nguyen, et autres
Publié: (2025)
par: Van Tu, Nguyen, et autres
Publié: (2025)
Identity-aware Feature Decoupling Learning for Clothing-change Person Re-identification
par: Xu, Haoxuan, et autres
Publié: (2025)
par: Xu, Haoxuan, et autres
Publié: (2025)
LLMs are Good Sign Language Translators
par: Gong, Jia, et autres
Publié: (2024)
par: Gong, Jia, et autres
Publié: (2024)
GaussianBlock: Building Part-Aware Compositional and Editable 3D Scene by Primitives and Gaussians
par: Jiang, Shuyi, et autres
Publié: (2024)
par: Jiang, Shuyi, et autres
Publié: (2024)
Towards Fast, Memory-based and Data-Efficient Vision-Language Policy
par: Li, Haoxuan, et autres
Publié: (2025)
par: Li, Haoxuan, et autres
Publié: (2025)
Branch, or Layer? Zeroth-Order Optimization for Continual Learning of Vision-Language Models
par: Liu, Ziwei, et autres
Publié: (2025)
par: Liu, Ziwei, et autres
Publié: (2025)
Avatar Concept Slider: Controllable Editing of Concepts in 3D Human Avatars
par: Foo, Lin Geng, et autres
Publié: (2024)
par: Foo, Lin Geng, et autres
Publié: (2024)
Enhancing Human-Centered Dynamic Scene Understanding via Multiple LLMs Collaborated Reasoning
par: Zhang, Hang, et autres
Publié: (2024)
par: Zhang, Hang, et autres
Publié: (2024)
Advancing from Automated to Autonomous Beamline by Leveraging Computer Vision
par: Li, Baolu, et autres
Publié: (2025)
par: Li, Baolu, et autres
Publié: (2025)
Sports-QA: A Large-Scale Video Question Answering Benchmark for Complex and Professional Sports
par: Li, Haopeng, et autres
Publié: (2024)
par: Li, Haopeng, et autres
Publié: (2024)
LAGA: Layered 3D Avatar Generation and Customization via Gaussian Splatting
par: Gong, Jia, et autres
Publié: (2024)
par: Gong, Jia, et autres
Publié: (2024)
BIT: Matching-based Bi-directional Interaction Transformation Network for Visible-Infrared Person Re-Identification
par: Xu, Haoxuan, et autres
Publié: (2026)
par: Xu, Haoxuan, et autres
Publié: (2026)
OpenVision: A Fully-Open, Cost-Effective Family of Advanced Vision Encoders for Multimodal Learning
par: Li, Xianhang, et autres
Publié: (2025)
par: Li, Xianhang, et autres
Publié: (2025)
DiSa: Directional Saliency-Aware Prompt Learning for Generalizable Vision-Language Models
par: Talemi, Niloufar Alipour, et autres
Publié: (2025)
par: Talemi, Niloufar Alipour, et autres
Publié: (2025)
A Survey of Attacks on Large Vision-Language Models: Resources, Advances, and Future Trends
par: Liu, Daizong, et autres
Publié: (2024)
par: Liu, Daizong, et autres
Publié: (2024)
Documents similaires
-
An Image-like Diffusion Method for Human-Object Interaction Detection
par: Hui, Xiaofei, et autres
Publié: (2025) -
DisC-GS: Discontinuity-aware Gaussian Splatting
par: Qu, Haoxuan, et autres
Publié: (2024) -
Towards Adaptive Pseudo-label Learning for Semi-Supervised Temporal Action Localization
par: Zhou, Feixiang, et autres
Publié: (2024) -
Learning to Generate Cross-Task Unexploitable Examples
par: Qu, Haoxuan, et autres
Publié: (2025) -
Translating Signals to Languages for sEMG-Based Activity Recognition
par: Wang, Ming, et autres
Publié: (2026)