CL-VISTA: Benchmarking Continual Learning in Video Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Haiyang, Shi, Yichen, Zhu, Fei, Liu, Wenzhuo, Zhao, Hongbo, Zeng, Fanhu, Ma, Shijie, Wang, Da-Han, Zhang, Xu-Yao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MCITlib: Multimodal Continual Instruction Tuning Library and Benchmark
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
Continual Learning for Generative AI: From LLMs to MLLMs and Beyond
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
Federated Continual Instruction Tuning
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
MLLM-CL: Continual Learning for Multimodal Large Language Models
di: Zhao, Hongbo, et al.
Pubblicazione: (2025)
di: Zhao, Hongbo, et al.
Pubblicazione: (2025)
DESIRE: Dynamic Knowledge Consolidation for Rehearsal-Free Continual Learning
di: Guo, Haiyang, et al.
Pubblicazione: (2024)
di: Guo, Haiyang, et al.
Pubblicazione: (2024)
HiDe-LLaVA: Hierarchical Decoupling for Continual Instruction Tuning of Multimodal Large Language Model
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
ModalPrompt: Towards Efficient Multimodal Continual Instruction Tuning with Dual-Modality Guided Prompt
di: Zeng, Fanhu, et al.
Pubblicazione: (2024)
di: Zeng, Fanhu, et al.
Pubblicazione: (2024)
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
di: Zhao, Hongbo, et al.
Pubblicazione: (2025)
di: Zhao, Hongbo, et al.
Pubblicazione: (2025)
RobustMerge: Parameter-Efficient Model Merging for MLLMs with Direction Robustness
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
Towards Efficient and General-Purpose Few-Shot Misclassification Detection for Vision-Language Models
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
di: Zeng, Fanhu, et al.
Pubblicazione: (2025)
Happy: A Debiased Learning Framework for Continual Generalized Category Discovery
di: Ma, Shijie, et al.
Pubblicazione: (2024)
di: Ma, Shijie, et al.
Pubblicazione: (2024)
PILoRA: Prototype Guided Incremental LoRA for Federated Class-Incremental Learning
di: Guo, Haiyang, et al.
Pubblicazione: (2024)
di: Guo, Haiyang, et al.
Pubblicazione: (2024)
LLaVA-c: Continual Improved Visual Instruction Tuning
di: Liu, Wenzhuo, et al.
Pubblicazione: (2025)
di: Liu, Wenzhuo, et al.
Pubblicazione: (2025)
Local-Prompt: Extensible Local Prompts for Few-Shot Out-of-Distribution Detection
di: Zeng, Fanhu, et al.
Pubblicazione: (2024)
di: Zeng, Fanhu, et al.
Pubblicazione: (2024)
MSPE: Multi-Scale Patch Embedding Prompts Vision Transformers to Any Resolution
di: Liu, Wenzhuo, et al.
Pubblicazione: (2024)
di: Liu, Wenzhuo, et al.
Pubblicazione: (2024)
Branch-Tuning: Balancing Stability and Plasticity for Continual Self-Supervised Learning
di: Liu, Wenzhuo, et al.
Pubblicazione: (2024)
di: Liu, Wenzhuo, et al.
Pubblicazione: (2024)
Global Convergence of Continual Learning on Non-IID Data
di: Zhu, Fei, et al.
Pubblicazione: (2025)
di: Zhu, Fei, et al.
Pubblicazione: (2025)
PrimeKG-CL: A Continual Graph Learning Benchmark on Evolving Biomedical Knowledge Graphs
di: Radwan, Yousef A., et al.
Pubblicazione: (2026)
di: Radwan, Yousef A., et al.
Pubblicazione: (2026)
ProtoGCD: Unified and Unbiased Prototype Learning for Generalized Category Discovery
di: Ma, Shijie, et al.
Pubblicazione: (2025)
di: Ma, Shijie, et al.
Pubblicazione: (2025)
Diffusion-based Perceptual Neural Video Compression with Temporal Diffusion Information Reuse
di: Ma, Wenzhuo, et al.
Pubblicazione: (2025)
di: Ma, Wenzhuo, et al.
Pubblicazione: (2025)
Fine-Grained Post-Training Quantization for Large Vision Language Models with Quantization-Aware Integrated Gradients
di: Xiang, Ziwei, et al.
Pubblicazione: (2026)
di: Xiang, Ziwei, et al.
Pubblicazione: (2026)
CL-bench: A Benchmark for Context Learning
di: Dou, Shihan, et al.
Pubblicazione: (2026)
di: Dou, Shihan, et al.
Pubblicazione: (2026)
EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models
di: Hu, He, et al.
Pubblicazione: (2025)
di: Hu, He, et al.
Pubblicazione: (2025)
Reinforcement Fine-Tuning Naturally Mitigates Forgetting in Continual Post-Training
di: Lai, Song, et al.
Pubblicazione: (2025)
di: Lai, Song, et al.
Pubblicazione: (2025)
DiffVC-OSD: One-Step Diffusion-based Perceptual Neural Video Compression Framework
di: Ma, Wenzhuo, et al.
Pubblicazione: (2025)
di: Ma, Wenzhuo, et al.
Pubblicazione: (2025)
InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with Instructions
di: Wang, Yifan, et al.
Pubblicazione: (2024)
di: Wang, Yifan, et al.
Pubblicazione: (2024)
VISTA: Video Interaction Spatio-Temporal Analysis Benchmark
di: Aparcedo, Alejandro, et al.
Pubblicazione: (2026)
di: Aparcedo, Alejandro, et al.
Pubblicazione: (2026)
DiffVC-RT: Towards Practical Real-Time Diffusion-based Perceptual Neural Video Compression
di: Ma, Wenzhuo, et al.
Pubblicazione: (2026)
di: Ma, Wenzhuo, et al.
Pubblicazione: (2026)
Towards Non-Exemplar Semi-Supervised Class-Incremental Learning
di: Liu, Wenzhuo, et al.
Pubblicazione: (2024)
di: Liu, Wenzhuo, et al.
Pubblicazione: (2024)
VideoCuRL: Video Curriculum Reinforcement Learning with Orthogonal Difficulty Decomposition
di: Jin, Hongbo, et al.
Pubblicazione: (2025)
di: Jin, Hongbo, et al.
Pubblicazione: (2025)
Towards Trustworthy Dataset Distillation
di: Ma, Shijie, et al.
Pubblicazione: (2023)
di: Ma, Shijie, et al.
Pubblicazione: (2023)
VISTA: An End-to-End Benchmark for Visual Spec-to-Web-App Coding Agents
di: Guo, JunJia, et al.
Pubblicazione: (2026)
di: Guo, JunJia, et al.
Pubblicazione: (2026)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
di: Zou, Tao, et al.
Pubblicazione: (2025)
di: Zou, Tao, et al.
Pubblicazione: (2025)
POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
di: Xu, Yichen, et al.
Pubblicazione: (2025)
di: Xu, Yichen, et al.
Pubblicazione: (2025)
Enhancing Long Video Question Answering with Scene-Localized Frame Grouping
di: Yang, Xuyi, et al.
Pubblicazione: (2025)
di: Yang, Xuyi, et al.
Pubblicazione: (2025)
LightCL: Compact Continual Learning with Low Memory Footprint For Edge Device
di: Wang, Zeqing, et al.
Pubblicazione: (2024)
di: Wang, Zeqing, et al.
Pubblicazione: (2024)
VISTA: Mitigating Semantic Inertia in Video-LLMs via Training-Free Dynamic Chain-of-Thought Routing
di: Jin, Hongbo, et al.
Pubblicazione: (2025)
di: Jin, Hongbo, et al.
Pubblicazione: (2025)
AdaCL:Adaptive Continual Learning
di: Yildirim, Elif Ceren Gok, et al.
Pubblicazione: (2023)
di: Yildirim, Elif Ceren Gok, et al.
Pubblicazione: (2023)
Reinforcement Learning with Continuous Actions Under Unmeasured Confounding
di: Li, Yuhan, et al.
Pubblicazione: (2025)
di: Li, Yuhan, et al.
Pubblicazione: (2025)
ChineseVideoBench: Benchmarking Multi-modal Large Models for Chinese Video Question Answering
di: Nie, Yuxiang, et al.
Pubblicazione: (2025)
di: Nie, Yuxiang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MCITlib: Multimodal Continual Instruction Tuning Library and Benchmark
di: Guo, Haiyang, et al.
Pubblicazione: (2025) -
Continual Learning for Generative AI: From LLMs to MLLMs and Beyond
di: Guo, Haiyang, et al.
Pubblicazione: (2025) -
Federated Continual Instruction Tuning
di: Guo, Haiyang, et al.
Pubblicazione: (2025) -
MLLM-CL: Continual Learning for Multimodal Large Language Models
di: Zhao, Hongbo, et al.
Pubblicazione: (2025) -
DESIRE: Dynamic Knowledge Consolidation for Rehearsal-Free Continual Learning
di: Guo, Haiyang, et al.
Pubblicazione: (2024)