PAL: Prompting Analytic Learning with Missing Modality for Multi-Modal Class-Incremental Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Yue, Xianghu, Chen, Yiming, Zhang, Xueyi, Gao, Xiaoxue, Feng, Mengling, Lao, Mingrui, Zhuang, Huiping, Li, Haizhou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CoAVT: A Cognition-Inspired Unified Audio-Visual-Text Pre-Training Model for Multimodal Processing
por: Yue, Xianghu, et al.
Publicado: (2024)
por: Yue, Xianghu, et al.
Publicado: (2024)
Audio-Visual Cross-Modal Compression for Generative Face Video Coding
por: Xu, Youmin, et al.
Publicado: (2025)
por: Xu, Youmin, et al.
Publicado: (2025)
Prompt-based Multimodal Semantic Communication for Multi-spectral Image Segmentation
por: Zhang, Haoshuo, et al.
Publicado: (2025)
por: Zhang, Haoshuo, et al.
Publicado: (2025)
Tube-Structured Incremental Semantic HARQ for Generative Video Receivers
por: Wang, Xuesong, et al.
Publicado: (2026)
por: Wang, Xuesong, et al.
Publicado: (2026)
ABC: Adaptive BayesNet Structure Learning for Computational Scalable Multi-task Image Compression
por: Zhang, Yufeng, et al.
Publicado: (2025)
por: Zhang, Yufeng, et al.
Publicado: (2025)
HybridPrompt: Bridging Generative Priors and Traditional Codecs for Mobile Streaming
por: Liu, Liming, et al.
Publicado: (2026)
por: Liu, Liming, et al.
Publicado: (2026)
QoE Optimization for Semantic Self-Correcting Video Transmission in Multi-UAV Networks
por: Chen, Xuyang, et al.
Publicado: (2025)
por: Chen, Xuyang, et al.
Publicado: (2025)
Efficient Sub-pixel Motion Compensation in Learned Video Codecs
por: Ladune, Théo, et al.
Publicado: (2025)
por: Ladune, Théo, et al.
Publicado: (2025)
A H.265/HEVC Fine-Grained ROI Video Encryption Algorithm Based on Coding Unit and Prompt Segmentation
por: Zhang, Xiang, et al.
Publicado: (2026)
por: Zhang, Xiang, et al.
Publicado: (2026)
Region-Adaptive Learned Hierarchical Encoding for 3D Gaussian Splatting Data
por: Sridhara, Shashank N., et al.
Publicado: (2025)
por: Sridhara, Shashank N., et al.
Publicado: (2025)
DQ-Ladder: A Deep Reinforcement Learning-based Bitrate Ladder for Adaptive Video Streaming
por: Farahani, Reza, et al.
Publicado: (2026)
por: Farahani, Reza, et al.
Publicado: (2026)
Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision
por: Wei, Yiping, et al.
Publicado: (2023)
por: Wei, Yiping, et al.
Publicado: (2023)
Contrastive Multi-Modal Hypergraph Reasoning for 3D Crowd Mesh Recovery
por: Sun, Minghao, et al.
Publicado: (2026)
por: Sun, Minghao, et al.
Publicado: (2026)
TVMC: Time-Varying Mesh Compression via Multi-Stage Anchor Mesh Generation
por: Huang, He, et al.
Publicado: (2025)
por: Huang, He, et al.
Publicado: (2025)
EvEnhancer: Empowering Effectiveness, Efficiency and Generalizability for Continuous Space-Time Video Super-Resolution with Events
por: Wei, Shuoyan, et al.
Publicado: (2025)
por: Wei, Shuoyan, et al.
Publicado: (2025)
Robust Live Streaming over LEO Satellite Constellations: Measurement, Analysis, and Handover-Aware Adaptation
por: Fang, Hao, et al.
Publicado: (2025)
por: Fang, Hao, et al.
Publicado: (2025)
CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection
por: Wang, Hang, et al.
Publicado: (2026)
por: Wang, Hang, et al.
Publicado: (2026)
Camel: Frame-Level Bandwidth Estimation for Low-Latency Live Streaming under Video Bitrate Undershooting
por: Liu, Liming, et al.
Publicado: (2026)
por: Liu, Liming, et al.
Publicado: (2026)
Transform and Entropy Coding in AV2
por: Nalci, Alican, et al.
Publicado: (2026)
por: Nalci, Alican, et al.
Publicado: (2026)
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
por: Xiong, Haoxuan, et al.
Publicado: (2026)
por: Xiong, Haoxuan, et al.
Publicado: (2026)
Robust Multi-modal Task-oriented Communications with Redundancy-aware Representations
por: Fu, Jingwen, et al.
Publicado: (2025)
por: Fu, Jingwen, et al.
Publicado: (2025)
LLIC: Large Receptive Field Transform Coding with Adaptive Weights for Learned Image Compression
por: Jiang, Wei, et al.
Publicado: (2023)
por: Jiang, Wei, et al.
Publicado: (2023)
Enhanced Template-based Intra Mode Derivation with Adaptive Block Vector Replacement
por: Zhang, Jiaqi, et al.
Publicado: (2025)
por: Zhang, Jiaqi, et al.
Publicado: (2025)
Rate-Quality or Energy-Quality Pareto Fronts for Adaptive Video Streaming?
por: Katsenou, Angeliki, et al.
Publicado: (2024)
por: Katsenou, Angeliki, et al.
Publicado: (2024)
Smaller is Better: Generative Models Can Power Short Video Preloading
por: Liu, Liming, et al.
Publicado: (2026)
por: Liu, Liming, et al.
Publicado: (2026)
NiMark: A Non-intrusive Watermarking Framework against Screen-shooting Attacks
por: Wu, Yufeng, et al.
Publicado: (2026)
por: Wu, Yufeng, et al.
Publicado: (2026)
Fast Multirate Encoding for 360° Video in OMAF Streaming Workflows
por: Premkumar, Amritha, et al.
Publicado: (2026)
por: Premkumar, Amritha, et al.
Publicado: (2026)
Decoding Complexity-Rate-Quality Pareto-Front for Adaptive VVC Streaming
por: Katsenou, Angeliki, et al.
Publicado: (2024)
por: Katsenou, Angeliki, et al.
Publicado: (2024)
Memory-Anchored Multimodal Reasoning for Explainable Video Forensics
por: Chen, Chen, et al.
Publicado: (2025)
por: Chen, Chen, et al.
Publicado: (2025)
GScomp-QA: A Subjective Dataset for Quality Assessment of Compressed Gaussian Splatting
por: Martin, Pedro, et al.
Publicado: (2026)
por: Martin, Pedro, et al.
Publicado: (2026)
Unravelling the Power of Single-Pass Look-Ahead in Modern Codecs for Optimized Transcoding Deployment
por: Vibhoothi, Vibhoothi, et al.
Publicado: (2024)
por: Vibhoothi, Vibhoothi, et al.
Publicado: (2024)
Perception-Aware Video Semantic Communication
por: Huang, Yinhuan, et al.
Publicado: (2026)
por: Huang, Yinhuan, et al.
Publicado: (2026)
Video Compression Beyond VVC: Quantitative Analysis of Intra Coding Tools in Enhanced Compression Model (ECM)
por: Abdoli, Mohsen, et al.
Publicado: (2024)
por: Abdoli, Mohsen, et al.
Publicado: (2024)
Dynamic resolution switching for live streaming
por: Xiong, Xin, et al.
Publicado: (2026)
por: Xiong, Xin, et al.
Publicado: (2026)
Enhanced Quality Aware-Scalable Underwater Image Compression
por: Zhu, Linwei, et al.
Publicado: (2025)
por: Zhu, Linwei, et al.
Publicado: (2025)
Generative Flow Networks for Personalized Multimedia Systems: A Case Study on Short Video Feeds
por: Jin, Yili, et al.
Publicado: (2025)
por: Jin, Yili, et al.
Publicado: (2025)
Partition Tree Search Acceleration for VVC: Survey and Evaluation with VTM Evolution
por: Kherchouche, M. E. A., et al.
Publicado: (2026)
por: Kherchouche, M. E. A., et al.
Publicado: (2026)
H.265/HEVC Video Steganalysis Based on CU Block Structure Gradients and IPM Mapping
por: Zhang, Xiang, et al.
Publicado: (2026)
por: Zhang, Xiang, et al.
Publicado: (2026)
Sandwiched Compression: Repurposing Standard Codecs with Neural Network Wrappers
por: Guleryuz, Onur G., et al.
Publicado: (2024)
por: Guleryuz, Onur G., et al.
Publicado: (2024)
Encoding Time and Energy Model for SVT-AV1 based on Video Complexity
por: Eichermüller, Lena, et al.
Publicado: (2024)
por: Eichermüller, Lena, et al.
Publicado: (2024)
Ejemplares similares
-
CoAVT: A Cognition-Inspired Unified Audio-Visual-Text Pre-Training Model for Multimodal Processing
por: Yue, Xianghu, et al.
Publicado: (2024) -
Audio-Visual Cross-Modal Compression for Generative Face Video Coding
por: Xu, Youmin, et al.
Publicado: (2025) -
Prompt-based Multimodal Semantic Communication for Multi-spectral Image Segmentation
por: Zhang, Haoshuo, et al.
Publicado: (2025) -
Tube-Structured Incremental Semantic HARQ for Generative Video Receivers
por: Wang, Xuesong, et al.
Publicado: (2026) -
ABC: Adaptive BayesNet Structure Learning for Computational Scalable Multi-task Image Compression
por: Zhang, Yufeng, et al.
Publicado: (2025)