A Systematic Review on Long-Tailed Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Chongsheng, Almpanidis, George, Fan, Gaojuan, Deng, Binquan, Zhang, Yanbo, Liu, Ji, Kamel, Aouaidjia, Soda, Paolo, Gama, João |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
3D Human Pose Estimation via Spatial Graph Order Attention and Temporal Body Aware Transformer
par: Aouaidjia, Kamel, et autres
Publié: (2025)
par: Aouaidjia, Kamel, et autres
Publié: (2025)
Improving action segmentation via explicit similarity measurement
par: Aouaidjia, Kamel, et autres
Publié: (2025)
par: Aouaidjia, Kamel, et autres
Publié: (2025)
DIP: Diffusion Learning of Inconsistency Pattern for General DeepFake Detection
par: Nie, Fan, et autres
Publié: (2024)
par: Nie, Fan, et autres
Publié: (2024)
LongInsightBench: A Comprehensive Benchmark for Evaluating Omni-Modal Models on Human-Centric Long-Video Understanding
par: Han, ZhaoYang, et autres
Publié: (2025)
par: Han, ZhaoYang, et autres
Publié: (2025)
Memory-enhanced Retrieval Augmentation for Long Video Understanding
par: Yuan, Huaying, et autres
Publié: (2025)
par: Yuan, Huaying, et autres
Publié: (2025)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
par: Zheng, Yaozong, et autres
Publié: (2025)
par: Zheng, Yaozong, et autres
Publié: (2025)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024)
par: Zhang, Zhenxing, et autres
Publié: (2024)
Generative Frame Sampler for Long Video Understanding
par: Yao, Linli, et autres
Publié: (2025)
par: Yao, Linli, et autres
Publié: (2025)
Long-Range Feature Propagating for Natural Image Matting
par: Liu, Qinglin, et autres
Publié: (2021)
par: Liu, Qinglin, et autres
Publié: (2021)
Towards Generalizable Deepfake Detection via Forgery-aware Audio-Visual Adaptation: A Variational Bayesian Approach
par: Nie, Fan, et autres
Publié: (2025)
par: Nie, Fan, et autres
Publié: (2025)
EALD-MLLM: Emotion Analysis in Long-sequential and De-identity videos with Multi-modal Large Language Model
par: Li, Deng, et autres
Publié: (2024)
par: Li, Deng, et autres
Publié: (2024)
FCBoost-Net: A Generative Network for Synthesizing Multiple Collocated Outfits via Fashion Compatibility Boosting
par: Zhou, Dongliang, et autres
Publié: (2025)
par: Zhou, Dongliang, et autres
Publié: (2025)
RDTF: Resource-efficient Dual-mask Training Framework for Multi-frame Animated Sticker Generation
par: Yuan, Zhiqiang, et autres
Publié: (2025)
par: Yuan, Zhiqiang, et autres
Publié: (2025)
TimeLoc: A Unified End-to-End Framework for Precise Timestamp Localization in Long Videos
par: Zhang, Chen-Lin, et autres
Publié: (2025)
par: Zhang, Chen-Lin, et autres
Publié: (2025)
L-LBVC: Long-Term Motion Estimation and Prediction for Learned Bi-Directional Video Compression
par: Zhai, Yongqi, et autres
Publié: (2025)
par: Zhai, Yongqi, et autres
Publié: (2025)
Learning Long-Range Action Representation by Two-Stream Mamba Pyramid Network for Figure Skating Assessment
par: Wang, Fengshun, et autres
Publié: (2025)
par: Wang, Fengshun, et autres
Publié: (2025)
Detached and Interactive Multimodal Learning
par: Fan, Yunfeng, et autres
Publié: (2024)
par: Fan, Yunfeng, et autres
Publié: (2024)
IWN: Image Watermarking Based on Idempotency
par: Deng, Kaixin
Publié: (2024)
par: Deng, Kaixin
Publié: (2024)
TUNA: Comprehensive Fine-grained Temporal Understanding Evaluation on Dense Dynamic Videos
par: Kong, Fanheng, et autres
Publié: (2025)
par: Kong, Fanheng, et autres
Publié: (2025)
Pre-training CLIP against Data Poisoning with Optimal Transport-based Matching and Alignment
par: Zhang, Tong, et autres
Publié: (2025)
par: Zhang, Tong, et autres
Publié: (2025)
A Multimodal Transformer for Live Streaming Highlight Prediction
par: Deng, Jiaxin, et autres
Publié: (2024)
par: Deng, Jiaxin, et autres
Publié: (2024)
AdaptaGen: Domain-Specific Image Generation through Hierarchical Semantic Optimization Framework
par: Zhang, Suoxiang, et autres
Publié: (2025)
par: Zhang, Suoxiang, et autres
Publié: (2025)
MOC-3D: Manifold-Order Consistency for Text-to-3D Generation
par: Fan, Chenyang, et autres
Publié: (2026)
par: Fan, Chenyang, et autres
Publié: (2026)
3D Gaussian Editing with A Single Image
par: Luo, Guan, et autres
Publié: (2024)
par: Luo, Guan, et autres
Publié: (2024)
Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots
par: Zheng, Guangting, et autres
Publié: (2025)
par: Zheng, Guangting, et autres
Publié: (2025)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
par: Zhang, Long, et autres
Publié: (2025)
par: Zhang, Long, et autres
Publié: (2025)
Learning Efficient Unsupervised Satellite Image-based Building Damage Detection
par: Zhang, Yiyun, et autres
Publié: (2023)
par: Zhang, Yiyun, et autres
Publié: (2023)
Learning Generalizable and Efficient Image Watermarking via Hierarchical Two-Stage Optimization
par: Liu, Ke, et autres
Publié: (2025)
par: Liu, Ke, et autres
Publié: (2025)
Generalized Video Anomaly Event Detection: Systematic Taxonomy and Comparison of Deep Models
par: Liu, Yang, et autres
Publié: (2023)
par: Liu, Yang, et autres
Publié: (2023)
Explainable Coarse-to-Fine Ancient Manuscript Duplicates Discovery
par: Zhang, Chongsheng, et autres
Publié: (2025)
par: Zhang, Chongsheng, et autres
Publié: (2025)
SizeGS: Size-aware Compression of 3D Gaussian Splatting via Mixed Integer Programming
par: Xie, Shuzhao, et autres
Publié: (2024)
par: Xie, Shuzhao, et autres
Publié: (2024)
Deep Compositional Phase Diffusion for Long Motion Sequence Generation
par: Au, Ho Yin, et autres
Publié: (2025)
par: Au, Ho Yin, et autres
Publié: (2025)
Deep Boosting Learning: A Brand-new Cooperative Approach for Image-Text Matching
par: Diao, Haiwen, et autres
Publié: (2024)
par: Diao, Haiwen, et autres
Publié: (2024)
Dual-Branch Network for Portrait Image Quality Assessment
par: Sun, Wei, et autres
Publié: (2024)
par: Sun, Wei, et autres
Publié: (2024)
MSVBench: Towards Human-Level Evaluation of Multi-Shot Video Generation
par: Shi, Haoyuan, et autres
Publié: (2026)
par: Shi, Haoyuan, et autres
Publié: (2026)
Hypergraph Tversky-Aware Domain Incremental Learning for Brain Tumor Segmentation with Missing Modalities
par: Wang, Junze, et autres
Publié: (2025)
par: Wang, Junze, et autres
Publié: (2025)
Dual Mutual Learning Network with Global-local Awareness for RGB-D Salient Object Detection
par: Yi, Kang, et autres
Publié: (2025)
par: Yi, Kang, et autres
Publié: (2025)
GSSF: Generalized Structural Sparse Function for Deep Cross-modal Metric Learning
par: Diao, Haiwen, et autres
Publié: (2024)
par: Diao, Haiwen, et autres
Publié: (2024)
UniPT: Universal Parallel Tuning for Transfer Learning with Efficient Parameter and Memory
par: Diao, Haiwen, et autres
Publié: (2023)
par: Diao, Haiwen, et autres
Publié: (2023)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
par: Zheng, Junjie, et autres
Publié: (2025)
par: Zheng, Junjie, et autres
Publié: (2025)
Documents similaires
-
3D Human Pose Estimation via Spatial Graph Order Attention and Temporal Body Aware Transformer
par: Aouaidjia, Kamel, et autres
Publié: (2025) -
Improving action segmentation via explicit similarity measurement
par: Aouaidjia, Kamel, et autres
Publié: (2025) -
DIP: Diffusion Learning of Inconsistency Pattern for General DeepFake Detection
par: Nie, Fan, et autres
Publié: (2024) -
LongInsightBench: A Comprehensive Benchmark for Evaluating Omni-Modal Models on Human-Centric Long-Video Understanding
par: Han, ZhaoYang, et autres
Publié: (2025) -
Memory-enhanced Retrieval Augmentation for Long Video Understanding
par: Yuan, Huaying, et autres
Publié: (2025)