Text-Guided Mixup Towards Long-Tailed Image Categorization
Fuente:
arXiv
Salvato in:
| Autori principali: | Franklin, Richard, Yao, Jiawei, Zhong, Deyang, Qian, Qi, Hu, Juhua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-Modal Proxy Learning Towards Personalized Visual Multiple Clustering
di: Yao, Jiawei, et al.
Pubblicazione: (2024)
di: Yao, Jiawei, et al.
Pubblicazione: (2024)
Dual-disentangled Deep Multiple Clustering
di: Yao, Jiawei, et al.
Pubblicazione: (2024)
di: Yao, Jiawei, et al.
Pubblicazione: (2024)
SimInversion: A Simple Framework for Inversion-Based Text-to-Image Editing
di: Qian, Qi, et al.
Pubblicazione: (2024)
di: Qian, Qi, et al.
Pubblicazione: (2024)
Mix from Failure: Confusion-Pairing Mixup for Long-Tailed Recognition
di: Yoon, Youngseok, et al.
Pubblicazione: (2024)
di: Yoon, Youngseok, et al.
Pubblicazione: (2024)
Online Zero-Shot Classification with CLIP
di: Qian, Qi, et al.
Pubblicazione: (2024)
di: Qian, Qi, et al.
Pubblicazione: (2024)
SeA: Semantic Adversarial Augmentation for Last Layer Features from Unsupervised Representation Learning
di: Qian, Qi, et al.
Pubblicazione: (2024)
di: Qian, Qi, et al.
Pubblicazione: (2024)
CuRe: Cultural Gaps in the Long Tail of Text-to-Image Systems
di: Rege, Aniket, et al.
Pubblicazione: (2025)
di: Rege, Aniket, et al.
Pubblicazione: (2025)
GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing
di: Qian, Yusu, et al.
Pubblicazione: (2025)
di: Qian, Yusu, et al.
Pubblicazione: (2025)
Concept Drift and Long-Tailed Distribution in Fine-Grained Visual Categorization: Benchmark and Method
di: Ye, Shuo, et al.
Pubblicazione: (2023)
di: Ye, Shuo, et al.
Pubblicazione: (2023)
Rethinking Model Efficiency: Multi-Agent Inference with Large Models
di: Dong, Sixun, et al.
Pubblicazione: (2026)
di: Dong, Sixun, et al.
Pubblicazione: (2026)
Distance Transform Guided Mixup for Alzheimer's Detection
di: Batool, Zobia, et al.
Pubblicazione: (2025)
di: Batool, Zobia, et al.
Pubblicazione: (2025)
Text-guided Foundation Model Adaptation for Long-Tailed Medical Image Classification
di: Li, Sirui, et al.
Pubblicazione: (2024)
di: Li, Sirui, et al.
Pubblicazione: (2024)
Saliency-guided and Patch-based Mixup for Long-tailed Skin Cancer Image Classification
di: Wei, Tianyunxi, et al.
Pubblicazione: (2024)
di: Wei, Tianyunxi, et al.
Pubblicazione: (2024)
Enhance Image Classification via Inter-Class Image Mixup with Diffusion Model
di: Wang, Zhicai, et al.
Pubblicazione: (2024)
di: Wang, Zhicai, et al.
Pubblicazione: (2024)
LogicOCR: Do Your Large Multimodal Models Excel at Logical Reasoning on Text-Rich Images?
di: Ye, Maoyuan, et al.
Pubblicazione: (2025)
di: Ye, Maoyuan, et al.
Pubblicazione: (2025)
DBN-Mix: Training Dual Branch Network Using Bilateral Mixup Augmentation for Long-Tailed Visual Recognition
di: Baik, Jae Soon, et al.
Pubblicazione: (2022)
di: Baik, Jae Soon, et al.
Pubblicazione: (2022)
TextVidBench: A Benchmark for Long Video Scene Text Understanding
di: Zhong, Yangyang, et al.
Pubblicazione: (2025)
di: Zhong, Yangyang, et al.
Pubblicazione: (2025)
CalibrateMix: Guided-Mixup Calibration of Image Semi-Supervised Models
di: Rahman, Mehrab Mustafy, et al.
Pubblicazione: (2025)
di: Rahman, Mehrab Mustafy, et al.
Pubblicazione: (2025)
MMTok: Multimodal Coverage Maximization for Efficient Inference of VLMs
di: Dong, Sixun, et al.
Pubblicazione: (2025)
di: Dong, Sixun, et al.
Pubblicazione: (2025)
GoMatching: A Simple Baseline for Video Text Spotting via Long and Short Term Matching
di: He, Haibin, et al.
Pubblicazione: (2024)
di: He, Haibin, et al.
Pubblicazione: (2024)
Selective Volume Mixup for Video Action Recognition
di: Tan, Yi, et al.
Pubblicazione: (2023)
di: Tan, Yi, et al.
Pubblicazione: (2023)
SFA: Scan, Focus, and Amplify toward Guidance-aware Answering for Video TextVQA
di: He, Haibin, et al.
Pubblicazione: (2025)
di: He, Haibin, et al.
Pubblicazione: (2025)
Towards Zero-Shot Camera Trap Image Categorization
di: Vyskočil, Jiří, et al.
Pubblicazione: (2024)
di: Vyskočil, Jiří, et al.
Pubblicazione: (2024)
Feature Fusion from Head to Tail for Long-Tailed Visual Recognition
di: Li, Mengke, et al.
Pubblicazione: (2023)
di: Li, Mengke, et al.
Pubblicazione: (2023)
Revisiting Adversarial Training under Long-Tailed Distributions
di: Yue, Xinli, et al.
Pubblicazione: (2024)
di: Yue, Xinli, et al.
Pubblicazione: (2024)
OpenMixup: Open Mixup Toolbox and Benchmark for Visual Representation Learning
di: Li, Siyuan, et al.
Pubblicazione: (2022)
di: Li, Siyuan, et al.
Pubblicazione: (2022)
Empowering Vision Transformers with Multi-Scale Causal Intervention for Long-Tailed Image Classification
di: Yan, Xiaoshuo, et al.
Pubblicazione: (2025)
di: Yan, Xiaoshuo, et al.
Pubblicazione: (2025)
Geometric Prior Guided Feature Representation Learning for Long-Tailed Classification
di: Ma, Yanbiao, et al.
Pubblicazione: (2024)
di: Ma, Yanbiao, et al.
Pubblicazione: (2024)
Adversarial AutoMixup
di: Qin, Huafeng, et al.
Pubblicazione: (2023)
di: Qin, Huafeng, et al.
Pubblicazione: (2023)
GUNNEL: Guided Mixup Augmentation and Multi-Model Fusion for Aquatic Animal Segmentation
di: Le, Minh-Quan, et al.
Pubblicazione: (2021)
di: Le, Minh-Quan, et al.
Pubblicazione: (2021)
Invariant Feature Learning for Generalized Long-Tailed Classification
di: Tang, Kaihua, et al.
Pubblicazione: (2022)
di: Tang, Kaihua, et al.
Pubblicazione: (2022)
Long-Tailed Visual Recognition via Permutation-Invariant Head-to-Tail Feature Fusion
di: Li, Mengke, et al.
Pubblicazione: (2025)
di: Li, Mengke, et al.
Pubblicazione: (2025)
Cost-Sensitive Learning for Long-Tailed Temporal Action Segmentation
di: Pang, Zhanzhong, et al.
Pubblicazione: (2025)
di: Pang, Zhanzhong, et al.
Pubblicazione: (2025)
Rethinking Structure Preservation in Text-Guided Image Editing with Visual Autoregressive Models
di: Xia, Tao, et al.
Pubblicazione: (2026)
di: Xia, Tao, et al.
Pubblicazione: (2026)
ET-SAM: Efficient Point Prompt Prediction in SAM for Unified Scene Text Detection and Layout Analysis
di: Zhang, Xike, et al.
Pubblicazione: (2026)
di: Zhang, Xike, et al.
Pubblicazione: (2026)
BGM: Background Mixup for X-ray Prohibited Items Detection
di: Liu, Weizhe, et al.
Pubblicazione: (2024)
di: Liu, Weizhe, et al.
Pubblicazione: (2024)
LongTail Driving Scenarios with Reasoning Traces: The KITScenes LongTail Dataset
di: Wagner, Royden, et al.
Pubblicazione: (2026)
di: Wagner, Royden, et al.
Pubblicazione: (2026)
Origin Identification for Text-Guided Image-to-Image Diffusion Models
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
Towards Improved Text-Aligned Codebook Learning: Multi-Hierarchical Codebook-Text Alignment with Long Text
di: Liang, Guotao, et al.
Pubblicazione: (2025)
di: Liang, Guotao, et al.
Pubblicazione: (2025)
Rethink Sparse Signals for Pose-guided Text-to-image Generation
di: Xuan, Wenjie, et al.
Pubblicazione: (2025)
di: Xuan, Wenjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Multi-Modal Proxy Learning Towards Personalized Visual Multiple Clustering
di: Yao, Jiawei, et al.
Pubblicazione: (2024) -
Dual-disentangled Deep Multiple Clustering
di: Yao, Jiawei, et al.
Pubblicazione: (2024) -
SimInversion: A Simple Framework for Inversion-Based Text-to-Image Editing
di: Qian, Qi, et al.
Pubblicazione: (2024) -
Mix from Failure: Confusion-Pairing Mixup for Long-Tailed Recognition
di: Yoon, Youngseok, et al.
Pubblicazione: (2024) -
Online Zero-Shot Classification with CLIP
di: Qian, Qi, et al.
Pubblicazione: (2024)