Enhancing Features in Long-tailed Data Using Large Vision Model
Fuente:
arXiv
Saved in:
| Main Authors: | Han, Pengxiao, Ye, Changkun, Tong, Jinguang, Jiang, Cuicui, Hong, Jie, Fang, Li, Li, Xuesong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Latent-based Diffusion Model for Long-tailed Recognition
by: Han, Pengxiao, et al.
Published: (2024)
by: Han, Pengxiao, et al.
Published: (2024)
Improving Viewpoint Consistency in 3D Generation via Structure Feature and CLIP Guidance
by: Zhang, Qing, et al.
Published: (2024)
by: Zhang, Qing, et al.
Published: (2024)
Structural Energy Guidance for View-Consistent Text-to-3D Generation
by: Zhang, Qing, et al.
Published: (2026)
by: Zhang, Qing, et al.
Published: (2026)
DGNS: Deformable Gaussian Splatting and Dynamic Neural Surface for Monocular Dynamic 3D Reconstruction
by: Li, Xuesong, et al.
Published: (2024)
by: Li, Xuesong, et al.
Published: (2024)
Structural Energy-Guided Sampling for View-Consistent Text-to-3D
by: Zhang, Qing, et al.
Published: (2025)
by: Zhang, Qing, et al.
Published: (2025)
Maintain Plasticity in Long-timescale Continual Test-time Adaptation
by: Wang, Yanshuo, et al.
Published: (2024)
by: Wang, Yanshuo, et al.
Published: (2024)
Adaptive and Balanced Re-initialization for Long-timescale Continual Test-time Domain Adaptation
by: Wang, Yanshuo, et al.
Published: (2026)
by: Wang, Yanshuo, et al.
Published: (2026)
Seeing is Believing? Enhancing Vision-Language Navigation using Visual Perturbations
by: Zhang, Xuesong, et al.
Published: (2024)
by: Zhang, Xuesong, et al.
Published: (2024)
GS-2DGS: Geometrically Supervised 2DGS for Reflective Object Reconstruction
by: Tong, Jinguang, et al.
Published: (2025)
by: Tong, Jinguang, et al.
Published: (2025)
Dual-granularity Sinkhorn Distillation for Enhanced Learning from Long-tailed Noisy Data
by: Hong, Feng, et al.
Published: (2025)
by: Hong, Feng, et al.
Published: (2025)
Probing and Bridging Geometry-Interaction Cues for Affordance Reasoning in Vision Foundation Models
by: Zhang, Qing, et al.
Published: (2026)
by: Zhang, Qing, et al.
Published: (2026)
Mitigating Long-tail Distribution in Oracle Bone Inscriptions: Dataset, Model, and Benchmark
by: Li, Jinhao, et al.
Published: (2025)
by: Li, Jinhao, et al.
Published: (2025)
Large-scale Long-tailed Disease Diagnosis on Radiology Images
by: Zheng, Qiaoyu, et al.
Published: (2023)
by: Zheng, Qiaoyu, et al.
Published: (2023)
Synthetic Defect Image Generation for Power Line Insulator Inspection Using Multimodal Large Language Models
by: Wang, Xuesong, et al.
Published: (2026)
by: Wang, Xuesong, et al.
Published: (2026)
DiffuLT: How to Make Diffusion Model Useful for Long-tail Recognition
by: Shao, Jie, et al.
Published: (2024)
by: Shao, Jie, et al.
Published: (2024)
Long-tail Internet photo reconstruction
by: Li, Yuan, et al.
Published: (2026)
by: Li, Yuan, et al.
Published: (2026)
Self-supervised Anomaly Detection Pretraining Enhances Long-tail ECG Diagnosis
by: Jiang, Aofan, et al.
Published: (2024)
by: Jiang, Aofan, et al.
Published: (2024)
Frequency-based Matcher for Long-tailed Semantic Segmentation
by: Li, Shan, et al.
Published: (2024)
by: Li, Shan, et al.
Published: (2024)
Effectively Enhancing Vision Language Large Models by Prompt Augmentation and Caption Utilization
by: Zhao, Minyi, et al.
Published: (2024)
by: Zhao, Minyi, et al.
Published: (2024)
Efficient and Long-Tailed Generalization for Pre-trained Vision-Language Model
by: Shi, Jiang-Xin, et al.
Published: (2024)
by: Shi, Jiang-Xin, et al.
Published: (2024)
Seeing the Evidence, Missing the Answer: Tool-Guided Vision-Language Models on Visual Illusions
by: Wang, Xuesong, et al.
Published: (2026)
by: Wang, Xuesong, et al.
Published: (2026)
Semantic Data Augmentation for Long-tailed Facial Expression Recognition
by: Li, Zijian, et al.
Published: (2024)
by: Li, Zijian, et al.
Published: (2024)
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving
by: Chen, Xuesong, et al.
Published: (2025)
by: Chen, Xuesong, et al.
Published: (2025)
Data-efficient Large Vision Models through Sequential Autoregression
by: Guo, Jianyuan, et al.
Published: (2024)
by: Guo, Jianyuan, et al.
Published: (2024)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
by: Chen, Jiawei, et al.
Published: (2024)
by: Chen, Jiawei, et al.
Published: (2024)
Contrastive Conditional-Unconditional Alignment for Long-tailed Diffusion Model
by: Chen, Fang, et al.
Published: (2025)
by: Chen, Fang, et al.
Published: (2025)
Enhancing Interactive Image Retrieval With Query Rewriting Using Large Language Models and Vision Language Models
by: Zhu, Hongyi, et al.
Published: (2024)
by: Zhu, Hongyi, et al.
Published: (2024)
Mitigating Hallucinations in Large Vision-Language Models via DPO: On-Policy Data Hold the Key
by: Yang, Zhihe, et al.
Published: (2025)
by: Yang, Zhihe, et al.
Published: (2025)
Long-Tailed Distribution-Aware Router For Mixture-of-Experts in Large Vision-Language Model
by: Cai, Chaoxiang, et al.
Published: (2025)
by: Cai, Chaoxiang, et al.
Published: (2025)
ScVLM: Enhancing Vision-Language Model for Safety-Critical Event Understanding
by: Shi, Liang, et al.
Published: (2024)
by: Shi, Liang, et al.
Published: (2024)
Delving into the Trajectory Long-tail Distribution for Muti-object Tracking
by: Chen, Sijia, et al.
Published: (2024)
by: Chen, Sijia, et al.
Published: (2024)
Gradient-Aware Logit Adjustment Loss for Long-tailed Classifier
by: Zhang, Fan, et al.
Published: (2024)
by: Zhang, Fan, et al.
Published: (2024)
SAKED: Mitigating Hallucination in Large Vision-Language Models via Stability-Aware Knowledge Enhanced Decoding
by: Li, Zhaoxu, et al.
Published: (2026)
by: Li, Zhaoxu, et al.
Published: (2026)
Raw Data Matters: Enhancing Prompt Tuning by Internal Augmentation on Vision-Language Models
by: Li, Haoyang, et al.
Published: (2025)
by: Li, Haoyang, et al.
Published: (2025)
Rethinking the Bias of Foundation Model under Long-tailed Distribution
by: Chen, Jiahao, et al.
Published: (2025)
by: Chen, Jiahao, et al.
Published: (2025)
Enhancing Vision-Language Compositional Understanding with Multimodal Synthetic Data
by: Li, Haoxin, et al.
Published: (2025)
by: Li, Haoxin, et al.
Published: (2025)
Generalized Categories Discovery for Long-tailed Recognition
by: Li, Ziyun, et al.
Published: (2023)
by: Li, Ziyun, et al.
Published: (2023)
Uncertainty-aware Sampling for Long-tailed Semi-supervised Learning
by: Yang, Kuo, et al.
Published: (2024)
by: Yang, Kuo, et al.
Published: (2024)
Rethinking Long-tailed Dataset Distillation: A Uni-Level Framework with Unbiased Recovery and Relabeling
by: Cui, Xiao, et al.
Published: (2025)
by: Cui, Xiao, et al.
Published: (2025)
Long-Tail Learning with Foundation Model: Heavy Fine-Tuning Hurts
by: Shi, Jiang-Xin, et al.
Published: (2023)
by: Shi, Jiang-Xin, et al.
Published: (2023)
Similar Items
-
Latent-based Diffusion Model for Long-tailed Recognition
by: Han, Pengxiao, et al.
Published: (2024) -
Improving Viewpoint Consistency in 3D Generation via Structure Feature and CLIP Guidance
by: Zhang, Qing, et al.
Published: (2024) -
Structural Energy Guidance for View-Consistent Text-to-3D Generation
by: Zhang, Qing, et al.
Published: (2026) -
DGNS: Deformable Gaussian Splatting and Dynamic Neural Surface for Monocular Dynamic 3D Reconstruction
by: Li, Xuesong, et al.
Published: (2024) -
Structural Energy-Guided Sampling for View-Consistent Text-to-3D
by: Zhang, Qing, et al.
Published: (2025)