5%>100%: Breaking Performance Shackles of Full Fine-Tuning on Visual Recognition Tasks
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yin, Dongshuo, Hu, Leiyi, Li, Bin, Zhang, Youqun, Yang, Xue |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
1%>100%: High-Efficiency Visual Adapter with Complex Linear Projection Optimization
von: Yin, Dongshuo, et al.
Veröffentlicht: (2026)
von: Yin, Dongshuo, et al.
Veröffentlicht: (2026)
DAPE: Dual-Stage Parameter-Efficient Fine-Tuning for Consistent Video Editing with Diffusion Models
von: Xia, Junhao, et al.
Veröffentlicht: (2025)
von: Xia, Junhao, et al.
Veröffentlicht: (2025)
On the Suitability of Reinforcement Fine-Tuning to Visual Tasks
von: Chen, Xiaxu, et al.
Veröffentlicht: (2025)
von: Chen, Xiaxu, et al.
Veröffentlicht: (2025)
VPD-100K: Towards Generalizable and Fine-grained Visual Privacy Protection
von: Hu, Xiaobin, et al.
Veröffentlicht: (2026)
von: Hu, Xiaobin, et al.
Veröffentlicht: (2026)
Improving Visual Prompt Tuning by Gaussian Neighborhood Minimization for Long-Tailed Visual Recognition
von: Li, Mengke, et al.
Veröffentlicht: (2024)
von: Li, Mengke, et al.
Veröffentlicht: (2024)
Mixed Text Recognition with Efficient Parameter Fine-Tuning and Transformer
von: Chang, Da, et al.
Veröffentlicht: (2024)
von: Chang, Da, et al.
Veröffentlicht: (2024)
Visual-RFT: Visual Reinforcement Fine-Tuning
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
ConsistentRFT: Reducing Visual Hallucinations in Flow-based Reinforcement Fine-Tuning
von: Tan, Xiaofeng, et al.
Veröffentlicht: (2026)
von: Tan, Xiaofeng, et al.
Veröffentlicht: (2026)
Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition
von: Li, Yu, et al.
Veröffentlicht: (2025)
von: Li, Yu, et al.
Veröffentlicht: (2025)
Breaking the Frame: Visual Place Recognition by Overlap Prediction
von: Wei, Tong, et al.
Veröffentlicht: (2024)
von: Wei, Tong, et al.
Veröffentlicht: (2024)
Sparse Fine-Tuning of Transformers for Generative Tasks
von: Chen, Wei, et al.
Veröffentlicht: (2025)
von: Chen, Wei, et al.
Veröffentlicht: (2025)
A Visual Question Answering Method for SAR Ship: Breaking the Requirement for Multimodal Dataset Construction and Model Fine-Tuning
von: Wang, Fei, et al.
Veröffentlicht: (2024)
von: Wang, Fei, et al.
Veröffentlicht: (2024)
TS-SAM: Fine-Tuning Segment-Anything Model for Downstream Tasks
von: Yu, Yang, et al.
Veröffentlicht: (2024)
von: Yu, Yang, et al.
Veröffentlicht: (2024)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
von: He, Junwen, et al.
Veröffentlicht: (2024)
von: He, Junwen, et al.
Veröffentlicht: (2024)
Dynamic Embedding of Hierarchical Visual Features for Efficient Vision-Language Fine-Tuning
von: Wei, Xinyu, et al.
Veröffentlicht: (2025)
von: Wei, Xinyu, et al.
Veröffentlicht: (2025)
Semantic Hierarchical Prompt Tuning for Parameter-Efficient Fine-Tuning
von: Zhu, Haowei, et al.
Veröffentlicht: (2024)
von: Zhu, Haowei, et al.
Veröffentlicht: (2024)
Facing the Elephant in the Room: Visual Prompt Tuning or Full Finetuning?
von: Han, Cheng, et al.
Veröffentlicht: (2024)
von: Han, Cheng, et al.
Veröffentlicht: (2024)
Multi-Task Dense Prediction Fine-Tuning with Mixture of Fine-Grained Experts
von: Xu, Yangyang, et al.
Veröffentlicht: (2025)
von: Xu, Yangyang, et al.
Veröffentlicht: (2025)
Democratizing Fine-grained Visual Recognition with Large Language Models
von: Liu, Mingxuan, et al.
Veröffentlicht: (2024)
von: Liu, Mingxuan, et al.
Veröffentlicht: (2024)
Expert Pyramid Tuning: Efficient Parameter Fine-Tuning for Expertise-Driven Task Allocation
von: Zhang, Jia-Chen, et al.
Veröffentlicht: (2026)
von: Zhang, Jia-Chen, et al.
Veröffentlicht: (2026)
SARE: Sample-wise Adaptive Reasoning for Training-free Fine-grained Visual Recognition
von: Yang, Jingxiao, et al.
Veröffentlicht: (2026)
von: Yang, Jingxiao, et al.
Veröffentlicht: (2026)
DiTASK: Multi-Task Fine-Tuning with Diffeomorphic Transformations
von: Mantri, Krishna Sri Ipsit, et al.
Veröffentlicht: (2025)
von: Mantri, Krishna Sri Ipsit, et al.
Veröffentlicht: (2025)
Progressive Homeostatic and Plastic Prompt Tuning for Audio-Visual Multi-Task Incremental Learning
von: Yin, Jiong, et al.
Veröffentlicht: (2025)
von: Yin, Jiong, et al.
Veröffentlicht: (2025)
AeroRAG: Structured Multimodal Retrieval-Augmented LLM for Fine-Grained Aerial Visual Reasoning
von: Xue, Junxiao, et al.
Veröffentlicht: (2026)
von: Xue, Junxiao, et al.
Veröffentlicht: (2026)
CReFT-CAD: Boosting Orthographic Projection Reasoning for CAD via Reinforcement Fine-Tuning
von: Niu, Ke, et al.
Veröffentlicht: (2025)
von: Niu, Ke, et al.
Veröffentlicht: (2025)
Think or Not Think: A Study of Explicit Thinking in Rule-Based Visual Reinforcement Fine-Tuning
von: Li, Ming, et al.
Veröffentlicht: (2025)
von: Li, Ming, et al.
Veröffentlicht: (2025)
Align and Surpass Human Camouflaged Perception: Visual Refocus Reinforcement Fine-Tuning
von: Shen, Ruolin, et al.
Veröffentlicht: (2025)
von: Shen, Ruolin, et al.
Veröffentlicht: (2025)
TSCLIP: Robust CLIP Fine-Tuning for Worldwide Cross-Regional Traffic Sign Recognition
von: Zhao, Guoyang, et al.
Veröffentlicht: (2024)
von: Zhao, Guoyang, et al.
Veröffentlicht: (2024)
Beyond Task-Specific Reasoning: A Unified Conditional Generative Framework for Abstract Visual Reasoning
von: Shi, Fan, et al.
Veröffentlicht: (2025)
von: Shi, Fan, et al.
Veröffentlicht: (2025)
Improving Few-Shot Change Detection Visual Question Answering via Decision-Ambiguity-guided Reinforcement Fine-Tuning
von: Dong, Fuyu, et al.
Veröffentlicht: (2025)
von: Dong, Fuyu, et al.
Veröffentlicht: (2025)
Sparsity- and Hybridity-Inspired Visual Parameter-Efficient Fine-Tuning for Medical Diagnosis
von: Liu, Mingyuan, et al.
Veröffentlicht: (2024)
von: Liu, Mingyuan, et al.
Veröffentlicht: (2024)
MLAE: Masked LoRA Experts for Visual Parameter-Efficient Fine-Tuning
von: Wang, Junjie, et al.
Veröffentlicht: (2024)
von: Wang, Junjie, et al.
Veröffentlicht: (2024)
Semantic-guided Fine-tuning of Foundation Model for Long-tailed Visual Recognition
von: Peng, Yufei, et al.
Veröffentlicht: (2025)
von: Peng, Yufei, et al.
Veröffentlicht: (2025)
Fine-Tuning Visual Autoregressive Models for Subject-Driven Generation
von: Chung, Jiwoo, et al.
Veröffentlicht: (2025)
von: Chung, Jiwoo, et al.
Veröffentlicht: (2025)
Robust Saliency-Aware Distillation for Few-shot Fine-grained Visual Recognition
von: Liu, Haiqi, et al.
Veröffentlicht: (2023)
von: Liu, Haiqi, et al.
Veröffentlicht: (2023)
Fine-Tuning Vision-Language Models for Visual Navigation Assistance
von: Li, Xiao, et al.
Veröffentlicht: (2025)
von: Li, Xiao, et al.
Veröffentlicht: (2025)
Lessons and Insights from a Unifying Study of Parameter-Efficient Fine-Tuning (PEFT) in Visual Recognition
von: Mai, Zheda, et al.
Veröffentlicht: (2024)
von: Mai, Zheda, et al.
Veröffentlicht: (2024)
Breaking Shallow Limits: Task-Driven Pixel Fusion for Gap-free RGBT Tracking
von: Lu, Andong, et al.
Veröffentlicht: (2025)
von: Lu, Andong, et al.
Veröffentlicht: (2025)
LMPT: Prompt Tuning with Class-Specific Embedding Loss for Long-tailed Multi-Label Visual Recognition
von: Xia, Peng, et al.
Veröffentlicht: (2023)
von: Xia, Peng, et al.
Veröffentlicht: (2023)
Visual Agentic Reinforcement Fine-Tuning
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
1%>100%: High-Efficiency Visual Adapter with Complex Linear Projection Optimization
von: Yin, Dongshuo, et al.
Veröffentlicht: (2026) -
DAPE: Dual-Stage Parameter-Efficient Fine-Tuning for Consistent Video Editing with Diffusion Models
von: Xia, Junhao, et al.
Veröffentlicht: (2025) -
On the Suitability of Reinforcement Fine-Tuning to Visual Tasks
von: Chen, Xiaxu, et al.
Veröffentlicht: (2025) -
VPD-100K: Towards Generalizable and Fine-grained Visual Privacy Protection
von: Hu, Xiaobin, et al.
Veröffentlicht: (2026) -
Improving Visual Prompt Tuning by Gaussian Neighborhood Minimization for Long-Tailed Visual Recognition
von: Li, Mengke, et al.
Veröffentlicht: (2024)