Minimal Interaction Separated Tuning: A New Paradigm for Visual Adaptation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Tang, Ningyuan, Fu, Minghao, Wu, Jianxin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
von: Tang, Ningyuan, et al.
Veröffentlicht: (2024)
von: Tang, Ningyuan, et al.
Veröffentlicht: (2024)
QwT-v2: Practical, Effective and Efficient Post-Training Quantization
von: Tang, Ningyuan, et al.
Veröffentlicht: (2025)
von: Tang, Ningyuan, et al.
Veröffentlicht: (2025)
DTL: Disentangled Transfer Learning for Visual Recognition
von: Fu, Minghao, et al.
Veröffentlicht: (2023)
von: Fu, Minghao, et al.
Veröffentlicht: (2023)
Rectify the Regression Bias in Long-Tailed Object Detection
von: Zhu, Ke, et al.
Veröffentlicht: (2024)
von: Zhu, Ke, et al.
Veröffentlicht: (2024)
TWEO: Transformers Without Extreme Outliers Enables FP8 Training And Quantization For Dummies
von: Liang, Guang, et al.
Veröffentlicht: (2025)
von: Liang, Guang, et al.
Veröffentlicht: (2025)
Images Speak Louder Than Scores: Failure Mode Escape for Enhancing Generative Quality
von: Shao, Jie, et al.
Veröffentlicht: (2025)
von: Shao, Jie, et al.
Veröffentlicht: (2025)
Interactive Tracking: A Human-in-the-Loop Paradigm with Memory-Augmented Adaptation
von: Huang, Yuqing, et al.
Veröffentlicht: (2026)
von: Huang, Yuqing, et al.
Veröffentlicht: (2026)
Quantization without Tears
von: Fu, Minghao, et al.
Veröffentlicht: (2024)
von: Fu, Minghao, et al.
Veröffentlicht: (2024)
Resolving Ambiguity in Gaze-Facilitated Visual Assistant Interaction Paradigm
von: Wang, Zeyu, et al.
Veröffentlicht: (2025)
von: Wang, Zeyu, et al.
Veröffentlicht: (2025)
Improving Visual Prompt Tuning by Gaussian Neighborhood Minimization for Long-Tailed Visual Recognition
von: Li, Mengke, et al.
Veröffentlicht: (2024)
von: Li, Mengke, et al.
Veröffentlicht: (2024)
VaaWIT: Visual-Aware Adaptation of Large Language Models for Multilingual Web Image Translation
von: Li, Bo, et al.
Veröffentlicht: (2026)
von: Li, Bo, et al.
Veröffentlicht: (2026)
First Creating Backgrounds Then Rendering Texts: A New Paradigm for Visual Text Blending
von: Li, Zhenhang, et al.
Veröffentlicht: (2024)
von: Li, Zhenhang, et al.
Veröffentlicht: (2024)
Harmonious Parameter Adaptation in Continual Visual Instruction Tuning for Safety-Aligned MLLMs
von: Wang, Ziqi, et al.
Veröffentlicht: (2025)
von: Wang, Ziqi, et al.
Veröffentlicht: (2025)
Visual Compositional Tuning
von: Wu, Xindi, et al.
Veröffentlicht: (2025)
von: Wu, Xindi, et al.
Veröffentlicht: (2025)
Straightforward Layer-wise Pruning for More Efficient Visual Adaptation
von: Han, Ruizi, et al.
Veröffentlicht: (2024)
von: Han, Ruizi, et al.
Veröffentlicht: (2024)
Unsupervised Robust Domain Adaptation: Paradigm, Theory and Algorithm
von: Huang, Fuxiang, et al.
Veröffentlicht: (2025)
von: Huang, Fuxiang, et al.
Veröffentlicht: (2025)
CoDA: Instructive Chain-of-Domain Adaptation with Severity-Aware Visual Prompt Tuning
von: Gong, Ziyang, et al.
Veröffentlicht: (2024)
von: Gong, Ziyang, et al.
Veröffentlicht: (2024)
PM2: A New Prompting Multi-modal Model Paradigm for Few-shot Medical Image Classification
von: Wang, Zhenwei, et al.
Veröffentlicht: (2024)
von: Wang, Zhenwei, et al.
Veröffentlicht: (2024)
Multi-Label Test-Time Adaptation with Bound Entropy Minimization
von: Wu, Xiangyu, et al.
Veröffentlicht: (2025)
von: Wu, Xiangyu, et al.
Veröffentlicht: (2025)
Visual Generation Tuning
von: Guo, Jiahao, et al.
Veröffentlicht: (2025)
von: Guo, Jiahao, et al.
Veröffentlicht: (2025)
Dynamic Tuning Towards Parameter and Inference Efficiency for ViT Adaptation
von: Zhao, Wangbo, et al.
Veröffentlicht: (2024)
von: Zhao, Wangbo, et al.
Veröffentlicht: (2024)
CMC-Bench: Towards a New Paradigm of Visual Signal Compression
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
NAS-LoRA: Empowering Parameter-Efficient Fine-Tuning for Visual Foundation Models with Searchable Adaptation
von: Chen, Renqi, et al.
Veröffentlicht: (2025)
von: Chen, Renqi, et al.
Veröffentlicht: (2025)
DetToolChain: A New Prompting Paradigm to Unleash Detection Ability of MLLM
von: Wu, Yixuan, et al.
Veröffentlicht: (2024)
von: Wu, Yixuan, et al.
Veröffentlicht: (2024)
InterGSEdit: Interactive 3D Gaussian Splatting Editing with 3D Geometry-Consistent Attention Prior
von: Wen, Minghao, et al.
Veröffentlicht: (2025)
von: Wen, Minghao, et al.
Veröffentlicht: (2025)
Osprey: Pixel Understanding with Visual Instruction Tuning
von: Yuan, Yuqian, et al.
Veröffentlicht: (2023)
von: Yuan, Yuqian, et al.
Veröffentlicht: (2023)
Nonlinear Bipolar Compensation: Handling Outliers in Post-Training Quantization
von: Sun, Peilin, et al.
Veröffentlicht: (2026)
von: Sun, Peilin, et al.
Veröffentlicht: (2026)
Little Data, Big Impact: Privacy-Aware Visual Language Models via Minimal Tuning
von: Samson, Laurens, et al.
Veröffentlicht: (2024)
von: Samson, Laurens, et al.
Veröffentlicht: (2024)
Pixel-Level Domain Adaptation: A New Perspective for Enhancing Weakly Supervised Semantic Segmentation
von: Du, Ye, et al.
Veröffentlicht: (2024)
von: Du, Ye, et al.
Veröffentlicht: (2024)
Scaling Up Audio-Synchronized Visual Animation: An Efficient Training Paradigm
von: Zhang, Lin, et al.
Veröffentlicht: (2025)
von: Zhang, Lin, et al.
Veröffentlicht: (2025)
PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering
von: Zhang, Xiaoman, et al.
Veröffentlicht: (2023)
von: Zhang, Xiaoman, et al.
Veröffentlicht: (2023)
Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through $f$-divergence Minimization
von: Sun, Haoyuan, et al.
Veröffentlicht: (2024)
von: Sun, Haoyuan, et al.
Veröffentlicht: (2024)
Visual Spatial Tuning
von: Yang, Rui, et al.
Veröffentlicht: (2025)
von: Yang, Rui, et al.
Veröffentlicht: (2025)
LiteFusion: Taming 3D Object Detectors from Vision-Based to Multi-Modal with Minimal Adaptation
von: Ren, Xiangxuan, et al.
Veröffentlicht: (2025)
von: Ren, Xiangxuan, et al.
Veröffentlicht: (2025)
Split to Merge: Unifying Separated Modalities for Unsupervised Domain Adaptation
von: Li, Xinyao, et al.
Veröffentlicht: (2024)
von: Li, Xinyao, et al.
Veröffentlicht: (2024)
GPLQ: A General, Practical, and Lightning QAT Method for Vision Transformers
von: Liang, Guang, et al.
Veröffentlicht: (2025)
von: Liang, Guang, et al.
Veröffentlicht: (2025)
PathVG: A New Benchmark and Dataset for Pathology Visual Grounding
von: Zhong, Chunlin, et al.
Veröffentlicht: (2025)
von: Zhong, Chunlin, et al.
Veröffentlicht: (2025)
Visual-RFT: Visual Reinforcement Fine-Tuning
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
LookSharp: Attention Entropy Minimization for Test-Time Adaptation
von: Mali, Yash, et al.
Veröffentlicht: (2025)
von: Mali, Yash, et al.
Veröffentlicht: (2025)
Robust Diagram Reasoning: A Framework for Enhancing LVLM Performance on Visually Perturbed Scientific Diagrams
von: Zhou, Minghao, et al.
Veröffentlicht: (2025)
von: Zhou, Minghao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
von: Tang, Ningyuan, et al.
Veröffentlicht: (2024) -
QwT-v2: Practical, Effective and Efficient Post-Training Quantization
von: Tang, Ningyuan, et al.
Veröffentlicht: (2025) -
DTL: Disentangled Transfer Learning for Visual Recognition
von: Fu, Minghao, et al.
Veröffentlicht: (2023) -
Rectify the Regression Bias in Long-Tailed Object Detection
von: Zhu, Ke, et al.
Veröffentlicht: (2024) -
TWEO: Transformers Without Extreme Outliers Enables FP8 Training And Quantization For Dummies
von: Liang, Guang, et al.
Veröffentlicht: (2025)