Remodeling Semantic Relationships in Vision-Language Fine-Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Xiangyang, Liu, Liu, Yu, Baosheng, Qiu, Jiayan, Shi, Zhenwei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LARGO: Low-Rank Regulated Gradient Projection for Robust Parameter Efficient Fine-Tuning
par: Zhang, Haotian, et autres
Publié: (2025)
par: Zhang, Haotian, et autres
Publié: (2025)
SEAM: Semantically Equivalent Across Modalities Benchmark for Vision-Language Models
par: Tang, Zhenwei, et autres
Publié: (2025)
par: Tang, Zhenwei, et autres
Publié: (2025)
SteelDefectX: A Multi-Form Vision-Language Dataset and Benchmark for Steel Surface Defect Analysis
par: Zhao, Shuxian, et autres
Publié: (2026)
par: Zhao, Shuxian, et autres
Publié: (2026)
A Visual Semantic Adaptive Watermark grounded by Prefix-Tuning for Large Vision-Language Model
par: Zheng, Qi, et autres
Publié: (2026)
par: Zheng, Qi, et autres
Publié: (2026)
Hierarchy-Aware Fine-Tuning of Vision-Language Models
par: Li, Jiayu, et autres
Publié: (2025)
par: Li, Jiayu, et autres
Publié: (2025)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
par: Lan, Long, et autres
Publié: (2024)
par: Lan, Long, et autres
Publié: (2024)
Adversarial Prompt Tuning for Vision-Language Models
par: Zhang, Jiaming, et autres
Publié: (2023)
par: Zhang, Jiaming, et autres
Publié: (2023)
Fine-Tuning Vision-Language Models for Visual Navigation Assistance
par: Li, Xiao, et autres
Publié: (2025)
par: Li, Xiao, et autres
Publié: (2025)
Towards Calibrated Robust Fine-Tuning of Vision-Language Models
par: Oh, Changdae, et autres
Publié: (2023)
par: Oh, Changdae, et autres
Publié: (2023)
NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust Vision-Language Models
par: Zhang, Jiaming, et autres
Publié: (2025)
par: Zhang, Jiaming, et autres
Publié: (2025)
EVLP:Learning Unified Embodied Vision-Language Planner with Reinforced Supervised Fine-Tuning
par: Cai, Xinyan, et autres
Publié: (2025)
par: Cai, Xinyan, et autres
Publié: (2025)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
par: Ma, Jie, et autres
Publié: (2026)
par: Ma, Jie, et autres
Publié: (2026)
Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models
par: Zhu, Wenhui, et autres
Publié: (2025)
par: Zhu, Wenhui, et autres
Publié: (2025)
3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation
par: Lee, Seonho, et autres
Publié: (2025)
par: Lee, Seonho, et autres
Publié: (2025)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
par: Tan, Huajie, et autres
Publié: (2025)
par: Tan, Huajie, et autres
Publié: (2025)
Fine-Tuning Vision-Language Model for Automated Engineering Drawing Information Extraction
par: Khan, Muhammad Tayyab, et autres
Publié: (2024)
par: Khan, Muhammad Tayyab, et autres
Publié: (2024)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
par: Ding, Kun, et autres
Publié: (2022)
par: Ding, Kun, et autres
Publié: (2022)
Mitigating the Reasoning Tax in Vision-Language Fine-Tuning with Input-Adaptive Depth Aggregation
par: Ren, Yiming, et autres
Publié: (2026)
par: Ren, Yiming, et autres
Publié: (2026)
RaVL: Discovering and Mitigating Spurious Correlations in Fine-Tuned Vision-Language Models
par: Varma, Maya, et autres
Publié: (2024)
par: Varma, Maya, et autres
Publié: (2024)
Is There Knowledge Left to Extract? Evidence of Fragility in Medically Fine-Tuned Vision-Language Models
par: McLaughlin, Oliver, et autres
Publié: (2026)
par: McLaughlin, Oliver, et autres
Publié: (2026)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
par: Zhang, Zhifang, et autres
Publié: (2024)
par: Zhang, Zhifang, et autres
Publié: (2024)
Global Semantic-Guided Sub-image Feature Weight Allocation in High-Resolution Large Vision-Language Models
par: Liang, Yuxuan, et autres
Publié: (2025)
par: Liang, Yuxuan, et autres
Publié: (2025)
Adaptive Layer Selection for Efficient Vision Transformer Fine-Tuning
par: Devoto, Alessio, et autres
Publié: (2024)
par: Devoto, Alessio, et autres
Publié: (2024)
Multimodal Carotid Risk Stratification with Large Vision-Language Models: Benchmarking, Fine-Tuning, and Clinical Insights
par: Tsolissou, Daphne, et autres
Publié: (2025)
par: Tsolissou, Daphne, et autres
Publié: (2025)
FairLLaVA: Fairness-Aware Parameter-Efficient Fine-Tuning for Large Vision-Language Assistants
par: Bhosale, Mahesh, et autres
Publié: (2026)
par: Bhosale, Mahesh, et autres
Publié: (2026)
Offline Semantic Guidance for Efficient Vision-Language-Action Policy Distillation
par: Shi, Jin, et autres
Publié: (2026)
par: Shi, Jin, et autres
Publié: (2026)
Think-Before-Draw: Decomposing Emotion Semantics & Fine-Grained Controllable Expressive Talking Head Generation
par: Shi, Hanlei, et autres
Publié: (2025)
par: Shi, Hanlei, et autres
Publié: (2025)
Biomed-DPT: Dual Modality Prompt Tuning for Biomedical Vision-Language Models
par: Peng, Wei, et autres
Publié: (2025)
par: Peng, Wei, et autres
Publié: (2025)
Urban Socio-Semantic Segmentation with Vision-Language Reasoning
par: Wang, Yu, et autres
Publié: (2026)
par: Wang, Yu, et autres
Publié: (2026)
Parameter-Efficient Fine-Tuning Medical Multimodal Large Language Models for Medical Visual Grounding
par: He, Jinlong, et autres
Publié: (2024)
par: He, Jinlong, et autres
Publié: (2024)
LongFly: Long-Horizon UAV Vision-and-Language Navigation with Spatiotemporal Context Integration
par: Jiang, Wen, et autres
Publié: (2025)
par: Jiang, Wen, et autres
Publié: (2025)
Sim-CLIP: Unsupervised Siamese Adversarial Fine-Tuning for Robust and Semantically-Rich Vision-Language Models
par: Hossain, Md Zarif, et autres
Publié: (2024)
par: Hossain, Md Zarif, et autres
Publié: (2024)
Fine-Grained Instruction-Guided Graph Reasoning for Vision-and-Language Navigation
par: Liu, Yaohua, et autres
Publié: (2025)
par: Liu, Yaohua, et autres
Publié: (2025)
GRE Suite: Geo-localization Inference via Fine-Tuned Vision-Language Models and Enhanced Reasoning Chains
par: Wang, Chun, et autres
Publié: (2025)
par: Wang, Chun, et autres
Publié: (2025)
VCM: Vision Concept Modeling Based on Implicit Contrastive Learning with Vision-Language Instruction Fine-Tuning
par: Luo, Run, et autres
Publié: (2025)
par: Luo, Run, et autres
Publié: (2025)
Visual Agentic Reinforcement Fine-Tuning
par: Liu, Ziyu, et autres
Publié: (2025)
par: Liu, Ziyu, et autres
Publié: (2025)
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
par: Tang, Ningyuan, et autres
Publié: (2024)
par: Tang, Ningyuan, et autres
Publié: (2024)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
par: Wang, Chenhao, et autres
Publié: (2026)
par: Wang, Chenhao, et autres
Publié: (2026)
Gradient-based Fine-Tuning through Pre-trained Model Regularization
par: Liu, Xuanbo, et autres
Publié: (2025)
par: Liu, Xuanbo, et autres
Publié: (2025)
Confounder-Aware Medical Data Selection for Fine-Tuning Pretrained Vision Models
par: Ji, Anyang, et autres
Publié: (2025)
par: Ji, Anyang, et autres
Publié: (2025)
Documents similaires
-
LARGO: Low-Rank Regulated Gradient Projection for Robust Parameter Efficient Fine-Tuning
par: Zhang, Haotian, et autres
Publié: (2025) -
SEAM: Semantically Equivalent Across Modalities Benchmark for Vision-Language Models
par: Tang, Zhenwei, et autres
Publié: (2025) -
SteelDefectX: A Multi-Form Vision-Language Dataset and Benchmark for Steel Surface Defect Analysis
par: Zhao, Shuxian, et autres
Publié: (2026) -
A Visual Semantic Adaptive Watermark grounded by Prefix-Tuning for Large Vision-Language Model
par: Zheng, Qi, et autres
Publié: (2026) -
Hierarchy-Aware Fine-Tuning of Vision-Language Models
par: Li, Jiayu, et autres
Publié: (2025)