Efficiency in Focus: LayerNorm as a Catalyst for Fine-tuning Medical Visual Language Pre-trained Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Jiawei, Yang, Dingkang, Jiang, Yue, Li, Mingcheng, Wei, Jinjie, Hou, Xiaolu, Zhang, Lihua |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Can LLMs' Tuning Methods Work in Medical Multimodal Domain?
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation
von: Li, Mingcheng, et al.
Veröffentlicht: (2025)
von: Li, Mingcheng, et al.
Veröffentlicht: (2025)
BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation
von: Hou, Xiaolu, et al.
Veröffentlicht: (2025)
von: Hou, Xiaolu, et al.
Veröffentlicht: (2025)
SatireDecoder: Visual Cascaded Decoupling for Enhancing Satirical Image Comprehension
von: Jiang, Yue, et al.
Veröffentlicht: (2025)
von: Jiang, Yue, et al.
Veröffentlicht: (2025)
ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation
von: Xue, Wei, et al.
Veröffentlicht: (2026)
von: Xue, Wei, et al.
Veröffentlicht: (2026)
CoMT: Chain-of-Medical-Thought Reduces Hallucination in Medical Report Generation
von: Jiang, Yue, et al.
Veröffentlicht: (2024)
von: Jiang, Yue, et al.
Veröffentlicht: (2024)
Toward Robust Incomplete Multimodal Sentiment Analysis via Hierarchical Representation Learning
von: Li, Mingcheng, et al.
Veröffentlicht: (2024)
von: Li, Mingcheng, et al.
Veröffentlicht: (2024)
Skip and Skip: Segmenting Medical Images with Prompts
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
Geometry and Dynamics of LayerNorm
von: Riechers, Paul M.
Veröffentlicht: (2024)
von: Riechers, Paul M.
Veröffentlicht: (2024)
You can remove GPT2's LayerNorm by fine-tuning
von: Heimersheim, Stefan
Veröffentlicht: (2024)
von: Heimersheim, Stefan
Veröffentlicht: (2024)
LayerNorm: A key component in parameter-efficient fine-tuning
von: ValizadehAslani, Taha, et al.
Veröffentlicht: (2024)
von: ValizadehAslani, Taha, et al.
Veröffentlicht: (2024)
MoETTA: Test-Time Adaptation Under Mixed Distribution Shifts with MoE-LayerNorm
von: Fan, Xiao, et al.
Veröffentlicht: (2025)
von: Fan, Xiao, et al.
Veröffentlicht: (2025)
MISS: A Generative Pretraining and Finetuning Approach for Med-VQA
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
Debiased Multimodal Understanding for Human Language Sequences
von: Xu, Zhi, et al.
Veröffentlicht: (2024)
von: Xu, Zhi, et al.
Veröffentlicht: (2024)
MedFILIP: Medical Fine-grained Language-Image Pre-training
von: Liang, Xinjie, et al.
Veröffentlicht: (2025)
von: Liang, Xinjie, et al.
Veröffentlicht: (2025)
On the Role of Attention Masks and LayerNorm in Transformers
von: Wu, Xinyi, et al.
Veröffentlicht: (2024)
von: Wu, Xinyi, et al.
Veröffentlicht: (2024)
SLaNC: Static LayerNorm Calibration
von: Salmani, Mahsa, et al.
Veröffentlicht: (2024)
von: Salmani, Mahsa, et al.
Veröffentlicht: (2024)
Post-LayerNorm Is Back: Stable, ExpressivE, and Deep
von: Chen, Chen, et al.
Veröffentlicht: (2026)
von: Chen, Chen, et al.
Veröffentlicht: (2026)
Robust Emotion Recognition in Context Debiasing
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
Resolving Evidence Sparsity: Agentic Context Engineering for Long-Document Understanding
von: Liu, Keliang, et al.
Veröffentlicht: (2025)
von: Liu, Keliang, et al.
Veröffentlicht: (2025)
An Empirical Study of Parameter Efficient Fine-tuning on Vision-Language Pre-train Model
von: Tian, Yuxin, et al.
Veröffentlicht: (2024)
von: Tian, Yuxin, et al.
Veröffentlicht: (2024)
Improving Factuality in Large Language Models via Decoding-Time Hallucinatory and Truthful Comparators
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
Securely Fine-tuning Pre-trained Encoders Against Adversarial Examples
von: Zhou, Ziqi, et al.
Veröffentlicht: (2024)
von: Zhou, Ziqi, et al.
Veröffentlicht: (2024)
Light-weight Fine-tuning Method for Defending Adversarial Noise in Pre-trained Medical Vision-Language Models
von: Han, Xu, et al.
Veröffentlicht: (2024)
von: Han, Xu, et al.
Veröffentlicht: (2024)
Transformers Don't Need LayerNorm at Inference Time: Scaling LayerNorm Removal to GPT-2 XL and the Implications for Mechanistic Interpretability
von: Baroni, Luca, et al.
Veröffentlicht: (2025)
von: Baroni, Luca, et al.
Veröffentlicht: (2025)
LayerNorm Induces Recency Bias in Transformer Decoders
von: Kim, Junu, et al.
Veröffentlicht: (2025)
von: Kim, Junu, et al.
Veröffentlicht: (2025)
Fine-tuning Pre-trained Vision-Language Models in a Human-Annotation-Free Manner
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2026)
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2026)
FysicsWorld: A Unified Full-Modality Benchmark for Any-to-Any Understanding, Generation, and Reasoning
von: Jiang, Yue, et al.
Veröffentlicht: (2025)
von: Jiang, Yue, et al.
Veröffentlicht: (2025)
Asynchronous Multimodal Video Sequence Fusion via Learning Modality-Exclusive and -Agnostic Representations
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
Robust Fine-tuning for Pre-trained 3D Point Cloud Models
von: Zhang, Zhibo, et al.
Veröffentlicht: (2024)
von: Zhang, Zhibo, et al.
Veröffentlicht: (2024)
PediatricsGPT: Large Language Models as Chinese Medical Assistants for Pediatric Applications
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
von: Yang, Dingkang, et al.
Veröffentlicht: (2024)
Improving Multimodal Sentiment Analysis via Modality Optimization and Dynamic Primary Modality Selection
von: Yang, Dingkang, et al.
Veröffentlicht: (2025)
von: Yang, Dingkang, et al.
Veröffentlicht: (2025)
MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation
von: Zhao, Xiao, et al.
Veröffentlicht: (2024)
von: Zhao, Xiao, et al.
Veröffentlicht: (2024)
Faster Diffusion Action Segmentation
von: Wang, Shuaibing, et al.
Veröffentlicht: (2024)
von: Wang, Shuaibing, et al.
Veröffentlicht: (2024)
HandGCAT: Occlusion-Robust 3D Hand Mesh Reconstruction from Monocular Images
von: Wang, Shuaibing, et al.
Veröffentlicht: (2024)
von: Wang, Shuaibing, et al.
Veröffentlicht: (2024)
OmniFysics: Towards Physical Intelligence Evolution via Omni-Modal Signal Processing and Network Optimization
von: Han, Minghao, et al.
Veröffentlicht: (2026)
von: Han, Minghao, et al.
Veröffentlicht: (2026)
Large Vision-Language Models as Emotion Recognizers in Context Awareness
von: Lei, Yuxuan, et al.
Veröffentlicht: (2024)
von: Lei, Yuxuan, et al.
Veröffentlicht: (2024)
SLCA++: Unleash the Power of Sequential Fine-tuning for Continual Learning with Pre-training
von: Zhang, Gengwei, et al.
Veröffentlicht: (2024)
von: Zhang, Gengwei, et al.
Veröffentlicht: (2024)
Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification
von: Tan, Zhaorui, et al.
Veröffentlicht: (2025)
von: Tan, Zhaorui, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Can LLMs' Tuning Methods Work in Medical Multimodal Domain?
von: Chen, Jiawei, et al.
Veröffentlicht: (2024) -
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
von: Chen, Jiawei, et al.
Veröffentlicht: (2024) -
MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation
von: Li, Mingcheng, et al.
Veröffentlicht: (2025) -
BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation
von: Hou, Xiaolu, et al.
Veröffentlicht: (2025) -
SatireDecoder: Visual Cascaded Decoupling for Enhancing Satirical Image Comprehension
von: Jiang, Yue, et al.
Veröffentlicht: (2025)