HiFT: A Hierarchical Full Parameter Fine-Tuning Strategy
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yongkang, Zhang, Yiqun, Li, Qian, Liu, Tong, Feng, Shi, Wang, Daling, Zhang, Yifei, Schütze, Hinrich |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ChunkFT: Byte-Streamed Optimization for Memory-Efficient Full Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2026)
par: Liu, Yongkang, et autres
Publié: (2026)
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2026)
par: Liu, Yongkang, et autres
Publié: (2026)
Look Within or Look Beyond? A Theoretical Comparison Between Parameter-Efficient and Full Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2025)
par: Liu, Yongkang, et autres
Publié: (2025)
Evaluate What You Can't Evaluate: Unassessable Quality for Generated Response
par: Liu, Yongkang, et autres
Publié: (2023)
par: Liu, Yongkang, et autres
Publié: (2023)
ChatZero:Zero-shot Cross-Lingual Dialogue Generation via Pseudo-Target Language
par: Liu, Yongkang, et autres
Publié: (2024)
par: Liu, Yongkang, et autres
Publié: (2024)
High-Rank Structured Modulation for Parameter-Efficient Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2026)
par: Liu, Yongkang, et autres
Publié: (2026)
Why Do More Experts Fail? A Theoretical Analysis of Model Merging
par: Wang, Zijing, et autres
Publié: (2025)
par: Wang, Zijing, et autres
Publié: (2025)
MoLAN: A Unified Modality-Aware Noise Dynamic Editing Framework for Multimodal Sentiment Analysis
par: Xu, Xingle, et autres
Publié: (2025)
par: Xu, Xingle, et autres
Publié: (2025)
GiFT: Gibbs Fine-Tuning for Code Generation
par: Li, Haochen, et autres
Publié: (2025)
par: Li, Haochen, et autres
Publié: (2025)
A Unified Data Augmentation Framework for Low-Resource Multi-Domain Dialogue Generation
par: Liu, Yongkang, et autres
Publié: (2024)
par: Liu, Yongkang, et autres
Publié: (2024)
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
par: Gerstner, Sebastian, et autres
Publié: (2026)
par: Gerstner, Sebastian, et autres
Publié: (2026)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
par: Gerstner, Sebastian, et autres
Publié: (2025)
par: Gerstner, Sebastian, et autres
Publié: (2025)
SAD: A Large-Scale Strategic Argumentative Dialogue Dataset
par: Liu, Yongkang, et autres
Publié: (2026)
par: Liu, Yongkang, et autres
Publié: (2026)
Your Pretrained Model Tells the Difficulty Itself: A Self-Adaptive Curriculum Learning Paradigm for Natural Language Understanding
par: Feng, Qi, et autres
Publié: (2025)
par: Feng, Qi, et autres
Publié: (2025)
LongForm: Effective Instruction Tuning with Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2023)
par: Köksal, Abdullatif, et autres
Publié: (2023)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
HiDe-LLaVA: Hierarchical Decoupling for Continual Instruction Tuning of Multimodal Large Language Model
par: Guo, Haiyang, et autres
Publié: (2025)
par: Guo, Haiyang, et autres
Publié: (2025)
Hi-ZFO: Hierarchical Zeroth- and First-Order LLM Fine-Tuning via Importance-Guided Tensor Selection
par: Jin, Feihu, et autres
Publié: (2026)
par: Jin, Feihu, et autres
Publié: (2026)
MEKiT: Multi-source Heterogeneous Knowledge Injection Method via Instruction Tuning for Emotion-Cause Pair Extraction
par: Mu, Shiyi, et autres
Publié: (2025)
par: Mu, Shiyi, et autres
Publié: (2025)
Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning
par: Lin, Zekai, et autres
Publié: (2026)
par: Lin, Zekai, et autres
Publié: (2026)
Parameter-Efficient Fine-Tuning via Circular Convolution
par: Chen, Aochuan, et autres
Publié: (2024)
par: Chen, Aochuan, et autres
Publié: (2024)
Neural Parameter Search for Slimmer Fine-Tuned Models and Better Transfer
par: Du, Guodong, et autres
Publié: (2025)
par: Du, Guodong, et autres
Publié: (2025)
Parameter-Efficient Fine-Tuning for Foundation Models
par: Zhang, Dan, et autres
Publié: (2025)
par: Zhang, Dan, et autres
Publié: (2025)
Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning
par: Zhang, Hanlu, et autres
Publié: (2025)
par: Zhang, Hanlu, et autres
Publié: (2025)
FT-Dojo: Towards Autonomous LLM Fine-Tuning with Language Agents
par: Li, Qizheng, et autres
Publié: (2026)
par: Li, Qizheng, et autres
Publié: (2026)
From Parameter Dynamics to Risk Scoring : Quantifying Sample-Level Safety Degradation in LLM Fine-tuning
par: Wang, Xiao, et autres
Publié: (2026)
par: Wang, Xiao, et autres
Publié: (2026)
MoRA: High-Rank Updating for Parameter-Efficient Fine-Tuning
par: Jiang, Ting, et autres
Publié: (2024)
par: Jiang, Ting, et autres
Publié: (2024)
MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2024)
par: Köksal, Abdullatif, et autres
Publié: (2024)
DropLoRA: Sparse Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
par: Zhang, Haojie
Publié: (2025)
par: Zhang, Haojie
Publié: (2025)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
par: Gao, Ziqi, et autres
Publié: (2024)
par: Gao, Ziqi, et autres
Publié: (2024)
Generative Emotion Cause Explanation in Multimodal Conversations
par: Wang, Lin, et autres
Publié: (2024)
par: Wang, Lin, et autres
Publié: (2024)
SPP: Sparsity-Preserved Parameter-Efficient Fine-Tuning for Large Language Models
par: Lu, Xudong, et autres
Publié: (2024)
par: Lu, Xudong, et autres
Publié: (2024)
FuRA: Full-Rank Parameter-Efficient Fine-Tuning with Spectral Preconditioning
par: Zhao, Yequan, et autres
Publié: (2026)
par: Zhao, Yequan, et autres
Publié: (2026)
From Parameters to Data: A Task-Parameter-Guided Fine-Tuning Pipeline for Efficient LLM Alignment
par: Chen, Hao, et autres
Publié: (2026)
par: Chen, Hao, et autres
Publié: (2026)
BlackboxNLP-2025 MIB Shared Task: Exploring Ensemble Strategies for Circuit Localization Methods
par: Mondorf, Philipp, et autres
Publié: (2025)
par: Mondorf, Philipp, et autres
Publié: (2025)
PlaM: Training-Free Plateau-Guided Model Merging for Better Visual Grounding in MLLMs
par: Wang, Zijing, et autres
Publié: (2026)
par: Wang, Zijing, et autres
Publié: (2026)
CRAFT Your Dataset: Task-Specific Synthetic Dataset Generation Through Corpus Retrieval and Augmentation
par: Ziegler, Ingo, et autres
Publié: (2024)
par: Ziegler, Ingo, et autres
Publié: (2024)
Better Call SAUL: Fluent and Consistent Language Model Editing with Generation Regularization
par: Wang, Mingyang, et autres
Publié: (2024)
par: Wang, Mingyang, et autres
Publié: (2024)
Learn it or Leave it: Module Composition and Pruning for Continual Learning
par: Wang, Mingyang, et autres
Publié: (2024)
par: Wang, Mingyang, et autres
Publié: (2024)
Rehearsal-Free Modular and Compositional Continual Learning for Language Models
par: Wang, Mingyang, et autres
Publié: (2024)
par: Wang, Mingyang, et autres
Publié: (2024)
Documents similaires
-
ChunkFT: Byte-Streamed Optimization for Memory-Efficient Full Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2026) -
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2026) -
Look Within or Look Beyond? A Theoretical Comparison Between Parameter-Efficient and Full Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2025) -
Evaluate What You Can't Evaluate: Unassessable Quality for Generated Response
par: Liu, Yongkang, et autres
Publié: (2023) -
ChatZero:Zero-shot Cross-Lingual Dialogue Generation via Pseudo-Target Language
par: Liu, Yongkang, et autres
Publié: (2024)