HiFT: A Hierarchical Full Parameter Fine-Tuning Strategy
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Yongkang, Zhang, Yiqun, Li, Qian, Liu, Tong, Feng, Shi, Wang, Daling, Zhang, Yifei, Schütze, Hinrich |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ChunkFT: Byte-Streamed Optimization for Memory-Efficient Full Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
Look Within or Look Beyond? A Theoretical Comparison Between Parameter-Efficient and Full Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2025)
di: Liu, Yongkang, et al.
Pubblicazione: (2025)
Evaluate What You Can't Evaluate: Unassessable Quality for Generated Response
di: Liu, Yongkang, et al.
Pubblicazione: (2023)
di: Liu, Yongkang, et al.
Pubblicazione: (2023)
ChatZero:Zero-shot Cross-Lingual Dialogue Generation via Pseudo-Target Language
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
High-Rank Structured Modulation for Parameter-Efficient Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
Why Do More Experts Fail? A Theoretical Analysis of Model Merging
di: Wang, Zijing, et al.
Pubblicazione: (2025)
di: Wang, Zijing, et al.
Pubblicazione: (2025)
MoLAN: A Unified Modality-Aware Noise Dynamic Editing Framework for Multimodal Sentiment Analysis
di: Xu, Xingle, et al.
Pubblicazione: (2025)
di: Xu, Xingle, et al.
Pubblicazione: (2025)
GiFT: Gibbs Fine-Tuning for Code Generation
di: Li, Haochen, et al.
Pubblicazione: (2025)
di: Li, Haochen, et al.
Pubblicazione: (2025)
A Unified Data Augmentation Framework for Low-Resource Multi-Domain Dialogue Generation
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
di: Gerstner, Sebastian, et al.
Pubblicazione: (2026)
di: Gerstner, Sebastian, et al.
Pubblicazione: (2026)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
di: Gerstner, Sebastian, et al.
Pubblicazione: (2025)
di: Gerstner, Sebastian, et al.
Pubblicazione: (2025)
SAD: A Large-Scale Strategic Argumentative Dialogue Dataset
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
Your Pretrained Model Tells the Difficulty Itself: A Self-Adaptive Curriculum Learning Paradigm for Natural Language Understanding
di: Feng, Qi, et al.
Pubblicazione: (2025)
di: Feng, Qi, et al.
Pubblicazione: (2025)
LongForm: Effective Instruction Tuning with Reverse Instructions
di: Köksal, Abdullatif, et al.
Pubblicazione: (2023)
di: Köksal, Abdullatif, et al.
Pubblicazione: (2023)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
di: Özeren, Enes, et al.
Pubblicazione: (2025)
di: Özeren, Enes, et al.
Pubblicazione: (2025)
HiDe-LLaVA: Hierarchical Decoupling for Continual Instruction Tuning of Multimodal Large Language Model
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
Hi-ZFO: Hierarchical Zeroth- and First-Order LLM Fine-Tuning via Importance-Guided Tensor Selection
di: Jin, Feihu, et al.
Pubblicazione: (2026)
di: Jin, Feihu, et al.
Pubblicazione: (2026)
MEKiT: Multi-source Heterogeneous Knowledge Injection Method via Instruction Tuning for Emotion-Cause Pair Extraction
di: Mu, Shiyi, et al.
Pubblicazione: (2025)
di: Mu, Shiyi, et al.
Pubblicazione: (2025)
Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning
di: Lin, Zekai, et al.
Pubblicazione: (2026)
di: Lin, Zekai, et al.
Pubblicazione: (2026)
Parameter-Efficient Fine-Tuning via Circular Convolution
di: Chen, Aochuan, et al.
Pubblicazione: (2024)
di: Chen, Aochuan, et al.
Pubblicazione: (2024)
Neural Parameter Search for Slimmer Fine-Tuned Models and Better Transfer
di: Du, Guodong, et al.
Pubblicazione: (2025)
di: Du, Guodong, et al.
Pubblicazione: (2025)
Parameter-Efficient Fine-Tuning for Foundation Models
di: Zhang, Dan, et al.
Pubblicazione: (2025)
di: Zhang, Dan, et al.
Pubblicazione: (2025)
Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning
di: Zhang, Hanlu, et al.
Pubblicazione: (2025)
di: Zhang, Hanlu, et al.
Pubblicazione: (2025)
FT-Dojo: Towards Autonomous LLM Fine-Tuning with Language Agents
di: Li, Qizheng, et al.
Pubblicazione: (2026)
di: Li, Qizheng, et al.
Pubblicazione: (2026)
From Parameter Dynamics to Risk Scoring : Quantifying Sample-Level Safety Degradation in LLM Fine-tuning
di: Wang, Xiao, et al.
Pubblicazione: (2026)
di: Wang, Xiao, et al.
Pubblicazione: (2026)
MoRA: High-Rank Updating for Parameter-Efficient Fine-Tuning
di: Jiang, Ting, et al.
Pubblicazione: (2024)
di: Jiang, Ting, et al.
Pubblicazione: (2024)
MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions
di: Köksal, Abdullatif, et al.
Pubblicazione: (2024)
di: Köksal, Abdullatif, et al.
Pubblicazione: (2024)
DropLoRA: Sparse Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
di: Zhang, Haojie
Pubblicazione: (2025)
di: Zhang, Haojie
Pubblicazione: (2025)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
di: Gao, Ziqi, et al.
Pubblicazione: (2024)
di: Gao, Ziqi, et al.
Pubblicazione: (2024)
Generative Emotion Cause Explanation in Multimodal Conversations
di: Wang, Lin, et al.
Pubblicazione: (2024)
di: Wang, Lin, et al.
Pubblicazione: (2024)
SPP: Sparsity-Preserved Parameter-Efficient Fine-Tuning for Large Language Models
di: Lu, Xudong, et al.
Pubblicazione: (2024)
di: Lu, Xudong, et al.
Pubblicazione: (2024)
FuRA: Full-Rank Parameter-Efficient Fine-Tuning with Spectral Preconditioning
di: Zhao, Yequan, et al.
Pubblicazione: (2026)
di: Zhao, Yequan, et al.
Pubblicazione: (2026)
From Parameters to Data: A Task-Parameter-Guided Fine-Tuning Pipeline for Efficient LLM Alignment
di: Chen, Hao, et al.
Pubblicazione: (2026)
di: Chen, Hao, et al.
Pubblicazione: (2026)
BlackboxNLP-2025 MIB Shared Task: Exploring Ensemble Strategies for Circuit Localization Methods
di: Mondorf, Philipp, et al.
Pubblicazione: (2025)
di: Mondorf, Philipp, et al.
Pubblicazione: (2025)
PlaM: Training-Free Plateau-Guided Model Merging for Better Visual Grounding in MLLMs
di: Wang, Zijing, et al.
Pubblicazione: (2026)
di: Wang, Zijing, et al.
Pubblicazione: (2026)
CRAFT Your Dataset: Task-Specific Synthetic Dataset Generation Through Corpus Retrieval and Augmentation
di: Ziegler, Ingo, et al.
Pubblicazione: (2024)
di: Ziegler, Ingo, et al.
Pubblicazione: (2024)
Better Call SAUL: Fluent and Consistent Language Model Editing with Generation Regularization
di: Wang, Mingyang, et al.
Pubblicazione: (2024)
di: Wang, Mingyang, et al.
Pubblicazione: (2024)
Learn it or Leave it: Module Composition and Pruning for Continual Learning
di: Wang, Mingyang, et al.
Pubblicazione: (2024)
di: Wang, Mingyang, et al.
Pubblicazione: (2024)
Rehearsal-Free Modular and Compositional Continual Learning for Language Models
di: Wang, Mingyang, et al.
Pubblicazione: (2024)
di: Wang, Mingyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ChunkFT: Byte-Streamed Optimization for Memory-Efficient Full Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2026) -
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2026) -
Look Within or Look Beyond? A Theoretical Comparison Between Parameter-Efficient and Full Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2025) -
Evaluate What You Can't Evaluate: Unassessable Quality for Generated Response
di: Liu, Yongkang, et al.
Pubblicazione: (2023) -
ChatZero:Zero-shot Cross-Lingual Dialogue Generation via Pseudo-Target Language
di: Liu, Yongkang, et al.
Pubblicazione: (2024)