Diversity in Large Language Models under Supervised Fine-Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Klypa, Roman, Cherednichenko, Oleksandr |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
di: Li, Ziniu, et al.
Pubblicazione: (2024)
di: Li, Ziniu, et al.
Pubblicazione: (2024)
Multimodal Alignment and Preference Optimization for Zero-Shot Conditional RNA Generation
di: Klypa, Roman, et al.
Pubblicazione: (2026)
di: Klypa, Roman, et al.
Pubblicazione: (2026)
BAnG: Bidirectional Anchored Generation for Conditional RNA Design
di: Klypa, Roman, et al.
Pubblicazione: (2025)
di: Klypa, Roman, et al.
Pubblicazione: (2025)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
di: Kim, Gyuhak, et al.
Pubblicazione: (2025)
di: Kim, Gyuhak, et al.
Pubblicazione: (2025)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
di: Riemer, Matthew, et al.
Pubblicazione: (2025)
di: Riemer, Matthew, et al.
Pubblicazione: (2025)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
di: Wei, Quan, et al.
Pubblicazione: (2025)
di: Wei, Quan, et al.
Pubblicazione: (2025)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
di: Zhang, Minmin, et al.
Pubblicazione: (2026)
di: Zhang, Minmin, et al.
Pubblicazione: (2026)
Self-Generative Adversarial Fine-Tuning for Large Language Models
di: Wu, Shiguang, et al.
Pubblicazione: (2026)
di: Wu, Shiguang, et al.
Pubblicazione: (2026)
Decentralized Low-Rank Fine-Tuning of Large Language Models
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2025)
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2025)
Sparse Gradient Compression for Fine-Tuning Large Language Models
di: Yang, David H., et al.
Pubblicazione: (2025)
di: Yang, David H., et al.
Pubblicazione: (2025)
Linearization Explains Fine-Tuning in Large Language Models
di: Afzal, Zahra Rahimi, et al.
Pubblicazione: (2026)
di: Afzal, Zahra Rahimi, et al.
Pubblicazione: (2026)
Dissecting Fine-Tuning Unlearning in Large Language Models
di: Hong, Yihuai, et al.
Pubblicazione: (2024)
di: Hong, Yihuai, et al.
Pubblicazione: (2024)
Anchored Supervised Fine-Tuning
di: Zhu, He, et al.
Pubblicazione: (2025)
di: Zhu, He, et al.
Pubblicazione: (2025)
Closed-Loop Supervised Fine-Tuning of Tokenized Traffic Models
di: Zhang, Zhejun, et al.
Pubblicazione: (2024)
di: Zhang, Zhejun, et al.
Pubblicazione: (2024)
Continual Fine-Tuning of Large Language Models via Program Memory
di: Le, Hung, et al.
Pubblicazione: (2026)
di: Le, Hung, et al.
Pubblicazione: (2026)
Unlock the Correlation between Supervised Fine-Tuning and Reinforcement Learning in Training Code Large Language Models
di: Chen, Jie, et al.
Pubblicazione: (2024)
di: Chen, Jie, et al.
Pubblicazione: (2024)
Erasing the Bias: Fine-Tuning Foundation Models for Semi-Supervised Learning
di: Gan, Kai, et al.
Pubblicazione: (2024)
di: Gan, Kai, et al.
Pubblicazione: (2024)
Differentially Private Subspace Fine-Tuning for Large Language Models
di: Zheng, Lele, et al.
Pubblicazione: (2026)
di: Zheng, Lele, et al.
Pubblicazione: (2026)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
di: Wang, Shumin, et al.
Pubblicazione: (2026)
di: Wang, Shumin, et al.
Pubblicazione: (2026)
Personalized Collaborative Fine-Tuning for On-Device Large Language Models
di: Wagner, Nicolas, et al.
Pubblicazione: (2024)
di: Wagner, Nicolas, et al.
Pubblicazione: (2024)
How Multilingual Are Large Language Models Fine-Tuned for Translation?
di: Richburg, Aquia, et al.
Pubblicazione: (2024)
di: Richburg, Aquia, et al.
Pubblicazione: (2024)
Rotation-Preserving Supervised Fine-Tuning
di: Jin, Hangzhan, et al.
Pubblicazione: (2026)
di: Jin, Hangzhan, et al.
Pubblicazione: (2026)
Aligning Large Language Model Agents with Rational and Moral Preferences: A Supervised Fine-Tuning Approach
di: Lu, Wei, et al.
Pubblicazione: (2025)
di: Lu, Wei, et al.
Pubblicazione: (2025)
Tangent Space Fine-Tuning for Directional Preference Alignment in Large Language Models
di: Erdogan, Mete
Pubblicazione: (2026)
di: Erdogan, Mete
Pubblicazione: (2026)
Resource-Efficient Federated Fine-Tuning Large Language Models for Heterogeneous Data
di: Liu, Jun, et al.
Pubblicazione: (2025)
di: Liu, Jun, et al.
Pubblicazione: (2025)
Boosting Large Language Models with Mask Fine-Tuning
di: Zhang, Mingyuan, et al.
Pubblicazione: (2025)
di: Zhang, Mingyuan, et al.
Pubblicazione: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
di: Ansell, Alan, et al.
Pubblicazione: (2024)
di: Ansell, Alan, et al.
Pubblicazione: (2024)
Proximal Supervised Fine-Tuning
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
di: Hong, Joey, et al.
Pubblicazione: (2024)
di: Hong, Joey, et al.
Pubblicazione: (2024)
FisherSFT: Data-Efficient Supervised Fine-Tuning of Language Models Using Information Gain
di: Deb, Rohan, et al.
Pubblicazione: (2025)
di: Deb, Rohan, et al.
Pubblicazione: (2025)
Fine-Tuning Large Language Models to Appropriately Abstain with Semantic Entropy
di: Tjandra, Benedict Aaron, et al.
Pubblicazione: (2024)
di: Tjandra, Benedict Aaron, et al.
Pubblicazione: (2024)
Communication-Efficient and Tensorized Federated Fine-Tuning of Large Language Models
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2024)
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2024)
Accurate and Efficient Fine-Tuning of Quantized Large Language Models Through Optimal Balance
di: Shen, Ao, et al.
Pubblicazione: (2024)
di: Shen, Ao, et al.
Pubblicazione: (2024)
Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models
di: Zong, Yongshuo, et al.
Pubblicazione: (2024)
di: Zong, Yongshuo, et al.
Pubblicazione: (2024)
Hyperbolic Fine-Tuning for Large Language Models
di: Yang, Menglin, et al.
Pubblicazione: (2024)
di: Yang, Menglin, et al.
Pubblicazione: (2024)
Aligning Large Language Models via Fine-grained Supervision
di: Xu, Dehong, et al.
Pubblicazione: (2024)
di: Xu, Dehong, et al.
Pubblicazione: (2024)
UFT: Unifying Supervised and Reinforcement Fine-Tuning
di: Liu, Mingyang, et al.
Pubblicazione: (2025)
di: Liu, Mingyang, et al.
Pubblicazione: (2025)
Crafting Efficient Fine-Tuning Strategies for Large Language Models
di: Oliver, Michael, et al.
Pubblicazione: (2024)
di: Oliver, Michael, et al.
Pubblicazione: (2024)
Improving Large Language Models with Concept-Aware Fine-Tuning
di: Chen, Michael K., et al.
Pubblicazione: (2025)
di: Chen, Michael K., et al.
Pubblicazione: (2025)
Adapting Large Language Models for Content Moderation: Pitfalls in Data Engineering and Supervised Fine-tuning
di: Ma, Huan, et al.
Pubblicazione: (2023)
di: Ma, Huan, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
di: Li, Ziniu, et al.
Pubblicazione: (2024) -
Multimodal Alignment and Preference Optimization for Zero-Shot Conditional RNA Generation
di: Klypa, Roman, et al.
Pubblicazione: (2026) -
BAnG: Bidirectional Anchored Generation for Conditional RNA Design
di: Klypa, Roman, et al.
Pubblicazione: (2025) -
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
di: Kim, Gyuhak, et al.
Pubblicazione: (2025) -
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
di: Riemer, Matthew, et al.
Pubblicazione: (2025)