IRIS: Interpolative Rényi Iterative Self-play for Large Language Model Fine-Tuning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liao, Wenjie, Wu, Like, Zhao, Liangjie, Xu, Shihui, Fujimura, Shigeru |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
von: Han, Bing, et al.
Veröffentlicht: (2025)
von: Han, Bing, et al.
Veröffentlicht: (2025)
Linearization Explains Fine-Tuning in Large Language Models
von: Afzal, Zahra Rahimi, et al.
Veröffentlicht: (2026)
von: Afzal, Zahra Rahimi, et al.
Veröffentlicht: (2026)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
von: Chang, Aofei, et al.
Veröffentlicht: (2024)
von: Chang, Aofei, et al.
Veröffentlicht: (2024)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
von: Zhou, Jiajun, et al.
Veröffentlicht: (2025)
von: Zhou, Jiajun, et al.
Veröffentlicht: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
Efficient Inference Using Large Language Models with Limited Human Data: Fine-Tuning then Rectification
von: Wang, Lei, et al.
Veröffentlicht: (2025)
von: Wang, Lei, et al.
Veröffentlicht: (2025)
FedKRSO: Communication and Memory Efficient Federated Fine-Tuning of Large Language Models
von: Yang, Guohao, et al.
Veröffentlicht: (2026)
von: Yang, Guohao, et al.
Veröffentlicht: (2026)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
von: Xu, Yichen, et al.
Veröffentlicht: (2026)
von: Xu, Yichen, et al.
Veröffentlicht: (2026)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
von: Zhang, Longteng, et al.
Veröffentlicht: (2026)
von: Zhang, Longteng, et al.
Veröffentlicht: (2026)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
von: Wei, Quan, et al.
Veröffentlicht: (2025)
von: Wei, Quan, et al.
Veröffentlicht: (2025)
Revisiting Privacy, Utility, and Efficiency Trade-offs when Fine-Tuning Large Language Models
von: Das, Soumi, et al.
Veröffentlicht: (2025)
von: Das, Soumi, et al.
Veröffentlicht: (2025)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
von: Kim, Gyuhak, et al.
Veröffentlicht: (2025)
von: Kim, Gyuhak, et al.
Veröffentlicht: (2025)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
von: Fang, Zihan, et al.
Veröffentlicht: (2024)
von: Fang, Zihan, et al.
Veröffentlicht: (2024)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
von: Balashov, Andrii
Veröffentlicht: (2025)
von: Balashov, Andrii
Veröffentlicht: (2025)
Boosting Large Language Models with Mask Fine-Tuning
von: Zhang, Mingyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Mingyuan, et al.
Veröffentlicht: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
von: Ansell, Alan, et al.
Veröffentlicht: (2024)
von: Ansell, Alan, et al.
Veröffentlicht: (2024)
Selective Self-Rehearsal: A Fine-Tuning Approach to Improve Generalization in Large Language Models
von: Gupta, Sonam, et al.
Veröffentlicht: (2024)
von: Gupta, Sonam, et al.
Veröffentlicht: (2024)
Iterative Distillation for Reward-Guided Fine-Tuning of Diffusion Models in Biomolecular Design
von: Su, Xingyu, et al.
Veröffentlicht: (2025)
von: Su, Xingyu, et al.
Veröffentlicht: (2025)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
von: Dong, Guanting, et al.
Veröffentlicht: (2024)
von: Dong, Guanting, et al.
Veröffentlicht: (2024)
FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed
von: Dang, Sizhe, et al.
Veröffentlicht: (2025)
von: Dang, Sizhe, et al.
Veröffentlicht: (2025)
MathSE: Improving Multimodal Mathematical Reasoning via Self-Evolving Iterative Reflection and Reward-Guided Fine-Tuning
von: Chen, Jinhao, et al.
Veröffentlicht: (2025)
von: Chen, Jinhao, et al.
Veröffentlicht: (2025)
A Bayesian Hybrid Parameter-Efficient Fine-Tuning Method for Large Language Models
von: Chai, Yidong, et al.
Veröffentlicht: (2025)
von: Chai, Yidong, et al.
Veröffentlicht: (2025)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
von: Riemer, Matthew, et al.
Veröffentlicht: (2025)
von: Riemer, Matthew, et al.
Veröffentlicht: (2025)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
von: Ye, Kai, et al.
Veröffentlicht: (2025)
von: Ye, Kai, et al.
Veröffentlicht: (2025)
Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models
von: Chen, Zixiang, et al.
Veröffentlicht: (2024)
von: Chen, Zixiang, et al.
Veröffentlicht: (2024)
Efficient and Scalable Fine-Tune of Language Models for Genome Understanding
von: Zhan, Huixin, et al.
Veröffentlicht: (2024)
von: Zhan, Huixin, et al.
Veröffentlicht: (2024)
Crafting Efficient Fine-Tuning Strategies for Large Language Models
von: Oliver, Michael, et al.
Veröffentlicht: (2024)
von: Oliver, Michael, et al.
Veröffentlicht: (2024)
Improving Large Language Models with Concept-Aware Fine-Tuning
von: Chen, Michael K., et al.
Veröffentlicht: (2025)
von: Chen, Michael K., et al.
Veröffentlicht: (2025)
STP: Self-play LLM Theorem Provers with Iterative Conjecturing and Proving
von: Dong, Kefan, et al.
Veröffentlicht: (2025)
von: Dong, Kefan, et al.
Veröffentlicht: (2025)
Fine-Tuning Improves Information Conveyance in Language Models
von: Cheng, Yuwei, et al.
Veröffentlicht: (2026)
von: Cheng, Yuwei, et al.
Veröffentlicht: (2026)
Let the Expert Stick to His Last: Expert-Specialized Fine-Tuning for Sparse Architectural Large Language Models
von: Wang, Zihan, et al.
Veröffentlicht: (2024)
von: Wang, Zihan, et al.
Veröffentlicht: (2024)
FLAME: Towards Federated Fine-Tuning Large Language Models Through Adaptive SMoE
von: Le, Khiem, et al.
Veröffentlicht: (2025)
von: Le, Khiem, et al.
Veröffentlicht: (2025)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025)
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025)
Widening the Network Mitigates the Impact of Data Heterogeneity on FedAvg
von: Jian, Like, et al.
Veröffentlicht: (2025)
von: Jian, Like, et al.
Veröffentlicht: (2025)
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
von: Zhao, Andrew, et al.
Veröffentlicht: (2025)
von: Zhao, Andrew, et al.
Veröffentlicht: (2025)
Rényi Neural Processes
von: Wang, Xuesong, et al.
Veröffentlicht: (2024)
von: Wang, Xuesong, et al.
Veröffentlicht: (2024)
MaZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
von: Zhang, Zhen, et al.
Veröffentlicht: (2025)
von: Zhang, Zhen, et al.
Veröffentlicht: (2025)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
von: Hu, Zixuan, et al.
Veröffentlicht: (2025)
von: Hu, Zixuan, et al.
Veröffentlicht: (2025)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
von: Zhang, Minmin, et al.
Veröffentlicht: (2026)
von: Zhang, Minmin, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024) -
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
von: Han, Bing, et al.
Veröffentlicht: (2025) -
Linearization Explains Fine-Tuning in Large Language Models
von: Afzal, Zahra Rahimi, et al.
Veröffentlicht: (2026) -
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
von: Chang, Aofei, et al.
Veröffentlicht: (2024) -
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
von: Zhou, Jiajun, et al.
Veröffentlicht: (2025)