IRIS: Interpolative Rényi Iterative Self-play for Large Language Model Fine-Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Liao, Wenjie, Wu, Like, Zhao, Liangjie, Xu, Shihui, Fujimura, Shigeru |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024)
por: Li, Ziniu, et al.
Publicado: (2024)
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
por: Han, Bing, et al.
Publicado: (2025)
por: Han, Bing, et al.
Publicado: (2025)
Linearization Explains Fine-Tuning in Large Language Models
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
por: Chang, Aofei, et al.
Publicado: (2024)
por: Chang, Aofei, et al.
Publicado: (2024)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
por: Zhou, Jiajun, et al.
Publicado: (2025)
por: Zhou, Jiajun, et al.
Publicado: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
por: Wang, Shumin, et al.
Publicado: (2026)
por: Wang, Shumin, et al.
Publicado: (2026)
Efficient Inference Using Large Language Models with Limited Human Data: Fine-Tuning then Rectification
por: Wang, Lei, et al.
Publicado: (2025)
por: Wang, Lei, et al.
Publicado: (2025)
FedKRSO: Communication and Memory Efficient Federated Fine-Tuning of Large Language Models
por: Yang, Guohao, et al.
Publicado: (2026)
por: Yang, Guohao, et al.
Publicado: (2026)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
por: Xu, Yichen, et al.
Publicado: (2026)
por: Xu, Yichen, et al.
Publicado: (2026)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
por: Zhang, Longteng, et al.
Publicado: (2026)
por: Zhang, Longteng, et al.
Publicado: (2026)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
por: Wei, Quan, et al.
Publicado: (2025)
por: Wei, Quan, et al.
Publicado: (2025)
Revisiting Privacy, Utility, and Efficiency Trade-offs when Fine-Tuning Large Language Models
por: Das, Soumi, et al.
Publicado: (2025)
por: Das, Soumi, et al.
Publicado: (2025)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
por: Kim, Gyuhak, et al.
Publicado: (2025)
por: Kim, Gyuhak, et al.
Publicado: (2025)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
por: Fang, Zihan, et al.
Publicado: (2024)
por: Fang, Zihan, et al.
Publicado: (2024)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
por: Balashov, Andrii
Publicado: (2025)
por: Balashov, Andrii
Publicado: (2025)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
por: Ansell, Alan, et al.
Publicado: (2024)
por: Ansell, Alan, et al.
Publicado: (2024)
Selective Self-Rehearsal: A Fine-Tuning Approach to Improve Generalization in Large Language Models
por: Gupta, Sonam, et al.
Publicado: (2024)
por: Gupta, Sonam, et al.
Publicado: (2024)
Iterative Distillation for Reward-Guided Fine-Tuning of Diffusion Models in Biomolecular Design
por: Su, Xingyu, et al.
Publicado: (2025)
por: Su, Xingyu, et al.
Publicado: (2025)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
por: Dong, Guanting, et al.
Publicado: (2024)
por: Dong, Guanting, et al.
Publicado: (2024)
FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed
por: Dang, Sizhe, et al.
Publicado: (2025)
por: Dang, Sizhe, et al.
Publicado: (2025)
MathSE: Improving Multimodal Mathematical Reasoning via Self-Evolving Iterative Reflection and Reward-Guided Fine-Tuning
por: Chen, Jinhao, et al.
Publicado: (2025)
por: Chen, Jinhao, et al.
Publicado: (2025)
A Bayesian Hybrid Parameter-Efficient Fine-Tuning Method for Large Language Models
por: Chai, Yidong, et al.
Publicado: (2025)
por: Chai, Yidong, et al.
Publicado: (2025)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
por: Riemer, Matthew, et al.
Publicado: (2025)
por: Riemer, Matthew, et al.
Publicado: (2025)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
por: Ye, Kai, et al.
Publicado: (2025)
por: Ye, Kai, et al.
Publicado: (2025)
Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models
por: Chen, Zixiang, et al.
Publicado: (2024)
por: Chen, Zixiang, et al.
Publicado: (2024)
Efficient and Scalable Fine-Tune of Language Models for Genome Understanding
por: Zhan, Huixin, et al.
Publicado: (2024)
por: Zhan, Huixin, et al.
Publicado: (2024)
Crafting Efficient Fine-Tuning Strategies for Large Language Models
por: Oliver, Michael, et al.
Publicado: (2024)
por: Oliver, Michael, et al.
Publicado: (2024)
Improving Large Language Models with Concept-Aware Fine-Tuning
por: Chen, Michael K., et al.
Publicado: (2025)
por: Chen, Michael K., et al.
Publicado: (2025)
STP: Self-play LLM Theorem Provers with Iterative Conjecturing and Proving
por: Dong, Kefan, et al.
Publicado: (2025)
por: Dong, Kefan, et al.
Publicado: (2025)
Fine-Tuning Improves Information Conveyance in Language Models
por: Cheng, Yuwei, et al.
Publicado: (2026)
por: Cheng, Yuwei, et al.
Publicado: (2026)
Let the Expert Stick to His Last: Expert-Specialized Fine-Tuning for Sparse Architectural Large Language Models
por: Wang, Zihan, et al.
Publicado: (2024)
por: Wang, Zihan, et al.
Publicado: (2024)
FLAME: Towards Federated Fine-Tuning Large Language Models Through Adaptive SMoE
por: Le, Khiem, et al.
Publicado: (2025)
por: Le, Khiem, et al.
Publicado: (2025)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
por: Xiao, Jiancong, et al.
Publicado: (2025)
por: Xiao, Jiancong, et al.
Publicado: (2025)
Widening the Network Mitigates the Impact of Data Heterogeneity on FedAvg
por: Jian, Like, et al.
Publicado: (2025)
por: Jian, Like, et al.
Publicado: (2025)
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
por: Zhao, Andrew, et al.
Publicado: (2025)
por: Zhao, Andrew, et al.
Publicado: (2025)
Rényi Neural Processes
por: Wang, Xuesong, et al.
Publicado: (2024)
por: Wang, Xuesong, et al.
Publicado: (2024)
MaZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
por: Zhang, Zhen, et al.
Publicado: (2025)
por: Zhang, Zhen, et al.
Publicado: (2025)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
por: Hu, Zixuan, et al.
Publicado: (2025)
por: Hu, Zixuan, et al.
Publicado: (2025)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
por: Zhang, Minmin, et al.
Publicado: (2026)
por: Zhang, Minmin, et al.
Publicado: (2026)
Ejemplares similares
-
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024) -
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
por: Han, Bing, et al.
Publicado: (2025) -
Linearization Explains Fine-Tuning in Large Language Models
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026) -
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
por: Chang, Aofei, et al.
Publicado: (2024) -
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
por: Zhou, Jiajun, et al.
Publicado: (2025)