Trinity-RFT: A General-Purpose and Unified Framework for Reinforcement Fine-Tuning of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Xuchen, Chen, Yanxi, Chen, Yushuo, Sun, Yuchang, Chen, Daoyuan, Zhang, Wenhao, Xie, Yuexiang, Huang, Yilun, Zhang, Yilei, Gao, Dawei, Shi, Weijie, Li, Yaliang, Ding, Bolin, Zhou, Jingren |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Selective Layer Fine-Tuning in Federated Learning
par: Sun, Yuchang, et autres
Publié: (2024)
par: Sun, Yuchang, et autres
Publié: (2024)
EE-LLM: Large-Scale Training and Inference of Early-Exit Large Language Models with 3D Parallelism
par: Chen, Yanxi, et autres
Publié: (2023)
par: Chen, Yanxi, et autres
Publié: (2023)
Data-Juicer 2.0: Cloud-Scale Adaptive Data Processing for and with Foundation Models
par: Chen, Daoyuan, et autres
Publié: (2024)
par: Chen, Daoyuan, et autres
Publié: (2024)
EE-Tuning: An Economical yet Scalable Solution for Tuning Early-Exit Large Language Models
par: Pan, Xuchen, et autres
Publié: (2024)
par: Pan, Xuchen, et autres
Publié: (2024)
Group-Relative REINFORCE Is Secretly an Off-Policy Algorithm: Demystifying Some Myths About GRPO and Its Friends
par: Yao, Chaorui, et autres
Publié: (2025)
par: Yao, Chaorui, et autres
Publié: (2025)
Federated Full-Parameter Tuning of Billion-Sized Language Models with Communication Cost under 18 Kilobytes
par: Qin, Zhen, et autres
Publié: (2023)
par: Qin, Zhen, et autres
Publié: (2023)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
par: Zhang, Wenhao, et autres
Publié: (2025)
par: Zhang, Wenhao, et autres
Publié: (2025)
Provable Scaling Laws for the Test-Time Compute of Large Language Models
par: Chen, Yanxi, et autres
Publié: (2024)
par: Chen, Yanxi, et autres
Publié: (2024)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
par: Wang, Shumin, et autres
Publié: (2026)
par: Wang, Shumin, et autres
Publié: (2026)
Grounded in Reality: Learning and Deploying Proactive LLM from Offline Logs
par: Wei, Fei, et autres
Publié: (2025)
par: Wei, Fei, et autres
Publié: (2025)
Enhancing Latent Computation in Transformers with Latent Tokens
par: Sun, Yuchang, et autres
Publié: (2025)
par: Sun, Yuchang, et autres
Publié: (2025)
Designing Algorithms Empowered by Language Models: An Analytical Framework, Case Studies, and Insights
par: Chen, Yanxi, et autres
Publié: (2024)
par: Chen, Yanxi, et autres
Publié: (2024)
FedBiOT: LLM Local Fine-tuning in Federated Learning without Full Model
par: Wu, Feijie, et autres
Publié: (2024)
par: Wu, Feijie, et autres
Publié: (2024)
Fine-Grained Modeling and Optimization for Intelligent Resource Management in Big Data Processing
par: Lyu, Chenghao, et autres
Publié: (2022)
par: Lyu, Chenghao, et autres
Publié: (2022)
Nimbus: A Unified Embodied Synthetic Data Generation Framework
par: He, Zeyu, et autres
Publié: (2026)
par: He, Zeyu, et autres
Publié: (2026)
Data-Juicer Sandbox: A Feedback-Driven Suite for Multimodal Data-Model Co-development
par: Chen, Daoyuan, et autres
Publié: (2024)
par: Chen, Daoyuan, et autres
Publié: (2024)
Improving LoRA in Privacy-preserving Federated Learning
par: Sun, Youbang, et autres
Publié: (2024)
par: Sun, Youbang, et autres
Publié: (2024)
MuxTune: Efficient Multi-Task LLM Fine-Tuning in Multi-Tenant Datacenters via Spatial-Temporal Backbone Multiplexing
par: Xue, Chunyu, et autres
Publié: (2026)
par: Xue, Chunyu, et autres
Publié: (2026)
MemAscend: System Memory Optimization for SSD-Offloaded LLM Fine-Tuning
par: Liaw, Yong-Cheng, et autres
Publié: (2025)
par: Liaw, Yong-Cheng, et autres
Publié: (2025)
BOTS: A Unified Framework for Bayesian Online Task Selection in LLM Reinforcement Finetuning
par: Shen, Qianli, et autres
Publié: (2025)
par: Shen, Qianli, et autres
Publié: (2025)
Analysis and Optimized CXL-Attached Memory Allocation for Long-Context LLM Fine-Tuning
par: Liaw, Yong-Cheng, et autres
Publié: (2025)
par: Liaw, Yong-Cheng, et autres
Publié: (2025)
RingAda: Pipelining Large Model Fine-Tuning on Edge Devices with Scheduled Layer Unfreezing
par: Li, Liang, et autres
Publié: (2025)
par: Li, Liang, et autres
Publié: (2025)
Memory-Efficient Split Federated Learning for LLM Fine-Tuning on Heterogeneous Mobile Devices
par: Chen, Xiaopei, et autres
Publié: (2025)
par: Chen, Xiaopei, et autres
Publié: (2025)
Heterogeneous Federated Fine-Tuning with Parallel One-Rank Adaptation
par: Zhang, Zikai, et autres
Publié: (2026)
par: Zhang, Zikai, et autres
Publié: (2026)
MimiC: Combating Client Dropouts in Federated Learning by Mimicking Central Updates
par: Sun, Yuchang, et autres
Publié: (2023)
par: Sun, Yuchang, et autres
Publié: (2023)
How to Collaborate: Towards Maximizing the Generalization Performance in Cross-Silo Federated Learning
par: Sun, Yuchang, et autres
Publié: (2024)
par: Sun, Yuchang, et autres
Publié: (2024)
SplitLoRA: A Split Parameter-Efficient Fine-Tuning Framework for Large Language Models
par: Lin, Zheng, et autres
Publié: (2024)
par: Lin, Zheng, et autres
Publié: (2024)
Very Large-Scale Multi-Agent Simulation in AgentScope
par: Pan, Xuchen, et autres
Publié: (2024)
par: Pan, Xuchen, et autres
Publié: (2024)
ExpertWeave: Efficiently Serving Expert-Specialized Fine-Tuned Adapters at Scale
par: Shi, Ge, et autres
Publié: (2025)
par: Shi, Ge, et autres
Publié: (2025)
MindGYM: What Matters in Question Synthesis for Thinking-Centric Fine-Tuning?
par: Xu, Zhe, et autres
Publié: (2025)
par: Xu, Zhe, et autres
Publié: (2025)
Split Fine-Tuning for Large Language Models in Wireless Networks
par: Zhang, Songge, et autres
Publié: (2025)
par: Zhang, Songge, et autres
Publié: (2025)
HLoRA: Efficient Federated Learning System for LLM Heterogeneous Fine-Tuning
par: Liu, Qianli, et autres
Publié: (2025)
par: Liu, Qianli, et autres
Publié: (2025)
The Synergy between Data and Multi-Modal Large Language Models: A Survey from Co-Development Perspective
par: Qin, Zhen, et autres
Publié: (2024)
par: Qin, Zhen, et autres
Publié: (2024)
Img-Diff: Contrastive Data Synthesis for Multimodal Large Language Models
par: Jiao, Qirui, et autres
Publié: (2024)
par: Jiao, Qirui, et autres
Publié: (2024)
EcoLoRA: Communication-Efficient Federated Fine-Tuning of Large Language Models
par: Liu, Han, et autres
Publié: (2025)
par: Liu, Han, et autres
Publié: (2025)
MotionRFT: Unified Reinforcement Fine-Tuning for Text-to-Motion Generation
par: Tan, Xiaofeng, et autres
Publié: (2026)
par: Tan, Xiaofeng, et autres
Publié: (2026)
Flexible Personalized Split Federated Learning for On-Device Fine-Tuning of Foundation Models
par: Yuan, Tianjun, et autres
Publié: (2025)
par: Yuan, Tianjun, et autres
Publié: (2025)
LoHan: Low-Cost High-Performance Framework to Fine-Tune 100B Model on a Consumer GPU
par: Liao, Changyue, et autres
Publié: (2024)
par: Liao, Changyue, et autres
Publié: (2024)
CacheFL: Privacy-Preserving and Efficient Federated Cache Model Fine-Tuning for Vision-Language Models
par: Yi, Mengjun, et autres
Publié: (2025)
par: Yi, Mengjun, et autres
Publié: (2025)
Federated Fine-Tuning of Sparsely-Activated Large Language Models on Resource-Constrained Devices
par: Chen, Fahao, et autres
Publié: (2025)
par: Chen, Fahao, et autres
Publié: (2025)
Documents similaires
-
Exploring Selective Layer Fine-Tuning in Federated Learning
par: Sun, Yuchang, et autres
Publié: (2024) -
EE-LLM: Large-Scale Training and Inference of Early-Exit Large Language Models with 3D Parallelism
par: Chen, Yanxi, et autres
Publié: (2023) -
Data-Juicer 2.0: Cloud-Scale Adaptive Data Processing for and with Foundation Models
par: Chen, Daoyuan, et autres
Publié: (2024) -
EE-Tuning: An Economical yet Scalable Solution for Tuning Early-Exit Large Language Models
par: Pan, Xuchen, et autres
Publié: (2024) -
Group-Relative REINFORCE Is Secretly an Off-Policy Algorithm: Demystifying Some Myths About GRPO and Its Friends
par: Yao, Chaorui, et autres
Publié: (2025)