Learning from the Right Rollouts: Data Attribution for PPO-based LLM Post-Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Shu, Dong, Zhang, Denghui, Hullman, Jessica |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Rollout-Training Co-Design for Efficient LLM-Based Multi-Agent Reinforcement Learning
di: Jiang, Zhida, et al.
Pubblicazione: (2026)
di: Jiang, Zhida, et al.
Pubblicazione: (2026)
Randomized Antipodal Search Done Right for Data Pareto Improvement of LLM Unlearning
di: Liu, Ziwen, et al.
Pubblicazione: (2026)
di: Liu, Ziwen, et al.
Pubblicazione: (2026)
Probe-Based Data Attribution: Discovering and Mitigating Undesirable Behaviors in LLM Post-Training
di: Xiao, Frank, et al.
Pubblicazione: (2026)
di: Xiao, Frank, et al.
Pubblicazione: (2026)
Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning
di: Xu, Yixuan Even, et al.
Pubblicazione: (2025)
di: Xu, Yixuan Even, et al.
Pubblicazione: (2025)
Explanations are a Means to an End: Decision Theoretic Explanation Evaluation
di: Guo, Ziyang, et al.
Pubblicazione: (2025)
di: Guo, Ziyang, et al.
Pubblicazione: (2025)
Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding
di: Iso, Hayate, et al.
Pubblicazione: (2026)
di: Iso, Hayate, et al.
Pubblicazione: (2026)
Segmental Advantage Estimation: Enhancing PPO for Long-Context LLM Training
di: Gong, Xue, et al.
Pubblicazione: (2026)
di: Gong, Xue, et al.
Pubblicazione: (2026)
Sketching the Readout of Large Language Models for Scalable Data Attribution and Valuation
di: Ran, Yide, et al.
Pubblicazione: (2026)
di: Ran, Yide, et al.
Pubblicazione: (2026)
A Conceptual Framework for Ethical Evaluation of Machine Learning Systems
di: Gupta, Neha R., et al.
Pubblicazione: (2024)
di: Gupta, Neha R., et al.
Pubblicazione: (2024)
Single-Rollout Hidden-State Dynamics for Training-Free RLVR Data Selection
di: Wu, Jianghao, et al.
Pubblicazione: (2026)
di: Wu, Jianghao, et al.
Pubblicazione: (2026)
QuRL: Efficient Reinforcement Learning with Quantized Rollout
di: Li, Yuhang, et al.
Pubblicazione: (2026)
di: Li, Yuhang, et al.
Pubblicazione: (2026)
Leveraging Error Diversity in Group Rollouts for Reinforcement Learning
di: Liu, Wenpu, et al.
Pubblicazione: (2026)
di: Liu, Wenpu, et al.
Pubblicazione: (2026)
Dr. Post-Training: A Data Regularization Perspective on LLM Post-Training
di: Hu, Pingbang, et al.
Pubblicazione: (2026)
di: Hu, Pingbang, et al.
Pubblicazione: (2026)
RollPacker: Mitigating Long-Tail Rollouts for Fast, Synchronous RL Post-Training
di: Gao, Wei, et al.
Pubblicazione: (2025)
di: Gao, Wei, et al.
Pubblicazione: (2025)
Mode-Dependent Rectification for Stable PPO Training
di: Mohamad, Mohamad, et al.
Pubblicazione: (2026)
di: Mohamad, Mohamad, et al.
Pubblicazione: (2026)
Explaining and Improving Information Complementarities in Multi-Agent Decision-making
di: Guo, Ziyang, et al.
Pubblicazione: (2025)
di: Guo, Ziyang, et al.
Pubblicazione: (2025)
Train Less, Learn More: Adaptive Efficient Rollout Optimization for Group-Based Reinforcement Learning
di: Zhang, Zhi, et al.
Pubblicazione: (2026)
di: Zhang, Zhi, et al.
Pubblicazione: (2026)
On Rollouts in Model-Based Reinforcement Learning
di: Frauenknecht, Bernd, et al.
Pubblicazione: (2025)
di: Frauenknecht, Bernd, et al.
Pubblicazione: (2025)
Guided Cooperation in Hierarchical Reinforcement Learning via Model-based Rollout
di: Wang, Haoran, et al.
Pubblicazione: (2023)
di: Wang, Haoran, et al.
Pubblicazione: (2023)
ROAST: Rollout-based On-distribution Activation Steering Technique
di: Su, Xuanbo, et al.
Pubblicazione: (2026)
di: Su, Xuanbo, et al.
Pubblicazione: (2026)
Evaluating the Utility of Conformal Prediction Sets for AI-Advised Image Labeling
di: Zhang, Dongping, et al.
Pubblicazione: (2024)
di: Zhang, Dongping, et al.
Pubblicazione: (2024)
Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning
di: Surana, Rohan, et al.
Pubblicazione: (2026)
di: Surana, Rohan, et al.
Pubblicazione: (2026)
ISACL: Internal State Analyzer for Copyrighted Training Data Leakage
di: Zhang, Guangwei, et al.
Pubblicazione: (2025)
di: Zhang, Guangwei, et al.
Pubblicazione: (2025)
ALinFiK: Learning to Approximate Linearized Future Influence Kernel for Scalable Third-Party LLM Data Valuation
di: Pan, Yanzhou, et al.
Pubblicazione: (2025)
di: Pan, Yanzhou, et al.
Pubblicazione: (2025)
Directional-Clamp PPO
di: Karpel, Gilad, et al.
Pubblicazione: (2025)
di: Karpel, Gilad, et al.
Pubblicazione: (2025)
Gradient-Informed Temporal Sampling Improves Rollout Accuracy in PDE Surrogate Training
di: Wang, Wenshuo, et al.
Pubblicazione: (2026)
di: Wang, Wenshuo, et al.
Pubblicazione: (2026)
VinePPO: Refining Credit Assignment in RL Training of LLMs
di: Kazemnejad, Amirhossein, et al.
Pubblicazione: (2024)
di: Kazemnejad, Amirhossein, et al.
Pubblicazione: (2024)
Learning to Weight Parameters for Training Data Attribution
di: Li, Shuangqi, et al.
Pubblicazione: (2025)
di: Li, Shuangqi, et al.
Pubblicazione: (2025)
Sampling Complexity of TD and PPO in RKHS
di: Zou, Lu, et al.
Pubblicazione: (2025)
di: Zou, Lu, et al.
Pubblicazione: (2025)
Exploring Training Data Attribution under Limited Access Constraints
di: Zhang, Shiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Shiyuan, et al.
Pubblicazione: (2025)
Enhancing Training Data Attribution with Representational Optimization
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
Efficient Ensembles Improve Training Data Attribution
di: Deng, Junwei, et al.
Pubblicazione: (2024)
di: Deng, Junwei, et al.
Pubblicazione: (2024)
BASIS: Batchwise Advantage Estimation from Single-Rollout Information Sharing for LLM Reasoning
di: Gong, Shijin, et al.
Pubblicazione: (2026)
di: Gong, Shijin, et al.
Pubblicazione: (2026)
Prompt Curriculum Learning for Efficient LLM Post-Training
di: Gao, Zhaolin, et al.
Pubblicazione: (2025)
di: Gao, Zhaolin, et al.
Pubblicazione: (2025)
Conformal Prediction and Human Decision Making
di: Hullman, Jessica, et al.
Pubblicazione: (2025)
di: Hullman, Jessica, et al.
Pubblicazione: (2025)
DARTS: Distribution-Aware Active Rollout Trajectory Shaping for Accelerating LLM Reinforcement Learning
di: Wang, Yujie, et al.
Pubblicazione: (2026)
di: Wang, Yujie, et al.
Pubblicazione: (2026)
Diffusion Attribution Score: Evaluating Training Data Influence in Diffusion Models
di: Lin, Jinxu, et al.
Pubblicazione: (2024)
di: Lin, Jinxu, et al.
Pubblicazione: (2024)
Alternating Reinforcement Learning for Rubric-Based Reward Modeling in Non-Verifiable LLM Post-Training
di: Xu, Ran, et al.
Pubblicazione: (2026)
di: Xu, Ran, et al.
Pubblicazione: (2026)
Sparse-RL: Breaking the Memory Wall in LLM Reinforcement Learning via Stable Sparse Rollouts
di: Luo, Sijia, et al.
Pubblicazione: (2026)
di: Luo, Sijia, et al.
Pubblicazione: (2026)
Consolidating Rewarded Perturbations for LLM Post-Training
di: Zhang, Zheyu, et al.
Pubblicazione: (2026)
di: Zhang, Zheyu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Rollout-Training Co-Design for Efficient LLM-Based Multi-Agent Reinforcement Learning
di: Jiang, Zhida, et al.
Pubblicazione: (2026) -
Randomized Antipodal Search Done Right for Data Pareto Improvement of LLM Unlearning
di: Liu, Ziwen, et al.
Pubblicazione: (2026) -
Probe-Based Data Attribution: Discovering and Mitigating Undesirable Behaviors in LLM Post-Training
di: Xiao, Frank, et al.
Pubblicazione: (2026) -
Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning
di: Xu, Yixuan Even, et al.
Pubblicazione: (2025) -
Explanations are a Means to an End: Decision Theoretic Explanation Evaluation
di: Guo, Ziyang, et al.
Pubblicazione: (2025)