Reinforcement Learning Fine-Tuning Enhances Activation Intensity and Diversity in the Internal Circuitry of LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Honglin, Hao, Qianyue, Xu, Fengli, Li, Yong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLM-Explorer: A Plug-in Reinforcement Learning Policy Exploration Enhancement Driven by Large Language Models
di: Hao, Qianyue, et al.
Pubblicazione: (2025)
di: Hao, Qianyue, et al.
Pubblicazione: (2025)
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
di: Ma, Hao, et al.
Pubblicazione: (2026)
di: Ma, Hao, et al.
Pubblicazione: (2026)
Multiple Weaks Win Single Strong: Large Language Models Ensemble Weak Reinforcement Learning Agents into a Supreme One
di: Song, Yiwen, et al.
Pubblicazione: (2025)
di: Song, Yiwen, et al.
Pubblicazione: (2025)
Internalizing Curriculum Judgment for LLM Reinforcement Fine-Tuning
di: Zheng, Han, et al.
Pubblicazione: (2026)
di: Zheng, Han, et al.
Pubblicazione: (2026)
Supervised Fine-Tuning as Inverse Reinforcement Learning
di: Sun, Hao
Pubblicazione: (2024)
di: Sun, Hao
Pubblicazione: (2024)
Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions
di: Ma, Lu, et al.
Pubblicazione: (2025)
di: Ma, Lu, et al.
Pubblicazione: (2025)
Top K Enhanced Reinforcement Learning Attacks on Heterogeneous Graph Node Classification
di: Gao, Honglin, et al.
Pubblicazione: (2024)
di: Gao, Honglin, et al.
Pubblicazione: (2024)
Belief or Circuitry? Causal Evidence for In-Context Graph Learning
di: Kowalyshyn, Katharine, et al.
Pubblicazione: (2026)
di: Kowalyshyn, Katharine, et al.
Pubblicazione: (2026)
Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning
di: Khadangi, Afshin, et al.
Pubblicazione: (2025)
di: Khadangi, Afshin, et al.
Pubblicazione: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
di: Li, Ziniu, et al.
Pubblicazione: (2024)
di: Li, Ziniu, et al.
Pubblicazione: (2024)
Beyond the Dirac Delta: Mitigating Diversity Collapse in Reinforcement Fine-Tuning for Versatile Image Generation
di: Liu, Jinmei, et al.
Pubblicazione: (2026)
di: Liu, Jinmei, et al.
Pubblicazione: (2026)
Understanding and Preserving Safety in Fine-Tuned LLMs
di: Zhang, Jiawen, et al.
Pubblicazione: (2026)
di: Zhang, Jiawen, et al.
Pubblicazione: (2026)
Adaptive Policy Selection and Fine-Tuning under Interaction Budgets for Offline-to-Online Reinforcement Learning
di: Bozkurt, Alper Kamil, et al.
Pubblicazione: (2026)
di: Bozkurt, Alper Kamil, et al.
Pubblicazione: (2026)
Fine-Tuning Diffusion Models for Molecular Generation via Reinforcement Learning and Fast Sampling
di: Lin, Guang, et al.
Pubblicazione: (2026)
di: Lin, Guang, et al.
Pubblicazione: (2026)
ESSAM: A Novel Competitive Evolution Strategies Approach to Reinforcement Learning for Memory Efficient LLMs Fine-Tuning
di: Sun, Zhishen, et al.
Pubblicazione: (2026)
di: Sun, Zhishen, et al.
Pubblicazione: (2026)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
di: Wang, Shumin, et al.
Pubblicazione: (2026)
di: Wang, Shumin, et al.
Pubblicazione: (2026)
Efficiently Learning at Test-Time: Active Fine-Tuning of LLMs
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
RPO:Reinforcement Fine-Tuning with Partial Reasoning Optimization
di: Yi, Hongzhu, et al.
Pubblicazione: (2026)
di: Yi, Hongzhu, et al.
Pubblicazione: (2026)
Diversity as a Reward: Fine-Tuning LLMs on a Mixture of Domain-Undetermined Data
di: Ling, Zhenqing, et al.
Pubblicazione: (2025)
di: Ling, Zhenqing, et al.
Pubblicazione: (2025)
CLoQ: Enhancing Fine-Tuning of Quantized LLMs via Calibrated LoRA Initialization
di: Deng, Yanxia, et al.
Pubblicazione: (2025)
di: Deng, Yanxia, et al.
Pubblicazione: (2025)
RL Is Neither a Panacea Nor a Mirage: Understanding Supervised vs. Reinforcement Learning Fine-Tuning for LLMs
di: Jin, Hangzhan, et al.
Pubblicazione: (2025)
di: Jin, Hangzhan, et al.
Pubblicazione: (2025)
Zeroth-Order Fine-Tuning of LLMs in Random Subspaces
di: Yu, Ziming, et al.
Pubblicazione: (2024)
di: Yu, Ziming, et al.
Pubblicazione: (2024)
Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets
di: Lu, Ning, et al.
Pubblicazione: (2025)
di: Lu, Ning, et al.
Pubblicazione: (2025)
Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity
di: Guo, Wentao, et al.
Pubblicazione: (2024)
di: Guo, Wentao, et al.
Pubblicazione: (2024)
ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback
di: Byun, Ju-Seung, et al.
Pubblicazione: (2024)
di: Byun, Ju-Seung, et al.
Pubblicazione: (2024)
Thompson Sampling via Fine-Tuning of LLMs
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)
di: Qin, Chongli, et al.
Pubblicazione: (2025)
di: Qin, Chongli, et al.
Pubblicazione: (2025)
DeltaDQ: Ultra-High Delta Compression for Fine-Tuned LLMs via Group-wise Dropout and Separate Quantization
di: Jiang, Yanfeng, et al.
Pubblicazione: (2024)
di: Jiang, Yanfeng, et al.
Pubblicazione: (2024)
Memory-Efficient Fine-Tuning via Low-Rank Activation Compression
di: Shi, Jiang-Xin, et al.
Pubblicazione: (2025)
di: Shi, Jiang-Xin, et al.
Pubblicazione: (2025)
Reinforcement Learning Enhanced LLMs: A Survey
di: Wang, Shuhe, et al.
Pubblicazione: (2024)
di: Wang, Shuhe, et al.
Pubblicazione: (2024)
SATURN: SAT-based Reinforcement Learning to Unleash LLMs Reasoning
di: Liu, Huanyu, et al.
Pubblicazione: (2025)
di: Liu, Huanyu, et al.
Pubblicazione: (2025)
Activated LoRA: Fine-tuned LLMs for Intrinsics
di: Greenewald, Kristjan, et al.
Pubblicazione: (2025)
di: Greenewald, Kristjan, et al.
Pubblicazione: (2025)
vTune: Verifiable Fine-Tuning for LLMs Through Backdooring
di: Zhang, Eva, et al.
Pubblicazione: (2024)
di: Zhang, Eva, et al.
Pubblicazione: (2024)
Teaching LLMs How to Learn with Contextual Fine-Tuning
di: Choi, Younwoo, et al.
Pubblicazione: (2025)
di: Choi, Younwoo, et al.
Pubblicazione: (2025)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
di: Balashov, Andrii
Pubblicazione: (2025)
di: Balashov, Andrii
Pubblicazione: (2025)
Origin Tracer: A Method for Detecting LoRA Fine-Tuning Origins in LLMs
di: Liang, Hongyu, et al.
Pubblicazione: (2025)
di: Liang, Hongyu, et al.
Pubblicazione: (2025)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
di: Shang, Yu, et al.
Pubblicazione: (2024)
di: Shang, Yu, et al.
Pubblicazione: (2024)
Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning
di: Tang, Zhenchao, et al.
Pubblicazione: (2025)
di: Tang, Zhenchao, et al.
Pubblicazione: (2025)
Fine-Tuning Language Models with Reward Learning on Policy
di: Lang, Hao, et al.
Pubblicazione: (2024)
di: Lang, Hao, et al.
Pubblicazione: (2024)
SATQuest: A Verifier for Logical Reasoning Evaluation and Reinforcement Fine-Tuning of LLMs
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LLM-Explorer: A Plug-in Reinforcement Learning Policy Exploration Enhancement Driven by Large Language Models
di: Hao, Qianyue, et al.
Pubblicazione: (2025) -
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
di: Ma, Hao, et al.
Pubblicazione: (2026) -
Multiple Weaks Win Single Strong: Large Language Models Ensemble Weak Reinforcement Learning Agents into a Supreme One
di: Song, Yiwen, et al.
Pubblicazione: (2025) -
Internalizing Curriculum Judgment for LLM Reinforcement Fine-Tuning
di: Zheng, Han, et al.
Pubblicazione: (2026) -
Supervised Fine-Tuning as Inverse Reinforcement Learning
di: Sun, Hao
Pubblicazione: (2024)