WST: Weak-to-Strong Knowledge Transfer via Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ge, Haosen, Li, Shuo, Huang, Lianghuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robust Knowledge Transfer in Tiered Reinforcement Learning
par: Huang, Jiawei, et autres
Publié: (2023)
par: Huang, Jiawei, et autres
Publié: (2023)
Multi-granularity Knowledge Transfer for Continual Reinforcement Learning
par: Pan, Chaofan, et autres
Publié: (2024)
par: Pan, Chaofan, et autres
Publié: (2024)
Multiple Weaks Win Single Strong: Large Language Models Ensemble Weak Reinforcement Learning Agents into a Supreme One
par: Song, Yiwen, et autres
Publié: (2025)
par: Song, Yiwen, et autres
Publié: (2025)
Exploration in Knowledge Transfer Utilizing Reinforcement Learning
par: Jedlička, Adam, et autres
Publié: (2024)
par: Jedlička, Adam, et autres
Publié: (2024)
Effective Reinforcement Learning for Reasoning in Language Models
par: Huang, Lianghuan, et autres
Publié: (2025)
par: Huang, Lianghuan, et autres
Publié: (2025)
Knowledge Transfer in Deep Reinforcement Learning via an RL-Specific GAN-Based Correspondence Function
par: Ruman, Marko, et autres
Publié: (2022)
par: Ruman, Marko, et autres
Publié: (2022)
Centralized Reward Agent for Knowledge Sharing and Transfer in Multi-Task Reinforcement Learning
par: Ma, Haozhe, et autres
Publié: (2024)
par: Ma, Haozhe, et autres
Publié: (2024)
KARL: Knowledge Agents via Reinforcement Learning
par: Chang, Jonathan D., et autres
Publié: (2026)
par: Chang, Jonathan D., et autres
Publié: (2026)
RAPID: An Efficient Reinforcement Learning Algorithm for Small Language Models
par: Huang, Lianghuan, et autres
Publié: (2025)
par: Huang, Lianghuan, et autres
Publié: (2025)
GPG: A Simple and Strong Reinforcement Learning Baseline for Model Reasoning
par: Chu, Xiangxiang, et autres
Publié: (2025)
par: Chu, Xiangxiang, et autres
Publié: (2025)
Mixture of Weak & Strong Experts on Graphs
par: Zeng, Hanqing, et autres
Publié: (2023)
par: Zeng, Hanqing, et autres
Publié: (2023)
Quantifying the Gain in Weak-to-Strong Generalization
par: Charikar, Moses, et autres
Publié: (2024)
par: Charikar, Moses, et autres
Publié: (2024)
Knowledge Transfer for Cross-Domain Reinforcement Learning: A Systematic Review
par: Serrano, Sergio A., et autres
Publié: (2024)
par: Serrano, Sergio A., et autres
Publié: (2024)
Weak-to-Strong Generalization under Distribution Shifts
par: Jeon, Myeongho, et autres
Publié: (2025)
par: Jeon, Myeongho, et autres
Publié: (2025)
Adaptive and Robust DBSCAN with Multi-agent Reinforcement Learning
par: Peng, Hao, et autres
Publié: (2025)
par: Peng, Hao, et autres
Publié: (2025)
Low-Complexity Inference in Continual Learning via Compressed Knowledge Transfer
par: Liu, Zhenrong, et autres
Publié: (2025)
par: Liu, Zhenrong, et autres
Publié: (2025)
Towards the Transferability of Rewards Recovered via Regularized Inverse Reinforcement Learning
par: Schlaginhaufen, Andreas, et autres
Publié: (2024)
par: Schlaginhaufen, Andreas, et autres
Publié: (2024)
Representations Shape Weak-to-Strong Generalization: Theoretical Insights and Empirical Predictions
par: Xue, Yihao, et autres
Publié: (2025)
par: Xue, Yihao, et autres
Publié: (2025)
Weak-to-Strong Elicitation via Mismatched Wrong Drafts
par: Deng, Wei
Publié: (2026)
par: Deng, Wei
Publié: (2026)
Energy-Based Transfer for Reinforcement Learning
par: Deng, Zeyun, et autres
Publié: (2025)
par: Deng, Zeyun, et autres
Publié: (2025)
Exploring Open-world Continual Learning with Knowns-Unknowns Knowledge Transfer
par: Li, Yujie, et autres
Publié: (2025)
par: Li, Yujie, et autres
Publié: (2025)
Generalizing Trust: Weak-to-Strong Trustworthiness in Language Models
par: Pawelczyk, Martin, et autres
Publié: (2024)
par: Pawelczyk, Martin, et autres
Publié: (2024)
Weak-to-Strong Generalization Through the Data-Centric Lens
par: Shin, Changho, et autres
Publié: (2024)
par: Shin, Changho, et autres
Publié: (2024)
Reinforcement-aware Knowledge Distillation for LLM Reasoning
par: Zhang, Zhaoyang, et autres
Publié: (2026)
par: Zhang, Zhaoyang, et autres
Publié: (2026)
Enabling Multi-Agent Transfer Reinforcement Learning via Scenario Independent Representation
par: Nipu, Ayesha Siddika, et autres
Publié: (2024)
par: Nipu, Ayesha Siddika, et autres
Publié: (2024)
Transferable Delay-Aware Reinforcement Learning via Implicit Causal Graph Modeling
par: Zhao, Chenran, et autres
Publié: (2026)
par: Zhao, Chenran, et autres
Publié: (2026)
Pentest-R1: Towards Autonomous Penetration Testing Reasoning Optimized via Two-Stage Reinforcement Learning
par: Kong, He, et autres
Publié: (2025)
par: Kong, He, et autres
Publié: (2025)
Generalized Adaptive Transfer Network: Enhancing Transfer Learning in Reinforcement Learning Across Domains
par: Verma, Abhishek, et autres
Publié: (2025)
par: Verma, Abhishek, et autres
Publié: (2025)
DRED: Zero-Shot Transfer in Reinforcement Learning via Data-Regularised Environment Design
par: Garcin, Samuel, et autres
Publié: (2024)
par: Garcin, Samuel, et autres
Publié: (2024)
When to Trust the Cheap Check: Weak and Strong Verification for Reasoning
par: Kiyani, Shayan, et autres
Publié: (2026)
par: Kiyani, Shayan, et autres
Publié: (2026)
Adaptive Target Localization under Uncertainty using Multi-Agent Deep Reinforcement Learning with Knowledge Transfer
par: Alagha, Ahmed, et autres
Publié: (2025)
par: Alagha, Ahmed, et autres
Publié: (2025)
UniFluids: Unified Neural Operator Learning with Conditional Flow-matching
par: Li, Haosen, et autres
Publié: (2026)
par: Li, Haosen, et autres
Publié: (2026)
A Method for Fast Autonomy Transfer in Reinforcement Learning
par: Sahabandu, Dinuka, et autres
Publié: (2024)
par: Sahabandu, Dinuka, et autres
Publié: (2024)
Heterogeneous Knowledge for Augmented Modular Reinforcement Learning
par: Wolf, Lorenz, et autres
Publié: (2023)
par: Wolf, Lorenz, et autres
Publié: (2023)
CrowdTransfer: Enabling Crowd Knowledge Transfer in AIoT Community
par: Liu, Yan, et autres
Publié: (2024)
par: Liu, Yan, et autres
Publié: (2024)
Multi-Domain Graph Foundation Models: Robust Knowledge Transfer via Topology Alignment
par: Wang, Shuo, et autres
Publié: (2025)
par: Wang, Shuo, et autres
Publié: (2025)
Conservative Distributional Reinforcement Learning with Safety Constraints
par: Zhang, Hengrui, et autres
Publié: (2022)
par: Zhang, Hengrui, et autres
Publié: (2022)
Generalizable Trajectory Prediction via Inverse Reinforcement Learning with Mamba-Graph Architecture
par: Li, Wenyun, et autres
Publié: (2025)
par: Li, Wenyun, et autres
Publié: (2025)
Automaton Distillation: Neuro-Symbolic Transfer Learning for Deep Reinforcement Learning
par: Singireddy, Suraj, et autres
Publié: (2023)
par: Singireddy, Suraj, et autres
Publié: (2023)
KARL: Mitigating Hallucinations in LLMs via Knowledge-Boundary-Aware Reinforcement Learning
par: Gao, Cheng, et autres
Publié: (2026)
par: Gao, Cheng, et autres
Publié: (2026)
Documents similaires
-
Robust Knowledge Transfer in Tiered Reinforcement Learning
par: Huang, Jiawei, et autres
Publié: (2023) -
Multi-granularity Knowledge Transfer for Continual Reinforcement Learning
par: Pan, Chaofan, et autres
Publié: (2024) -
Multiple Weaks Win Single Strong: Large Language Models Ensemble Weak Reinforcement Learning Agents into a Supreme One
par: Song, Yiwen, et autres
Publié: (2025) -
Exploration in Knowledge Transfer Utilizing Reinforcement Learning
par: Jedlička, Adam, et autres
Publié: (2024) -
Effective Reinforcement Learning for Reasoning in Language Models
par: Huang, Lianghuan, et autres
Publié: (2025)