Sample Efficient Reinforcement Learning via Large Vision Language Model Distillation
Fuente:
arXiv
Saved in:
| Main Authors: | Lee, Donghoon, Luu, Tung M., Lee, Younghwan, Yoo, Chang D. |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
by: Lee, Younghwan, et al.
Published: (2025)
by: Lee, Younghwan, et al.
Published: (2025)
Policy Learning from Large Vision-Language Model Feedback without Reward Modeling
by: Luu, Tung M., et al.
Published: (2025)
by: Luu, Tung M., et al.
Published: (2025)
Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models
by: Luu, Tung Minh, et al.
Published: (2025)
by: Luu, Tung Minh, et al.
Published: (2025)
Predictive Coding for Decision Transformer
by: Luu, Tung M., et al.
Published: (2024)
by: Luu, Tung M., et al.
Published: (2024)
On the Perturbed States for Transformed Input-robust Reinforcement Learning
by: Luu, Tung M., et al.
Published: (2024)
by: Luu, Tung M., et al.
Published: (2024)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
by: Nguyen, Thanh, et al.
Published: (2024)
by: Nguyen, Thanh, et al.
Published: (2024)
Mitigating Adversarial Perturbations for Deep Reinforcement Learning via Vector Quantization
by: Luu, Tung M., et al.
Published: (2024)
by: Luu, Tung M., et al.
Published: (2024)
Uncertainty-Aware Rank-One MIMO Q Network Framework for Accelerated Offline Reinforcement Learning
by: Nguyen, Thanh, et al.
Published: (2026)
by: Nguyen, Thanh, et al.
Published: (2026)
DriVLM: Domain Adaptation of Vision-Language Models in Autonomous Driving
by: Zheng, Xuran, et al.
Published: (2025)
by: Zheng, Xuran, et al.
Published: (2025)
Offline Policy Learning via Skill-step Abstraction for Long-horizon Goal-Conditioned Tasks
by: Kim, Donghoon, et al.
Published: (2024)
by: Kim, Donghoon, et al.
Published: (2024)
Masking Teacher and Reinforcing Student for Distilling Vision-Language Models
by: Lee, Byung-Kwan, et al.
Published: (2025)
by: Lee, Byung-Kwan, et al.
Published: (2025)
KFCPO: Kronecker-Factored Approximated Constrained Policy Optimization
by: Lim, Joonyoung, et al.
Published: (2025)
by: Lim, Joonyoung, et al.
Published: (2025)
Topology-Guided Knowledge Distillation for Efficient Point Cloud Processing
by: Hai, Luu Tung, et al.
Published: (2025)
by: Hai, Luu Tung, et al.
Published: (2025)
GB-DQN: Gradient Boosted DQN Models for Non-stationary Reinforcement Learning
by: Lee, Chang-Hwan, et al.
Published: (2025)
by: Lee, Chang-Hwan, et al.
Published: (2025)
One-Step Flow Q-Learning: Addressing the Diffusion Policy Bottleneck in Offline Reinforcement Learning
by: Nguyen, Thanh, et al.
Published: (2025)
by: Nguyen, Thanh, et al.
Published: (2025)
RAPID: An Efficient Reinforcement Learning Algorithm for Small Language Models
by: Huang, Lianghuan, et al.
Published: (2025)
by: Huang, Lianghuan, et al.
Published: (2025)
Distilling Reinforcement Learning Algorithms for In-Context Model-Based Planning
by: Son, Jaehyeon, et al.
Published: (2025)
by: Son, Jaehyeon, et al.
Published: (2025)
Querying Easily Flip-flopped Samples for Deep Active Learning
by: Cho, Seong Jin, et al.
Published: (2024)
by: Cho, Seong Jin, et al.
Published: (2024)
Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning
by: Qi, Yajie, et al.
Published: (2025)
by: Qi, Yajie, et al.
Published: (2025)
Efficient Reinforcement Learning with Large Language Model Priors
by: Yan, Xue, et al.
Published: (2024)
by: Yan, Xue, et al.
Published: (2024)
Settling the Sample Complexity of Online Reinforcement Learning
by: Zhang, Zihan, et al.
Published: (2023)
by: Zhang, Zihan, et al.
Published: (2023)
The Role of Masking for Efficient Supervised Knowledge Distillation of Vision Transformers
by: Son, Seungwoo, et al.
Published: (2023)
by: Son, Seungwoo, et al.
Published: (2023)
CADENT: Gated Hybrid Distillation for Sample-Efficient Transfer in Reinforcement Learning
by: Alinejad, Mahyar, et al.
Published: (2026)
by: Alinejad, Mahyar, et al.
Published: (2026)
The Generative Leap: Sharp Sample Complexity for Efficiently Learning Gaussian Multi-Index Models
by: Damian, Alex, et al.
Published: (2025)
by: Damian, Alex, et al.
Published: (2025)
PCoreSet: Effective Active Learning through Knowledge Distillation from Vision-Language Models
by: Kang, Seongjae, et al.
Published: (2025)
by: Kang, Seongjae, et al.
Published: (2025)
Distilled Thompson Sampling: Practical and Efficient Thompson Sampling via Imitation Learning
by: Namkoong, Hongseok, et al.
Published: (2020)
by: Namkoong, Hongseok, et al.
Published: (2020)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
by: Yang, Senqiao, et al.
Published: (2025)
by: Yang, Senqiao, et al.
Published: (2025)
Efficient Alignment of Large Language Models via Data Sampling
by: Khera, Amrit, et al.
Published: (2024)
by: Khera, Amrit, et al.
Published: (2024)
EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning
by: Aravindan, Siddharth, et al.
Published: (2025)
by: Aravindan, Siddharth, et al.
Published: (2025)
Efficient Epistemic Uncertainty Estimation for Large Language Models via Knowledge Distillation
by: Park, Seonghyeon, et al.
Published: (2026)
by: Park, Seonghyeon, et al.
Published: (2026)
Sample-Efficient Reinforcement Learning from Human Feedback via Information-Directed Sampling
by: Qi, Han, et al.
Published: (2025)
by: Qi, Han, et al.
Published: (2025)
Efficient Reinforcement Learning for Large Language Models with Intrinsic Exploration
by: Sun, Yan, et al.
Published: (2025)
by: Sun, Yan, et al.
Published: (2025)
Tree-Structured Synergy of Large Language Models and Bayesian Optimization for Efficient CASH
by: Xu, Beicheng, et al.
Published: (2026)
by: Xu, Beicheng, et al.
Published: (2026)
Enhancing Knowledge Tracing with Concept Map and Response Disentanglement
by: Park, Soonwook, et al.
Published: (2024)
by: Park, Soonwook, et al.
Published: (2024)
Reasoning-preserved Efficient Distillation of Large Language Models via Activation-aware Initialization
by: He, Junlin, et al.
Published: (2026)
by: He, Junlin, et al.
Published: (2026)
Weighted Multi-Prompt Learning with Description-free Large Language Model Distillation
by: Lee, Sua, et al.
Published: (2025)
by: Lee, Sua, et al.
Published: (2025)
Unveiling the Latent Directions of Reflection in Large Language Models
by: Chang, Fu-Chieh, et al.
Published: (2025)
by: Chang, Fu-Chieh, et al.
Published: (2025)
Sampling-Based Safe Reinforcement Learning
by: Vignola, Luca, et al.
Published: (2026)
by: Vignola, Luca, et al.
Published: (2026)
Tender: Accelerating Large Language Models via Tensor Decomposition and Runtime Requantization
by: Lee, Jungi, et al.
Published: (2024)
by: Lee, Jungi, et al.
Published: (2024)
LRQ: Optimizing Post-Training Quantization for Large Language Models by Learning Low-Rank Weight-Scaling Matrices
by: Lee, Jung Hyun, et al.
Published: (2024)
by: Lee, Jung Hyun, et al.
Published: (2024)
Similar Items
-
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
by: Lee, Younghwan, et al.
Published: (2025) -
Policy Learning from Large Vision-Language Model Feedback without Reward Modeling
by: Luu, Tung M., et al.
Published: (2025) -
Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models
by: Luu, Tung Minh, et al.
Published: (2025) -
Predictive Coding for Decision Transformer
by: Luu, Tung M., et al.
Published: (2024) -
On the Perturbed States for Transformed Input-robust Reinforcement Learning
by: Luu, Tung M., et al.
Published: (2024)