SF-DQN: Provable Knowledge Transfer using Successor Feature for Deep Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Shuai, Fernando, Heshan Devaka, Liu, Miao, Murugesan, Keerthiram, Lu, Songtao, Chen, Pin-Yu, Chen, Tianyi, Wang, Meng |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Mitigating Gradient Bias in Multi-objective Learning: A Provably Convergent Stochastic Approach
by: Fernando, Heshan, et al.
Published: (2022)
by: Fernando, Heshan, et al.
Published: (2022)
STARLING: Self-supervised Training of Text-based Reinforcement Learning Agent with Large Language Models
by: Basavatia, Shreyas, et al.
Published: (2024)
by: Basavatia, Shreyas, et al.
Published: (2024)
PEEL the Layers and Find Yourself: Revisiting Inference-time Data Leakage for Residual Neural Networks
by: Arif, Huzaifa, et al.
Published: (2025)
by: Arif, Huzaifa, et al.
Published: (2025)
On the Effects of Fine-tuning Language Models for Text-Based Reinforcement Learning
by: Gruppi, Mauricio, et al.
Published: (2024)
by: Gruppi, Mauricio, et al.
Published: (2024)
Three-Way Trade-Off in Multi-Objective Learning: Optimization, Generalization and Conflict-Avoidance
by: Chen, Lisha, et al.
Published: (2023)
by: Chen, Lisha, et al.
Published: (2023)
Learning on Transformers is Provable Low-Rank and Sparse: A One-layer Analysis
by: Li, Hongkang, et al.
Published: (2024)
by: Li, Hongkang, et al.
Published: (2024)
Patching LLM Like Software: A Lightweight Method for Improving Safety Policy in Large Language Models
by: Arif, Huzaifa, et al.
Published: (2025)
by: Arif, Huzaifa, et al.
Published: (2025)
How Do Nonlinear Transformers Learn and Generalize in In-Context Learning?
by: Li, Hongkang, et al.
Published: (2024)
by: Li, Hongkang, et al.
Published: (2024)
Successor Features for Transfer in Alternating Markov Games
by: Amatya, Sunny, et al.
Published: (2025)
by: Amatya, Sunny, et al.
Published: (2025)
EXPLORER: Exploration-guided Reasoning for Textual Reinforcement Learning
by: Basu, Kinjal, et al.
Published: (2024)
by: Basu, Kinjal, et al.
Published: (2024)
Stacked Universal Successor Feature Approximators for Safety in Reinforcement Learning
by: Cannon, Ian, et al.
Published: (2024)
by: Cannon, Ian, et al.
Published: (2024)
Can Mamba Learn In Context with Outliers? A Theoretical Generalization Analysis
by: Li, Hongkang, et al.
Published: (2025)
by: Li, Hongkang, et al.
Published: (2025)
OjaKV: Context-Aware Online Low-Rank KV Cache Compression
by: Zhu, Yuxuan, et al.
Published: (2025)
by: Zhu, Yuxuan, et al.
Published: (2025)
Multi-Task Reinforcement Learning in Continuous Control with Successor Feature-Based Concurrent Composition
by: Liu, Yu Tang, et al.
Published: (2023)
by: Liu, Yu Tang, et al.
Published: (2023)
GB-DQN: Gradient Boosted DQN Models for Non-stationary Reinforcement Learning
by: Lee, Chang-Hwan, et al.
Published: (2025)
by: Lee, Chang-Hwan, et al.
Published: (2025)
Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
by: Jain, Arnav Kumar, et al.
Published: (2024)
by: Jain, Arnav Kumar, et al.
Published: (2024)
Hierarchical Successor Representation for Robust Transfer
by: Yu, Changmin, et al.
Published: (2026)
by: Yu, Changmin, et al.
Published: (2026)
Learning Successor Features the Simple Way
by: Chua, Raymond, et al.
Published: (2024)
by: Chua, Raymond, et al.
Published: (2024)
SymDQN: Symbolic Knowledge and Reasoning in Neural Network-based Reinforcement Learning
by: Amador, Ivo, et al.
Published: (2025)
by: Amador, Ivo, et al.
Published: (2025)
ZoomR: Memory Efficient Reasoning through Multi-Granularity Key Value Retrieval
by: Yang, David H., et al.
Published: (2026)
by: Yang, David H., et al.
Published: (2026)
When is Task Vector Provably Effective for Model Editing? A Generalization Analysis of Nonlinear Transformers
by: Li, Hongkang, et al.
Published: (2025)
by: Li, Hongkang, et al.
Published: (2025)
Training Nonlinear Transformers for Chain-of-Thought Inference: A Theoretical Generalization Analysis
by: Li, Hongkang, et al.
Published: (2024)
by: Li, Hongkang, et al.
Published: (2024)
Which Features are Best for Successor Features?
by: Ollivier, Yann
Published: (2025)
by: Ollivier, Yann
Published: (2025)
Targeted Advertising on Social Networks Using Online Variational Tensor Regression
by: Idé, Tsuyoshi, et al.
Published: (2022)
by: Idé, Tsuyoshi, et al.
Published: (2022)
Hybrid DQN-TD3 Reinforcement Learning for Autonomous Navigation in Dynamic Environments
by: He, Xiaoyi, et al.
Published: (2025)
by: He, Xiaoyi, et al.
Published: (2025)
A Controlled Study of Double DQN and Dueling DQN Under Cross-Environment Transfer
by: Nasir, Azkaa, et al.
Published: (2026)
by: Nasir, Azkaa, et al.
Published: (2026)
Mitigating Misalignment Contagion by Steering with Implicit Traits
by: Chang, Maria, et al.
Published: (2026)
by: Chang, Maria, et al.
Published: (2026)
AgentRouter: A Knowledge-Graph-Guided LLM Router for Collaborative Multi-Agent Question Answering
by: Zhang, Zheyuan, et al.
Published: (2025)
by: Zhang, Zheyuan, et al.
Published: (2025)
Learning Successor Features with Distributed Hebbian Temporal Memory
by: Dzhivelikian, Evgenii, et al.
Published: (2023)
by: Dzhivelikian, Evgenii, et al.
Published: (2023)
LongDA: Benchmarking LLM Agents for Long-Document Data Analysis
by: Li, Yiyang, et al.
Published: (2026)
by: Li, Yiyang, et al.
Published: (2026)
Towards Aligning Language Models with Textual Feedback
by: Lloret, Saüc Abadal, et al.
Published: (2024)
by: Lloret, Saüc Abadal, et al.
Published: (2024)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
by: Wang, Changhong, et al.
Published: (2024)
by: Wang, Changhong, et al.
Published: (2024)
Balancing Multi-modal Sensor Learning via Multi-objective Optimization
by: Fernando, Heshan, et al.
Published: (2025)
by: Fernando, Heshan, et al.
Published: (2025)
CM-DQN: A Value-Based Deep Reinforcement Learning Model to Simulate Confirmation Bias
by: Shen, Jiacheng, et al.
Published: (2024)
by: Shen, Jiacheng, et al.
Published: (2024)
Full-Gradient Successor Feature Representations
by: Shrirao, Ritish, et al.
Published: (2026)
by: Shrirao, Ritish, et al.
Published: (2026)
Does DQN Learn?
by: Gopalan, Aditya, et al.
Published: (2022)
by: Gopalan, Aditya, et al.
Published: (2022)
Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
by: Fernando, Heshan, et al.
Published: (2024)
by: Fernando, Heshan, et al.
Published: (2024)
$\pi2\text{vec}$: Policy Representations with Successor Features
by: Scarpellini, Gianluca, et al.
Published: (2023)
by: Scarpellini, Gianluca, et al.
Published: (2023)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
by: Vora, Kevin, et al.
Published: (2025)
by: Vora, Kevin, et al.
Published: (2025)
A note on the maximum probability of ultra log-concave distributions
by: Aravinda, Heshan
Published: (2025)
by: Aravinda, Heshan
Published: (2025)
Similar Items
-
Mitigating Gradient Bias in Multi-objective Learning: A Provably Convergent Stochastic Approach
by: Fernando, Heshan, et al.
Published: (2022) -
STARLING: Self-supervised Training of Text-based Reinforcement Learning Agent with Large Language Models
by: Basavatia, Shreyas, et al.
Published: (2024) -
PEEL the Layers and Find Yourself: Revisiting Inference-time Data Leakage for Residual Neural Networks
by: Arif, Huzaifa, et al.
Published: (2025) -
On the Effects of Fine-tuning Language Models for Text-Based Reinforcement Learning
by: Gruppi, Mauricio, et al.
Published: (2024) -
Three-Way Trade-Off in Multi-Objective Learning: Optimization, Generalization and Conflict-Avoidance
by: Chen, Lisha, et al.
Published: (2023)