Focused Skill Discovery: Learning to Control Specific State Variables while Minimizing Side Effects
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Carr, Jonathan Colaço, Sun, Qinyi, Allen, Cameron |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Pixels to Factors: Learning Independently Controllable State Variables for Reinforcement Learning
par: Rodriguez-Sanchez, Rafael, et autres
Publié: (2025)
par: Rodriguez-Sanchez, Rafael, et autres
Publié: (2025)
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
par: Carr, Jonathan Colaço, et autres
Publié: (2026)
par: Carr, Jonathan Colaço, et autres
Publié: (2026)
Learning Markov State Abstractions for Deep Reinforcement Learning
par: Allen, Cameron, et autres
Publié: (2021)
par: Allen, Cameron, et autres
Publié: (2021)
SUSD: Structured Unsupervised Skill Discovery through State Factorization
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2026)
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2026)
Efficient Skill Discovery via Regret-Aware Optimization
par: Zhang, He, et autres
Publié: (2025)
par: Zhang, He, et autres
Publié: (2025)
Minimizing Surrogate Losses for Decision-Focused Learning using Differentiable Optimization
par: Mandi, Jayanta, et autres
Publié: (2025)
par: Mandi, Jayanta, et autres
Publié: (2025)
Reference Grounded Skill Discovery
par: Rho, Seungeun, et autres
Publié: (2025)
par: Rho, Seungeun, et autres
Publié: (2025)
Agentic Skill Discovery
par: Zhao, Xufeng, et autres
Publié: (2024)
par: Zhao, Xufeng, et autres
Publié: (2024)
Unsupervised Skill Discovery as Exploration for Learning Agile Locomotion
par: Rho, Seungeun, et autres
Publié: (2025)
par: Rho, Seungeun, et autres
Publié: (2025)
Variational Offline Multi-agent Skill Discovery
par: Chen, Jiayu, et autres
Publié: (2024)
par: Chen, Jiayu, et autres
Publié: (2024)
Continual Learning through Control Minimization
par: de Haan, Sander, et autres
Publié: (2026)
par: de Haan, Sander, et autres
Publié: (2026)
Causal Pre-training Under the Fairness Lens: An Empirical Study of TabPFN
par: Liu, Qinyi, et autres
Publié: (2026)
par: Liu, Qinyi, et autres
Publié: (2026)
Towards Privacy-Preserving Data-Driven Education: The Potential of Federated Learning
par: Khalil, Mohammad, et autres
Publié: (2025)
par: Khalil, Mohammad, et autres
Publié: (2025)
Leveraging Human Feedback for Semantically-Relevant Skill Discovery
par: Hussonnois, Maxence, et autres
Publié: (2026)
par: Hussonnois, Maxence, et autres
Publié: (2026)
State Soup: In-Context Skill Learning, Retrieval and Mixing
par: Pióro, Maciej, et autres
Publié: (2024)
par: Pióro, Maciej, et autres
Publié: (2024)
Principle-Evolvable Scientific Discovery via Uncertainty Minimization
par: Pu, Yingming, et autres
Publié: (2026)
par: Pu, Yingming, et autres
Publié: (2026)
Thought Cloning: Learning to Think while Acting by Imitating Human Thinking
par: Hu, Shengran, et autres
Publié: (2023)
par: Hu, Shengran, et autres
Publié: (2023)
SkillTree: Explainable Skill-Based Deep Reinforcement Learning for Long-Horizon Control Tasks
par: Wen, Yongyan, et autres
Publié: (2024)
par: Wen, Yongyan, et autres
Publié: (2024)
Benchmarking Partial Observability in Reinforcement Learning with a Suite of Memory-Improvable Domains
par: Tao, Ruo Yu, et autres
Publié: (2025)
par: Tao, Ruo Yu, et autres
Publié: (2025)
Creating Artificial Students that Never Existed: Leveraging Large Language Models and CTGANs for Synthetic Data Generation
par: Khalil, Mohammad, et autres
Publié: (2025)
par: Khalil, Mohammad, et autres
Publié: (2025)
Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback
par: Yang, Yongjin, et autres
Publié: (2025)
par: Yang, Yongjin, et autres
Publié: (2025)
Focus On This, Not That! Steering LLMs with Adaptive Feature Specification
par: Lamb, Tom A., et autres
Publié: (2024)
par: Lamb, Tom A., et autres
Publié: (2024)
Dynamic Contrastive Skill Learning with State-Transition Based Skill Clustering and Dynamic Length Adjustment
par: Choi, Jinwoo, et autres
Publié: (2025)
par: Choi, Jinwoo, et autres
Publié: (2025)
Causal Discovery in Linear Models with Unobserved Variables and Measurement Error
par: Yang, Yuqin, et autres
Publié: (2024)
par: Yang, Yuqin, et autres
Publié: (2024)
Skill-Critic: Refining Learned Skills for Hierarchical Reinforcement Learning
par: Hao, Ce, et autres
Publié: (2023)
par: Hao, Ce, et autres
Publié: (2023)
Language Guided Skill Discovery
par: Rho, Seungeun, et autres
Publié: (2024)
par: Rho, Seungeun, et autres
Publié: (2024)
Evaluating Causal Discovery Algorithms for Path-Specific Fairness and Utility in Healthcare
par: Nagesh, Nitish, et autres
Publié: (2026)
par: Nagesh, Nitish, et autres
Publié: (2026)
Neuro-Symbolic Skill Discovery for Conditional Multi-Level Planning
par: Aktas, Hakan, et autres
Publié: (2024)
par: Aktas, Hakan, et autres
Publié: (2024)
Minimize Control Inputs for Strong Structural Controllability Using Reinforcement Learning with Graph Neural Network
par: Zou, Mengbang, et autres
Publié: (2024)
par: Zou, Mengbang, et autres
Publié: (2024)
Evidence of Learned Look-Ahead in a Chess-Playing Neural Network
par: Jenner, Erik, et autres
Publié: (2024)
par: Jenner, Erik, et autres
Publié: (2024)
Discovery of False Data Injection Schemes on Frequency Controllers with Reinforcement Learning
par: Prasad, Romesh, et autres
Publié: (2024)
par: Prasad, Romesh, et autres
Publié: (2024)
Evolutionary Task Discovery: Advancing Reasoning Frontiers via Skill Composition and Complexity Scaling
par: Ye, Liqin, et autres
Publié: (2026)
par: Ye, Liqin, et autres
Publié: (2026)
Hierarchical Meta-Reinforcement Learning via Automated Macro-Action Discovery
par: Cho, Minjae, et autres
Publié: (2024)
par: Cho, Minjae, et autres
Publié: (2024)
SkillOrchestra: Learning to Route Agents via Skill Transfer
par: Wang, Jiayu, et autres
Publié: (2026)
par: Wang, Jiayu, et autres
Publié: (2026)
OrthoFormer: Instrumental Variable Estimation in Transformer Hidden States via Neural Control Functions
par: Luo, Charles
Publié: (2026)
par: Luo, Charles
Publié: (2026)
Auto-Discovery-Bench: Diagnosing Structured State Tracking in Oracle-Guided Discovery
par: Chen, Tingting, et autres
Publié: (2025)
par: Chen, Tingting, et autres
Publié: (2025)
Fair Machine Unlearning: Data Removal while Mitigating Disparities
par: Oesterling, Alex, et autres
Publié: (2023)
par: Oesterling, Alex, et autres
Publié: (2023)
Unsupervised Skill Discovery for Robotic Manipulation through Automatic Task Generation
par: Jansonnie, Paul, et autres
Publié: (2024)
par: Jansonnie, Paul, et autres
Publié: (2024)
ComSD: Balancing Behavioral Quality and Diversity in Unsupervised Skill Discovery
par: Liu, Xin, et autres
Publié: (2023)
par: Liu, Xin, et autres
Publié: (2023)
Efficient Latent Variable Causal Discovery: Combining Score Search and Targeted Testing
par: Ramsey, Joseph, et autres
Publié: (2025)
par: Ramsey, Joseph, et autres
Publié: (2025)
Documents similaires
-
From Pixels to Factors: Learning Independently Controllable State Variables for Reinforcement Learning
par: Rodriguez-Sanchez, Rafael, et autres
Publié: (2025) -
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
par: Carr, Jonathan Colaço, et autres
Publié: (2026) -
Learning Markov State Abstractions for Deep Reinforcement Learning
par: Allen, Cameron, et autres
Publié: (2021) -
SUSD: Structured Unsupervised Skill Discovery through State Factorization
par: Hosseini, Seyed Mohammad Hadi, et autres
Publié: (2026) -
Efficient Skill Discovery via Regret-Aware Optimization
par: Zhang, He, et autres
Publié: (2025)