Autonomous Learning From Success and Failure: Goal-Conditioned Supervised Learning with Negative Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Zeqiang, Wurzberger, Fabian, Schmid, Gerrit, Gottwald, Sebastian, Braun, Daniel A. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
par: Li, Shijun, et autres
Publié: (2026)
par: Li, Shijun, et autres
Publié: (2026)
SVL: Goal-Conditioned Reinforcement Learning as Survival Learning
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2026)
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2026)
Goal-Conditioned Supervised Learning for Multi-Objective Recommendation
par: Li, Shijun, et autres
Publié: (2024)
par: Li, Shijun, et autres
Publié: (2024)
Backward Learning for Goal-Conditioned Policies
par: Höftmann, Marc, et autres
Publié: (2023)
par: Höftmann, Marc, et autres
Publié: (2023)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
par: Wibault, Clarisse, et autres
Publié: (2026)
par: Wibault, Clarisse, et autres
Publié: (2026)
Goal Exploration via Adaptive Skill Distribution for Goal-Conditioned Reinforcement Learning
par: Wu, Lisheng, et autres
Publié: (2024)
par: Wu, Lisheng, et autres
Publié: (2024)
Proposing Hierarchical Goal-Conditioned Policy Planning in Multi-Goal Reinforcement Learning
par: Rens, Gavin B.
Publié: (2025)
par: Rens, Gavin B.
Publié: (2025)
Negative Feedback System as Optimizer for Machine Learning Systems
par: Hasan, Md Munir, et autres
Publié: (2021)
par: Hasan, Md Munir, et autres
Publié: (2021)
Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning
par: Chuck, Caleb, et autres
Publié: (2025)
par: Chuck, Caleb, et autres
Publié: (2025)
Goal-Conditioned Agents that Learn Everything All at Once
par: Matthews, Michael, et autres
Publié: (2026)
par: Matthews, Michael, et autres
Publié: (2026)
GCHR : Goal-Conditioned Hindsight Regularization for Sample-Efficient Reinforcement Learning
par: Lei, Xing, et autres
Publié: (2025)
par: Lei, Xing, et autres
Publié: (2025)
Goal-Conditioned Reinforcement Learning for Data-Driven Maritime Navigation
par: Vaidheeswaran, Vaishnav, et autres
Publié: (2025)
par: Vaidheeswaran, Vaishnav, et autres
Publié: (2025)
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
par: Sikchi, Harshit, et autres
Publié: (2023)
par: Sikchi, Harshit, et autres
Publié: (2023)
Temporal Imbalance of Positive and Negative Supervision in Class-Incremental Learning
par: Ma, Jinge, et autres
Publié: (2026)
par: Ma, Jinge, et autres
Publié: (2026)
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
par: Shi, Yiwei, et autres
Publié: (2024)
par: Shi, Yiwei, et autres
Publié: (2024)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
par: Huang, Xingshuai, et autres
Publié: (2024)
par: Huang, Xingshuai, et autres
Publié: (2024)
Benchmark Success, Clinical Failure: When Reinforcement Learning Optimizes for Benchmarks, Not Patients
par: Berger, Armin, et autres
Publié: (2025)
par: Berger, Armin, et autres
Publié: (2025)
UNO: Unlearning via Orthogonalization in Generative models
par: Mandal, Pinak, et autres
Publié: (2025)
par: Mandal, Pinak, et autres
Publié: (2025)
Incorporating Spatial Information into Goal-Conditioned Hierarchical Reinforcement Learning via Graph Representations
par: Zhang, Shuyuan, et autres
Publié: (2025)
par: Zhang, Shuyuan, et autres
Publié: (2025)
Why Goal-Conditioned Reinforcement Learning Works: Relation to Dual Control
par: Lawrence, Nathan P., et autres
Publié: (2025)
par: Lawrence, Nathan P., et autres
Publié: (2025)
From Answers to Arguments: Toward Trustworthy Clinical Diagnostic Reasoning with Toulmin-Guided Curriculum Goal-Conditioned Learning
par: Zhan, Chen, et autres
Publié: (2026)
par: Zhan, Chen, et autres
Publié: (2026)
Replay Failures as Successes: Sample-Efficient Reinforcement Learning for Instruction Following
par: Zhang, Kongcheng, et autres
Publié: (2025)
par: Zhang, Kongcheng, et autres
Publié: (2025)
Validity Learning on Failures: Mitigating the Distribution Shift in Autonomous Vehicle Planning
par: Arasteh, Fazel, et autres
Publié: (2024)
par: Arasteh, Fazel, et autres
Publié: (2024)
Dynamic Neural Curiosity Enhances Learning Flexibility for Autonomous Goal Discovery
par: Houbre, Quentin, et autres
Publié: (2024)
par: Houbre, Quentin, et autres
Publié: (2024)
Option-aware Temporally Abstracted Value for Offline Goal-Conditioned Reinforcement Learning
par: Ahn, Hongjoon, et autres
Publié: (2025)
par: Ahn, Hongjoon, et autres
Publié: (2025)
Exploring the Edges of Latent State Clusters for Goal-Conditioned Reinforcement Learning
par: Duan, Yuanlin, et autres
Publié: (2024)
par: Duan, Yuanlin, et autres
Publié: (2024)
Autotelic Agents with Intrinsically Motivated Goal-Conditioned Reinforcement Learning: a Short Survey
par: Colas, Cédric, et autres
Publié: (2020)
par: Colas, Cédric, et autres
Publié: (2020)
Offline Policy Learning via Skill-step Abstraction for Long-horizon Goal-Conditioned Tasks
par: Kim, Donghoon, et autres
Publié: (2024)
par: Kim, Donghoon, et autres
Publié: (2024)
Beyond Error-Based Optimization: Experience-Driven Symbolic Regression with Goal-Conditioned Reinforcement Learning
par: Sun, Jianwen, et autres
Publié: (2026)
par: Sun, Jianwen, et autres
Publié: (2026)
Dense and Diverse Goal Coverage in Multi Goal Reinforcement Learning
par: Singh, Sagalpreet, et autres
Publié: (2025)
par: Singh, Sagalpreet, et autres
Publié: (2025)
Data-Efficient Hierarchical Goal-Conditioned Reinforcement Learning via Normalizing Flows
par: Garg, Shaswat, et autres
Publié: (2026)
par: Garg, Shaswat, et autres
Publié: (2026)
Goal Recognition as Reinforcement Learning
par: Amado, Leonardo Rosa, et autres
Publié: (2022)
par: Amado, Leonardo Rosa, et autres
Publié: (2022)
How to Provably Improve Return Conditioned Supervised Learning?
par: Liu, Zhishuai, et autres
Publié: (2025)
par: Liu, Zhishuai, et autres
Publié: (2025)
Success Conditioning as Policy Improvement: The Optimization Problem Solved by Imitating Success
par: Russo, Daniel
Publié: (2026)
par: Russo, Daniel
Publié: (2026)
Incoherence in Goal-Conditioned Autoregressive Models
par: Karwowski, Jacek, et autres
Publié: (2025)
par: Karwowski, Jacek, et autres
Publié: (2025)
Multimodal Negative Learning
par: Gong, Baoquan, et autres
Publié: (2025)
par: Gong, Baoquan, et autres
Publié: (2025)
Energy per Successful Goal: Goal-Level Energy Accounting for Agentic AI Systems
par: Panigrahy, Deepak, et autres
Publié: (2026)
par: Panigrahy, Deepak, et autres
Publié: (2026)
Return-to-Go Is More Than a Number: Q-Guided Alignment for Return-Conditioned Supervised Learning
par: Yang, Yuxiao, et autres
Publié: (2026)
par: Yang, Yuxiao, et autres
Publié: (2026)
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning
par: Salt, Llewyn, et autres
Publié: (2025)
par: Salt, Llewyn, et autres
Publié: (2025)
Chain-of-Goals Hierarchical Policy for Long-Horizon Offline Goal-Conditioned RL
par: Choi, Jinwoo, et autres
Publié: (2026)
par: Choi, Jinwoo, et autres
Publié: (2026)
Documents similaires
-
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
par: Li, Shijun, et autres
Publié: (2026) -
SVL: Goal-Conditioned Reinforcement Learning as Survival Learning
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2026) -
Goal-Conditioned Supervised Learning for Multi-Objective Recommendation
par: Li, Shijun, et autres
Publié: (2024) -
Backward Learning for Goal-Conditioned Policies
par: Höftmann, Marc, et autres
Publié: (2023) -
Abstraction for Offline Goal-Conditioned Reinforcement Learning
par: Wibault, Clarisse, et autres
Publié: (2026)