Leveraging LLMs for reward function design in reinforcement learning control tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Cardenoso, Franklin, Caarls, Wouter |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Deep Reinforcement Learning for Haptic Shared Control in Unknown Tasks
di: Fernandez, Franklin Cardeñoso, et al.
Pubblicazione: (2021)
di: Fernandez, Franklin Cardeñoso, et al.
Pubblicazione: (2021)
Simulation-based reinforcement learning for real-world autonomous driving
di: Osiński, Błażej, et al.
Pubblicazione: (2019)
di: Osiński, Błażej, et al.
Pubblicazione: (2019)
Correspondence learning between morphologically different robots via task demonstrations
di: Aktas, Hakan, et al.
Pubblicazione: (2023)
di: Aktas, Hakan, et al.
Pubblicazione: (2023)
Autonomous navigation of catheters and guidewires in mechanical thrombectomy using inverse reinforcement learning
di: Robertshaw, Harry, et al.
Pubblicazione: (2024)
di: Robertshaw, Harry, et al.
Pubblicazione: (2024)
Maximum diffusion reinforcement learning
di: Berrueta, Thomas A., et al.
Pubblicazione: (2023)
di: Berrueta, Thomas A., et al.
Pubblicazione: (2023)
Scilab-RL: A software framework for efficient reinforcement learning and cognitive modeling research
di: Dohmen, Jan, et al.
Pubblicazione: (2024)
di: Dohmen, Jan, et al.
Pubblicazione: (2024)
MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
Physics-informed offline reinforcement learning eliminates catastrophic fuel waste in maritime routing
di: Bora, Aniruddha, et al.
Pubblicazione: (2026)
di: Bora, Aniruddha, et al.
Pubblicazione: (2026)
Knowledge capture, adaptation and composition (KCAC): A framework for cross-task curriculum learning in robotic manipulation
di: Wang, Xinrui, et al.
Pubblicazione: (2025)
di: Wang, Xinrui, et al.
Pubblicazione: (2025)
Graph-Grounded LLMs: Leveraging Graphical Function Calling to Minimize LLM Hallucinations
di: Gupta, Piyush, et al.
Pubblicazione: (2025)
di: Gupta, Piyush, et al.
Pubblicazione: (2025)
A transformer-based deep reinforcement learning approach to spatial navigation in a partially observable Morris Water Maze
di: Eggen, Marte, et al.
Pubblicazione: (2024)
di: Eggen, Marte, et al.
Pubblicazione: (2024)
The intrinsic motivation of reinforcement and imitation learning for sequential tasks
di: Nguyen, Sao Mai
Pubblicazione: (2024)
di: Nguyen, Sao Mai
Pubblicazione: (2024)
Using reinforcement learning to probe the role of feedback in skill acquisition
di: Terpin, Antonio, et al.
Pubblicazione: (2025)
di: Terpin, Antonio, et al.
Pubblicazione: (2025)
Exploring reinforcement learning for incident response in autonomous military vehicles
di: Madsen, Henrik, et al.
Pubblicazione: (2024)
di: Madsen, Henrik, et al.
Pubblicazione: (2024)
On the benefits of pixel-based hierarchical policies for task generalization
di: Cristea-Platon, Tudor, et al.
Pubblicazione: (2024)
di: Cristea-Platon, Tudor, et al.
Pubblicazione: (2024)
Less is more -- the Dispatcher/ Executor principle for multi-task Reinforcement Learning
di: Riedmiller, Martin, et al.
Pubblicazione: (2023)
di: Riedmiller, Martin, et al.
Pubblicazione: (2023)
Human-compatible driving partners through data-regularized self-play reinforcement learning
di: Cornelisse, Daphne, et al.
Pubblicazione: (2024)
di: Cornelisse, Daphne, et al.
Pubblicazione: (2024)
Curriculum reinforcement learning with measurable task representation learning
di: Wen, Yongyan, et al.
Pubblicazione: (2026)
di: Wen, Yongyan, et al.
Pubblicazione: (2026)
RoboGPT: an intelligent agent of making embodied long-term decisions for daily instruction tasks
di: Chen, Yaran, et al.
Pubblicazione: (2023)
di: Chen, Yaran, et al.
Pubblicazione: (2023)
Planning to avoid ambiguous states through Gaussian approximations to non-linear sensors in active inference agents
di: Kouw, Wouter M.
Pubblicazione: (2024)
di: Kouw, Wouter M.
Pubblicazione: (2024)
Leveraging Analytic Gradients in Provably Safe Reinforcement Learning
di: Walter, Tim, et al.
Pubblicazione: (2025)
di: Walter, Tim, et al.
Pubblicazione: (2025)
Body Transformer: Leveraging Robot Embodiment for Policy Learning
di: Sferrazza, Carmelo, et al.
Pubblicazione: (2024)
di: Sferrazza, Carmelo, et al.
Pubblicazione: (2024)
Leveraging Sub-Optimal Data for Human-in-the-Loop Reinforcement Learning
di: Muslimani, Calarina, et al.
Pubblicazione: (2024)
di: Muslimani, Calarina, et al.
Pubblicazione: (2024)
Message passing-based inference in an autoregressive active inference agent
di: Kouw, Wouter M., et al.
Pubblicazione: (2025)
di: Kouw, Wouter M., et al.
Pubblicazione: (2025)
Leveraging Procedural Generation for Learning Autonomous Peg-in-Hole Assembly in Space
di: Orsula, Andrej, et al.
Pubblicazione: (2024)
di: Orsula, Andrej, et al.
Pubblicazione: (2024)
Redefining Data Pairing for Motion Retargeting Leveraging a Human Body Prior
di: Figuera, Xiyana, et al.
Pubblicazione: (2024)
di: Figuera, Xiyana, et al.
Pubblicazione: (2024)
Q-learning with Adjoint Matching
di: Li, Qiyang, et al.
Pubblicazione: (2026)
di: Li, Qiyang, et al.
Pubblicazione: (2026)
Trinity: Unifying Class-Agnostic Terrain and Semantic Segmentation for Unstructured Outdoor Environments by Leveraging Synthetic Data
di: Müller, Marcus G, et al.
Pubblicazione: (2026)
di: Müller, Marcus G, et al.
Pubblicazione: (2026)
Revisiting Safe Exploration in Safe Reinforcement learning
di: Eckel, David, et al.
Pubblicazione: (2024)
di: Eckel, David, et al.
Pubblicazione: (2024)
Reinforcement-learning robotic sailboats: simulator and preliminary results
di: Vasconcellos, Eduardo Charles, et al.
Pubblicazione: (2024)
di: Vasconcellos, Eduardo Charles, et al.
Pubblicazione: (2024)
CoFineLLM: Conformal Finetuning of LLMs for Language-Instructed Robot Planning
di: Wang, Jun, et al.
Pubblicazione: (2025)
di: Wang, Jun, et al.
Pubblicazione: (2025)
Enabling robots to follow abstract instructions and complete complex dynamic tasks
di: Mon-Williams, Ruaridh, et al.
Pubblicazione: (2024)
di: Mon-Williams, Ruaridh, et al.
Pubblicazione: (2024)
Interactive incremental learning of generalizable skills with local trajectory modulation
di: Knauer, Markus, et al.
Pubblicazione: (2024)
di: Knauer, Markus, et al.
Pubblicazione: (2024)
Can only LLMs do Reasoning?: Potential of Small Language Models in Task Planning
di: Choi, Gawon, et al.
Pubblicazione: (2024)
di: Choi, Gawon, et al.
Pubblicazione: (2024)
Exploring multimodal implicit behavior learning for vehicle navigation in simulated cities
di: Antonelo, Eric Aislan, et al.
Pubblicazione: (2025)
di: Antonelo, Eric Aislan, et al.
Pubblicazione: (2025)
DEAS: DEtached value learning with Action Sequence for Scalable Offline RL
di: Kim, Changyeon, et al.
Pubblicazione: (2025)
di: Kim, Changyeon, et al.
Pubblicazione: (2025)
DIAR: Diffusion-model-guided Implicit Q-learning with Adaptive Revaluation
di: Park, Jaehyun, et al.
Pubblicazione: (2024)
di: Park, Jaehyun, et al.
Pubblicazione: (2024)
Noise-based reward-modulated learning
di: Fernández, Jesús García, et al.
Pubblicazione: (2025)
di: Fernández, Jesús García, et al.
Pubblicazione: (2025)
Mitigating Suboptimality of Deterministic Policy Gradients in Complex Q-functions
di: Jain, Ayush, et al.
Pubblicazione: (2024)
di: Jain, Ayush, et al.
Pubblicazione: (2024)
Active teacher selection for reward learning
di: Freedman, Rachel, et al.
Pubblicazione: (2023)
di: Freedman, Rachel, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Deep Reinforcement Learning for Haptic Shared Control in Unknown Tasks
di: Fernandez, Franklin Cardeñoso, et al.
Pubblicazione: (2021) -
Simulation-based reinforcement learning for real-world autonomous driving
di: Osiński, Błażej, et al.
Pubblicazione: (2019) -
Correspondence learning between morphologically different robots via task demonstrations
di: Aktas, Hakan, et al.
Pubblicazione: (2023) -
Autonomous navigation of catheters and guidewires in mechanical thrombectomy using inverse reinforcement learning
di: Robertshaw, Harry, et al.
Pubblicazione: (2024) -
Maximum diffusion reinforcement learning
di: Berrueta, Thomas A., et al.
Pubblicazione: (2023)