Language Models as Efficient Reward Function Searchers for Custom-Environment Multi-Objective Reinforcement
Fuente:
arXiv
Guardado en:
| Autores principales: | Xie, Guanwen, Xu, Jingzehua, Yang, Yiyuan, Ding, Yimian, Zhang, Shuai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ERFSL: An Efficient Reward Function Searcher via Language Models for Custom-Environment Multi-Objective Optimization (Student Abstract)
por: Xie, Guanwen, et al.
Publicado: (2026)
por: Xie, Guanwen, et al.
Publicado: (2026)
Enhancing Information Freshness: An AoI Optimized Markov Decision Process
por: Xu, Jingzehua, et al.
Publicado: (2024)
por: Xu, Jingzehua, et al.
Publicado: (2024)
Make Your AUV Adaptive: An Environment-Aware Reinforcement Learning Framework For Underwater Tasks
por: Ding, Yimian, et al.
Publicado: (2025)
por: Ding, Yimian, et al.
Publicado: (2025)
AoI-MDP: An AoI Optimized Markov Decision Process (Student Abstract)
por: Ding, Yimian, et al.
Publicado: (2026)
por: Ding, Yimian, et al.
Publicado: (2026)
Multi-Objective-Optimization Assisted Data Collection Framework for IoUT Based on Offline Reinforcement
por: Ding, Yimian, et al.
Publicado: (2024)
por: Ding, Yimian, et al.
Publicado: (2024)
USV-AUV Collaboration Framework for Underwater Tasks under Extreme Sea Conditions
por: Xu, Jingzehua, et al.
Publicado: (2024)
por: Xu, Jingzehua, et al.
Publicado: (2024)
EFILN: The Electric Field Inversion-Localization Network for High-Precision Underwater Positioning
por: Ding, Yimian, et al.
Publicado: (2024)
por: Ding, Yimian, et al.
Publicado: (2024)
Never Too Rigid to Reach: Adaptive Virtual Model Control with LLM- and Lyapunov-Based Reinforcement Learning
por: Xu, Jingzehua, et al.
Publicado: (2025)
por: Xu, Jingzehua, et al.
Publicado: (2025)
Never too Cocky to Cooperate: An FIM and RL-based USV-AUV Collaborative System for Underwater Tasks in Extreme Sea Conditions
por: Xu, Jingzehua, et al.
Publicado: (2025)
por: Xu, Jingzehua, et al.
Publicado: (2025)
Controllable Preference Optimization: Toward Controllable Multi-Objective Alignment
por: Guo, Yiju, et al.
Publicado: (2024)
por: Guo, Yiju, et al.
Publicado: (2024)
Never too Prim to Swim: An LLM-Enhanced RL-based Adaptive S-Surface Controller for AUVs under Extreme Sea Conditions
por: Xie, Guanwen, et al.
Publicado: (2025)
por: Xie, Guanwen, et al.
Publicado: (2025)
Ocean Diviner: A Diffusion-Augmented Reinforcement Learning Framework for AUV Robust Control in Underwater Tasks
por: Xu, Jingzehua, et al.
Publicado: (2025)
por: Xu, Jingzehua, et al.
Publicado: (2025)
Underwater Embodied Intelligence for Autonomous Robots: A Constraint-Coupled Perspective on Planning, Control, and Deployment
por: Xu, Jingzehua, et al.
Publicado: (2026)
por: Xu, Jingzehua, et al.
Publicado: (2026)
Multi-Objective Planning with Contextual Lexicographic Reward Preferences
por: Rustagi, Pulkit, et al.
Publicado: (2025)
por: Rustagi, Pulkit, et al.
Publicado: (2025)
Control Barrier Function for Aligning Large Language Models
por: Miyaoka, Yuya, et al.
Publicado: (2025)
por: Miyaoka, Yuya, et al.
Publicado: (2025)
Large Language Model Guided Incentive Aware Reward Design for Cooperative Multi-Agent Reinforcement Learning
por: Urgun, Dogan, et al.
Publicado: (2026)
por: Urgun, Dogan, et al.
Publicado: (2026)
When Motion Learns to Listen: Diffusion-Prior Lyapunov Actor-Critic Framework with LLM Guidance for Stable and Robust AUV Control in Underwater Tasks
por: Xu, Jingzehua, et al.
Publicado: (2025)
por: Xu, Jingzehua, et al.
Publicado: (2025)
Is FISHER All You Need in The Multi-AUV Underwater Target Tracking Task?
por: Xie, Guanwen, et al.
Publicado: (2024)
por: Xie, Guanwen, et al.
Publicado: (2024)
RL2: Reinforce Large Language Model to Assist Safe Reinforcement Learning for Energy Management of Active Distribution Networks
por: Yang, Xu, et al.
Publicado: (2024)
por: Yang, Xu, et al.
Publicado: (2024)
When Semantics Connect the Swarm: LLM-Driven Fuzzy Control for Cooperative Multi-Robot Underwater Coverage
por: Xu, Jingzehua, et al.
Publicado: (2025)
por: Xu, Jingzehua, et al.
Publicado: (2025)
Multi-Objective Reinforcement Learning for Large Language Model Optimization: Visionary Perspective
por: Kong, Lingxiao, et al.
Publicado: (2025)
por: Kong, Lingxiao, et al.
Publicado: (2025)
Multi-Objective Reinforcement Learning for Power Grid Topology Control
por: Lautenbacher, Thomas, et al.
Publicado: (2025)
por: Lautenbacher, Thomas, et al.
Publicado: (2025)
CircuitLM: A Multi-Agent LLM-Aided Design Framework for Generating Circuit Schematics from Natural Language Prompts
por: Hasan, Khandakar Shakib Al, et al.
Publicado: (2026)
por: Hasan, Khandakar Shakib Al, et al.
Publicado: (2026)
Deep Reinforcement Learning for Multi-Objective Optimization: Enhancing Wind Turbine Energy Generation while Mitigating Noise Emissions
por: de Frutos, Martín, et al.
Publicado: (2024)
por: de Frutos, Martín, et al.
Publicado: (2024)
Dual-Objective Reinforcement Learning with Novel Hamilton-Jacobi-Bellman Formulations
por: Sharpless, William, et al.
Publicado: (2025)
por: Sharpless, William, et al.
Publicado: (2025)
Bridging Natural Language and Microgrid Dynamics: A Context-Aware Simulator and Dataset
por: Bartels, Tinko Sebastian, et al.
Publicado: (2026)
por: Bartels, Tinko Sebastian, et al.
Publicado: (2026)
Retrieval Augmented (Knowledge Graph), and Large Language Model-Driven Design Structure Matrix (DSM) Generation of Cyber-Physical Systems
por: Bank, H. Sinan, et al.
Publicado: (2026)
por: Bank, H. Sinan, et al.
Publicado: (2026)
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
por: Bai, Qinbo, et al.
Publicado: (2021)
por: Bai, Qinbo, et al.
Publicado: (2021)
Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway Traffic
por: Pathare, Deepthi, et al.
Publicado: (2026)
por: Pathare, Deepthi, et al.
Publicado: (2026)
Control Synthesis in Partially Observable Environments for Complex Perception-Related Objectives
por: Xuan, Zetong, et al.
Publicado: (2025)
por: Xuan, Zetong, et al.
Publicado: (2025)
A Signal Contract for Online Language Grounding and Discovery in Decision-Making
por: Panagopoulos, Dimitris, et al.
Publicado: (2025)
por: Panagopoulos, Dimitris, et al.
Publicado: (2025)
Safety Optimized Reinforcement Learning via Multi-Objective Policy Optimization
por: Honari, Homayoun, et al.
Publicado: (2024)
por: Honari, Homayoun, et al.
Publicado: (2024)
Enhancing LLMs for Power System Simulations: A Feedback-driven Multi-agent Framework
por: Jia, Mengshuo, et al.
Publicado: (2024)
por: Jia, Mengshuo, et al.
Publicado: (2024)
Towards Efficient Multi-Objective Optimisation for Real-World Power Grid Topology Control
por: Manyari, Yassine El, et al.
Publicado: (2025)
por: Manyari, Yassine El, et al.
Publicado: (2025)
Multi-Objective Optimization Using Adaptive Distributed Reinforcement Learning
por: Tan, Jing, et al.
Publicado: (2024)
por: Tan, Jing, et al.
Publicado: (2024)
MORPH-U: Multi-Objective Resilient Motion Planning for V2X-Enabled Autonomous Driving in High-Uncertainty Environments via Simulation
por: Lai, Shih-Yu
Publicado: (2026)
por: Lai, Shih-Yu
Publicado: (2026)
Deep Reinforcement Learning for Power Grid Multi-Stage Cascading Failure Mitigation
por: Meng, Bo, et al.
Publicado: (2025)
por: Meng, Bo, et al.
Publicado: (2025)
Automating Modelica Module Generation Using Large Language Models: A Case Study on Building Control Description Language
por: Wan, Hanlong, et al.
Publicado: (2025)
por: Wan, Hanlong, et al.
Publicado: (2025)
Fine-tuning Smaller Language Models for Question Answering over Financial Documents
por: Phogat, Karmvir Singh, et al.
Publicado: (2024)
por: Phogat, Karmvir Singh, et al.
Publicado: (2024)
Exploiting Symmetry in Dynamics for Model-Based Reinforcement Learning with Asymmetric Rewards
por: Sonmez, Yasin, et al.
Publicado: (2024)
por: Sonmez, Yasin, et al.
Publicado: (2024)
Ejemplares similares
-
ERFSL: An Efficient Reward Function Searcher via Language Models for Custom-Environment Multi-Objective Optimization (Student Abstract)
por: Xie, Guanwen, et al.
Publicado: (2026) -
Enhancing Information Freshness: An AoI Optimized Markov Decision Process
por: Xu, Jingzehua, et al.
Publicado: (2024) -
Make Your AUV Adaptive: An Environment-Aware Reinforcement Learning Framework For Underwater Tasks
por: Ding, Yimian, et al.
Publicado: (2025) -
AoI-MDP: An AoI Optimized Markov Decision Process (Student Abstract)
por: Ding, Yimian, et al.
Publicado: (2026) -
Multi-Objective-Optimization Assisted Data Collection Framework for IoUT Based on Offline Reinforcement
por: Ding, Yimian, et al.
Publicado: (2024)