Balancing Multiple Objectives in Urban Traffic Control with Reinforcement Learning from AI Feedback
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhao, Chenyang, Cahill, Vinny, Dusparic, Ivana |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Geographically-aware Transformer-based Traffic Forecasting for Urban Motorway Digital Twins
von: Kušić, Krešimir, et al.
Veröffentlicht: (2026)
von: Kušić, Krešimir, et al.
Veröffentlicht: (2026)
Continual Reinforcement Learning for Cyber-Physical Systems: Lessons Learned and Open Challenges
von: Nolle, Kim N., et al.
Veröffentlicht: (2025)
von: Nolle, Kim N., et al.
Veröffentlicht: (2025)
Drama: Mamba-Enabled Model-Based Reinforcement Learning Is Sample and Parameter Efficient
von: Wang, Wenlong, et al.
Veröffentlicht: (2024)
von: Wang, Wenlong, et al.
Veröffentlicht: (2024)
Applying Neural Monte Carlo Tree Search to Unsignalized Multi-intersection Scheduling for Autonomous Vehicles
von: Shi, Yucheng, et al.
Veröffentlicht: (2024)
von: Shi, Yucheng, et al.
Veröffentlicht: (2024)
Multi-Objective Deep Reinforcement Learning for Optimisation in Autonomous Systems
von: Rosero, Juan C., et al.
Veröffentlicht: (2024)
von: Rosero, Juan C., et al.
Veröffentlicht: (2024)
TREX: Trajectory Explanations for Multi-Objective Reinforcement Learning
von: Rajapakse, Dilina, et al.
Veröffentlicht: (2026)
von: Rajapakse, Dilina, et al.
Veröffentlicht: (2026)
Redefining Counterfactual Explanations for Reinforcement Learning: Overview, Challenges and Opportunities
von: Gajcin, Jasmina, et al.
Veröffentlicht: (2022)
von: Gajcin, Jasmina, et al.
Veröffentlicht: (2022)
Semifactual Explanations for Reinforcement Learning
von: Gajcin, Jasmina, et al.
Veröffentlicht: (2024)
von: Gajcin, Jasmina, et al.
Veröffentlicht: (2024)
Adapting the Behavior of Reinforcement Learning Agents to Changing Action Spaces and Reward Functions
von: de la Rosa, Raul, et al.
Veröffentlicht: (2026)
von: de la Rosa, Raul, et al.
Veröffentlicht: (2026)
ACTER: Diverse and Actionable Counterfactual Sequences for Explaining and Diagnosing RL Policies
von: Gajcin, Jasmina, et al.
Veröffentlicht: (2024)
von: Gajcin, Jasmina, et al.
Veröffentlicht: (2024)
Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning
von: McCarthy, James, et al.
Veröffentlicht: (2025)
von: McCarthy, James, et al.
Veröffentlicht: (2025)
Curriculum-RLAIF: Curriculum Alignment with Reinforcement Learning from AI Feedback
von: Lin, Jiaye, et al.
Veröffentlicht: (2025)
von: Lin, Jiaye, et al.
Veröffentlicht: (2025)
FBOS-RL: Feedback-Driven Bi-Objective Synergistic Reinforcement Learning
von: Zhang, Xikai, et al.
Veröffentlicht: (2026)
von: Zhang, Xikai, et al.
Veröffentlicht: (2026)
Safe Urban Traffic Control via Uncertainty-Aware Conformal Prediction and World-Model Reinforcement Learning
von: Chandra, Joydeep, et al.
Veröffentlicht: (2026)
von: Chandra, Joydeep, et al.
Veröffentlicht: (2026)
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
von: Gu, Shangding, et al.
Veröffentlicht: (2024)
von: Gu, Shangding, et al.
Veröffentlicht: (2024)
Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway Traffic
von: Pathare, Deepthi, et al.
Veröffentlicht: (2026)
von: Pathare, Deepthi, et al.
Veröffentlicht: (2026)
TrafficClaw: A Generalizable LLM Agent in the Unified Physical Environment for Urban Traffic Control
von: Lai, Siqi, et al.
Veröffentlicht: (2026)
von: Lai, Siqi, et al.
Veröffentlicht: (2026)
MTLight: Efficient Multi-Task Reinforcement Learning for Traffic Signal Control
von: Zhu, Liwen, et al.
Veröffentlicht: (2024)
von: Zhu, Liwen, et al.
Veröffentlicht: (2024)
AI Alignment through Reinforcement Learning from Human Feedback? Contradictions and Limitations
von: Lindström, Adam Dahlgren, et al.
Veröffentlicht: (2024)
von: Lindström, Adam Dahlgren, et al.
Veröffentlicht: (2024)
Conformal Arbitrage: Risk-Controlled Balancing of Competing Objectives in Language Models
von: Overman, William, et al.
Veröffentlicht: (2025)
von: Overman, William, et al.
Veröffentlicht: (2025)
Reinforcement Learning from User Feedback
von: Han, Eric, et al.
Veröffentlicht: (2025)
von: Han, Eric, et al.
Veröffentlicht: (2025)
Balancing Rewards in Text Summarization: Multi-Objective Reinforcement Learning via HyperVolume Optimization
von: Song, Junjie, et al.
Veröffentlicht: (2025)
von: Song, Junjie, et al.
Veröffentlicht: (2025)
Generalized Phase Pressure Control Enhanced Reinforcement Learning for Traffic Signal Control
von: Liao, Xiao-Cheng, et al.
Veröffentlicht: (2025)
von: Liao, Xiao-Cheng, et al.
Veröffentlicht: (2025)
Polychromic Objectives for Reinforcement Learning
von: Hamid, Jubayer Ibn, et al.
Veröffentlicht: (2025)
von: Hamid, Jubayer Ibn, et al.
Veröffentlicht: (2025)
Reinforcement Learning from Implicit Neural Feedback for Human-Aligned Robot Control
von: Kim, Suzie
Veröffentlicht: (2025)
von: Kim, Suzie
Veröffentlicht: (2025)
ROSE: A Recognition-Oriented Speech Enhancement Framework in Air Traffic Control Using Multi-Objective Learning
von: Yu, Xincheng, et al.
Veröffentlicht: (2023)
von: Yu, Xincheng, et al.
Veröffentlicht: (2023)
A Robust and Efficient Multi-Agent Reinforcement Learning Framework for Traffic Signal Control
von: Huang, Sheng-You, et al.
Veröffentlicht: (2026)
von: Huang, Sheng-You, et al.
Veröffentlicht: (2026)
RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback
von: Lee, Harrison, et al.
Veröffentlicht: (2023)
von: Lee, Harrison, et al.
Veröffentlicht: (2023)
Spatial-Temporal Feedback Diffusion Guidance for Controlled Traffic Imputation
von: Mao, Xiaowei, et al.
Veröffentlicht: (2026)
von: Mao, Xiaowei, et al.
Veröffentlicht: (2026)
Deep Reinforcement Learning for Traffic Light Control in Intelligent Transportation Systems
von: Zhu, Ming, et al.
Veröffentlicht: (2023)
von: Zhu, Ming, et al.
Veröffentlicht: (2023)
Targeted Exploration via Unified Entropy Control for Reinforcement Learning
von: Wang, Chen, et al.
Veröffentlicht: (2026)
von: Wang, Chen, et al.
Veröffentlicht: (2026)
Reinforcement Learning with Token-level Feedback for Controllable Text Generation
von: Li, Wendi, et al.
Veröffentlicht: (2024)
von: Li, Wendi, et al.
Veröffentlicht: (2024)
Context-Aware Model-Based Reinforcement Learning for Autonomous Racing
von: Moustafa, Emran Yasser, et al.
Veröffentlicht: (2025)
von: Moustafa, Emran Yasser, et al.
Veröffentlicht: (2025)
Model Predictive Control-Guided Reinforcement Learning for Implicit Balancing
von: Madahi, Seyed Soroush Karimi, et al.
Veröffentlicht: (2025)
von: Madahi, Seyed Soroush Karimi, et al.
Veröffentlicht: (2025)
Impact of Collective Behaviors of Autonomous Vehicles on Urban Traffic Dynamics: A Multi-Agent Reinforcement Learning Approach
von: Akman, Ahmet Onur, et al.
Veröffentlicht: (2025)
von: Akman, Ahmet Onur, et al.
Veröffentlicht: (2025)
Multi-Objective Reinforcement Learning for Power Grid Topology Control
von: Lautenbacher, Thomas, et al.
Veröffentlicht: (2025)
von: Lautenbacher, Thomas, et al.
Veröffentlicht: (2025)
AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
von: Mei, Lang, et al.
Veröffentlicht: (2025)
von: Mei, Lang, et al.
Veröffentlicht: (2025)
Flexible Blood Glucose Control: Offline Reinforcement Learning from Human Feedback
von: Emerson, Harry, et al.
Veröffentlicht: (2025)
von: Emerson, Harry, et al.
Veröffentlicht: (2025)
Traffic-R1: Reinforced LLMs Bring Human-Like Reasoning to Traffic Signal Control Systems
von: Zou, Xingchen, et al.
Veröffentlicht: (2025)
von: Zou, Xingchen, et al.
Veröffentlicht: (2025)
Optimistic Reinforcement Learning with Quantile Objectives
von: Alipour-Vaezi, Mohammad, et al.
Veröffentlicht: (2025)
von: Alipour-Vaezi, Mohammad, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Geographically-aware Transformer-based Traffic Forecasting for Urban Motorway Digital Twins
von: Kušić, Krešimir, et al.
Veröffentlicht: (2026) -
Continual Reinforcement Learning for Cyber-Physical Systems: Lessons Learned and Open Challenges
von: Nolle, Kim N., et al.
Veröffentlicht: (2025) -
Drama: Mamba-Enabled Model-Based Reinforcement Learning Is Sample and Parameter Efficient
von: Wang, Wenlong, et al.
Veröffentlicht: (2024) -
Applying Neural Monte Carlo Tree Search to Unsignalized Multi-intersection Scheduling for Autonomous Vehicles
von: Shi, Yucheng, et al.
Veröffentlicht: (2024) -
Multi-Objective Deep Reinforcement Learning for Optimisation in Autonomous Systems
von: Rosero, Juan C., et al.
Veröffentlicht: (2024)