DGLight: DQN-Guided GRPO Fine-Tuning of Large Language Models for Traffic Signal Control
Fuente:
arXiv
Guardado en:
| Autor principal: | Yu, Chenbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Dual Large Language Models Architecture with Herald Guided Prompts for Parallel Fine Grained Traffic Signal Control
por: Guo, Qing, et al.
Publicado: (2025)
por: Guo, Qing, et al.
Publicado: (2025)
GRPO-RM: Fine-Tuning Representation Models via GRPO-Driven Reinforcement Learning
por: Xu, Yanchen, et al.
Publicado: (2025)
por: Xu, Yanchen, et al.
Publicado: (2025)
DreamerV3 for Traffic Signal Control: Hyperparameter Tuning and Performance
por: Li, Qiang, et al.
Publicado: (2025)
por: Li, Qiang, et al.
Publicado: (2025)
GB-DQN: Gradient Boosted DQN Models for Non-stationary Reinforcement Learning
por: Lee, Chang-Hwan, et al.
Publicado: (2025)
por: Lee, Chang-Hwan, et al.
Publicado: (2025)
Decentralized Semantic Traffic Control in AVs Using RL and DQN for Dynamic Roadblocks
por: Figetakis, Emanuel, et al.
Publicado: (2024)
por: Figetakis, Emanuel, et al.
Publicado: (2024)
EvolveSignal: A Large Language Model Powered Coding Agent for Discovering Traffic Signal Control Strategies
por: Wang, Leizhen, et al.
Publicado: (2025)
por: Wang, Leizhen, et al.
Publicado: (2025)
A Controlled Study of Double DQN and Dueling DQN Under Cross-Environment Transfer
por: Nasir, Azkaa, et al.
Publicado: (2026)
por: Nasir, Azkaa, et al.
Publicado: (2026)
Sparse Gradient Compression for Fine-Tuning Large Language Models
por: Yang, David H., et al.
Publicado: (2025)
por: Yang, David H., et al.
Publicado: (2025)
AMIR-GRPO: Inducing Implicit Preference Signals into GRPO
por: Yari, Amir Hossein, et al.
Publicado: (2026)
por: Yari, Amir Hossein, et al.
Publicado: (2026)
Closed-Loop Supervised Fine-Tuning of Tokenized Traffic Models
por: Zhang, Zhejun, et al.
Publicado: (2024)
por: Zhang, Zhejun, et al.
Publicado: (2024)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
por: Xu, Yichen, et al.
Publicado: (2026)
por: Xu, Yichen, et al.
Publicado: (2026)
GIFT: Group-Relative Implicit Fine-Tuning Integrates GRPO with DPO and UNA
por: Wang, Zhichao
Publicado: (2025)
por: Wang, Zhichao
Publicado: (2025)
Audio Question Answering with GRPO-Based Fine-Tuning and Calibrated Segment-Level Predictions
por: Gibier, Marcel, et al.
Publicado: (2025)
por: Gibier, Marcel, et al.
Publicado: (2025)
GRPO-TTA: Test-Time Visual Tuning for Vision-Language Models via GRPO-Driven Reinforcement Learning
por: Li, Yujun, et al.
Publicado: (2026)
por: Li, Yujun, et al.
Publicado: (2026)
Transformation-Augmented GRPO for Enhancing Exploration in Reasoning of Large Language Models
por: Le, Khiem, et al.
Publicado: (2026)
por: Le, Khiem, et al.
Publicado: (2026)
Self-Generative Adversarial Fine-Tuning for Large Language Models
por: Wu, Shiguang, et al.
Publicado: (2026)
por: Wu, Shiguang, et al.
Publicado: (2026)
Diversity in Large Language Models under Supervised Fine-Tuning
por: Klypa, Roman, et al.
Publicado: (2026)
por: Klypa, Roman, et al.
Publicado: (2026)
Decentralized Low-Rank Fine-Tuning of Large Language Models
por: Ghiasvand, Sajjad, et al.
Publicado: (2025)
por: Ghiasvand, Sajjad, et al.
Publicado: (2025)
RIFT: Group-Relative RL Fine-Tuning for Realistic and Controllable Traffic Simulation
por: Chen, Keyu, et al.
Publicado: (2025)
por: Chen, Keyu, et al.
Publicado: (2025)
Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models
por: Zong, Yongshuo, et al.
Publicado: (2024)
por: Zong, Yongshuo, et al.
Publicado: (2024)
QuantLRM: Quantization of Large Reasoning Models via Fine-Tuning Signals
por: Zhang, Nan, et al.
Publicado: (2026)
por: Zhang, Nan, et al.
Publicado: (2026)
Fine-Tuned Language Models as Space Systems Controllers
por: Zucchelli, Enrico M., et al.
Publicado: (2025)
por: Zucchelli, Enrico M., et al.
Publicado: (2025)
Linearization Explains Fine-Tuning in Large Language Models
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
Dissecting Fine-Tuning Unlearning in Large Language Models
por: Hong, Yihuai, et al.
Publicado: (2024)
por: Hong, Yihuai, et al.
Publicado: (2024)
Multi-Layer GRPO: Enhancing Reasoning and Self-Correction in Large Language Models
por: Ding, Fei, et al.
Publicado: (2025)
por: Ding, Fei, et al.
Publicado: (2025)
Continual Fine-Tuning of Large Language Models via Program Memory
por: Le, Hung, et al.
Publicado: (2026)
por: Le, Hung, et al.
Publicado: (2026)
CoLLMLight: Cooperative Large Language Model Agents for Network-Wide Traffic Signal Control
por: Yuan, Zirui, et al.
Publicado: (2025)
por: Yuan, Zirui, et al.
Publicado: (2025)
S-GRPO: Unified Post-Training for Large Vision-Language Models
por: Yan, Yuming, et al.
Publicado: (2026)
por: Yan, Yuming, et al.
Publicado: (2026)
G-Loss: Graph-Guided Fine-Tuning of Language Models
por: Sharma, Aditya, et al.
Publicado: (2026)
por: Sharma, Aditya, et al.
Publicado: (2026)
Differentially Private Subspace Fine-Tuning for Large Language Models
por: Zheng, Lele, et al.
Publicado: (2026)
por: Zheng, Lele, et al.
Publicado: (2026)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
por: Wang, Shumin, et al.
Publicado: (2026)
por: Wang, Shumin, et al.
Publicado: (2026)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024)
por: Li, Ziniu, et al.
Publicado: (2024)
Personalized Collaborative Fine-Tuning for On-Device Large Language Models
por: Wagner, Nicolas, et al.
Publicado: (2024)
por: Wagner, Nicolas, et al.
Publicado: (2024)
How Multilingual Are Large Language Models Fine-Tuned for Translation?
por: Richburg, Aquia, et al.
Publicado: (2024)
por: Richburg, Aquia, et al.
Publicado: (2024)
Large-scale Regional Traffic Signal Control Based on Single-Agent Reinforcement Learning
por: Li, Qiang, et al.
Publicado: (2025)
por: Li, Qiang, et al.
Publicado: (2025)
Tangent Space Fine-Tuning for Directional Preference Alignment in Large Language Models
por: Erdogan, Mete
Publicado: (2026)
por: Erdogan, Mete
Publicado: (2026)
Resource-Efficient Federated Fine-Tuning Large Language Models for Heterogeneous Data
por: Liu, Jun, et al.
Publicado: (2025)
por: Liu, Jun, et al.
Publicado: (2025)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
por: Ansell, Alan, et al.
Publicado: (2024)
por: Ansell, Alan, et al.
Publicado: (2024)
Single-agent Reinforcement Learning Model for Regional Adaptive Traffic Signal Control
por: Li, Qiang, et al.
Publicado: (2025)
por: Li, Qiang, et al.
Publicado: (2025)
Ejemplares similares
-
A Dual Large Language Models Architecture with Herald Guided Prompts for Parallel Fine Grained Traffic Signal Control
por: Guo, Qing, et al.
Publicado: (2025) -
GRPO-RM: Fine-Tuning Representation Models via GRPO-Driven Reinforcement Learning
por: Xu, Yanchen, et al.
Publicado: (2025) -
DreamerV3 for Traffic Signal Control: Hyperparameter Tuning and Performance
por: Li, Qiang, et al.
Publicado: (2025) -
GB-DQN: Gradient Boosted DQN Models for Non-stationary Reinforcement Learning
por: Lee, Chang-Hwan, et al.
Publicado: (2025) -
Decentralized Semantic Traffic Control in AVs Using RL and DQN for Dynamic Roadblocks
por: Figetakis, Emanuel, et al.
Publicado: (2024)