Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Max, Yu, Chan-Hung, Lee, Wei-Hsu, Hung, Cheng-Wei, Chen, Yen-Chun, Sun, Shao-Hua |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Assessing the Interpretability of Programmatic Policies with Large Language Models
by: Bashir, Zahra, et al.
Published: (2023)
by: Bashir, Zahra, et al.
Published: (2023)
Searching for Programmatic Policies in Semantic Spaces
by: Moraes, Rubens O., et al.
Published: (2024)
by: Moraes, Rubens O., et al.
Published: (2024)
LLM Discussion: Enhancing the Creativity of Large Language Models via Discussion Framework and Role-Play
by: Lu, Li-Chun, et al.
Published: (2024)
by: Lu, Li-Chun, et al.
Published: (2024)
AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning
by: Lin, Tzu-Han, et al.
Published: (2025)
by: Lin, Tzu-Han, et al.
Published: (2025)
Programmatic Reinforcement Learning: Navigating Gridworlds
by: Shabadi, Guruprerana, et al.
Published: (2024)
by: Shabadi, Guruprerana, et al.
Published: (2024)
Programmatic Imitation Learning from Unlabeled and Noisy Demonstrations
by: Xin, Jimmy, et al.
Published: (2023)
by: Xin, Jimmy, et al.
Published: (2023)
Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples
by: Kuan, Chun-Yi, et al.
Published: (2025)
by: Kuan, Chun-Yi, et al.
Published: (2025)
Unveiling the Power of Intermediate Representations for Static Analysis: A Survey
by: Zhang, Bowen, et al.
Published: (2024)
by: Zhang, Bowen, et al.
Published: (2024)
Synthesizing Backward Error Bounds, Backward
by: Zielinski, Laura, et al.
Published: (2026)
by: Zielinski, Laura, et al.
Published: (2026)
On Calibration of Large Language Models: From Response To Capability
by: Yang, Sin-Han, et al.
Published: (2026)
by: Yang, Sin-Han, et al.
Published: (2026)
BILLY: Steering Large Language Models via Merging Persona Vectors for Creative Generation
by: Pai, Tsung-Min, et al.
Published: (2025)
by: Pai, Tsung-Min, et al.
Published: (2025)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
by: Hsu, Chan-Jan, et al.
Published: (2026)
by: Hsu, Chan-Jan, et al.
Published: (2026)
SUQL: Conversational Search over Structured and Unstructured Data with Large Language Models
by: Liu, Shicheng, et al.
Published: (2023)
by: Liu, Shicheng, et al.
Published: (2023)
Over-Reasoning and Redundant Calculation of Large Language Models
by: Chiang, Cheng-Han, et al.
Published: (2024)
by: Chiang, Cheng-Han, et al.
Published: (2024)
Program Machine Policy: Addressing Long-Horizon Tasks by Integrating Program Synthesis and State Machines
by: Lin, Yu-An, et al.
Published: (2023)
by: Lin, Yu-An, et al.
Published: (2023)
Equality Saturation Guided by Large Language Models
by: Peng, Wentao, et al.
Published: (2025)
by: Peng, Wentao, et al.
Published: (2025)
Understanding Sounds, Missing the Questions: The Challenge of Object Hallucination in Large Audio-Language Models
by: Kuan, Chun-Yi, et al.
Published: (2024)
by: Kuan, Chun-Yi, et al.
Published: (2024)
Investigating Video Reasoning Capability of Large Language Models with Tropes in Movies
by: Su, Hung-Ting, et al.
Published: (2024)
by: Su, Hung-Ting, et al.
Published: (2024)
Large Language Model as an Assignment Evaluator: Insights, Feedback, and Challenges in a 1000+ Student Course
by: Chiang, Cheng-Han, et al.
Published: (2024)
by: Chiang, Cheng-Han, et al.
Published: (2024)
Spoken Stereoset: On Evaluating Social Bias Toward Speaker in Speech Large Language Models
by: Lin, Yi-Cheng, et al.
Published: (2024)
by: Lin, Yi-Cheng, et al.
Published: (2024)
Efficient Beam Search for Large Language Models Using Trie-Based Decoding
by: Chan, Brian J, et al.
Published: (2025)
by: Chan, Brian J, et al.
Published: (2025)
AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models
by: Yeh, Cheng-Kai, et al.
Published: (2025)
by: Yeh, Cheng-Kai, et al.
Published: (2025)
Large Language Models for In-Context Student Modeling: Synthesizing Student's Behavior in Visual Programming
by: Nguyen, Manh Hung, et al.
Published: (2023)
by: Nguyen, Manh Hung, et al.
Published: (2023)
Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models
by: Kuan, Chun-Yi, et al.
Published: (2026)
by: Kuan, Chun-Yi, et al.
Published: (2026)
Highly Incremental: A Simple Programmatic Approach for Many Objectives (Extended Version)
by: Schröer, Philipp, et al.
Published: (2026)
by: Schröer, Philipp, et al.
Published: (2026)
Integrating Large Language Models and Reinforcement Learning for Non-Linear Reasoning
by: Alon, Yoav, et al.
Published: (2024)
by: Alon, Yoav, et al.
Published: (2024)
MUGEN: Evaluating and Improving Multi-audio Understanding of Large Audio-Language Models
by: Yang, Chih-Kai, et al.
Published: (2026)
by: Yang, Chih-Kai, et al.
Published: (2026)
Gender Bias in Instruction-Guided Speech Synthesis Models
by: Kuan, Chun-Yi, et al.
Published: (2025)
by: Kuan, Chun-Yi, et al.
Published: (2025)
Can Large Audio-Language Models Truly Hear? Tackling Hallucinations with Multi-Task Assessment and Stepwise Audio Reasoning
by: Kuan, Chun-Yi, et al.
Published: (2024)
by: Kuan, Chun-Yi, et al.
Published: (2024)
Efficient Action-Constrained Reinforcement Learning via Acceptance-Rejection Method and Augmented MDPs
by: Hung, Wei, et al.
Published: (2025)
by: Hung, Wei, et al.
Published: (2025)
EvolVE: Evolutionary Search for LLM-based Verilog Generation and Optimization
by: Hsin, Wei-Po, et al.
Published: (2026)
by: Hsin, Wei-Po, et al.
Published: (2026)
Causal Tracing of Audio-Text Fusion in Large Audio Language Models
by: Chen, Wei-Chih, et al.
Published: (2026)
by: Chen, Wei-Chih, et al.
Published: (2026)
SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition
by: Hsu, Ming-Hao, et al.
Published: (2024)
by: Hsu, Ming-Hao, et al.
Published: (2024)
Guess & Sketch: Language Model Guided Transpilation
by: Lee, Celine, et al.
Published: (2023)
by: Lee, Celine, et al.
Published: (2023)
Exploring In-Context Learning of Textless Speech Language Model for Speech Classification Tasks
by: Hsu, Ming-Hao, et al.
Published: (2023)
by: Hsu, Ming-Hao, et al.
Published: (2023)
Reducing Object Hallucination in Large Audio-Language Models via Audio-Aware Decoding
by: Hsu, Tzu-wen, et al.
Published: (2025)
by: Hsu, Tzu-wen, et al.
Published: (2025)
A Self-Refining Framework for Enhancing ASR Using TTS-Synthesized Data
by: Chou, Cheng-Kang, et al.
Published: (2025)
by: Chou, Cheng-Kang, et al.
Published: (2025)
Hearing the Order: Investigating Position Bias in Large Audio-Language Models
by: Lin, Yu-Xiang, et al.
Published: (2025)
by: Lin, Yu-Xiang, et al.
Published: (2025)
Examining Forgetting in Continual Pre-training of Aligned Large Language Models
by: Li, Chen-An, et al.
Published: (2024)
by: Li, Chen-An, et al.
Published: (2024)
SafeTree: Expressive Tree Policies for Microservices
by: Grewal, Karuna, et al.
Published: (2025)
by: Grewal, Karuna, et al.
Published: (2025)
Similar Items
-
Assessing the Interpretability of Programmatic Policies with Large Language Models
by: Bashir, Zahra, et al.
Published: (2023) -
Searching for Programmatic Policies in Semantic Spaces
by: Moraes, Rubens O., et al.
Published: (2024) -
LLM Discussion: Enhancing the Creativity of Large Language Models via Discussion Framework and Role-Play
by: Lu, Li-Chun, et al.
Published: (2024) -
AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning
by: Lin, Tzu-Han, et al.
Published: (2025) -
Programmatic Reinforcement Learning: Navigating Gridworlds
by: Shabadi, Guruprerana, et al.
Published: (2024)