Where You Go is Who You Are: Behavioral Theory-Guided LLMs for Inverse Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Yuran, Xu, Susu, Wang, Chenguang, Zhao, Xilei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Perceptions to Decisions: Wildfire Evacuation Decision Prediction with Behavioral Theory-informed LLMs
por: Chen, Ruxiao, et al.
Publicado: (2025)
por: Chen, Ruxiao, et al.
Publicado: (2025)
Synthesizing Attitudes, Predicting Actions (SAPA): Behavioral Theory-Guided LLMs for Ridesourcing Mode Choice Modeling
por: Sameen, Mustafa, et al.
Publicado: (2025)
por: Sameen, Mustafa, et al.
Publicado: (2025)
Where Do You Go? Pedestrian Trajectory Prediction using Scene Features
por: Rezaei, Mohammad Ali, et al.
Publicado: (2025)
por: Rezaei, Mohammad Ali, et al.
Publicado: (2025)
OffSeeker: Online Reinforcement Learning Is Not All You Need for Deep Research Agents
por: Zhou, Yuhang, et al.
Publicado: (2026)
por: Zhou, Yuhang, et al.
Publicado: (2026)
AIMatDesign: Knowledge-Augmented Reinforcement Learning for Inverse Materials Design under Data Scarcity
por: Yu, Yeyong, et al.
Publicado: (2025)
por: Yu, Yeyong, et al.
Publicado: (2025)
Where Did It Go Wrong? Attributing Undesirable LLM Behaviors via Representation Gradient Tracing
por: Li, Zhe, et al.
Publicado: (2025)
por: Li, Zhe, et al.
Publicado: (2025)
Easy Samples Are All You Need: Self-Evolving LLMs via Data-Efficient Reinforcement Learning
por: Yu, Zhiyin, et al.
Publicado: (2026)
por: Yu, Zhiyin, et al.
Publicado: (2026)
Discovering What You Can Control: Interventional Boundary Discovery for Reinforcement Learning
por: Liu, Jiaxin, et al.
Publicado: (2026)
por: Liu, Jiaxin, et al.
Publicado: (2026)
Is Exploration All You Need? Effective Exploration Characteristics for Transfer in Reinforcement Learning
por: Balloch, Jonathan C., et al.
Publicado: (2024)
por: Balloch, Jonathan C., et al.
Publicado: (2024)
Inverse Reinforcement Learning with Switching Rewards and History Dependency for Characterizing Animal Behaviors
por: Ke, Jingyang, et al.
Publicado: (2025)
por: Ke, Jingyang, et al.
Publicado: (2025)
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective
por: Zhao, Lei, et al.
Publicado: (2023)
por: Zhao, Lei, et al.
Publicado: (2023)
Response-Level Rewards Are All You Need for Online Reinforcement Learning in LLMs: A Mathematical Perspective
por: He, Shenghua, et al.
Publicado: (2025)
por: He, Shenghua, et al.
Publicado: (2025)
No More Adam: Learning Rate Scaling at Initialization is All You Need
por: Xu, Minghao, et al.
Publicado: (2024)
por: Xu, Minghao, et al.
Publicado: (2024)
On the Effective Horizon of Inverse Reinforcement Learning
por: Xu, Yiqing, et al.
Publicado: (2023)
por: Xu, Yiqing, et al.
Publicado: (2023)
Attention is All You Need Until You Need Retention
por: Yaslioglu, M. Murat
Publicado: (2025)
por: Yaslioglu, M. Murat
Publicado: (2025)
Is Behavior Cloning All You Need? Understanding Horizon in Imitation Learning
por: Foster, Dylan J., et al.
Publicado: (2024)
por: Foster, Dylan J., et al.
Publicado: (2024)
Scaling Is All You Need: Autonomous Driving with JAX-Accelerated Reinforcement Learning
por: Harmel, Moritz, et al.
Publicado: (2023)
por: Harmel, Moritz, et al.
Publicado: (2023)
Generalizing Behavior via Inverse Reinforcement Learning with Closed-Form Reward Centroids
por: Lazzati, Filippo, et al.
Publicado: (2025)
por: Lazzati, Filippo, et al.
Publicado: (2025)
DIM: Enforcing Domain-Informed Monotonicity in Deep Neural Networks
por: Salim, Joshua, et al.
Publicado: (2025)
por: Salim, Joshua, et al.
Publicado: (2025)
When Your AIs Deceive You: Challenges of Partial Observability in Reinforcement Learning from Human Feedback
por: Lang, Leon, et al.
Publicado: (2024)
por: Lang, Leon, et al.
Publicado: (2024)
Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning
por: Sun, Hao, et al.
Publicado: (2024)
por: Sun, Hao, et al.
Publicado: (2024)
You are out of context!
por: Cobino, Giancarlo, et al.
Publicado: (2024)
por: Cobino, Giancarlo, et al.
Publicado: (2024)
Hybrid Inverse Reinforcement Learning
por: Ren, Juntao, et al.
Publicado: (2024)
por: Ren, Juntao, et al.
Publicado: (2024)
What Can You Do When You Have Zero Rewards During RL?
por: Prakash, Jatin, et al.
Publicado: (2025)
por: Prakash, Jatin, et al.
Publicado: (2025)
Supervised Fine-Tuning as Inverse Reinforcement Learning
por: Sun, Hao
Publicado: (2024)
por: Sun, Hao
Publicado: (2024)
Partial Differential Equations is All You Need for Generating Neural Architectures -- A Theory for Physical Artificial Intelligence Systems
por: Guo, Ping, et al.
Publicado: (2021)
por: Guo, Ping, et al.
Publicado: (2021)
Masking Improves Contrastive Self-Supervised Learning for ConvNets, and Saliency Tells You Where
por: Chin, Zhi-Yi, et al.
Publicado: (2023)
por: Chin, Zhi-Yi, et al.
Publicado: (2023)
You Need an Encoder for Native Position-Independent Caching
por: Zhao, Shiju, et al.
Publicado: (2026)
por: Zhao, Shiju, et al.
Publicado: (2026)
What LLMs Think When You Don't Tell Them What to Think About?
por: Kwon, Yongchan, et al.
Publicado: (2026)
por: Kwon, Yongchan, et al.
Publicado: (2026)
Can LLMs Guide Their Own Exploration? Gradient-Guided Reinforcement Learning for LLM Reasoning
por: Liang, Zhenwen, et al.
Publicado: (2025)
por: Liang, Zhenwen, et al.
Publicado: (2025)
Optimisation Is Not What You Need
por: Ibias, Alfredo
Publicado: (2025)
por: Ibias, Alfredo
Publicado: (2025)
Seek and You Shall Fold
por: Sellam, Nadav Bojan, et al.
Publicado: (2025)
por: Sellam, Nadav Bojan, et al.
Publicado: (2025)
Context is All You Need
por: Delanois, Jean Erik, et al.
Publicado: (2026)
por: Delanois, Jean Erik, et al.
Publicado: (2026)
Learning Dynamic Belief Graphs for Theory-of-mind Reasoning
por: Chen, Ruxiao, et al.
Publicado: (2026)
por: Chen, Ruxiao, et al.
Publicado: (2026)
Attention Is All You Need for KV Cache in Diffusion LLMs
por: Nguyen-Tri, Quan, et al.
Publicado: (2025)
por: Nguyen-Tri, Quan, et al.
Publicado: (2025)
Modeling Behavioral Preferences of Cyber Adversaries Using Inverse Reinforcement Learning
por: Shinde, Aditya, et al.
Publicado: (2025)
por: Shinde, Aditya, et al.
Publicado: (2025)
Recursive Deep Inverse Reinforcement Learning
por: Ghanem, Paul, et al.
Publicado: (2025)
por: Ghanem, Paul, et al.
Publicado: (2025)
Can LLMs Help You at Work? A Sandbox for Evaluating LLM Agents in Enterprise Environments
por: Vishwakarma, Harsh, et al.
Publicado: (2025)
por: Vishwakarma, Harsh, et al.
Publicado: (2025)
Fast Rates for Inverse Reinforcement Learning
por: Schlaginhaufen, Andreas, et al.
Publicado: (2026)
por: Schlaginhaufen, Andreas, et al.
Publicado: (2026)
Environment Design for Inverse Reinforcement Learning
por: Buening, Thomas Kleine, et al.
Publicado: (2022)
por: Buening, Thomas Kleine, et al.
Publicado: (2022)
Ejemplares similares
-
From Perceptions to Decisions: Wildfire Evacuation Decision Prediction with Behavioral Theory-informed LLMs
por: Chen, Ruxiao, et al.
Publicado: (2025) -
Synthesizing Attitudes, Predicting Actions (SAPA): Behavioral Theory-Guided LLMs for Ridesourcing Mode Choice Modeling
por: Sameen, Mustafa, et al.
Publicado: (2025) -
Where Do You Go? Pedestrian Trajectory Prediction using Scene Features
por: Rezaei, Mohammad Ali, et al.
Publicado: (2025) -
OffSeeker: Online Reinforcement Learning Is Not All You Need for Deep Research Agents
por: Zhou, Yuhang, et al.
Publicado: (2026) -
AIMatDesign: Knowledge-Augmented Reinforcement Learning for Inverse Materials Design under Data Scarcity
por: Yu, Yeyong, et al.
Publicado: (2025)