Enhancing Decision-Making of Large Language Models via Actor-Critic
Fuente:
arXiv
Salvato in:
| Autori principali: | Dong, Heng, Duan, Kefei, Zhang, Chongjie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive Tuning
di: Pasewark, Eric, et al.
Pubblicazione: (2024)
di: Pasewark, Eric, et al.
Pubblicazione: (2024)
On the Decision-Making Abilities in Role-Playing using Large Language Models
di: Shen, Chenglei, et al.
Pubblicazione: (2024)
di: Shen, Chenglei, et al.
Pubblicazione: (2024)
Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting
di: Chen, Wei, et al.
Pubblicazione: (2025)
di: Chen, Wei, et al.
Pubblicazione: (2025)
CONDESION-BENCH: Conditional Decision-Making of Large Language Models in Compositional Action Space
di: Hwang, Yeonjun, et al.
Pubblicazione: (2026)
di: Hwang, Yeonjun, et al.
Pubblicazione: (2026)
Asymmetric Actor-Critic for Multi-turn LLM Agents
di: Jiang, Shuli, et al.
Pubblicazione: (2026)
di: Jiang, Shuli, et al.
Pubblicazione: (2026)
CriticEval: Evaluating Large Language Model as Critic
di: Lan, Tian, et al.
Pubblicazione: (2024)
di: Lan, Tian, et al.
Pubblicazione: (2024)
Unveiling the Mystery of Weight in Large Foundation Models: Gaussian Distribution Never Fades
di: Si, Chongjie, et al.
Pubblicazione: (2025)
di: Si, Chongjie, et al.
Pubblicazione: (2025)
DeLLMa: Decision Making Under Uncertainty with Large Language Models
di: Liu, Ollie, et al.
Pubblicazione: (2024)
di: Liu, Ollie, et al.
Pubblicazione: (2024)
Building Decision Making Models Through Language Model Regime
di: Zhang, Yu, et al.
Pubblicazione: (2024)
di: Zhang, Yu, et al.
Pubblicazione: (2024)
Knowledge Graph-Enhanced Large Language Models via Path Selection
di: Liu, Haochen, et al.
Pubblicazione: (2024)
di: Liu, Haochen, et al.
Pubblicazione: (2024)
ECCoT: A Framework for Enhancing Effective Cognition via Chain of Thought in Large Language Model
di: Duan, Zhenke, et al.
Pubblicazione: (2025)
di: Duan, Zhenke, et al.
Pubblicazione: (2025)
Geometry of Decision Making in Language Models
di: Joshi, Abhinav, et al.
Pubblicazione: (2025)
di: Joshi, Abhinav, et al.
Pubblicazione: (2025)
Enhancing Large Language Models through Structured Reasoning
di: Dong, Yubo, et al.
Pubblicazione: (2025)
di: Dong, Yubo, et al.
Pubblicazione: (2025)
O3D: Offline Data-driven Discovery and Distillation for Sequential Decision-Making with Large Language Models
di: Xiao, Yuchen, et al.
Pubblicazione: (2023)
di: Xiao, Yuchen, et al.
Pubblicazione: (2023)
Cascaded Language Models for Cost-effective Human-AI Decision-Making
di: Fanconi, Claudio, et al.
Pubblicazione: (2025)
di: Fanconi, Claudio, et al.
Pubblicazione: (2025)
Leveraging Large Language Models for Collective Decision-Making
di: Papachristou, Marios, et al.
Pubblicazione: (2023)
di: Papachristou, Marios, et al.
Pubblicazione: (2023)
Abstraction-of-Thought Makes Language Models Better Reasoners
di: Hong, Ruixin, et al.
Pubblicazione: (2024)
di: Hong, Ruixin, et al.
Pubblicazione: (2024)
Enhancing Large Language Models for Clinical Decision Support by Incorporating Clinical Practice Guidelines
di: Oniani, David, et al.
Pubblicazione: (2024)
di: Oniani, David, et al.
Pubblicazione: (2024)
Online Intrinsic Rewards for Decision Making Agents from Large Language Model Feedback
di: Zheng, Qinqing, et al.
Pubblicazione: (2024)
di: Zheng, Qinqing, et al.
Pubblicazione: (2024)
Controlling Large Language Model-based Agents for Large-Scale Decision-Making: An Actor-Critic Approach
di: Zhang, Bin, et al.
Pubblicazione: (2023)
di: Zhang, Bin, et al.
Pubblicazione: (2023)
Agent AI with LangGraph: A Modular Framework for Enhancing Machine Translation Using Large Language Models
di: Wang, Jialin, et al.
Pubblicazione: (2024)
di: Wang, Jialin, et al.
Pubblicazione: (2024)
Answer, Refuse, or Guess? Investigating Risk-Aware Decision Making in Language Models
di: Wu, Cheng-Kuang, et al.
Pubblicazione: (2025)
di: Wu, Cheng-Kuang, et al.
Pubblicazione: (2025)
Decision-Level Ordinal Modeling for Multimodal Essay Scoring with Large Language Models
di: Zhang, Han, et al.
Pubblicazione: (2026)
di: Zhang, Han, et al.
Pubblicazione: (2026)
SPFT-SQL: Enhancing Large Language Model for Text-to-SQL Parsing by Self-Play Fine-Tuning
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
Ask more, know better: Reinforce-Learned Prompt Questions for Decision Making with Large Language Models
di: Yan, Xue, et al.
Pubblicazione: (2023)
di: Yan, Xue, et al.
Pubblicazione: (2023)
Hierarchical Alignment: Surgical Fine-Tuning via Functional Layer Specialization in Large Language Models
di: Zhang, Yukun, et al.
Pubblicazione: (2025)
di: Zhang, Yukun, et al.
Pubblicazione: (2025)
Political Actor Agent: Simulating Legislative System for Roll Call Votes Prediction with Large Language Models
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Supervised Knowledge Makes Large Language Models Better In-context Learners
di: Yang, Linyi, et al.
Pubblicazione: (2023)
di: Yang, Linyi, et al.
Pubblicazione: (2023)
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
CliBench: A Multifaceted and Multigranular Evaluation of Large Language Models for Clinical Decision Making
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2024)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2024)
ACC-Collab: An Actor-Critic Approach to Multi-Agent LLM Collaboration
di: Estornell, Andrew, et al.
Pubblicazione: (2024)
di: Estornell, Andrew, et al.
Pubblicazione: (2024)
Bad Actor, Good Advisor: Exploring the Role of Large Language Models in Fake News Detection
di: Hu, Beizhe, et al.
Pubblicazione: (2023)
di: Hu, Beizhe, et al.
Pubblicazione: (2023)
Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
di: Zhai, Yuexiang, et al.
Pubblicazione: (2024)
di: Zhai, Yuexiang, et al.
Pubblicazione: (2024)
Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation Transitions
di: Shi, Boyu, et al.
Pubblicazione: (2026)
di: Shi, Boyu, et al.
Pubblicazione: (2026)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
MedCritical: Enhancing Medical Reasoning in Small Language Models via Self-Collaborative Correction
di: Su, Xinchun, et al.
Pubblicazione: (2025)
di: Su, Xinchun, et al.
Pubblicazione: (2025)
DeFine: Decision-Making with Analogical Reasoning over Factor Profiles
di: Hu, Yebowen, et al.
Pubblicazione: (2024)
di: Hu, Yebowen, et al.
Pubblicazione: (2024)
Does It Make Sense to Speak of Introspection in Large Language Models?
di: Comsa, Iulia M., et al.
Pubblicazione: (2025)
di: Comsa, Iulia M., et al.
Pubblicazione: (2025)
Making Metadata More FAIR Using Large Language Models
di: Sundaram, Sowmya S., et al.
Pubblicazione: (2023)
di: Sundaram, Sowmya S., et al.
Pubblicazione: (2023)
Bridging the Novice-Expert Gap via Models of Decision-Making: A Case Study on Remediating Math Mistakes
di: Wang, Rose E., et al.
Pubblicazione: (2023)
di: Wang, Rose E., et al.
Pubblicazione: (2023)
Documenti analoghi
-
Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive Tuning
di: Pasewark, Eric, et al.
Pubblicazione: (2024) -
On the Decision-Making Abilities in Role-Playing using Large Language Models
di: Shen, Chenglei, et al.
Pubblicazione: (2024) -
Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting
di: Chen, Wei, et al.
Pubblicazione: (2025) -
CONDESION-BENCH: Conditional Decision-Making of Large Language Models in Compositional Action Space
di: Hwang, Yeonjun, et al.
Pubblicazione: (2026) -
Asymmetric Actor-Critic for Multi-turn LLM Agents
di: Jiang, Shuli, et al.
Pubblicazione: (2026)