Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Minmin, Aghaei, Sina, Saghafian, Soroush |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Effective Generative AI: The Human-Algorithm Centaur
por: Saghafian, Soroush, et al.
Publicado: (2024)
por: Saghafian, Soroush, et al.
Publicado: (2024)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024)
por: Li, Ziniu, et al.
Publicado: (2024)
Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
por: Zhai, Yuexiang, et al.
Publicado: (2024)
por: Zhai, Yuexiang, et al.
Publicado: (2024)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
por: Kim, Gyuhak, et al.
Publicado: (2025)
por: Kim, Gyuhak, et al.
Publicado: (2025)
Improving Large Language Models with Concept-Aware Fine-Tuning
por: Chen, Michael K., et al.
Publicado: (2025)
por: Chen, Michael K., et al.
Publicado: (2025)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
por: Riemer, Matthew, et al.
Publicado: (2025)
por: Riemer, Matthew, et al.
Publicado: (2025)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
por: Hong, Joey, et al.
Publicado: (2024)
por: Hong, Joey, et al.
Publicado: (2024)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
por: Wei, Quan, et al.
Publicado: (2025)
por: Wei, Quan, et al.
Publicado: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
por: Wang, Shumin, et al.
Publicado: (2026)
por: Wang, Shumin, et al.
Publicado: (2026)
Unlock the Correlation between Supervised Fine-Tuning and Reinforcement Learning in Training Code Large Language Models
por: Chen, Jie, et al.
Publicado: (2024)
por: Chen, Jie, et al.
Publicado: (2024)
Linearization Explains Fine-Tuning in Large Language Models
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
Online Sequential Decision-Making with Unknown Delays
por: Wu, Ping, et al.
Publicado: (2024)
por: Wu, Ping, et al.
Publicado: (2024)
Reward Design for Justifiable Sequential Decision-Making
por: Sukovic, Aleksa, et al.
Publicado: (2024)
por: Sukovic, Aleksa, et al.
Publicado: (2024)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
por: Balashov, Andrii
Publicado: (2025)
por: Balashov, Andrii
Publicado: (2025)
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
por: Li, Shijun, et al.
Publicado: (2026)
por: Li, Shijun, et al.
Publicado: (2026)
Aligning Large Language Models via Fine-grained Supervision
por: Xu, Dehong, et al.
Publicado: (2024)
por: Xu, Dehong, et al.
Publicado: (2024)
RoSA: Accurate Parameter-Efficient Fine-Tuning via Robust Adaptation
por: Nikdan, Mahdi, et al.
Publicado: (2024)
por: Nikdan, Mahdi, et al.
Publicado: (2024)
QuantLRM: Quantization of Large Reasoning Models via Fine-Tuning Signals
por: Zhang, Nan, et al.
Publicado: (2026)
por: Zhang, Nan, et al.
Publicado: (2026)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
por: Ye, Kai, et al.
Publicado: (2025)
por: Ye, Kai, et al.
Publicado: (2025)
Rotation-Preserving Supervised Fine-Tuning
por: Jin, Hangzhan, et al.
Publicado: (2026)
por: Jin, Hangzhan, et al.
Publicado: (2026)
Translating the Rashomon Effect to Sequential Decision-Making Tasks
por: Gross, Dennis, et al.
Publicado: (2025)
por: Gross, Dennis, et al.
Publicado: (2025)
Fine-Tuning Improves Information Conveyance in Language Models
por: Cheng, Yuwei, et al.
Publicado: (2026)
por: Cheng, Yuwei, et al.
Publicado: (2026)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
por: Zhou, Jiajun, et al.
Publicado: (2025)
por: Zhou, Jiajun, et al.
Publicado: (2025)
Optimal Sequential Decision-Making in Geosteering: A Reinforcement Learning Approach
por: Muhammad, Ressi Bonti, et al.
Publicado: (2023)
por: Muhammad, Ressi Bonti, et al.
Publicado: (2023)
Decision Transformer vs. Decision Mamba: Analysing the Complexity of Sequential Decision Making in Atari Games
por: Yan, Ke
Publicado: (2024)
por: Yan, Ke
Publicado: (2024)
Supervised Fine-Tuning as Inverse Reinforcement Learning
por: Sun, Hao
Publicado: (2024)
por: Sun, Hao
Publicado: (2024)
Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)
por: Qin, Chongli, et al.
Publicado: (2025)
por: Qin, Chongli, et al.
Publicado: (2025)
Understanding the Training and Generalization of Pretrained Transformer for Sequential Decision Making
por: Wang, Hanzhao, et al.
Publicado: (2024)
por: Wang, Hanzhao, et al.
Publicado: (2024)
AsynDBT: Asynchronous Distributed Bilevel Tuning for efficient In-Context Learning with Large Language Models
por: Ma, Hui, et al.
Publicado: (2026)
por: Ma, Hui, et al.
Publicado: (2026)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
por: Hu, Zixuan, et al.
Publicado: (2025)
por: Hu, Zixuan, et al.
Publicado: (2025)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
por: Zhang, Longteng, et al.
Publicado: (2026)
por: Zhang, Longteng, et al.
Publicado: (2026)
Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting
por: Chen, Wei, et al.
Publicado: (2025)
por: Chen, Wei, et al.
Publicado: (2025)
Optimizing Sensor Redundancy in Sequential Decision-Making Problems
por: Nüßlein, Jonas, et al.
Publicado: (2024)
por: Nüßlein, Jonas, et al.
Publicado: (2024)
Selective Self-Rehearsal: A Fine-Tuning Approach to Improve Generalization in Large Language Models
por: Gupta, Sonam, et al.
Publicado: (2024)
por: Gupta, Sonam, et al.
Publicado: (2024)
IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning
por: Mishra, Aayush, et al.
Publicado: (2025)
por: Mishra, Aayush, et al.
Publicado: (2025)
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
por: Krishnan, Ranganath, et al.
Publicado: (2024)
por: Krishnan, Ranganath, et al.
Publicado: (2024)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
por: Fang, Zihan, et al.
Publicado: (2024)
por: Fang, Zihan, et al.
Publicado: (2024)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
por: Zhang, Wenhao, et al.
Publicado: (2025)
por: Zhang, Wenhao, et al.
Publicado: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
por: Ansell, Alan, et al.
Publicado: (2024)
por: Ansell, Alan, et al.
Publicado: (2024)
Ejemplares similares
-
Effective Generative AI: The Human-Algorithm Centaur
por: Saghafian, Soroush, et al.
Publicado: (2024) -
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024) -
Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
por: Zhai, Yuexiang, et al.
Publicado: (2024) -
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
por: Kim, Gyuhak, et al.
Publicado: (2025) -
Improving Large Language Models with Concept-Aware Fine-Tuning
por: Chen, Michael K., et al.
Publicado: (2025)