Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Minmin, Aghaei, Sina, Saghafian, Soroush |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Effective Generative AI: The Human-Algorithm Centaur
von: Saghafian, Soroush, et al.
Veröffentlicht: (2024)
von: Saghafian, Soroush, et al.
Veröffentlicht: (2024)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
von: Zhai, Yuexiang, et al.
Veröffentlicht: (2024)
von: Zhai, Yuexiang, et al.
Veröffentlicht: (2024)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
von: Kim, Gyuhak, et al.
Veröffentlicht: (2025)
von: Kim, Gyuhak, et al.
Veröffentlicht: (2025)
Improving Large Language Models with Concept-Aware Fine-Tuning
von: Chen, Michael K., et al.
Veröffentlicht: (2025)
von: Chen, Michael K., et al.
Veröffentlicht: (2025)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
von: Riemer, Matthew, et al.
Veröffentlicht: (2025)
von: Riemer, Matthew, et al.
Veröffentlicht: (2025)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
von: Hong, Joey, et al.
Veröffentlicht: (2024)
von: Hong, Joey, et al.
Veröffentlicht: (2024)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
von: Wei, Quan, et al.
Veröffentlicht: (2025)
von: Wei, Quan, et al.
Veröffentlicht: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
Unlock the Correlation between Supervised Fine-Tuning and Reinforcement Learning in Training Code Large Language Models
von: Chen, Jie, et al.
Veröffentlicht: (2024)
von: Chen, Jie, et al.
Veröffentlicht: (2024)
Linearization Explains Fine-Tuning in Large Language Models
von: Afzal, Zahra Rahimi, et al.
Veröffentlicht: (2026)
von: Afzal, Zahra Rahimi, et al.
Veröffentlicht: (2026)
Online Sequential Decision-Making with Unknown Delays
von: Wu, Ping, et al.
Veröffentlicht: (2024)
von: Wu, Ping, et al.
Veröffentlicht: (2024)
Reward Design for Justifiable Sequential Decision-Making
von: Sukovic, Aleksa, et al.
Veröffentlicht: (2024)
von: Sukovic, Aleksa, et al.
Veröffentlicht: (2024)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
von: Balashov, Andrii
Veröffentlicht: (2025)
von: Balashov, Andrii
Veröffentlicht: (2025)
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
von: Li, Shijun, et al.
Veröffentlicht: (2026)
von: Li, Shijun, et al.
Veröffentlicht: (2026)
Aligning Large Language Models via Fine-grained Supervision
von: Xu, Dehong, et al.
Veröffentlicht: (2024)
von: Xu, Dehong, et al.
Veröffentlicht: (2024)
RoSA: Accurate Parameter-Efficient Fine-Tuning via Robust Adaptation
von: Nikdan, Mahdi, et al.
Veröffentlicht: (2024)
von: Nikdan, Mahdi, et al.
Veröffentlicht: (2024)
QuantLRM: Quantization of Large Reasoning Models via Fine-Tuning Signals
von: Zhang, Nan, et al.
Veröffentlicht: (2026)
von: Zhang, Nan, et al.
Veröffentlicht: (2026)
Boosting Large Language Models with Mask Fine-Tuning
von: Zhang, Mingyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Mingyuan, et al.
Veröffentlicht: (2025)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
von: Ye, Kai, et al.
Veröffentlicht: (2025)
von: Ye, Kai, et al.
Veröffentlicht: (2025)
Rotation-Preserving Supervised Fine-Tuning
von: Jin, Hangzhan, et al.
Veröffentlicht: (2026)
von: Jin, Hangzhan, et al.
Veröffentlicht: (2026)
Translating the Rashomon Effect to Sequential Decision-Making Tasks
von: Gross, Dennis, et al.
Veröffentlicht: (2025)
von: Gross, Dennis, et al.
Veröffentlicht: (2025)
Fine-Tuning Improves Information Conveyance in Language Models
von: Cheng, Yuwei, et al.
Veröffentlicht: (2026)
von: Cheng, Yuwei, et al.
Veröffentlicht: (2026)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
von: Zhou, Jiajun, et al.
Veröffentlicht: (2025)
von: Zhou, Jiajun, et al.
Veröffentlicht: (2025)
Optimal Sequential Decision-Making in Geosteering: A Reinforcement Learning Approach
von: Muhammad, Ressi Bonti, et al.
Veröffentlicht: (2023)
von: Muhammad, Ressi Bonti, et al.
Veröffentlicht: (2023)
Decision Transformer vs. Decision Mamba: Analysing the Complexity of Sequential Decision Making in Atari Games
von: Yan, Ke
Veröffentlicht: (2024)
von: Yan, Ke
Veröffentlicht: (2024)
Supervised Fine-Tuning as Inverse Reinforcement Learning
von: Sun, Hao
Veröffentlicht: (2024)
von: Sun, Hao
Veröffentlicht: (2024)
Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)
von: Qin, Chongli, et al.
Veröffentlicht: (2025)
von: Qin, Chongli, et al.
Veröffentlicht: (2025)
Understanding the Training and Generalization of Pretrained Transformer for Sequential Decision Making
von: Wang, Hanzhao, et al.
Veröffentlicht: (2024)
von: Wang, Hanzhao, et al.
Veröffentlicht: (2024)
AsynDBT: Asynchronous Distributed Bilevel Tuning for efficient In-Context Learning with Large Language Models
von: Ma, Hui, et al.
Veröffentlicht: (2026)
von: Ma, Hui, et al.
Veröffentlicht: (2026)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
von: Hu, Zixuan, et al.
Veröffentlicht: (2025)
von: Hu, Zixuan, et al.
Veröffentlicht: (2025)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
von: Zhang, Longteng, et al.
Veröffentlicht: (2026)
von: Zhang, Longteng, et al.
Veröffentlicht: (2026)
Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting
von: Chen, Wei, et al.
Veröffentlicht: (2025)
von: Chen, Wei, et al.
Veröffentlicht: (2025)
Optimizing Sensor Redundancy in Sequential Decision-Making Problems
von: Nüßlein, Jonas, et al.
Veröffentlicht: (2024)
von: Nüßlein, Jonas, et al.
Veröffentlicht: (2024)
Selective Self-Rehearsal: A Fine-Tuning Approach to Improve Generalization in Large Language Models
von: Gupta, Sonam, et al.
Veröffentlicht: (2024)
von: Gupta, Sonam, et al.
Veröffentlicht: (2024)
IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning
von: Mishra, Aayush, et al.
Veröffentlicht: (2025)
von: Mishra, Aayush, et al.
Veröffentlicht: (2025)
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
von: Krishnan, Ranganath, et al.
Veröffentlicht: (2024)
von: Krishnan, Ranganath, et al.
Veröffentlicht: (2024)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
von: Fang, Zihan, et al.
Veröffentlicht: (2024)
von: Fang, Zihan, et al.
Veröffentlicht: (2024)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
von: Ansell, Alan, et al.
Veröffentlicht: (2024)
von: Ansell, Alan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Effective Generative AI: The Human-Algorithm Centaur
von: Saghafian, Soroush, et al.
Veröffentlicht: (2024) -
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024) -
Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
von: Zhai, Yuexiang, et al.
Veröffentlicht: (2024) -
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
von: Kim, Gyuhak, et al.
Veröffentlicht: (2025) -
Improving Large Language Models with Concept-Aware Fine-Tuning
von: Chen, Michael K., et al.
Veröffentlicht: (2025)