Salvato in:
| Autori principali: | Chen, Siguang, Lv, Chunli, Xie, Miao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2601.12945 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LASeR: Learning to Adaptively Select Reward Models with Multi-Armed Bandits
di: Nguyen, Duy, et al.
Pubblicazione: (2024)
di: Nguyen, Duy, et al.
Pubblicazione: (2024)
Data Mixing for Large Language Models Pretraining: A Survey and Outlook
di: Chen, Zhuo, et al.
Pubblicazione: (2026)
di: Chen, Zhuo, et al.
Pubblicazione: (2026)
Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits
di: Xing, Sixue, et al.
Pubblicazione: (2026)
di: Xing, Sixue, et al.
Pubblicazione: (2026)
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2026)
di: Peng, Runyu, et al.
Pubblicazione: (2026)
Large Language Model-Enhanced Multi-Armed Bandits
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
LLM-Based Human-Agent Collaboration and Interaction Systems: A Survey
di: Zou, Henry Peng, et al.
Pubblicazione: (2025)
di: Zou, Henry Peng, et al.
Pubblicazione: (2025)
A Survey of On-Policy Distillation for Large Language Models
di: Song, Mingyang, et al.
Pubblicazione: (2026)
di: Song, Mingyang, et al.
Pubblicazione: (2026)
A Survey on Mixture of Experts in Large Language Models
di: Cai, Weilin, et al.
Pubblicazione: (2024)
di: Cai, Weilin, et al.
Pubblicazione: (2024)
Large Language Models on Graphs: A Comprehensive Survey
di: Jin, Bowen, et al.
Pubblicazione: (2023)
di: Jin, Bowen, et al.
Pubblicazione: (2023)
Continual Learning for Large Language Models: A Survey
di: Wu, Tongtong, et al.
Pubblicazione: (2024)
di: Wu, Tongtong, et al.
Pubblicazione: (2024)
Multi-Step Reasoning with Large Language Models, a Survey
di: Plaat, Aske, et al.
Pubblicazione: (2024)
di: Plaat, Aske, et al.
Pubblicazione: (2024)
A Survey of Low-bit Large Language Models: Basics, Systems, and Algorithms
di: Gong, Ruihao, et al.
Pubblicazione: (2024)
di: Gong, Ruihao, et al.
Pubblicazione: (2024)
A Survey on Hallucination in Large Vision-Language Models
di: Liu, Hanchao, et al.
Pubblicazione: (2024)
di: Liu, Hanchao, et al.
Pubblicazione: (2024)
A Survey on Symbolic Knowledge Distillation of Large Language Models
di: Acharya, Kamal, et al.
Pubblicazione: (2024)
di: Acharya, Kamal, et al.
Pubblicazione: (2024)
Towards Lifelong Learning of Large Language Models: A Survey
di: Zheng, Junhao, et al.
Pubblicazione: (2024)
di: Zheng, Junhao, et al.
Pubblicazione: (2024)
A Survey on Training-free Alignment of Large Language Models
di: Pan, Birong, et al.
Pubblicazione: (2025)
di: Pan, Birong, et al.
Pubblicazione: (2025)
Linear Dynamics in the RLVR Training of Large Language Models
di: Wang, Tianle, et al.
Pubblicazione: (2026)
di: Wang, Tianle, et al.
Pubblicazione: (2026)
Harnessing Large Language Models for Disaster Management: A Survey
di: Lei, Zhenyu, et al.
Pubblicazione: (2025)
di: Lei, Zhenyu, et al.
Pubblicazione: (2025)
A Survey on Data Selection for Language Models
di: Albalak, Alon, et al.
Pubblicazione: (2024)
di: Albalak, Alon, et al.
Pubblicazione: (2024)
Multimodal Large Language Models for Medicine: A Comprehensive Survey
di: Ye, Jiarui, et al.
Pubblicazione: (2025)
di: Ye, Jiarui, et al.
Pubblicazione: (2025)
Global Rewards in Restless Multi-Armed Bandits
di: Raman, Naveen, et al.
Pubblicazione: (2024)
di: Raman, Naveen, et al.
Pubblicazione: (2024)
KIEval: A Knowledge-grounded Interactive Evaluation Framework for Large Language Models
di: Yu, Zhuohao, et al.
Pubblicazione: (2024)
di: Yu, Zhuohao, et al.
Pubblicazione: (2024)
A Human-Like Reasoning Framework for Multi-Phases Planning Task with Large Language Models
di: Xie, Chengxing, et al.
Pubblicazione: (2024)
di: Xie, Chengxing, et al.
Pubblicazione: (2024)
A Survey on Multimodal Large Language Models
di: Yin, Shukang, et al.
Pubblicazione: (2023)
di: Yin, Shukang, et al.
Pubblicazione: (2023)
A Survey on LoRA of Large Language Models
di: Mao, Yuren, et al.
Pubblicazione: (2024)
di: Mao, Yuren, et al.
Pubblicazione: (2024)
Instruction Tuning for Large Language Models: A Survey
di: Zhang, Shengyu, et al.
Pubblicazione: (2023)
di: Zhang, Shengyu, et al.
Pubblicazione: (2023)
Emergent Abilities in Large Language Models: A Survey
di: Berti, Leonardo, et al.
Pubblicazione: (2025)
di: Berti, Leonardo, et al.
Pubblicazione: (2025)
Large Language Models for Time Series: A Survey
di: Zhang, Xiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Xiyuan, et al.
Pubblicazione: (2024)
Simple Is Effective: The Roles of Graphs and Large Language Models in Knowledge-Graph-Based Retrieval-Augmented Generation
di: Li, Mufei, et al.
Pubblicazione: (2024)
di: Li, Mufei, et al.
Pubblicazione: (2024)
Interactive and Expressive Code-Augmented Planning with Large Language Models
di: Liu, Anthony Z., et al.
Pubblicazione: (2024)
di: Liu, Anthony Z., et al.
Pubblicazione: (2024)
NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models
di: Liu, Weiqi, et al.
Pubblicazione: (2026)
di: Liu, Weiqi, et al.
Pubblicazione: (2026)
Knowledge Mechanisms in Large Language Models: A Survey and Perspective
di: Wang, Mengru, et al.
Pubblicazione: (2024)
di: Wang, Mengru, et al.
Pubblicazione: (2024)
Beyond the Limits: A Survey of Techniques to Extend the Context Length in Large Language Models
di: Wang, Xindi, et al.
Pubblicazione: (2024)
di: Wang, Xindi, et al.
Pubblicazione: (2024)
A Survey on Medical Large Language Models: Technology, Application, Trustworthiness, and Future Directions
di: Liu, Lei, et al.
Pubblicazione: (2024)
di: Liu, Lei, et al.
Pubblicazione: (2024)
Risks, Causes, and Mitigations of Widespread Deployments of Large Language Models (LLMs): A Survey
di: Sakib, Md Nazmus, et al.
Pubblicazione: (2024)
di: Sakib, Md Nazmus, et al.
Pubblicazione: (2024)
Model Compression and Efficient Inference for Large Language Models: A Survey
di: Wang, Wenxiao, et al.
Pubblicazione: (2024)
di: Wang, Wenxiao, et al.
Pubblicazione: (2024)
Interpreting Key Mechanisms of Factual Recall in Transformer-Based Language Models
di: Lv, Ang, et al.
Pubblicazione: (2024)
di: Lv, Ang, et al.
Pubblicazione: (2024)
Bias and Fairness in Large Language Models: A Survey
di: Gallegos, Isabel O., et al.
Pubblicazione: (2023)
di: Gallegos, Isabel O., et al.
Pubblicazione: (2023)
Flickering Multi-Armed Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
Off-Policy Value-Based Reinforcement Learning for Large Language Models
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2026)
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LASeR: Learning to Adaptively Select Reward Models with Multi-Armed Bandits
di: Nguyen, Duy, et al.
Pubblicazione: (2024) -
Data Mixing for Large Language Models Pretraining: A Survey and Outlook
di: Chen, Zhuo, et al.
Pubblicazione: (2026) -
Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits
di: Xing, Sixue, et al.
Pubblicazione: (2026) -
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2026) -
Large Language Model-Enhanced Multi-Armed Bandits
di: Sun, Jiahang, et al.
Pubblicazione: (2025)