Efficient Prompting Methods for Large Language Models: A Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Chang, Kaiyan, Xu, Songcheng, Wang, Chenglong, Luo, Yingfeng, Liu, Xiaoqian, Xiao, Tong, Zhu, Jingbo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
di: Chang, Kaiyan, et al.
Pubblicazione: (2025)
di: Chang, Kaiyan, et al.
Pubblicazione: (2025)
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
di: Chang, Kaiyan, et al.
Pubblicazione: (2026)
di: Chang, Kaiyan, et al.
Pubblicazione: (2026)
Hybrid Alignment Training for Large Language Models
di: Wang, Chenglong, et al.
Pubblicazione: (2024)
di: Wang, Chenglong, et al.
Pubblicazione: (2024)
RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
di: Luo, Yingfeng, et al.
Pubblicazione: (2026)
di: Luo, Yingfeng, et al.
Pubblicazione: (2026)
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
Learning Evaluation Models from Large Language Models for Sequence Generation
di: Wang, Chenglong, et al.
Pubblicazione: (2023)
di: Wang, Chenglong, et al.
Pubblicazione: (2023)
Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
di: Zhou, Hang, et al.
Pubblicazione: (2024)
di: Zhou, Hang, et al.
Pubblicazione: (2024)
One Size Does Not Fit All: A Distribution-Aware Sparsification for More Precise Model Merging
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
Foundations of Large Language Models
di: Xiao, Tong, et al.
Pubblicazione: (2025)
di: Xiao, Tong, et al.
Pubblicazione: (2025)
Recent Advances in End-to-End Simultaneous Speech Translation
di: Liu, Xiaoqian, et al.
Pubblicazione: (2024)
di: Liu, Xiaoqian, et al.
Pubblicazione: (2024)
NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
Early Exit Is a Natural Capability in Transformer-based Models: An Empirical Study on Early Exit without Joint Optimization
di: Shan, Weiqiao, et al.
Pubblicazione: (2024)
di: Shan, Weiqiao, et al.
Pubblicazione: (2024)
Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
di: Zhao, Runsong, et al.
Pubblicazione: (2024)
di: Zhao, Runsong, et al.
Pubblicazione: (2024)
Revealing the Parallel Multilingual Learning within Large Language Models
di: Mu, Yongyu, et al.
Pubblicazione: (2024)
di: Mu, Yongyu, et al.
Pubblicazione: (2024)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
di: Fan, Yuchun, et al.
Pubblicazione: (2025)
di: Fan, Yuchun, et al.
Pubblicazione: (2025)
SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models
di: Huo, Yifu, et al.
Pubblicazione: (2026)
di: Huo, Yifu, et al.
Pubblicazione: (2026)
SageLM: A Multi-aspect and Explainable Large Language Model for Speech Judgement
di: Ge, Yuan, et al.
Pubblicazione: (2025)
di: Ge, Yuan, et al.
Pubblicazione: (2025)
Cross-layer Attention Sharing for Pre-trained Large Language Models
di: Mu, Yongyu, et al.
Pubblicazione: (2024)
di: Mu, Yongyu, et al.
Pubblicazione: (2024)
SUBQRAG: Sub-Question Driven Dynamic Graph RAG
di: Li, Jiaoyang, et al.
Pubblicazione: (2025)
di: Li, Jiaoyang, et al.
Pubblicazione: (2025)
RankPrompt: Step-by-Step Comparisons Make Language Models Better Reasoners
di: Hu, Chi, et al.
Pubblicazione: (2024)
di: Hu, Chi, et al.
Pubblicazione: (2024)
Prompt Compression for Large Language Models: A Survey
di: Li, Zongqian, et al.
Pubblicazione: (2024)
di: Li, Zongqian, et al.
Pubblicazione: (2024)
From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction
di: Zhu, Mingcheng, et al.
Pubblicazione: (2026)
di: Zhu, Mingcheng, et al.
Pubblicazione: (2026)
A Survey on Efficient Large Language Model Training: From Data-centric Perspectives
di: Luo, Junyu, et al.
Pubblicazione: (2025)
di: Luo, Junyu, et al.
Pubblicazione: (2025)
Teaching Language Models to Self-Improve by Learning from Language Feedback
di: Hu, Chi, et al.
Pubblicazione: (2024)
di: Hu, Chi, et al.
Pubblicazione: (2024)
A Survey of Uncertainty Estimation Methods on Large Language Models
di: Xia, Zhiqiu, et al.
Pubblicazione: (2025)
di: Xia, Zhiqiu, et al.
Pubblicazione: (2025)
Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
di: Liu, Xinyu, et al.
Pubblicazione: (2024)
di: Liu, Xinyu, et al.
Pubblicazione: (2024)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
di: Huang, Pengcheng, et al.
Pubblicazione: (2024)
di: Huang, Pengcheng, et al.
Pubblicazione: (2024)
KVLink: Accelerating Large Language Models via Efficient KV Cache Reuse
di: Yang, Jingbo, et al.
Pubblicazione: (2025)
di: Yang, Jingbo, et al.
Pubblicazione: (2025)
Efficient Large Language Models: A Survey
di: Wan, Zhongwei, et al.
Pubblicazione: (2023)
di: Wan, Zhongwei, et al.
Pubblicazione: (2023)
Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
di: Wang, Chenglong, et al.
Pubblicazione: (2025)
di: Wang, Chenglong, et al.
Pubblicazione: (2025)
FLEXI: Benchmarking Full-duplex Human-LLM Speech Interaction
di: Ge, Yuan, et al.
Pubblicazione: (2025)
di: Ge, Yuan, et al.
Pubblicazione: (2025)
Active Prompting with Chain-of-Thought for Large Language Models
di: Diao, Shizhe, et al.
Pubblicazione: (2023)
di: Diao, Shizhe, et al.
Pubblicazione: (2023)
A Modular-based Strategy for Mitigating Gradient Conflicts in Simultaneous Speech Translation
di: Liu, Xiaoqian, et al.
Pubblicazione: (2024)
di: Liu, Xiaoqian, et al.
Pubblicazione: (2024)
A Survey on Efficient Inference for Large Language Models
di: Zhou, Zixuan, et al.
Pubblicazione: (2024)
di: Zhou, Zixuan, et al.
Pubblicazione: (2024)
On the Emotion Understanding of Synthesized Speech
di: Ge, Yuan, et al.
Pubblicazione: (2026)
di: Ge, Yuan, et al.
Pubblicazione: (2026)
Pedestrian Attribute Recognition: A New Benchmark Dataset and A Large Language Model Augmented Framework
di: Jin, Jiandong, et al.
Pubblicazione: (2024)
di: Jin, Jiandong, et al.
Pubblicazione: (2024)
A Survey on Evaluation of Large Language Models
di: Chang, Yupeng, et al.
Pubblicazione: (2023)
di: Chang, Yupeng, et al.
Pubblicazione: (2023)
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
A Survey of Prompt Engineering Methods in Large Language Models for Different NLP Tasks
di: Vatsal, Shubham, et al.
Pubblicazione: (2024)
di: Vatsal, Shubham, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
di: Chang, Kaiyan, et al.
Pubblicazione: (2025) -
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
di: Chang, Kaiyan, et al.
Pubblicazione: (2026) -
Hybrid Alignment Training for Large Language Models
di: Wang, Chenglong, et al.
Pubblicazione: (2024) -
RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
di: Luo, Yingfeng, et al.
Pubblicazione: (2026) -
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
di: Mu, Yongyu, et al.
Pubblicazione: (2025)