A Survey on Prompt Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Zongqian, Su, Yixuan, Collier, Nigel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PT-MoE: An Efficient Finetuning Framework for Integrating Mixture-of-Experts into Prompt Tuning
por: Li, Zongqian, et al.
Publicado: (2025)
por: Li, Zongqian, et al.
Publicado: (2025)
Prompt Compression for Large Language Models: A Survey
por: Li, Zongqian, et al.
Publicado: (2024)
por: Li, Zongqian, et al.
Publicado: (2024)
500xCompressor: Generalized Prompt Compression for Large Language Models
por: Li, Zongqian, et al.
Publicado: (2024)
por: Li, Zongqian, et al.
Publicado: (2024)
Flexi-LoRA with Input-Adaptive Ranks: Efficient Finetuning for Speech and Reasoning Tasks
por: Li, Zongqian, et al.
Publicado: (2026)
por: Li, Zongqian, et al.
Publicado: (2026)
ReasonGraph: Visualisation of Reasoning Paths
por: Li, Zongqian, et al.
Publicado: (2025)
por: Li, Zongqian, et al.
Publicado: (2025)
Breaking Training Bottlenecks: Effective and Stable Reinforcement Learning for Coding Models
por: Li, Zongqian, et al.
Publicado: (2026)
por: Li, Zongqian, et al.
Publicado: (2026)
Unlocking Structure Measuring: Introducing PDD, an Automatic Metric for Positional Discourse Coherence
por: Liu, Yinhong, et al.
Publicado: (2024)
por: Liu, Yinhong, et al.
Publicado: (2024)
COFFEE: A Contrastive Oracle-Free Framework for Event Extraction
por: Zhang, Meiru, et al.
Publicado: (2023)
por: Zhang, Meiru, et al.
Publicado: (2023)
Attention Instruction: Amplifying Attention in the Middle via Prompting
por: Zhang, Meiru, et al.
Publicado: (2024)
por: Zhang, Meiru, et al.
Publicado: (2024)
iNews: A Multimodal Dataset for Modeling Personalized Affective Responses to News
por: Hu, Tiancheng, et al.
Publicado: (2025)
por: Hu, Tiancheng, et al.
Publicado: (2025)
Scaling Data Difficulty: Improving Coding Models via Reinforcement Learning on Fresh and Challenging Problems
por: Li, Zongqian, et al.
Publicado: (2026)
por: Li, Zongqian, et al.
Publicado: (2026)
PiVe: Prompting with Iterative Verification Improving Graph-based Generative Capability of LLMs
por: Han, Jiuzhou, et al.
Publicado: (2023)
por: Han, Jiuzhou, et al.
Publicado: (2023)
Quantifying the Persona Effect in LLM Simulations
por: Hu, Tiancheng, et al.
Publicado: (2024)
por: Hu, Tiancheng, et al.
Publicado: (2024)
Sparkles: Unlocking Chats Across Multiple Images for Multimodal Instruction-Following Models
por: Huang, Yupan, et al.
Publicado: (2023)
por: Huang, Yupan, et al.
Publicado: (2023)
Steer Model beyond Assistant: Controlling System Prompt Strength via Contrastive Decoding
por: Dong, Yijiang River, et al.
Publicado: (2026)
por: Dong, Yijiang River, et al.
Publicado: (2026)
Time to Revist Exact Match
por: Abbood, Auss, et al.
Publicado: (2025)
por: Abbood, Auss, et al.
Publicado: (2025)
Can LLM be a Personalized Judge?
por: Dong, Yijiang River, et al.
Publicado: (2024)
por: Dong, Yijiang River, et al.
Publicado: (2024)
Navigating the Alignment-Calibration Trade-off: A Pareto-Superior Frontier via Model Merging
por: Hu, Tiancheng, et al.
Publicado: (2025)
por: Hu, Tiancheng, et al.
Publicado: (2025)
LUQ: Long-text Uncertainty Quantification for LLMs
por: Zhang, Caiqi, et al.
Publicado: (2024)
por: Zhang, Caiqi, et al.
Publicado: (2024)
TOAD: Task-Oriented Automatic Dialogs with Diverse Response Styles
por: Liu, Yinhong, et al.
Publicado: (2024)
por: Liu, Yinhong, et al.
Publicado: (2024)
All Roads Lead to Rome: Graph-Based Confidence Estimation for Large Language Model Reasoning
por: Zhang, Caiqi, et al.
Publicado: (2025)
por: Zhang, Caiqi, et al.
Publicado: (2025)
Multi-agent AI systems outperform human teams in creativity
por: Hu, Tiancheng, et al.
Publicado: (2026)
por: Hu, Tiancheng, et al.
Publicado: (2026)
LoVeC: Reinforcement Learning for Better Verbalized Confidence in Long-Form Generations
por: Zhang, Caiqi, et al.
Publicado: (2025)
por: Zhang, Caiqi, et al.
Publicado: (2025)
TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law
por: Hui, Zheng, et al.
Publicado: (2025)
por: Hui, Zheng, et al.
Publicado: (2025)
Know the Unknown: An Uncertainty-Sensitive Method for LLM Instruction Tuning
por: Li, Jiaqi, et al.
Publicado: (2024)
por: Li, Jiaqi, et al.
Publicado: (2024)
Multi-Trigger Poisoning Amplifies Backdoor Vulnerabilities in LLMs
por: Sivapiromrat, Sanhanat, et al.
Publicado: (2025)
por: Sivapiromrat, Sanhanat, et al.
Publicado: (2025)
Valid Survey Simulations with Limited Human Data: The Roles of Prompting, Fine-Tuning, and Rectification
por: Krsteski, Stefan, et al.
Publicado: (2025)
por: Krsteski, Stefan, et al.
Publicado: (2025)
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
por: Lin, Yujie, et al.
Publicado: (2026)
por: Lin, Yujie, et al.
Publicado: (2026)
When Personalization Meets Reality: A Multi-Faceted Analysis of Personalized Preference Learning
por: Dong, Yijiang River, et al.
Publicado: (2025)
por: Dong, Yijiang River, et al.
Publicado: (2025)
Conformity in Large Language Models
por: Zhu, Xiaochen, et al.
Publicado: (2024)
por: Zhu, Xiaochen, et al.
Publicado: (2024)
Beyond the Final Layer: Intermediate Representations for Better Multilingual Calibration in Large Language Models
por: Zhou, Ej, et al.
Publicado: (2025)
por: Zhou, Ej, et al.
Publicado: (2025)
Biological Sequence with Language Model Prompting: A Survey
por: Jiang, Jiyue, et al.
Publicado: (2025)
por: Jiang, Jiyue, et al.
Publicado: (2025)
Value of Information: A Framework for Human-Agent Communication
por: Dong, Yijiang River, et al.
Publicado: (2026)
por: Dong, Yijiang River, et al.
Publicado: (2026)
Privacy-R1: Privacy-Aware Multi-LLM Agent Collaboration via Reinforcement Learning
por: Hui, Zheng, et al.
Publicado: (2025)
por: Hui, Zheng, et al.
Publicado: (2025)
Confident Rankings with Fewer Items: Adaptive LLM Evaluation with Continuous Scores
por: Balkır, Esma, et al.
Publicado: (2026)
por: Balkır, Esma, et al.
Publicado: (2026)
Multi-Reward GRPO Fine-Tuning for De-biasing Large Language Models: A Study Based on Chinese-Context Discrimination Data
por: Yixuan, Deng, et al.
Publicado: (2025)
por: Yixuan, Deng, et al.
Publicado: (2025)
Improving Word Translation via Two-Stage Contrastive Learning
por: Li, Yaoyiran, et al.
Publicado: (2022)
por: Li, Yaoyiran, et al.
Publicado: (2022)
TopViewRS: Vision-Language Models as Top-View Spatial Reasoners
por: Li, Chengzu, et al.
Publicado: (2024)
por: Li, Chengzu, et al.
Publicado: (2024)
Safety-Aware Fine-Tuning of Large Language Models
por: Choi, Hyeong Kyu, et al.
Publicado: (2024)
por: Choi, Hyeong Kyu, et al.
Publicado: (2024)
UNCLE: Benchmarking Uncertainty Expressions in Long-Form Generation
por: Yang, Ruihan, et al.
Publicado: (2025)
por: Yang, Ruihan, et al.
Publicado: (2025)
Ejemplares similares
-
PT-MoE: An Efficient Finetuning Framework for Integrating Mixture-of-Experts into Prompt Tuning
por: Li, Zongqian, et al.
Publicado: (2025) -
Prompt Compression for Large Language Models: A Survey
por: Li, Zongqian, et al.
Publicado: (2024) -
500xCompressor: Generalized Prompt Compression for Large Language Models
por: Li, Zongqian, et al.
Publicado: (2024) -
Flexi-LoRA with Input-Adaptive Ranks: Efficient Finetuning for Speech and Reasoning Tasks
por: Li, Zongqian, et al.
Publicado: (2026) -
ReasonGraph: Visualisation of Reasoning Paths
por: Li, Zongqian, et al.
Publicado: (2025)