GLaPE: Gold Label-agnostic Prompt Evaluation and Optimization for Large Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Xuanchang, Zhang, Zhuosheng, Zhao, Hai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Zero-to-Strong Generalization: Eliciting Strong Capabilities of Large Language Models Iteratively without Gold Labels
di: Liu, Chaoqun, et al.
Pubblicazione: (2024)
di: Liu, Chaoqun, et al.
Pubblicazione: (2024)
From Lists to Emojis: How Format Bias Affects Model Alignment
di: Zhang, Xuanchang, et al.
Pubblicazione: (2024)
di: Zhang, Xuanchang, et al.
Pubblicazione: (2024)
LLM Prompt Duel Optimizer: Efficient Label-Free Prompt Optimization
di: Wu, Yuanchen, et al.
Pubblicazione: (2025)
di: Wu, Yuanchen, et al.
Pubblicazione: (2025)
Benchmarking Large Language Model Uncertainty for Prompt Optimization
di: Guo, Pei-Fu, et al.
Pubblicazione: (2024)
di: Guo, Pei-Fu, et al.
Pubblicazione: (2024)
Generalizable Chain-of-Thought Prompting in Mixed-task Scenarios with Large Language Models
di: Zou, Anni, et al.
Pubblicazione: (2023)
di: Zou, Anni, et al.
Pubblicazione: (2023)
Self-Prompting Large Language Models for Zero-Shot Open-Domain QA
di: Li, Junlong, et al.
Pubblicazione: (2022)
di: Li, Junlong, et al.
Pubblicazione: (2022)
Prompts as Auto-Optimized Training Hyperparameters: Training Best-in-Class IR Models from Scratch with 10 Gold Labels
di: Xian, Jasper, et al.
Pubblicazione: (2024)
di: Xian, Jasper, et al.
Pubblicazione: (2024)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
Prompting in the Dark: Assessing Human Performance in Prompt Engineering for Data Labeling When Gold Labels Are Absent
di: He, Zeyu, et al.
Pubblicazione: (2025)
di: He, Zeyu, et al.
Pubblicazione: (2025)
SparseEval: Efficient Evaluation of Large Language Models by Sparse Optimization
di: Zhang, Taolin, et al.
Pubblicazione: (2026)
di: Zhang, Taolin, et al.
Pubblicazione: (2026)
Large Language Model Prompt Datasets: An In-depth Analysis and Insights
di: Zhang, Yuanming, et al.
Pubblicazione: (2025)
di: Zhang, Yuanming, et al.
Pubblicazione: (2025)
Discovering Low-rank Subspaces for Language-agnostic Multilingual Representations
di: Xie, Zhihui, et al.
Pubblicazione: (2024)
di: Xie, Zhihui, et al.
Pubblicazione: (2024)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
PromptBench: A Unified Library for Evaluation of Large Language Models
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
PromptCoT 2.0: Scaling Prompt Synthesis for Large Language Model Reasoning
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
Towards End-to-End Open Conversational Machine Reading
di: Zhou, Sizhe, et al.
Pubblicazione: (2022)
di: Zhou, Sizhe, et al.
Pubblicazione: (2022)
Leveraging Large Language Models for Structure Learning in Prompted Weak Supervision
di: Su, Jinyan, et al.
Pubblicazione: (2024)
di: Su, Jinyan, et al.
Pubblicazione: (2024)
ReAGent: A Model-agnostic Feature Attribution Method for Generative Language Models
di: Zhao, Zhixue, et al.
Pubblicazione: (2024)
di: Zhao, Zhixue, et al.
Pubblicazione: (2024)
Understanding the Relationship between Prompts and Response Uncertainty in Large Language Models
di: Zhang, Ze Yu, et al.
Pubblicazione: (2024)
di: Zhang, Ze Yu, et al.
Pubblicazione: (2024)
SPRIG: Improving Large Language Model Performance by System Prompt Optimization
di: Zhang, Lechen, et al.
Pubblicazione: (2024)
di: Zhang, Lechen, et al.
Pubblicazione: (2024)
Language Model Prompt Selection via Simulation Optimization
di: Zhang, Haoting, et al.
Pubblicazione: (2024)
di: Zhang, Haoting, et al.
Pubblicazione: (2024)
Composite Backdoor Attacks Against Large Language Models
di: Huang, Hai, et al.
Pubblicazione: (2023)
di: Huang, Hai, et al.
Pubblicazione: (2023)
Automatic Prompt Selection for Large Language Models
di: Do, Viet-Tung, et al.
Pubblicazione: (2024)
di: Do, Viet-Tung, et al.
Pubblicazione: (2024)
The Illusionist's Prompt: Exposing the Factual Vulnerabilities of Large Language Models with Linguistic Nuances
di: Wang, Yining, et al.
Pubblicazione: (2025)
di: Wang, Yining, et al.
Pubblicazione: (2025)
GEM: Gaussian Embedding Modeling for Out-of-Distribution Detection in GUI Agents
di: Wu, Zheng, et al.
Pubblicazione: (2025)
di: Wu, Zheng, et al.
Pubblicazione: (2025)
CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts
di: Sheokand, Manik, et al.
Pubblicazione: (2025)
di: Sheokand, Manik, et al.
Pubblicazione: (2025)
Do LLMs Overcome Shortcut Learning? An Evaluation of Shortcut Challenges in Large Language Models
di: Yuan, Yu, et al.
Pubblicazione: (2024)
di: Yuan, Yu, et al.
Pubblicazione: (2024)
Automatic Pseudo-Harmful Prompt Generation for Evaluating False Refusals in Large Language Models
di: An, Bang, et al.
Pubblicazione: (2024)
di: An, Bang, et al.
Pubblicazione: (2024)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
di: Song, Weixi, et al.
Pubblicazione: (2023)
di: Song, Weixi, et al.
Pubblicazione: (2023)
Systematic Evaluation of Machine-Generated Reasoning and PHQ-9 Labeling for Depression Detection Using Large Language Models
di: Shao, Zongru, et al.
Pubblicazione: (2025)
di: Shao, Zongru, et al.
Pubblicazione: (2025)
Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection
di: Yan, Jun, et al.
Pubblicazione: (2023)
di: Yan, Jun, et al.
Pubblicazione: (2023)
Prompt Public Large Language Models to Synthesize Data for Private On-device Applications
di: Wu, Shanshan, et al.
Pubblicazione: (2024)
di: Wu, Shanshan, et al.
Pubblicazione: (2024)
An Examination on the Effectiveness of Divide-and-Conquer Prompting in Large Language Models
di: Zhang, Yizhou, et al.
Pubblicazione: (2024)
di: Zhang, Yizhou, et al.
Pubblicazione: (2024)
On the Overscaling Curse of Parallel Thinking: System Efficacy Contradicts Sample Efficiency
di: Wang, Yiming, et al.
Pubblicazione: (2026)
di: Wang, Yiming, et al.
Pubblicazione: (2026)
Prompting Large Language Models for Clinical Temporal Relation Extraction
di: He, Jianping, et al.
Pubblicazione: (2024)
di: He, Jianping, et al.
Pubblicazione: (2024)
Bias after Prompting: Persistent Discrimination in Large Language Models
di: Sivakumar, Nivedha, et al.
Pubblicazione: (2025)
di: Sivakumar, Nivedha, et al.
Pubblicazione: (2025)
Prompting Large Language Models to Detect Dementia Family Caregivers
di: Biswas, Md Badsha, et al.
Pubblicazione: (2025)
di: Biswas, Md Badsha, et al.
Pubblicazione: (2025)
Progressive-Hint Prompting Improves Reasoning in Large Language Models
di: Zheng, Chuanyang, et al.
Pubblicazione: (2023)
di: Zheng, Chuanyang, et al.
Pubblicazione: (2023)
Prompt-Dependent Ranking of Large Language Models with Uncertainty Quantification
di: Menendez, Angel Rodrigo Avelar, et al.
Pubblicazione: (2026)
di: Menendez, Angel Rodrigo Avelar, et al.
Pubblicazione: (2026)
ADOPT: Adaptive Dependency-Guided Joint Prompt Optimization for Multi-Step LLM Pipelines
di: Zhao, Minjun, et al.
Pubblicazione: (2025)
di: Zhao, Minjun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Zero-to-Strong Generalization: Eliciting Strong Capabilities of Large Language Models Iteratively without Gold Labels
di: Liu, Chaoqun, et al.
Pubblicazione: (2024) -
From Lists to Emojis: How Format Bias Affects Model Alignment
di: Zhang, Xuanchang, et al.
Pubblicazione: (2024) -
LLM Prompt Duel Optimizer: Efficient Label-Free Prompt Optimization
di: Wu, Yuanchen, et al.
Pubblicazione: (2025) -
Benchmarking Large Language Model Uncertainty for Prompt Optimization
di: Guo, Pei-Fu, et al.
Pubblicazione: (2024) -
Generalizable Chain-of-Thought Prompting in Mixed-task Scenarios with Large Language Models
di: Zou, Anni, et al.
Pubblicazione: (2023)