What Single-Prompt Accuracy Misses: A Multi-Variant Reliability Audit of Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Karmakar, Ranit, Chatterjee, Jayita |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AgentFloor: How Far Up the tool use Ladder Can Small Open-Weight Models Go?
di: Karmakar, Ranit, et al.
Pubblicazione: (2026)
di: Karmakar, Ranit, et al.
Pubblicazione: (2026)
What Is Missing: Interpretable Ratings for Large Language Model Outputs
di: Stranges, Nicholas, et al.
Pubblicazione: (2026)
di: Stranges, Nicholas, et al.
Pubblicazione: (2026)
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
di: Ulmer, Dennis, et al.
Pubblicazione: (2025)
di: Ulmer, Dennis, et al.
Pubblicazione: (2025)
Soft Token Attacks Cannot Reliably Audit Unlearning in Large Language Models
di: Chen, Haokun, et al.
Pubblicazione: (2025)
di: Chen, Haokun, et al.
Pubblicazione: (2025)
Are Large Language Models Truly Smarter Than Humans?
di: M, Eshwar Reddy, et al.
Pubblicazione: (2026)
di: M, Eshwar Reddy, et al.
Pubblicazione: (2026)
AuditWen:An Open-Source Large Language Model for Audit
di: Huang, Jiajia, et al.
Pubblicazione: (2024)
di: Huang, Jiajia, et al.
Pubblicazione: (2024)
POSIX: A Prompt Sensitivity Index For Large Language Models
di: Chatterjee, Anwoy, et al.
Pubblicazione: (2024)
di: Chatterjee, Anwoy, et al.
Pubblicazione: (2024)
Beyond Single-Granularity Prompts: A Multi-Scale Chain-of-Thought Prompt Learning for Graph
di: Zheng, Ziyu, et al.
Pubblicazione: (2025)
di: Zheng, Ziyu, et al.
Pubblicazione: (2025)
What's in a Name? Auditing Large Language Models for Race and Gender Bias
di: Salinas, Alejandro, et al.
Pubblicazione: (2024)
di: Salinas, Alejandro, et al.
Pubblicazione: (2024)
CALM: Curiosity-Driven Auditing for Large Language Models
di: Zheng, Xiang, et al.
Pubblicazione: (2025)
di: Zheng, Xiang, et al.
Pubblicazione: (2025)
On the Reliability of Large Language Models to Misinformed and Demographically-Informed Prompts
di: Aremu, Toluwani, et al.
Pubblicazione: (2024)
di: Aremu, Toluwani, et al.
Pubblicazione: (2024)
PairBench: Are Vision-Language Models Reliable at Comparing What They See?
di: Feizi, Aarash, et al.
Pubblicazione: (2025)
di: Feizi, Aarash, et al.
Pubblicazione: (2025)
SoftPQ: Robust Instance Segmentation Evaluation via Soft Matching and Tunable Thresholds
di: Karmakar, Ranit, et al.
Pubblicazione: (2025)
di: Karmakar, Ranit, et al.
Pubblicazione: (2025)
Output Scouting: Auditing Large Language Models for Catastrophic Responses
di: Bell, Andrew, et al.
Pubblicazione: (2024)
di: Bell, Andrew, et al.
Pubblicazione: (2024)
SuperPos-Prompt: Enhancing Soft Prompt Tuning of Language Models with Superposition of Multi Token Embeddings
di: SadraeiJavaeri, MohammadAli, et al.
Pubblicazione: (2024)
di: SadraeiJavaeri, MohammadAli, et al.
Pubblicazione: (2024)
M-Ped: Multi-Prompt Ensemble Decoding for Large Language Models
di: Guo, Jiaxin, et al.
Pubblicazione: (2024)
di: Guo, Jiaxin, et al.
Pubblicazione: (2024)
PRISM: A Methodology for Auditing Biases in Large Language Models
di: Azzopardi, Leif, et al.
Pubblicazione: (2024)
di: Azzopardi, Leif, et al.
Pubblicazione: (2024)
Missed Connections: Lateral Thinking Puzzles for Large Language Models
di: Todd, Graham, et al.
Pubblicazione: (2024)
di: Todd, Graham, et al.
Pubblicazione: (2024)
Round-Trip Translation Reveals What Frontier Multilingual Benchmarks Miss
di: Skorobogat, Ronald, et al.
Pubblicazione: (2026)
di: Skorobogat, Ronald, et al.
Pubblicazione: (2026)
ContextGuard: Structured Self-Auditing for Context Learning in Language Models
di: Jin, Hongbo, et al.
Pubblicazione: (2026)
di: Jin, Hongbo, et al.
Pubblicazione: (2026)
Audit-of-Understanding: Posterior-Constrained Inference for Mathematical Reasoning in Language Models
di: Abdaljalil, Samir, et al.
Pubblicazione: (2025)
di: Abdaljalil, Samir, et al.
Pubblicazione: (2025)
DeepTRACE: Auditing Deep Research AI Systems for Tracking Reliability Across Citations and Evidence
di: Venkit, Pranav Narayanan, et al.
Pubblicazione: (2025)
di: Venkit, Pranav Narayanan, et al.
Pubblicazione: (2025)
Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models
di: Liu, Biao, et al.
Pubblicazione: (2025)
di: Liu, Biao, et al.
Pubblicazione: (2025)
PromptBridge: Cross-Model Prompt Transfer for Large Language Models
di: Wang, Yaxuan, et al.
Pubblicazione: (2025)
di: Wang, Yaxuan, et al.
Pubblicazione: (2025)
"Sorry, I Didn't Catch That": How Speech Models Miss What Matters Most
di: Zhou, Kaitlyn, et al.
Pubblicazione: (2026)
di: Zhou, Kaitlyn, et al.
Pubblicazione: (2026)
UtilityMax Prompting: A Formal Framework for Multi-Objective Large Language Model Tasks
di: Marom, Ofir
Pubblicazione: (2026)
di: Marom, Ofir
Pubblicazione: (2026)
Aligning Knowledge Graphs and Language Models for Factual Accuracy
di: Nishat, Nur A Zarin, et al.
Pubblicazione: (2025)
di: Nishat, Nur A Zarin, et al.
Pubblicazione: (2025)
INACIA: Integrating Large Language Models in Brazilian Audit Courts: Opportunities and Challenges
di: Pereira, Jayr, et al.
Pubblicazione: (2024)
di: Pereira, Jayr, et al.
Pubblicazione: (2024)
Don't Change My View: Ideological Bias Auditing in Large Language Models
di: Kröger, Paul, et al.
Pubblicazione: (2025)
di: Kröger, Paul, et al.
Pubblicazione: (2025)
On Active Privacy Auditing in Supervised Fine-tuning for White-Box Language Models
di: Sun, Qian, et al.
Pubblicazione: (2024)
di: Sun, Qian, et al.
Pubblicazione: (2024)
Chinese Metaphor Recognition Using a Multi-stage Prompting Large Language Model
di: Wang, Jie, et al.
Pubblicazione: (2024)
di: Wang, Jie, et al.
Pubblicazione: (2024)
Meaning Typed Prompting: A Technique for Efficient, Reliable Structured Output Generation
di: Irugalbandara, Chandra
Pubblicazione: (2024)
di: Irugalbandara, Chandra
Pubblicazione: (2024)
Enhancing Diagnostic Accuracy through Multi-Agent Conversations: Using Large Language Models to Mitigate Cognitive Bias
di: Ke, Yu He, et al.
Pubblicazione: (2024)
di: Ke, Yu He, et al.
Pubblicazione: (2024)
Abductive Inference in Retrieval-Augmented Language Models: Generating and Validating Missing Premises
di: Lin, Shiyin
Pubblicazione: (2025)
di: Lin, Shiyin
Pubblicazione: (2025)
High Accuracy, Less Talk (HALT): Reliable LLMs through Capability-Aligned Finetuning
di: Franzmeyer, Tim, et al.
Pubblicazione: (2025)
di: Franzmeyer, Tim, et al.
Pubblicazione: (2025)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
di: Li, Yubo, et al.
Pubblicazione: (2025)
di: Li, Yubo, et al.
Pubblicazione: (2025)
Enhanced Review Detection and Recognition: A Platform-Agnostic Approach with Application to Online Commerce
di: Karmakar, Priyabrata, et al.
Pubblicazione: (2024)
di: Karmakar, Priyabrata, et al.
Pubblicazione: (2024)
Beyond Accuracy: Evaluating the Reasoning Behavior of Large Language Models -- A Survey
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
Can LLMs replace Neil deGrasse Tyson? Evaluating the Reliability of LLMs as Science Communicators
di: Bajpai, Prasoon, et al.
Pubblicazione: (2024)
di: Bajpai, Prasoon, et al.
Pubblicazione: (2024)
HIDE and Seek: Detecting Hallucinations in Language Models via Decoupled Representations
di: Chatterjee, Anwoy, et al.
Pubblicazione: (2025)
di: Chatterjee, Anwoy, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AgentFloor: How Far Up the tool use Ladder Can Small Open-Weight Models Go?
di: Karmakar, Ranit, et al.
Pubblicazione: (2026) -
What Is Missing: Interpretable Ratings for Large Language Model Outputs
di: Stranges, Nicholas, et al.
Pubblicazione: (2026) -
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
di: Ulmer, Dennis, et al.
Pubblicazione: (2025) -
Soft Token Attacks Cannot Reliably Audit Unlearning in Large Language Models
di: Chen, Haokun, et al.
Pubblicazione: (2025) -
Are Large Language Models Truly Smarter Than Humans?
di: M, Eshwar Reddy, et al.
Pubblicazione: (2026)