Large Language Model Confidence Estimation via Black-Box Access
Fuente:
arXiv
Salvato in:
| Autori principali: | Pedapati, Tejaswini, Dhurandhar, Amit, Ghosh, Soumya, Dan, Soham, Sattigeri, Prasanna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NeuroPrune: A Neuro-inspired Topological Sparse Training Algorithm for Large Language Models
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
Large Language Models can be Strong Self-Detoxifiers
di: Ko, Ching-Yun, et al.
Pubblicazione: (2024)
di: Ko, Ching-Yun, et al.
Pubblicazione: (2024)
CELL your Model: Contrastive Explanations for Large Language Models
di: Luss, Ronny, et al.
Pubblicazione: (2024)
di: Luss, Ronny, et al.
Pubblicazione: (2024)
Differentiable Prompt Learning for Vision Language Models
di: Huang, Zhenhan, et al.
Pubblicazione: (2024)
di: Huang, Zhenhan, et al.
Pubblicazione: (2024)
Ranking Large Language Models without Ground Truth
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
Graph-based Uncertainty Metrics for Long-form Language Model Outputs
di: Jiang, Mingjian, et al.
Pubblicazione: (2024)
di: Jiang, Mingjian, et al.
Pubblicazione: (2024)
Thermometer: Towards Universal Calibration for Large Language Models
di: Shen, Maohao, et al.
Pubblicazione: (2024)
di: Shen, Maohao, et al.
Pubblicazione: (2024)
CoFrNets: Interpretable Neural Architecture Inspired by Continued Fractions
di: Puri, Isha, et al.
Pubblicazione: (2025)
di: Puri, Isha, et al.
Pubblicazione: (2025)
Multi-Level Explanations for Generative Language Models
di: Paes, Lucas Monteiro, et al.
Pubblicazione: (2024)
di: Paes, Lucas Monteiro, et al.
Pubblicazione: (2024)
Needle in the Haystack for Memory Based Large Language Models
di: Nelson, Elliot, et al.
Pubblicazione: (2024)
di: Nelson, Elliot, et al.
Pubblicazione: (2024)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
di: Sun, Haotian, et al.
Pubblicazione: (2024)
di: Sun, Haotian, et al.
Pubblicazione: (2024)
STAR: Spectral Truncation and Rescale for Model Merging
di: Lee, Yu-Ang, et al.
Pubblicazione: (2025)
di: Lee, Yu-Ang, et al.
Pubblicazione: (2025)
Trust Regions for Explanations via Black-Box Probabilistic Certification
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)
OjaKV: Context-Aware Online Low-Rank KV Cache Compression
di: Zhu, Yuxuan, et al.
Pubblicazione: (2025)
di: Zhu, Yuxuan, et al.
Pubblicazione: (2025)
In-Context Explainers: Harnessing LLMs for Explaining Black Box Models
di: Kroeger, Nicholas, et al.
Pubblicazione: (2023)
di: Kroeger, Nicholas, et al.
Pubblicazione: (2023)
Are Large Language Models Reliable AI Scientists? Assessing Reverse-Engineering of Black-Box Systems
di: Geng, Jiayi, et al.
Pubblicazione: (2025)
di: Geng, Jiayi, et al.
Pubblicazione: (2025)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
di: Tsai, Yao-Hung Hubert, et al.
Pubblicazione: (2024)
di: Tsai, Yao-Hung Hubert, et al.
Pubblicazione: (2024)
ZoomR: Memory Efficient Reasoning through Multi-Granularity Key Value Retrieval
di: Yang, David H., et al.
Pubblicazione: (2026)
di: Yang, David H., et al.
Pubblicazione: (2026)
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)
PAL: Proxy-Guided Black-Box Attack on Large Language Models
di: Sitawarin, Chawin, et al.
Pubblicazione: (2024)
di: Sitawarin, Chawin, et al.
Pubblicazione: (2024)
Confidence-Modulated Speculative Decoding for Large Language Models
di: Sen, Jaydip, et al.
Pubblicazione: (2025)
di: Sen, Jaydip, et al.
Pubblicazione: (2025)
Uncertainty Quantification for Language Models: A Suite of Black-Box, White-Box, LLM Judge, and Ensemble Scorers
di: Bouchard, Dylan, et al.
Pubblicazione: (2025)
di: Bouchard, Dylan, et al.
Pubblicazione: (2025)
Early Stopping for Large Reasoning Models via Confidence Dynamics
di: Hosseini, Parsa, et al.
Pubblicazione: (2026)
di: Hosseini, Parsa, et al.
Pubblicazione: (2026)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
Nested-ReFT: Efficient Reinforcement Learning for Large Language Model Fine-Tuning via Off-Policy Rollouts
di: Heuillet, Maxime, et al.
Pubblicazione: (2025)
di: Heuillet, Maxime, et al.
Pubblicazione: (2025)
Alignment Studio: Aligning Large Language Models to Particular Contextual Regulations
di: Achintalwar, Swapnaja, et al.
Pubblicazione: (2024)
di: Achintalwar, Swapnaja, et al.
Pubblicazione: (2024)
Do Large Language Models Know How Much They Know?
di: Prato, Gabriele, et al.
Pubblicazione: (2025)
di: Prato, Gabriele, et al.
Pubblicazione: (2025)
LYNX: Learning Dynamic Exits for Confidence-Controlled Reasoning
di: Akgül, Ömer Faruk, et al.
Pubblicazione: (2025)
di: Akgül, Ömer Faruk, et al.
Pubblicazione: (2025)
Confidence Regulation Neurons in Language Models
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
SLOT: Structuring the Output of Large Language Models
di: Wang, Darren Yow-Bang, et al.
Pubblicazione: (2025)
di: Wang, Darren Yow-Bang, et al.
Pubblicazione: (2025)
WikiContradict: A Benchmark for Evaluating LLMs on Real-World Knowledge Conflicts from Wikipedia
di: Hou, Yufang, et al.
Pubblicazione: (2024)
di: Hou, Yufang, et al.
Pubblicazione: (2024)
HYDRA: Model Factorization Framework for Black-Box LLM Personalization
di: Zhuang, Yuchen, et al.
Pubblicazione: (2024)
di: Zhuang, Yuchen, et al.
Pubblicazione: (2024)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
di: Li, Shuozhe, et al.
Pubblicazione: (2026)
di: Li, Shuozhe, et al.
Pubblicazione: (2026)
Clinical QA 2.0: Multi-Task Learning for Answer Extraction and Categorization
di: Pattnayak, Priyaranjan, et al.
Pubblicazione: (2025)
di: Pattnayak, Priyaranjan, et al.
Pubblicazione: (2025)
Mafin: Enhancing Black-Box Embeddings with Model Augmented Fine-Tuning
di: Zhang, Mingtian, et al.
Pubblicazione: (2024)
di: Zhang, Mingtian, et al.
Pubblicazione: (2024)
Graph-based Confidence Calibration for Large Language Models
di: Li, Yukun, et al.
Pubblicazione: (2024)
di: Li, Yukun, et al.
Pubblicazione: (2024)
CTBench: A Comprehensive Benchmark for Evaluating Language Model Capabilities in Clinical Trial Design
di: Neehal, Nafis, et al.
Pubblicazione: (2024)
di: Neehal, Nafis, et al.
Pubblicazione: (2024)
Topic Modelling Black Box Optimization
di: Akramov, Roman, et al.
Pubblicazione: (2025)
di: Akramov, Roman, et al.
Pubblicazione: (2025)
Knowledge Editing on Black-box Large Language Models
di: Song, Xiaoshuai, et al.
Pubblicazione: (2024)
di: Song, Xiaoshuai, et al.
Pubblicazione: (2024)
MICE for CATs: Model-Internal Confidence Estimation for Calibrating Agents with Tools
di: Subramani, Nishant, et al.
Pubblicazione: (2025)
di: Subramani, Nishant, et al.
Pubblicazione: (2025)
Documenti analoghi
-
NeuroPrune: A Neuro-inspired Topological Sparse Training Algorithm for Large Language Models
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024) -
Large Language Models can be Strong Self-Detoxifiers
di: Ko, Ching-Yun, et al.
Pubblicazione: (2024) -
CELL your Model: Contrastive Explanations for Large Language Models
di: Luss, Ronny, et al.
Pubblicazione: (2024) -
Differentiable Prompt Learning for Vision Language Models
di: Huang, Zhenhan, et al.
Pubblicazione: (2024) -
Ranking Large Language Models without Ground Truth
di: Dhurandhar, Amit, et al.
Pubblicazione: (2024)