Test-Time Fairness and Robustness in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Cotta, Leonardo, Maddison, Chris J. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Observational Scaling Laws and the Predictability of Language Model Performance
por: Ruan, Yangjun, et al.
Publicado: (2024)
por: Ruan, Yangjun, et al.
Publicado: (2024)
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
por: Jung, Dahyun, et al.
Publicado: (2025)
por: Jung, Dahyun, et al.
Publicado: (2025)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
por: Dong, Honghua, et al.
Publicado: (2024)
por: Dong, Honghua, et al.
Publicado: (2024)
Testing and Evaluation of Large Language Models: Correctness, Non-Toxicity, and Fairness
por: Wang, Wenxuan
Publicado: (2024)
por: Wang, Wenxuan
Publicado: (2024)
A Survey on Fairness in Large Language Models
por: Li, Yingji, et al.
Publicado: (2023)
por: Li, Yingji, et al.
Publicado: (2023)
Metamorphic Testing for Fairness Evaluation in Large Language Models: Identifying Intersectional Bias in LLaMA and GPT
por: Reddy, Harishwar, et al.
Publicado: (2025)
por: Reddy, Harishwar, et al.
Publicado: (2025)
Training-Free Test-Time Contrastive Learning for Large Language Models
por: Zheng, Kaiwen, et al.
Publicado: (2026)
por: Zheng, Kaiwen, et al.
Publicado: (2026)
Fairness in Large Language Models: A Taxonomic Survey
por: Chu, Zhibo, et al.
Publicado: (2024)
por: Chu, Zhibo, et al.
Publicado: (2024)
Improving Fairness in LLMs Through Testing-Time Adversaries
por: Gregio, Isabela Pereira, et al.
Publicado: (2025)
por: Gregio, Isabela Pereira, et al.
Publicado: (2025)
When Large Language Models contradict humans? Large Language Models' Sycophantic Behaviour
por: Ranaldi, Leonardo, et al.
Publicado: (2023)
por: Ranaldi, Leonardo, et al.
Publicado: (2023)
Test-Time Learning for Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025)
por: Hu, Jinwu, et al.
Publicado: (2025)
A Multi-Domain Red Teaming Framework for Safety, Robustness, and Fairness Evaluation of Medical Large Language Models
por: Feier, Andrei Marian, et al.
Publicado: (2026)
por: Feier, Andrei Marian, et al.
Publicado: (2026)
Efficient Fairness Testing in Large Language Models: Prioritizing Metamorphic Relations for Bias Detection
por: Giramata, Suavis, et al.
Publicado: (2025)
por: Giramata, Suavis, et al.
Publicado: (2025)
On Fairness of Unified Multimodal Large Language Model for Image Generation
por: Liu, Ming, et al.
Publicado: (2025)
por: Liu, Ming, et al.
Publicado: (2025)
Reasoning to Learn from Latent Thoughts
por: Ruan, Yangjun, et al.
Publicado: (2025)
por: Ruan, Yangjun, et al.
Publicado: (2025)
MedAdapter: Efficient Test-Time Adaptation of Large Language Models towards Medical Reasoning
por: Shi, Wenqi, et al.
Publicado: (2024)
por: Shi, Wenqi, et al.
Publicado: (2024)
m1: Unleash the Potential of Test-Time Scaling for Medical Reasoning with Large Language Models
por: Huang, Xiaoke, et al.
Publicado: (2025)
por: Huang, Xiaoke, et al.
Publicado: (2025)
Think Again! The Effect of Test-Time Compute on Preferences, Opinions, and Beliefs of Large Language Models
por: Kour, George, et al.
Publicado: (2025)
por: Kour, George, et al.
Publicado: (2025)
On Adversarial Robustness and Out-of-Distribution Robustness of Large Language Models
por: Yang, April, et al.
Publicado: (2024)
por: Yang, April, et al.
Publicado: (2024)
Evaluating the Retrieval Robustness of Large Language Models
por: Cao, Shuyang, et al.
Publicado: (2025)
por: Cao, Shuyang, et al.
Publicado: (2025)
A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?
por: Zhang, Qiyuan, et al.
Publicado: (2025)
por: Zhang, Qiyuan, et al.
Publicado: (2025)
Provable Scaling Laws for the Test-Time Compute of Large Language Models
por: Chen, Yanxi, et al.
Publicado: (2024)
por: Chen, Yanxi, et al.
Publicado: (2024)
Query-Conditioned Test-Time Self-Training for Large Language Models
por: Song, Chaehee, et al.
Publicado: (2026)
por: Song, Chaehee, et al.
Publicado: (2026)
COFT: Counterfactual-Conformal Decoding for Fair Chain-of-Thought Reasoning in Large Language Models
por: Fayyazi, Arya, et al.
Publicado: (2026)
por: Fayyazi, Arya, et al.
Publicado: (2026)
Finish First, Perfect Later: Test-Time Token-Level Cross-Validation for Diffusion Large Language Models
por: Tian, Runchu, et al.
Publicado: (2025)
por: Tian, Runchu, et al.
Publicado: (2025)
Probing the Robustness of Theory of Mind in Large Language Models
por: Nickel, Christian, et al.
Publicado: (2024)
por: Nickel, Christian, et al.
Publicado: (2024)
Investigating the Robustness of Deductive Reasoning with Large Language Models
por: Hoppe, Fabian, et al.
Publicado: (2025)
por: Hoppe, Fabian, et al.
Publicado: (2025)
Measuring Representation Robustness in Large Language Models for Geometry
por: Jawandhia, Vedant, et al.
Publicado: (2026)
por: Jawandhia, Vedant, et al.
Publicado: (2026)
Robustness of Prompting: Enhancing Robustness of Large Language Models Against Prompting Attacks
por: Mu, Lin, et al.
Publicado: (2025)
por: Mu, Lin, et al.
Publicado: (2025)
Harnessing Consistency for Robust Test-Time LLM Ensemble
por: Zeng, Zhichen, et al.
Publicado: (2025)
por: Zeng, Zhichen, et al.
Publicado: (2025)
ReProbe: Efficient Test-Time Scaling of Multi-Step Reasoning by Probing Internal States of Large Language Models
por: Ni, Jingwei, et al.
Publicado: (2025)
por: Ni, Jingwei, et al.
Publicado: (2025)
Prompting Fairness: Integrating Causality to Debias Large Language Models
por: Li, Jingling, et al.
Publicado: (2024)
por: Li, Jingling, et al.
Publicado: (2024)
Bias and Fairness in Large Language Models: A Survey
por: Gallegos, Isabel O., et al.
Publicado: (2023)
por: Gallegos, Isabel O., et al.
Publicado: (2023)
MetaSC: Test-Time Safety Specification Optimization for Language Models
por: Gallego, Víctor
Publicado: (2025)
por: Gallego, Víctor
Publicado: (2025)
Towards Robust Instruction Tuning on Multimodal Large Language Models
por: Han, Wei, et al.
Publicado: (2024)
por: Han, Wei, et al.
Publicado: (2024)
An Information-Theoretic Framework for Robust Large Language Model Editing
por: Chen, Qizhou, et al.
Publicado: (2025)
por: Chen, Qizhou, et al.
Publicado: (2025)
Unveiling Performance Challenges of Large Language Models in Low-Resource Healthcare: A Demographic Fairness Perspective
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
Do Large Language Models Understand Word Senses?
por: Meconi, Domenico, et al.
Publicado: (2025)
por: Meconi, Domenico, et al.
Publicado: (2025)
WellDunn: On the Robustness and Explainability of Language Models and Large Language Models in Identifying Wellness Dimensions
por: Mohammadi, Seyedali, et al.
Publicado: (2024)
por: Mohammadi, Seyedali, et al.
Publicado: (2024)
Hypothesis Testing Prompting Improves Deductive Reasoning in Large Language Models
por: Li, Yitian, et al.
Publicado: (2024)
por: Li, Yitian, et al.
Publicado: (2024)
Ejemplares similares
-
Observational Scaling Laws and the Predictability of Language Model Performance
por: Ruan, Yangjun, et al.
Publicado: (2024) -
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
por: Jung, Dahyun, et al.
Publicado: (2025) -
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
por: Dong, Honghua, et al.
Publicado: (2024) -
Testing and Evaluation of Large Language Models: Correctness, Non-Toxicity, and Fairness
por: Wang, Wenxuan
Publicado: (2024) -
A Survey on Fairness in Large Language Models
por: Li, Yingji, et al.
Publicado: (2023)