Enregistré dans:
| Auteurs principaux: | Lafargue, Valentin, Guerra-Adames, Ariel, Claeys, Emmanuelle, Vuichard, Elouan, Loubes, Jean-Michel |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.16749 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exposing the Illusion of Fairness: Auditing Vulnerabilities to Distributional Manipulation Attacks
par: Lafargue, Valentin, et autres
Publié: (2025)
par: Lafargue, Valentin, et autres
Publié: (2025)
Fairness is in the details: Face Dataset Auditing
par: Lafargue, Valentin, et autres
Publié: (2025)
par: Lafargue, Valentin, et autres
Publié: (2025)
Buzz, Choose, Forget: A Meta-Bandit Framework for Bee-Like Decision Making
par: Claeys, Emmanuelle, et autres
Publié: (2025)
par: Claeys, Emmanuelle, et autres
Publié: (2025)
A Graph Signal Processing Framework for Hallucination Detection in Large Language Models
par: Noël, Valentin
Publié: (2025)
par: Noël, Valentin
Publié: (2025)
Latent Performance Profiling of Large Language Models
par: Chakraborty, Tanmoy, et autres
Publié: (2026)
par: Chakraborty, Tanmoy, et autres
Publié: (2026)
Temporally Consistent Factuality Probing for Large Language Models
par: Bajpai, Ashutosh, et autres
Publié: (2024)
par: Bajpai, Ashutosh, et autres
Publié: (2024)
Signal and Noise: A Framework for Reducing Uncertainty in Language Model Evaluation
par: Heineman, David, et autres
Publié: (2025)
par: Heineman, David, et autres
Publié: (2025)
CultureLLM: Incorporating Cultural Differences into Large Language Models
par: Li, Cheng, et autres
Publié: (2024)
par: Li, Cheng, et autres
Publié: (2024)
Cultural Alignment in Large Language Models: An Explanatory Analysis Based on Hofstede's Cultural Dimensions
par: Masoud, Reem I., et autres
Publié: (2023)
par: Masoud, Reem I., et autres
Publié: (2023)
Model-Agnostic Fairness Regularization for GNNs with Incomplete Sensitive Information
par: Kejani, Mahdi Tavassoli, et autres
Publié: (2025)
par: Kejani, Mahdi Tavassoli, et autres
Publié: (2025)
Attention Sinks as Internal Signals for Hallucination Detection in Large Language Models
par: Binkowski, Jakub, et autres
Publié: (2026)
par: Binkowski, Jakub, et autres
Publié: (2026)
Efficient Knowledge Probing of Large Language Models by Adapting Pre-trained Embeddings
par: Sharma, Kartik, et autres
Publié: (2025)
par: Sharma, Kartik, et autres
Publié: (2025)
Language Models Entangle Language and Culture
par: Jain, Shourya, et autres
Publié: (2026)
par: Jain, Shourya, et autres
Publié: (2026)
Can Large Language Models Generalize Procedures Across Representations?
par: Lin, Fangru, et autres
Publié: (2026)
par: Lin, Fangru, et autres
Publié: (2026)
Derivational Morphology Reveals Analogical Generalization in Large Language Models
par: Hofmann, Valentin, et autres
Publié: (2024)
par: Hofmann, Valentin, et autres
Publié: (2024)
Not All Denoising Steps Are Equal: Model Scheduling for Faster Masked Diffusion Language Models
par: Sedykh, Ivan, et autres
Publié: (2026)
par: Sedykh, Ivan, et autres
Publié: (2026)
Dynamic Evaluation of Large Language Models by Meta Probing Agents
par: Zhu, Kaijie, et autres
Publié: (2024)
par: Zhu, Kaijie, et autres
Publié: (2024)
Probing the Decision Boundaries of In-context Learning in Large Language Models
par: Zhao, Siyan, et autres
Publié: (2024)
par: Zhao, Siyan, et autres
Publié: (2024)
Exploring Multilingual Probing in Large Language Models: A Cross-Language Analysis
par: Li, Daoyang, et autres
Publié: (2024)
par: Li, Daoyang, et autres
Publié: (2024)
Trust in One Round: Confidence Estimation for Large Language Models via Structural Signals
par: Yang, Pengyue, et autres
Publié: (2026)
par: Yang, Pengyue, et autres
Publié: (2026)
Language over Content: Tracing Cultural Understanding in Multilingual Large Language Models
par: Cho, Seungho, et autres
Publié: (2025)
par: Cho, Seungho, et autres
Publié: (2025)
Who Endorsed It? Measuring Authority Bias Across Expertise Levels in Language Models
par: Mammen, Priyanka Mary, et autres
Publié: (2026)
par: Mammen, Priyanka Mary, et autres
Publié: (2026)
Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks
par: Lin, Fangru, et autres
Publié: (2024)
par: Lin, Fangru, et autres
Publié: (2024)
DiJiang: Efficient Large Language Models through Compact Kernelization
par: Chen, Hanting, et autres
Publié: (2024)
par: Chen, Hanting, et autres
Publié: (2024)
Rethinking Interpretability in the Era of Large Language Models
par: Singh, Chandan, et autres
Publié: (2024)
par: Singh, Chandan, et autres
Publié: (2024)
FacLens: Transferable Probe for Foreseeing Non-Factuality in Fact-Seeking Question Answering of Large Language Models
par: Wang, Yanling, et autres
Publié: (2024)
par: Wang, Yanling, et autres
Publié: (2024)
Synthetic Data Generation in Low-Resource Settings via Fine-Tuning of Large Language Models
par: Kaddour, Jean, et autres
Publié: (2023)
par: Kaddour, Jean, et autres
Publié: (2023)
Talking Nonsense: Probing Large Language Models' Understanding of Adversarial Gibberish Inputs
par: Cherepanova, Valeriia, et autres
Publié: (2024)
par: Cherepanova, Valeriia, et autres
Publié: (2024)
Graph-enhanced Large Language Models in Asynchronous Plan Reasoning
par: Lin, Fangru, et autres
Publié: (2024)
par: Lin, Fangru, et autres
Publié: (2024)
P^3SUM: Preserving Author's Perspective in News Summarization with Diffusion Language Models
par: Liu, Yuhan, et autres
Publié: (2023)
par: Liu, Yuhan, et autres
Publié: (2023)
Markov Constraint as Large Language Model Surrogate
par: Bonlarron, Alexandre, et autres
Publié: (2024)
par: Bonlarron, Alexandre, et autres
Publié: (2024)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
par: Le, Qi, et autres
Publié: (2025)
par: Le, Qi, et autres
Publié: (2025)
Evaluating Black-Box Vulnerabilities with Wasserstein-Constrained Data Perturbations
par: Monteiro, Adriana Laurindo, et autres
Publié: (2026)
par: Monteiro, Adriana Laurindo, et autres
Publié: (2026)
Having Beer after Prayer? Measuring Cultural Bias in Large Language Models
par: Naous, Tarek, et autres
Publié: (2023)
par: Naous, Tarek, et autres
Publié: (2023)
Comparing Template-based and Template-free Language Model Probing
par: Shaier, Sagi, et autres
Publié: (2024)
par: Shaier, Sagi, et autres
Publié: (2024)
Monitoring Latent World States in Language Models with Propositional Probes
par: Feng, Jiahai, et autres
Publié: (2024)
par: Feng, Jiahai, et autres
Publié: (2024)
CALM: Culturally Self-Aware Language Models
par: Shen, Lingzhi, et autres
Publié: (2026)
par: Shen, Lingzhi, et autres
Publié: (2026)
KGLens: Towards Efficient and Effective Knowledge Probing of Large Language Models with Knowledge Graphs
par: Zheng, Shangshang, et autres
Publié: (2023)
par: Zheng, Shangshang, et autres
Publié: (2023)
Probing the Robustness of Large Language Models Safety to Latent Perturbations
par: Gu, Tianle, et autres
Publié: (2025)
par: Gu, Tianle, et autres
Publié: (2025)
A Nurse is Blue and Elephant is Rugby: Cross Domain Alignment in Large Language Models Reveal Human-like Patterns
par: Yehudai, Asaf, et autres
Publié: (2024)
par: Yehudai, Asaf, et autres
Publié: (2024)
Documents similaires
-
Exposing the Illusion of Fairness: Auditing Vulnerabilities to Distributional Manipulation Attacks
par: Lafargue, Valentin, et autres
Publié: (2025) -
Fairness is in the details: Face Dataset Auditing
par: Lafargue, Valentin, et autres
Publié: (2025) -
Buzz, Choose, Forget: A Meta-Bandit Framework for Bee-Like Decision Making
par: Claeys, Emmanuelle, et autres
Publié: (2025) -
A Graph Signal Processing Framework for Hallucination Detection in Large Language Models
par: Noël, Valentin
Publié: (2025) -
Latent Performance Profiling of Large Language Models
par: Chakraborty, Tanmoy, et autres
Publié: (2026)