LExT: Towards Evaluating Trustworthiness of Natural Language Explanations
Fuente:
arXiv
Guardado en:
| Autores principales: | Shailya, Krithi, Rajpal, Shreya, Krishnan, Gokul S, Ravindran, Balaraman |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Where Should I Study? Biased Language Models Decide! Evaluating Fairness in LMs for Academic Recommendations
por: Shailya, Krithi, et al.
Publicado: (2025)
por: Shailya, Krithi, et al.
Publicado: (2025)
mFARM: Towards Multi-Faceted Fairness Assessment based on HARMs in Clinical Decision Support
por: Adappanavar, Shreyash, et al.
Publicado: (2025)
por: Adappanavar, Shreyash, et al.
Publicado: (2025)
IndiCASA: A Dataset and Bias Evaluation Framework in LLMs Using Contrastive Embedding Similarity in the Indian Context
por: S, Santhosh G, et al.
Publicado: (2025)
por: S, Santhosh G, et al.
Publicado: (2025)
Are Models Trained on Indian Legal Data Fair?
por: Girhepuje, Sahil, et al.
Publicado: (2023)
por: Girhepuje, Sahil, et al.
Publicado: (2023)
InSaAF: Incorporating Safety through Accuracy and Fairness | Are LLMs ready for the Indian Legal Domain?
por: Tripathi, Yogesh, et al.
Publicado: (2024)
por: Tripathi, Yogesh, et al.
Publicado: (2024)
PONTE: Personalized Orchestration for Natural Language Trustworthy Explanations
por: Vineis, Vittoria, et al.
Publicado: (2026)
por: Vineis, Vittoria, et al.
Publicado: (2026)
Participatory Approaches in AI Development and Governance: Case Studies
por: Parthasarathy, Ambreesh, et al.
Publicado: (2024)
por: Parthasarathy, Ambreesh, et al.
Publicado: (2024)
BERTologyNavigator: Advanced Question Answering with BERT-based Semantics
por: Rajpal, Shreya, et al.
Publicado: (2024)
por: Rajpal, Shreya, et al.
Publicado: (2024)
SWAN: Sparse Winnowed Attention for Reduced Inference Memory via Decompression-Free KV-Cache Compression
por: S, Santhosh G, et al.
Publicado: (2025)
por: S, Santhosh G, et al.
Publicado: (2025)
AQUA: Attention via QUery mAgnitudes for Memory and Compute Efficient Inference in LLMs
por: S, Santhosh G, et al.
Publicado: (2025)
por: S, Santhosh G, et al.
Publicado: (2025)
Learning from Natural Language Explanations for Generalizable Entity Matching
por: Wadhwa, Somin, et al.
Publicado: (2024)
por: Wadhwa, Somin, et al.
Publicado: (2024)
Participatory Approaches in AI Development and Governance: A Principled Approach
por: Parthasarathy, Ambreesh, et al.
Publicado: (2024)
por: Parthasarathy, Ambreesh, et al.
Publicado: (2024)
XForecast: Evaluating Natural Language Explanations for Time Series Forecasting
por: Aksu, Taha, et al.
Publicado: (2024)
por: Aksu, Taha, et al.
Publicado: (2024)
Toward Socially Aware Vision-Language Models: Evaluating Cultural Competence Through Multimodal Story Generation
por: Mukherjee, Arka, et al.
Publicado: (2025)
por: Mukherjee, Arka, et al.
Publicado: (2025)
Towards Consistent Natural-Language Explanations via Explanation-Consistency Finetuning
por: Chen, Yanda, et al.
Publicado: (2024)
por: Chen, Yanda, et al.
Publicado: (2024)
Situated Natural Language Explanations
por: Zhu, Zining, et al.
Publicado: (2023)
por: Zhu, Zining, et al.
Publicado: (2023)
On the Importance and Evaluation of Narrativity in Natural Language AI Explanations
por: Cedro, Mateusz, et al.
Publicado: (2026)
por: Cedro, Mateusz, et al.
Publicado: (2026)
Explainability of Large Language Models: Opportunities and Challenges toward Generating Trustworthy Explanations
por: Atakishiyev, Shahin, et al.
Publicado: (2025)
por: Atakishiyev, Shahin, et al.
Publicado: (2025)
Language Models can Subtly Deceive Without Lying: A Case Study on Strategic Phrasing in Legislation
por: Dogra, Atharvan, et al.
Publicado: (2024)
por: Dogra, Atharvan, et al.
Publicado: (2024)
MoLEx: Mixture of Layer Experts for Finetuning with Sparse Upcycling
por: Teo, Rachel S. Y., et al.
Publicado: (2025)
por: Teo, Rachel S. Y., et al.
Publicado: (2025)
Reasoning with Natural Language Explanations
por: Valentino, Marco, et al.
Publicado: (2024)
por: Valentino, Marco, et al.
Publicado: (2024)
Towards Faithful Natural Language Explanations: A Study Using Activation Patching in Large Language Models
por: Yeo, Wei Jie, et al.
Publicado: (2024)
por: Yeo, Wei Jie, et al.
Publicado: (2024)
A Taxonomy for Design and Evaluation of Prompt-Based Natural Language Explanations
por: Nejadgholi, Isar, et al.
Publicado: (2025)
por: Nejadgholi, Isar, et al.
Publicado: (2025)
Combining Transformers with Natural Language Explanations
por: Ruggeri, Federico, et al.
Publicado: (2021)
por: Ruggeri, Federico, et al.
Publicado: (2021)
CLINIC: Evaluating Multilingual Trustworthiness in Language Models for Healthcare
por: Ghosh, Akash, et al.
Publicado: (2025)
por: Ghosh, Akash, et al.
Publicado: (2025)
Self-Critique and Refinement for Faithful Natural Language Explanations
por: Wang, Yingming, et al.
Publicado: (2025)
por: Wang, Yingming, et al.
Publicado: (2025)
Using Natural Language Explanations to Rescale Human Judgments
por: Wadhwa, Manya, et al.
Publicado: (2023)
por: Wadhwa, Manya, et al.
Publicado: (2023)
Reasoning-Grounded Natural Language Explanations for Language Models
por: Cahlik, Vojtech, et al.
Publicado: (2025)
por: Cahlik, Vojtech, et al.
Publicado: (2025)
mmJEE-Eval: A Bilingual Multimodal Benchmark for Evaluating Scientific Reasoning in Vision-Language Models
por: Mukherjee, Arka, et al.
Publicado: (2025)
por: Mukherjee, Arka, et al.
Publicado: (2025)
Scenarios and Approaches for Situated Natural Language Explanations
por: Qiu, Pengshuo, et al.
Publicado: (2024)
por: Qiu, Pengshuo, et al.
Publicado: (2024)
Using Natural Language Explanations to Improve Robustness of In-context Learning
por: He, Xuanli, et al.
Publicado: (2023)
por: He, Xuanli, et al.
Publicado: (2023)
Explanation based Bias Decoupling Regularization for Natural Language Inference
por: Zang, Jianxiang, et al.
Publicado: (2024)
por: Zang, Jianxiang, et al.
Publicado: (2024)
PromptExp: Multi-granularity Prompt Explanation of Large Language Models
por: Dong, Ximing, et al.
Publicado: (2024)
por: Dong, Ximing, et al.
Publicado: (2024)
ReLExS: Reinforcement Learning Explanations for Stackelberg No-Regret Learners
por: Huang, Xiangge, et al.
Publicado: (2024)
por: Huang, Xiangge, et al.
Publicado: (2024)
Towards a Framework for Evaluating Explanations in Automated Fact Verification
por: Kotonya, Neema, et al.
Publicado: (2024)
por: Kotonya, Neema, et al.
Publicado: (2024)
SQLucid: Grounding Natural Language Database Queries with Interactive Explanations
por: Tian, Yuan, et al.
Publicado: (2024)
por: Tian, Yuan, et al.
Publicado: (2024)
CEV-LM: Controlled Edit Vector Language Model for Shaping Natural Language Generations
por: Moorjani, Samraj, et al.
Publicado: (2024)
por: Moorjani, Samraj, et al.
Publicado: (2024)
Evaluating the Reliability of Self-Explanations in Large Language Models
por: Randl, Korbinian, et al.
Publicado: (2024)
por: Randl, Korbinian, et al.
Publicado: (2024)
Natural Language Counterfactual Explanations for Graphs Using Large Language Models
por: Giorgi, Flavio, et al.
Publicado: (2024)
por: Giorgi, Flavio, et al.
Publicado: (2024)
Toward Trustworthy Difficulty Assessments: Large Language Models as Judges in Programming and Synthetic Tasks
por: Tabib, H. M. Shadman, et al.
Publicado: (2025)
por: Tabib, H. M. Shadman, et al.
Publicado: (2025)
Ejemplares similares
-
Where Should I Study? Biased Language Models Decide! Evaluating Fairness in LMs for Academic Recommendations
por: Shailya, Krithi, et al.
Publicado: (2025) -
mFARM: Towards Multi-Faceted Fairness Assessment based on HARMs in Clinical Decision Support
por: Adappanavar, Shreyash, et al.
Publicado: (2025) -
IndiCASA: A Dataset and Bias Evaluation Framework in LLMs Using Contrastive Embedding Similarity in the Indian Context
por: S, Santhosh G, et al.
Publicado: (2025) -
Are Models Trained on Indian Legal Data Fair?
por: Girhepuje, Sahil, et al.
Publicado: (2023) -
InSaAF: Incorporating Safety through Accuracy and Fairness | Are LLMs ready for the Indian Legal Domain?
por: Tripathi, Yogesh, et al.
Publicado: (2024)