Applied Explainability for Large Language Models: A Comparative Study
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Kancharla, Venkata Abhinandan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Multi-Encoder Frozen-Decoder Approach for Fine-Tuning Large Language Models
par: Dhole, Kaustubh D.
Publié: (2025)
par: Dhole, Kaustubh D.
Publié: (2025)
Adaptive Activation Cancellation for Hallucination Mitigation in Large Language Models
par: Yocam, Eric, et autres
Publié: (2026)
par: Yocam, Eric, et autres
Publié: (2026)
Efficient Strategy for Improving Large Language Model (LLM) Capabilities
par: Gutiérrez, Julián Camilo Velandia
Publié: (2025)
par: Gutiérrez, Julián Camilo Velandia
Publié: (2025)
A Lightweight Approach to Detection of AI-Generated Texts Using Stylometric Features
par: Aityan, Sergey K., et autres
Publié: (2025)
par: Aityan, Sergey K., et autres
Publié: (2025)
Do LLMs Know What They Know? Measuring Metacognitive Efficiency with Signal Detection Theory
par: Cacioli, Jon-Paul
Publié: (2026)
par: Cacioli, Jon-Paul
Publié: (2026)
Large Language Models Are Not Strong Abstract Reasoners
par: Gendron, Gaël, et autres
Publié: (2023)
par: Gendron, Gaël, et autres
Publié: (2023)
ADALog: Adaptive Unsupervised Anomaly detection in Logs with Self-attention Masked Language Model
par: Pospieszny, Przemek, et autres
Publié: (2025)
par: Pospieszny, Przemek, et autres
Publié: (2025)
Classification of descriptions and summary using multiple passes of statistical and natural language toolkits
par: Banthia, Saumya, et autres
Publié: (2020)
par: Banthia, Saumya, et autres
Publié: (2020)
Exploring Model Invariance with Discrete Search for Ultra-Low-Bit Quantization
par: Wen, Yuqiao, et autres
Publié: (2025)
par: Wen, Yuqiao, et autres
Publié: (2025)
A Semantic Approach to Negation Detection and Word Disambiguation with Natural Language Processing
par: Okpala, Izunna, et autres
Publié: (2023)
par: Okpala, Izunna, et autres
Publié: (2023)
Computational Economics in Large Language Models: Exploring Model Behavior and Incentive Design under Resource Constraints
par: Reddy, Sandeep, et autres
Publié: (2025)
par: Reddy, Sandeep, et autres
Publié: (2025)
When is dataset cartography ineffective? Using training dynamics does not improve robustness against Adversarial SQuAD
par: Mandal, Paul K.
Publié: (2025)
par: Mandal, Paul K.
Publié: (2025)
EBBS: An Ensemble with Bi-Level Beam Search for Zero-Shot Machine Translation
par: Wen, Yuqiao, et autres
Publié: (2024)
par: Wen, Yuqiao, et autres
Publié: (2024)
Less is More: Learning Graph Tasks with Just LLMs
par: Shirai, Sola, et autres
Publié: (2025)
par: Shirai, Sola, et autres
Publié: (2025)
Adversarially Probing Cross-Family Sound Symbolism in 27 Languages
par: Sharma, Anika, et autres
Publié: (2025)
par: Sharma, Anika, et autres
Publié: (2025)
MIMIC-SR-ICD11: A Dataset for Narrative-Based Diagnosis
par: Wu, Yuexin, et autres
Publié: (2025)
par: Wu, Yuexin, et autres
Publié: (2025)
DROID: Dual Representation for Out-of-Scope Intent Detection
par: Rashwan, Wael, et autres
Publié: (2025)
par: Rashwan, Wael, et autres
Publié: (2025)
Transparent but Powerful: Explainability, Accuracy, and Generalizability in ADHD Detection from Social Media Data
par: Wiechmann, D., et autres
Publié: (2024)
par: Wiechmann, D., et autres
Publié: (2024)
Efficient Hate Speech Detection: Evaluating 38 Models from Traditional Methods to Transformers
par: Abusaqer, Mahmoud, et autres
Publié: (2025)
par: Abusaqer, Mahmoud, et autres
Publié: (2025)
Accelerating Language Model Workflows with Prompt Choreography
par: Bai, TJ, et autres
Publié: (2025)
par: Bai, TJ, et autres
Publié: (2025)
Cost-Aware Model Selection for Text Classification: Multi-Objective Trade-offs Between Fine-Tuned Encoders and LLM Prompting in Production
par: Gonzalez, Alberto Andres Valdes
Publié: (2026)
par: Gonzalez, Alberto Andres Valdes
Publié: (2026)
Measuring Intent Comprehension in LLMs
par: Kunievsky, Nadav, et autres
Publié: (2025)
par: Kunievsky, Nadav, et autres
Publié: (2025)
TaylorShift: Shifting the Complexity of Self-Attention from Squared to Linear (and Back) using Taylor-Softmax
par: Nauen, Tobias Christian, et autres
Publié: (2024)
par: Nauen, Tobias Christian, et autres
Publié: (2024)
Correspondence of high-dimensional emotion structures elicited by video clips between humans and Multimodal LLMs
par: Asanuma, Haruka, et autres
Publié: (2025)
par: Asanuma, Haruka, et autres
Publié: (2025)
Suicide Risk Assessment Using Multimodal Speech Features: A Study on the SW1 Challenge Dataset
par: Marie, Ambre, et autres
Publié: (2025)
par: Marie, Ambre, et autres
Publié: (2025)
Listwise Direct Preference Optimization with Multi-Dimensional Preference Mixing
par: Sun, Yuhui, et autres
Publié: (2025)
par: Sun, Yuhui, et autres
Publié: (2025)
Predicting When to Trust Vision-Language Models for Spatial Reasoning
par: Imran, Muhammad, et autres
Publié: (2026)
par: Imran, Muhammad, et autres
Publié: (2026)
GradES: Significantly Faster Training in Transformers with Gradient-Based Early Stopping
par: Wen, Qifu, et autres
Publié: (2025)
par: Wen, Qifu, et autres
Publié: (2025)
Let Your Graph Do the Talking: Encoding Structured Data for LLMs
par: Perozzi, Bryan, et autres
Publié: (2024)
par: Perozzi, Bryan, et autres
Publié: (2024)
FinBERT-QA: Financial Question Answering with pre-trained BERT Language Models
par: Yuan, Bithiah
Publié: (2025)
par: Yuan, Bithiah
Publié: (2025)
A Lightweight Multi-Expert Generative Language Model System for Engineering Information and Knowledge Extraction
par: Bogachov, Bogdan, et autres
Publié: (2025)
par: Bogachov, Bogdan, et autres
Publié: (2025)
Beyond Subtokens: A Rich Character Embedding for Low-resource and Morphologically Complex Languages
par: Schneider, Felix, et autres
Publié: (2026)
par: Schneider, Felix, et autres
Publié: (2026)
Emotional Voice Messages (EMOVOME) database: emotion recognition in spontaneous voice messages
par: Zaragozá, Lucía Gómez, et autres
Publié: (2024)
par: Zaragozá, Lucía Gómez, et autres
Publié: (2024)
Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content
par: Koushik, Girish A., et autres
Publié: (2025)
par: Koushik, Girish A., et autres
Publié: (2025)
A Comparative Study of Feature Selection in Tsetlin Machines
par: Halenka, Vojtech, et autres
Publié: (2025)
par: Halenka, Vojtech, et autres
Publié: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
Logits-Constrained Framework with RoBERTa for Ancient Chinese NER
par: Hua, Wenjie, et autres
Publié: (2025)
par: Hua, Wenjie, et autres
Publié: (2025)
LLM Performance Predictors: Learning When to Escalate in Hybrid Human-AI Moderation Systems
par: Bachar, Or, et autres
Publié: (2026)
par: Bachar, Or, et autres
Publié: (2026)
Semantic Superiority vs. Forensic Efficiency: A Comparative Analysis of Deep Learning and Psycholinguistics for Business Email Compromise Detection
par: Adjei, Yaw Osei, et autres
Publié: (2025)
par: Adjei, Yaw Osei, et autres
Publié: (2025)
The Need for Guardrails with Large Language Models in Medical Safety-Critical Settings: An Artificial Intelligence Application in the Pharmacovigilance Ecosystem
par: Hakim, Joe B, et autres
Publié: (2024)
par: Hakim, Joe B, et autres
Publié: (2024)
Documents similaires
-
A Multi-Encoder Frozen-Decoder Approach for Fine-Tuning Large Language Models
par: Dhole, Kaustubh D.
Publié: (2025) -
Adaptive Activation Cancellation for Hallucination Mitigation in Large Language Models
par: Yocam, Eric, et autres
Publié: (2026) -
Efficient Strategy for Improving Large Language Model (LLM) Capabilities
par: Gutiérrez, Julián Camilo Velandia
Publié: (2025) -
A Lightweight Approach to Detection of AI-Generated Texts Using Stylometric Features
par: Aityan, Sergey K., et autres
Publié: (2025) -
Do LLMs Know What They Know? Measuring Metacognitive Efficiency with Signal Detection Theory
par: Cacioli, Jon-Paul
Publié: (2026)