Saved in:
| Main Authors: | Kendapadi, Aum, Zaman, Kerem, Menon, Rakesh R., Srivastava, Shashank |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2412.11388 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
by: Zaman, Kerem, et al.
Published: (2025)
by: Zaman, Kerem, et al.
Published: (2025)
A Causal Lens for Evaluating Faithfulness Metrics
by: Zaman, Kerem, et al.
Published: (2025)
by: Zaman, Kerem, et al.
Published: (2025)
DISCERN: Decoding Systematic Errors in Natural Language for Text Classifiers
by: Menon, Rakesh R., et al.
Published: (2024)
by: Menon, Rakesh R., et al.
Published: (2024)
Fuse to Forget: Bias Reduction and Selective Memorization through Model Fusion
by: Zaman, Kerem, et al.
Published: (2023)
by: Zaman, Kerem, et al.
Published: (2023)
SocialGaze: Improving the Integration of Human Social Norms in Large Language Models
by: Vijjini, Anvesh Rao, et al.
Published: (2024)
by: Vijjini, Anvesh Rao, et al.
Published: (2024)
The Point of No Return: Counterfactual Localization of Deceptive Commitment in Language-Model Reasoning
by: Merrill, Scott, et al.
Published: (2026)
by: Merrill, Scott, et al.
Published: (2026)
Classifying Unreliable Narrators with Large Language Models
by: Brei, Anneliese, et al.
Published: (2025)
by: Brei, Anneliese, et al.
Published: (2025)
Pedagogical Alignment of Large Language Models
by: Sonkar, Shashank, et al.
Published: (2024)
by: Sonkar, Shashank, et al.
Published: (2024)
INTERACT: An AI-Driven Extended Reality Framework for Accesible Communication Featuring Real-Time Sign Language Interpretation and Emotion Recognition
by: Tantaroudas, Nikolaos D., et al.
Published: (2026)
by: Tantaroudas, Nikolaos D., et al.
Published: (2026)
PHEONA: An Evaluation Framework for Large Language Model-based Approaches to Computational Phenotyping
by: Pungitore, Sarah, et al.
Published: (2025)
by: Pungitore, Sarah, et al.
Published: (2025)
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
by: Srivastava, Varun, et al.
Published: (2025)
by: Srivastava, Varun, et al.
Published: (2025)
Orthographic Constraint Satisfaction and Human Difficulty Alignment in Large Language Models
by: Tuck, Bryan E., et al.
Published: (2025)
by: Tuck, Bryan E., et al.
Published: (2025)
Point of Order: Action-Aware LLM Persona Modeling for Realistic Civic Simulation
by: Merrill, Scott, et al.
Published: (2025)
by: Merrill, Scott, et al.
Published: (2025)
Are Large Language Models Sensitive to the Motives Behind Communication?
by: Wu, Addison J., et al.
Published: (2025)
by: Wu, Addison J., et al.
Published: (2025)
Towards Robust Evaluation: A Comprehensive Taxonomy of Datasets and Metrics for Open Domain Question Answering in the Era of Large Language Models
by: Srivastava, Akchay, et al.
Published: (2024)
by: Srivastava, Akchay, et al.
Published: (2024)
Design and Application of Multimodal Large Language Model Based System for End to End Automation of Accident Dataset Generation
by: Chowdhury, MD Thamed Bin Zaman, et al.
Published: (2025)
by: Chowdhury, MD Thamed Bin Zaman, et al.
Published: (2025)
Leveraging Inter-Chunk Interactions for Enhanced Retrieval in Large Language Model-Based Question Answering
by: Guo, Tiezheng, et al.
Published: (2024)
by: Guo, Tiezheng, et al.
Published: (2024)
Animate, or Inanimate, That is the Question for Large Language Models
by: Ranaldi, Leonardo, et al.
Published: (2024)
by: Ranaldi, Leonardo, et al.
Published: (2024)
Questioning the Survey Responses of Large Language Models
by: Dominguez-Olmedo, Ricardo, et al.
Published: (2023)
by: Dominguez-Olmedo, Ricardo, et al.
Published: (2023)
MalAlgoQA: Pedagogical Evaluation of Counterfactual Reasoning in Large Language Models and Implications for AI in Education
by: Liu, Naiming, et al.
Published: (2024)
by: Liu, Naiming, et al.
Published: (2024)
Learning from "Silly" Questions Improves Large Language Models, But Only Slightly
by: Zhu, Tingyuan, et al.
Published: (2024)
by: Zhu, Tingyuan, et al.
Published: (2024)
Interactive-KBQA: Multi-Turn Interactions for Knowledge Base Question Answering with Large Language Models
by: Xiong, Guanming, et al.
Published: (2024)
by: Xiong, Guanming, et al.
Published: (2024)
Improving Multimodal Large Language Models Using Continual Learning
by: Srivastava, Shikhar, et al.
Published: (2024)
by: Srivastava, Shikhar, et al.
Published: (2024)
REPRO-Bench: Can Agentic AI Systems Assess the Reproducibility of Social Science Research?
by: Hu, Chuxuan, et al.
Published: (2025)
by: Hu, Chuxuan, et al.
Published: (2025)
Contrastive Learning for Knowledge-Based Question Generation in Large Language Models
by: Zhang, Zhenhong, et al.
Published: (2024)
by: Zhang, Zhenhong, et al.
Published: (2024)
Question: How do Large Language Models perform on the Question Answering tasks? Answer:
by: Fischer, Kevin, et al.
Published: (2024)
by: Fischer, Kevin, et al.
Published: (2024)
Enabling Inclusive Systematic Reviews: Incorporating Preprint Articles with Large Language Model-Driven Evaluations
by: Yang, Rui, et al.
Published: (2025)
by: Yang, Rui, et al.
Published: (2025)
Ask Good Questions for Large Language Models
by: Wu, Qi, et al.
Published: (2025)
by: Wu, Qi, et al.
Published: (2025)
Language Model-Driven Data Pruning Enables Efficient Active Learning
by: Azeemi, Abdul Hameed, et al.
Published: (2024)
by: Azeemi, Abdul Hameed, et al.
Published: (2024)
Mitigating Knowledge Conflicts in Language Model-Driven Question Answering
by: Cao, Han, et al.
Published: (2024)
by: Cao, Han, et al.
Published: (2024)
Market-Bench: Evaluating Large Language Models on Introductory Quantitative Trading and Market Dynamics
by: Srivastava, Abhay, et al.
Published: (2025)
by: Srivastava, Abhay, et al.
Published: (2025)
Turkronicles: Diachronic Resources for the Fast Evolving Turkish Language
by: Yazar, Togay, et al.
Published: (2024)
by: Yazar, Togay, et al.
Published: (2024)
CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models
by: Liu, Naiming, et al.
Published: (2025)
by: Liu, Naiming, et al.
Published: (2025)
Durghotona GPT: A Web Scraping and Large Language Model Based Framework to Generate Road Accident Dataset Automatically in Bangladesh
by: Chowdhury, MD Thamed Bin Zaman, et al.
Published: (2025)
by: Chowdhury, MD Thamed Bin Zaman, et al.
Published: (2025)
LLM-ProS: Analyzing Large Language Models' Performance in Competitive Problem Solving
by: Hossain, Md Sifat, et al.
Published: (2025)
by: Hossain, Md Sifat, et al.
Published: (2025)
Automated Knowledge Graph Construction using Large Language Models and Sentence Complexity Modelling
by: Anuyah, Sydney, et al.
Published: (2025)
by: Anuyah, Sydney, et al.
Published: (2025)
Awakening Augmented Generation: Learning to Awaken Internal Knowledge of Large Language Models for Question Answering
by: Liao, Huanxuan, et al.
Published: (2024)
by: Liao, Huanxuan, et al.
Published: (2024)
BQA: Body Language Question Answering Dataset for Video Large Language Models
by: Ozaki, Shintaro, et al.
Published: (2024)
by: Ozaki, Shintaro, et al.
Published: (2024)
A Comprehensive Survey of Hallucination Mitigation Techniques in Large Language Models
by: Tonmoy, S. M Towhidul Islam, et al.
Published: (2024)
by: Tonmoy, S. M Towhidul Islam, et al.
Published: (2024)
MalruleLib: Large-Scale Executable Misconception Reasoning with Step Traces for Modeling Student Thinking in Mathematics
by: Chen, Xinghe, et al.
Published: (2026)
by: Chen, Xinghe, et al.
Published: (2026)
Similar Items
-
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
by: Zaman, Kerem, et al.
Published: (2025) -
A Causal Lens for Evaluating Faithfulness Metrics
by: Zaman, Kerem, et al.
Published: (2025) -
DISCERN: Decoding Systematic Errors in Natural Language for Text Classifiers
by: Menon, Rakesh R., et al.
Published: (2024) -
Fuse to Forget: Bias Reduction and Selective Memorization through Model Fusion
by: Zaman, Kerem, et al.
Published: (2023) -
SocialGaze: Improving the Integration of Human Social Norms in Large Language Models
by: Vijjini, Anvesh Rao, et al.
Published: (2024)