IDRBench: Understanding the Capability of Large Language Models on Interdisciplinary Research
Fuente:
arXiv
Saved in:
| Main Authors: | Shen, Yuanhao, de Sousa, Daniel Xavier, Marçal, Ricardo, Guo, Hongyu, Zhu, Xiaodan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
IDRBench: Interactive Deep Research Benchmark
by: Feng, Yingchaojie, et al.
Published: (2026)
by: Feng, Yingchaojie, et al.
Published: (2026)
SpaRC and SpaRP: Spatial Reasoning Characterization and Path Generation for Understanding Spatial Reasoning Capability of Large Language Models
by: Rizvi, Md Imbesat Hassan, et al.
Published: (2024)
by: Rizvi, Md Imbesat Hassan, et al.
Published: (2024)
Understanding the Capabilities and Limitations of Large Language Models for Cultural Commonsense
by: Shen, Siqi, et al.
Published: (2024)
by: Shen, Siqi, et al.
Published: (2024)
Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models
by: Liu, Shaonan, et al.
Published: (2026)
by: Liu, Shaonan, et al.
Published: (2026)
Robust Utility-Preserving Text Anonymization Based on Large Language Models
by: Yang, Tianyu, et al.
Published: (2024)
by: Yang, Tianyu, et al.
Published: (2024)
StringLLM: Understanding the String Processing Capability of Large Language Models
by: Wang, Xilong, et al.
Published: (2024)
by: Wang, Xilong, et al.
Published: (2024)
Evaluating the Capabilities of Large Language Models for Multi-label Emotion Understanding
by: Belay, Tadesse Destaw, et al.
Published: (2024)
by: Belay, Tadesse Destaw, et al.
Published: (2024)
Preservation of Language Understanding Capabilities in Speech-aware Large Language Models
by: Kubis, Marek, et al.
Published: (2025)
by: Kubis, Marek, et al.
Published: (2025)
PLMM: Personal Large Language Models on Mobile Devices
by: Gong, Yuanhao
Published: (2023)
by: Gong, Yuanhao
Published: (2023)
Sports Intelligence: Assessing the Sports Understanding Capabilities of Language Models through Question Answering from Text to Video
by: Yang, Zhengbang, et al.
Published: (2024)
by: Yang, Zhengbang, et al.
Published: (2024)
FAC$^2$E: Better Understanding Large Language Model Capabilities by Dissociating Language and Cognition
by: Wang, Xiaoqiang, et al.
Published: (2024)
by: Wang, Xiaoqiang, et al.
Published: (2024)
Improving the Language Understanding Capabilities of Large Language Models Using Reinforcement Learning
by: Hu, Bokai, et al.
Published: (2024)
by: Hu, Bokai, et al.
Published: (2024)
Investigating Symbolic Capabilities of Large Language Models
by: Dave, Neisarg, et al.
Published: (2024)
by: Dave, Neisarg, et al.
Published: (2024)
Speak While Watching: Unleashing TRUE Real-Time Video Understanding Capability of Multimodal Large Language Models
by: Lin, Junyan, et al.
Published: (2026)
by: Lin, Junyan, et al.
Published: (2026)
Disinformation Capabilities of Large Language Models
by: Vykopal, Ivan, et al.
Published: (2023)
by: Vykopal, Ivan, et al.
Published: (2023)
Unmasking the Shadows of AI: Investigating Deceptive Capabilities in Large Language Models
by: Guo, Linge
Published: (2024)
by: Guo, Linge
Published: (2024)
Can Large Language Models Understand Intermediate Representations in Compilers?
by: Jiang, Hailong, et al.
Published: (2025)
by: Jiang, Hailong, et al.
Published: (2025)
GraphInstruct: Empowering Large Language Models with Graph Understanding and Reasoning Capability
by: Luo, Zihan, et al.
Published: (2024)
by: Luo, Zihan, et al.
Published: (2024)
Chronicle: A Multimodal Foundation Model for Joint Language and Time Series Understanding
by: Quinlan, Paul, et al.
Published: (2026)
by: Quinlan, Paul, et al.
Published: (2026)
A Novel Paradigm Boosting Translation Capabilities of Large Language Models
by: Guo, Jiaxin, et al.
Published: (2024)
by: Guo, Jiaxin, et al.
Published: (2024)
NatLogAttack: A Framework for Attacking Natural Language Inference Models with Natural Logic
by: Zheng, Zi'ou, et al.
Published: (2023)
by: Zheng, Zi'ou, et al.
Published: (2023)
Understanding Teacher Revisions of Large Language Model-Generated Feedback
by: Borchers, Conrad, et al.
Published: (2026)
by: Borchers, Conrad, et al.
Published: (2026)
Reasoning Capabilities and Invariability of Large Language Models
by: Raganato, Alessandro, et al.
Published: (2025)
by: Raganato, Alessandro, et al.
Published: (2025)
Distilling Instruction-following Abilities of Large Language Models with Task-aware Curriculum Planning
by: Yue, Yuanhao, et al.
Published: (2024)
by: Yue, Yuanhao, et al.
Published: (2024)
On the Temporal Question-Answering Capabilities of Large Language Models Over Anonymized Data
by: Ruiz, Alfredo Garrachón, et al.
Published: (2025)
by: Ruiz, Alfredo Garrachón, et al.
Published: (2025)
Improving Natural Language Capability of Code Large Language Model
by: Li, Wei, et al.
Published: (2024)
by: Li, Wei, et al.
Published: (2024)
Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset
by: Zhu, Jie, et al.
Published: (2024)
by: Zhu, Jie, et al.
Published: (2024)
SportQA: A Benchmark for Sports Understanding in Large Language Models
by: Xia, Haotian, et al.
Published: (2024)
by: Xia, Haotian, et al.
Published: (2024)
Prompt Engineering Large Language Models' Forecasting Capabilities
by: Schoenegger, Philipp, et al.
Published: (2025)
by: Schoenegger, Philipp, et al.
Published: (2025)
Mixture-of-Agents Enhances Large Language Model Capabilities
by: Wang, Junlin, et al.
Published: (2024)
by: Wang, Junlin, et al.
Published: (2024)
Evaluating the Generation Capabilities of Large Chinese Language Models
by: Zeng, Hui, et al.
Published: (2023)
by: Zeng, Hui, et al.
Published: (2023)
Evaluating Accounting Reasoning Capabilities of Large Language Models
by: Zhou, Jie, et al.
Published: (2026)
by: Zhou, Jie, et al.
Published: (2026)
Compressed Sensing for Capability Localization in Large Language Models
by: Bair, Anna, et al.
Published: (2026)
by: Bair, Anna, et al.
Published: (2026)
Exploring the Role of Reasoning Structures for Constructing Proofs in Multi-Step Natural Language Reasoning with Large Language Models
by: Zheng, Zi'ou, et al.
Published: (2024)
by: Zheng, Zi'ou, et al.
Published: (2024)
Can Large Language Models Understand Context?
by: Zhu, Yilun, et al.
Published: (2024)
by: Zhu, Yilun, et al.
Published: (2024)
LayoutLLM: Layout Instruction Tuning with Large Language Models for Document Understanding
by: Luo, Chuwei, et al.
Published: (2024)
by: Luo, Chuwei, et al.
Published: (2024)
Do Large Language Models Truly Understand Geometric Structures?
by: Wang, Xiaofeng, et al.
Published: (2025)
by: Wang, Xiaofeng, et al.
Published: (2025)
Language-Specific Neurons: The Key to Multilingual Capabilities in Large Language Models
by: Tang, Tianyi, et al.
Published: (2024)
by: Tang, Tianyi, et al.
Published: (2024)
High-Fidelity Pruning for Large Language Models
by: Zhu, Yijun, et al.
Published: (2026)
by: Zhu, Yijun, et al.
Published: (2026)
Large Language Models Understanding: an Inherent Ambiguity Barrier
by: Nissani, Daniel N.
Published: (2025)
by: Nissani, Daniel N.
Published: (2025)
Similar Items
-
IDRBench: Interactive Deep Research Benchmark
by: Feng, Yingchaojie, et al.
Published: (2026) -
SpaRC and SpaRP: Spatial Reasoning Characterization and Path Generation for Understanding Spatial Reasoning Capability of Large Language Models
by: Rizvi, Md Imbesat Hassan, et al.
Published: (2024) -
Understanding the Capabilities and Limitations of Large Language Models for Cultural Commonsense
by: Shen, Siqi, et al.
Published: (2024) -
Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models
by: Liu, Shaonan, et al.
Published: (2026) -
Robust Utility-Preserving Text Anonymization Based on Large Language Models
by: Yang, Tianyu, et al.
Published: (2024)