DARG: Dynamic Evaluation of Large Language Models via Adaptive Reasoning Graph
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Zhehao, Chen, Jiaao, Yang, Diyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Dynamic Skill Adaptation for Large Language Models
di: Chen, Jiaao, et al.
Pubblicazione: (2024)
di: Chen, Jiaao, et al.
Pubblicazione: (2024)
Can Large Language Models Transform Computational Social Science?
di: Ziems, Caleb, et al.
Pubblicazione: (2023)
di: Ziems, Caleb, et al.
Pubblicazione: (2023)
DyVal: Dynamic Evaluation of Large Language Models for Reasoning Tasks
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
Demystifying Verbatim Memorization in Large Language Models
di: Huang, Jing, et al.
Pubblicazione: (2024)
di: Huang, Jing, et al.
Pubblicazione: (2024)
Sketch2Code: Evaluating Vision-Language Models for Interactive Web Design Prototyping
di: Li, Ryan, et al.
Pubblicazione: (2024)
di: Li, Ryan, et al.
Pubblicazione: (2024)
Fine-tuning a Large Language Model for Automating Computational Fluid Dynamics Simulations
di: Dong, Zhehao, et al.
Pubblicazione: (2025)
di: Dong, Zhehao, et al.
Pubblicazione: (2025)
Attacking Vision-Language Computer Agents via Pop-ups
di: Zhang, Yanzhe, et al.
Pubblicazione: (2024)
di: Zhang, Yanzhe, et al.
Pubblicazione: (2024)
Are Large Language Models Consistent over Value-laden Questions?
di: Moore, Jared, et al.
Pubblicazione: (2024)
di: Moore, Jared, et al.
Pubblicazione: (2024)
Graph-constrained Reasoning: Faithful Reasoning on Knowledge Graphs with Large Language Models
di: Luo, Linhao, et al.
Pubblicazione: (2024)
di: Luo, Linhao, et al.
Pubblicazione: (2024)
Global-Recent Semantic Reasoning on Dynamic Text-Attributed Graphs with Large Language Models
di: Wang, Yunan, et al.
Pubblicazione: (2025)
di: Wang, Yunan, et al.
Pubblicazione: (2025)
EquiBench: Benchmarking Large Language Models' Reasoning about Program Semantics via Equivalence Checking
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
Evaluating Accounting Reasoning Capabilities of Large Language Models
di: Zhou, Jie, et al.
Pubblicazione: (2026)
di: Zhou, Jie, et al.
Pubblicazione: (2026)
Skills-in-Context Prompting: Unlocking Compositionality in Large Language Models
di: Chen, Jiaao, et al.
Pubblicazione: (2023)
di: Chen, Jiaao, et al.
Pubblicazione: (2023)
ClinDEF: A Dynamic Evaluation Framework for Large Language Models in Clinical Reasoning
di: Tang, Yuqi, et al.
Pubblicazione: (2025)
di: Tang, Yuqi, et al.
Pubblicazione: (2025)
Personalization of Large Language Models: A Survey
di: Zhang, Zhehao, et al.
Pubblicazione: (2024)
di: Zhang, Zhehao, et al.
Pubblicazione: (2024)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
Generative Interfaces for Language Models
di: Chen, Jiaqi, et al.
Pubblicazione: (2025)
di: Chen, Jiaqi, et al.
Pubblicazione: (2025)
Social Skill Training with Large Language Models
di: Yang, Diyi, et al.
Pubblicazione: (2024)
di: Yang, Diyi, et al.
Pubblicazione: (2024)
AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control
di: Li, Ruosen, et al.
Pubblicazione: (2025)
di: Li, Ruosen, et al.
Pubblicazione: (2025)
Accounting Reasoning in Large Language Models: Concepts, Evaluation, and Empirical Analysis
di: Zhou, Jie, et al.
Pubblicazione: (2025)
di: Zhou, Jie, et al.
Pubblicazione: (2025)
EconNLI: Evaluating Large Language Models on Economics Reasoning
di: Guo, Yue, et al.
Pubblicazione: (2024)
di: Guo, Yue, et al.
Pubblicazione: (2024)
FACT-AUDIT: An Adaptive Multi-Agent Framework for Dynamic Fact-Checking Evaluation of Large Language Models
di: Lin, Hongzhan, et al.
Pubblicazione: (2025)
di: Lin, Hongzhan, et al.
Pubblicazione: (2025)
Searching for Privacy Risks in LLM Agents via Simulation
di: Zhang, Yanzhe, et al.
Pubblicazione: (2025)
di: Zhang, Yanzhe, et al.
Pubblicazione: (2025)
When Large Language Models are Reliable for Judging Empathic Communication
di: Kumar, Aakriti, et al.
Pubblicazione: (2025)
di: Kumar, Aakriti, et al.
Pubblicazione: (2025)
Distilling Reasoning Ability from Large Language Models with Adaptive Thinking
di: Chen, Xiaoshu, et al.
Pubblicazione: (2024)
di: Chen, Xiaoshu, et al.
Pubblicazione: (2024)
Decoding Susceptibility: Modeling Misbelief to Misinformation Through a Computational Approach
di: Liu, Yanchen, et al.
Pubblicazione: (2023)
di: Liu, Yanchen, et al.
Pubblicazione: (2023)
Evaluating and Enhancing Large Language Models for Conversational Reasoning on Knowledge Graphs
di: Huang, Yuxuan
Pubblicazione: (2023)
di: Huang, Yuxuan
Pubblicazione: (2023)
Mixture of Reasonings: Teach Large Language Models to Reason with Adaptive Strategies
di: Xiong, Tao, et al.
Pubblicazione: (2025)
di: Xiong, Tao, et al.
Pubblicazione: (2025)
LayAlign: Enhancing Multilingual Reasoning in Large Language Models via Layer-Wise Adaptive Fusion and Alignment Strategy
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
Paths-over-Graph: Knowledge Graph Empowered Large Language Model Reasoning
di: Tan, Xingyu, et al.
Pubblicazione: (2024)
di: Tan, Xingyu, et al.
Pubblicazione: (2024)
Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge Graph
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
A Comprehensive Study on Quantization Techniques for Large Language Models
di: Lang, Jiedong, et al.
Pubblicazione: (2024)
di: Lang, Jiedong, et al.
Pubblicazione: (2024)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
di: Zhu, Yingjie, et al.
Pubblicazione: (2024)
di: Zhu, Yingjie, et al.
Pubblicazione: (2024)
GraphArena: Evaluating and Exploring Large Language Models on Graph Computation
di: Tang, Jianheng, et al.
Pubblicazione: (2024)
di: Tang, Jianheng, et al.
Pubblicazione: (2024)
Adaptive-Solver Framework for Dynamic Strategy Selection in Large Language Model Reasoning
di: Zhou, Jianpeng, et al.
Pubblicazione: (2023)
di: Zhou, Jianpeng, et al.
Pubblicazione: (2023)
Mitigating Prompt-Induced Hallucinations in Large Language Models via Structured Reasoning
di: Hao, Jinbo, et al.
Pubblicazione: (2026)
di: Hao, Jinbo, et al.
Pubblicazione: (2026)
A Large Language Model Based Method for Complex Logical Reasoning over Knowledge Graphs
di: Zhang, Ziyan, et al.
Pubblicazione: (2025)
di: Zhang, Ziyan, et al.
Pubblicazione: (2025)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
di: Xing, Wang, et al.
Pubblicazione: (2026)
di: Xing, Wang, et al.
Pubblicazione: (2026)
PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models
di: Qiu, Shi, et al.
Pubblicazione: (2025)
di: Qiu, Shi, et al.
Pubblicazione: (2025)
KnowledgeNavigator: Leveraging Large Language Models for Enhanced Reasoning over Knowledge Graph
di: Guo, Tiezheng, et al.
Pubblicazione: (2023)
di: Guo, Tiezheng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Dynamic Skill Adaptation for Large Language Models
di: Chen, Jiaao, et al.
Pubblicazione: (2024) -
Can Large Language Models Transform Computational Social Science?
di: Ziems, Caleb, et al.
Pubblicazione: (2023) -
DyVal: Dynamic Evaluation of Large Language Models for Reasoning Tasks
di: Zhu, Kaijie, et al.
Pubblicazione: (2023) -
Demystifying Verbatim Memorization in Large Language Models
di: Huang, Jing, et al.
Pubblicazione: (2024) -
Sketch2Code: Evaluating Vision-Language Models for Interactive Web Design Prototyping
di: Li, Ryan, et al.
Pubblicazione: (2024)