Why Did Apple Fall: Evaluating Curiosity in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Haoyu, Jiang, Sihang, Chen, Yuyan, Meng, Xiaojun, Wei, Jiansheng, Wang, Yitong, Xiao, Yanghua |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Recent Advancement of Emotion Cognition in Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Dr.Academy: A Benchmark for Evaluating Questioning Capability in Education for Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
EmotionQueen: A Benchmark for Evaluating Empathy of Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
par: Huang, Yuncheng, et autres
Publié: (2023)
par: Huang, Yuncheng, et autres
Publié: (2023)
MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Can Pre-trained Language Models Understand Chinese Humor?
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Do Large Language Models have Problem-Solving Capability under Incomplete Information Scenarios?
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
CALM: Curiosity-Driven Auditing for Large Language Models
par: Zheng, Xiang, et autres
Publié: (2025)
par: Zheng, Xiang, et autres
Publié: (2025)
Hallucination Detection: Robustly Discerning Reliable Answers in Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Curiosity-driven Red-teaming for Large Language Models
par: Hong, Zhang-Wei, et autres
Publié: (2024)
par: Hong, Zhang-Wei, et autres
Publié: (2024)
AdaptiveLog: An Adaptive Log Analysis Framework with the Collaboration of Large and Small Language Model
par: Ma, Lipeng, et autres
Publié: (2025)
par: Ma, Lipeng, et autres
Publié: (2025)
StrucText-Eval: Evaluating Large Language Model's Reasoning Ability in Structure-Rich Text
par: Gu, Zhouhong, et autres
Publié: (2024)
par: Gu, Zhouhong, et autres
Publié: (2024)
Chain-of-Knowledge: Integrating Knowledge Reasoning into Large Language Models by Learning from Knowledge Graphs
par: Zhang, Yifei, et autres
Publié: (2024)
par: Zhang, Yifei, et autres
Publié: (2024)
SED: Self-Evaluation Decoding Enhances Large Language Models for Better Generation
par: Luo, Ziqin, et autres
Publié: (2024)
par: Luo, Ziqin, et autres
Publié: (2024)
A Stitch in Time Saves Nine: Proactive Self-Refinement for Language Models
par: Han, Jinyi, et autres
Publié: (2025)
par: Han, Jinyi, et autres
Publié: (2025)
Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding
par: Li, Yanda, et autres
Publié: (2024)
par: Li, Yanda, et autres
Publié: (2024)
QUILL: Quotation Generation Enhancement of Large Language Models
par: Xiao, Jin, et autres
Publié: (2024)
par: Xiao, Jin, et autres
Publié: (2024)
Your Models Have Thought Enough: Training Large Reasoning Models to Stop Overthinking
par: Han, Jinyi, et autres
Publié: (2025)
par: Han, Jinyi, et autres
Publié: (2025)
CDS: Knowledge Component-Driven Data Synthesis Guided by Cognitive Diagnosis Theory
par: Zhao, Haokun, et autres
Publié: (2025)
par: Zhao, Haokun, et autres
Publié: (2025)
Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation
par: Zhang, Yichi, et autres
Publié: (2025)
par: Zhang, Yichi, et autres
Publié: (2025)
Past Meets Present: Creating Historical Analogy with Large Language Models
par: Li, Nianqi, et autres
Publié: (2024)
par: Li, Nianqi, et autres
Publié: (2024)
Mechanistic Decoding of Cognitive Constructs in Large Language Models
par: Shou, Yitong, et autres
Publié: (2026)
par: Shou, Yitong, et autres
Publié: (2026)
Selective Expert Guidance for Effective and Diverse Exploration in Reinforcement Learning of LLMs
par: Jiang, Zishang, et autres
Publié: (2025)
par: Jiang, Zishang, et autres
Publié: (2025)
Evaluating and Mitigating Linguistic Discrimination in Large Language Models
par: Dong, Guoliang, et autres
Publié: (2024)
par: Dong, Guoliang, et autres
Publié: (2024)
Apple Intelligence Foundation Language Models
par: Gunter, Tom, et autres
Publié: (2024)
par: Gunter, Tom, et autres
Publié: (2024)
CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
par: Dai, Runpeng, et autres
Publié: (2025)
par: Dai, Runpeng, et autres
Publié: (2025)
Exploring and Evaluating Multimodal Knowledge Reasoning Consistency of Multimodal Large Language Models
par: Jia, Boyu, et autres
Publié: (2025)
par: Jia, Boyu, et autres
Publié: (2025)
Small Language Model Can Self-correct
par: Han, Haixia, et autres
Publié: (2024)
par: Han, Haixia, et autres
Publié: (2024)
"I See What You Did There": Can Large Vision-Language Models Understand Multimodal Puns?
par: Xu, Naen, et autres
Publié: (2026)
par: Xu, Naen, et autres
Publié: (2026)
SAFER: Probing Safety in Reward Models with Sparse Autoencoder
par: Shi, Wei, et autres
Publié: (2025)
par: Shi, Wei, et autres
Publié: (2025)
MathAgent: Adversarial Evolution of Constraint Graphs for Mathematical Reasoning Data Synthesis
par: Yu, Zixiong, et autres
Publié: (2026)
par: Yu, Zixiong, et autres
Publié: (2026)
A Survey on Evaluation of Large Language Models
par: Chang, Yupeng, et autres
Publié: (2023)
par: Chang, Yupeng, et autres
Publié: (2023)
CultureScope: A Dimensional Lens for Probing Cultural Understanding in LLMs
par: Zhang, Jinghao, et autres
Publié: (2025)
par: Zhang, Jinghao, et autres
Publié: (2025)
Open-SQL Framework: Enhancing Text-to-SQL on Open-source Large Language Models
par: Chen, Xiaojun, et autres
Publié: (2024)
par: Chen, Xiaojun, et autres
Publié: (2024)
HAMMER: Hamiltonian Curiosity Augmented Large Language Model Reinforcement
par: Yang, Ming, et autres
Publié: (2025)
par: Yang, Ming, et autres
Publié: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
par: Xiao, Wenyang, et autres
Publié: (2025)
par: Xiao, Wenyang, et autres
Publié: (2025)
Large Language Models for Predictive Analysis: How Far Are They?
par: Chen, Qin, et autres
Publié: (2025)
par: Chen, Qin, et autres
Publié: (2025)
Can Large Language Models Understand Real-World Complex Instructions?
par: He, Qianyu, et autres
Publié: (2023)
par: He, Qianyu, et autres
Publié: (2023)
Integrating Chemistry Knowledge in Large Language Models via Prompt Engineering
par: Liu, Hongxuan, et autres
Publié: (2024)
par: Liu, Hongxuan, et autres
Publié: (2024)
Step-by-Step Mastery: Enhancing Soft Constraint Following Ability of Large Language Models
par: Ren, Qingyu, et autres
Publié: (2025)
par: Ren, Qingyu, et autres
Publié: (2025)
Documents similaires
-
Recent Advancement of Emotion Cognition in Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024) -
Dr.Academy: A Benchmark for Evaluating Questioning Capability in Education for Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024) -
EmotionQueen: A Benchmark for Evaluating Empathy of Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024) -
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
par: Huang, Yuncheng, et autres
Publié: (2023) -
MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization
par: Chen, Yuyan, et autres
Publié: (2024)