Deep Associations, High Creativity: A Simple yet Effective Metric for Evaluating Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Qiu, Ziliang, Hu, Renfen |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DMON: A Simple yet Effective Approach for Argument Structure Learning
by: Sun, Wei, et al.
Published: (2024)
by: Sun, Wei, et al.
Published: (2024)
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
by: Kim, Dahyun, et al.
Published: (2023)
by: Kim, Dahyun, et al.
Published: (2023)
MapGuide: A Simple yet Effective Method to Reconstruct Continuous Language from Brain Activities
by: Zhao, Xinpei, et al.
Published: (2024)
by: Zhao, Xinpei, et al.
Published: (2024)
CreativityPrism: A Holistic Evaluation Framework for Large Language Model Creativity
by: Hou, Zhaoyi Joey, et al.
Published: (2025)
by: Hou, Zhaoyi Joey, et al.
Published: (2025)
Sibyl: Simple yet Effective Agent Framework for Complex Real-world Reasoning
by: Wang, Yulong, et al.
Published: (2024)
by: Wang, Yulong, et al.
Published: (2024)
Steering Large Language Models to Evaluate and Amplify Creativity
by: Olson, Matthew Lyle, et al.
Published: (2024)
by: Olson, Matthew Lyle, et al.
Published: (2024)
The System Hallucination Scale (SHS): A Minimal yet Effective Human-Centered Instrument for Evaluating Hallucination-Related Behavior in Large Language Models
by: Müller, Heimo, et al.
Published: (2026)
by: Müller, Heimo, et al.
Published: (2026)
Enhancing Creativity in Large Language Models through Associative Thinking Strategies
by: Mehrotra, Pronita, et al.
Published: (2024)
by: Mehrotra, Pronita, et al.
Published: (2024)
Assessing and Understanding Creativity in Large Language Models
by: Zhao, Yunpu, et al.
Published: (2024)
by: Zhao, Yunpu, et al.
Published: (2024)
Automated Creativity Evaluation for Large Language Models: A Reference-Based Approach
by: Li, Ruizhe, et al.
Published: (2025)
by: Li, Ruizhe, et al.
Published: (2025)
Evaluating Creative Short Story Generation in Humans and Large Language Models
by: Ismayilzada, Mete, et al.
Published: (2024)
by: Ismayilzada, Mete, et al.
Published: (2024)
A Simple and Effective Pruning Approach for Large Language Models
by: Sun, Mingjie, et al.
Published: (2023)
by: Sun, Mingjie, et al.
Published: (2023)
On the Creativity of Large Language Models
by: Franceschelli, Giorgio, et al.
Published: (2023)
by: Franceschelli, Giorgio, et al.
Published: (2023)
Simple Yet Effective: Extracting Private Data Across Clients in Federated Fine-Tuning of Large Language Models
by: Hu, Yingqi, et al.
Published: (2025)
by: Hu, Yingqi, et al.
Published: (2025)
Is Temperature the Creativity Parameter of Large Language Models?
by: Peeperkorn, Max, et al.
Published: (2024)
by: Peeperkorn, Max, et al.
Published: (2024)
Divergent Creativity in Humans and Large Language Models
by: Bellemare-Pepin, Antoine, et al.
Published: (2024)
by: Bellemare-Pepin, Antoine, et al.
Published: (2024)
Beyond Metrics: A Critical Analysis of the Variability in Large Language Model Evaluation Frameworks
by: Pimentel, Marco AF, et al.
Published: (2024)
by: Pimentel, Marco AF, et al.
Published: (2024)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
by: Liu, Han, et al.
Published: (2024)
by: Liu, Han, et al.
Published: (2024)
MacGyver: Are Large Language Models Creative Problem Solvers?
by: Tian, Yufei, et al.
Published: (2023)
by: Tian, Yufei, et al.
Published: (2023)
Efficiently Building a Domain-Specific Large Language Model from Scratch: A Case Study of a Classical Chinese Large Language Model
by: Li, Shen, et al.
Published: (2025)
by: Li, Shen, et al.
Published: (2025)
Simple and Effective Masked Diffusion Language Models
by: Sahoo, Subham Sekhar, et al.
Published: (2024)
by: Sahoo, Subham Sekhar, et al.
Published: (2024)
DeepJSONEval: Benchmarking Complex Nested JSON Data Mining for Large Language Models
by: Zhou, Zhicheng, et al.
Published: (2025)
by: Zhou, Zhicheng, et al.
Published: (2025)
Creative Convergence or Imitation? Genre-Specific Homogeneity in LLM-Generated Chinese Literature
by: Ma, Yuanchi, et al.
Published: (2026)
by: Ma, Yuanchi, et al.
Published: (2026)
Less is More: A Simple yet Effective Token Reduction Method for Efficient Multi-modal LLMs
by: Song, Dingjie, et al.
Published: (2024)
by: Song, Dingjie, et al.
Published: (2024)
Evaluating the Performance of Large Language Models on GAOKAO Benchmark
by: Zhang, Xiaotian, et al.
Published: (2023)
by: Zhang, Xiaotian, et al.
Published: (2023)
Evaluating Psychological Safety of Large Language Models
by: Li, Xingxuan, et al.
Published: (2022)
by: Li, Xingxuan, et al.
Published: (2022)
Large Language Models Are Still Misled by Simple Bias Ensembles
by: Sun, Zhouhao, et al.
Published: (2025)
by: Sun, Zhouhao, et al.
Published: (2025)
FLAME: Financial Large-Language Model Assessment and Metrics Evaluation
by: Guo, Jiayu, et al.
Published: (2025)
by: Guo, Jiayu, et al.
Published: (2025)
WRDScore: New Metric for Evaluation of Natural Language Generation Models
by: Mussabayev, Ravil
Published: (2024)
by: Mussabayev, Ravil
Published: (2024)
BILLY: Steering Large Language Models via Merging Persona Vectors for Creative Generation
by: Pai, Tsung-Min, et al.
Published: (2025)
by: Pai, Tsung-Min, et al.
Published: (2025)
Exposing Numeracy Gaps: A Benchmark to Evaluate Fundamental Numerical Abilities in Large Language Models
by: Li, Haoyang, et al.
Published: (2025)
by: Li, Haoyang, et al.
Published: (2025)
Information Suppression in Large Language Models: Auditing, Quantifying, and Characterizing Censorship in DeepSeek
by: Qiu, Peiran, et al.
Published: (2025)
by: Qiu, Peiran, et al.
Published: (2025)
ANLS* -- A Universal Document Processing Metric for Generative Large Language Models
by: Peer, David, et al.
Published: (2024)
by: Peer, David, et al.
Published: (2024)
On the Effectiveness of Incremental Training of Large Language Models
by: Li, Miles Q., et al.
Published: (2024)
by: Li, Miles Q., et al.
Published: (2024)
Art or Artifice? Large Language Models and the False Promise of Creativity
by: Chakrabarty, Tuhin, et al.
Published: (2023)
by: Chakrabarty, Tuhin, et al.
Published: (2023)
Language Bias in LVLMs: From In-Depth Analysis to Simple and Effective Mitigation
by: Chen, Yangneng, et al.
Published: (2026)
by: Chen, Yangneng, et al.
Published: (2026)
The Effectiveness of Style Vectors for Steering Large Language Models: A Human Evaluation
by: Diallo, Diaoulé, et al.
Published: (2026)
by: Diallo, Diaoulé, et al.
Published: (2026)
Type-Less yet Type-Aware Inductive Link Prediction with Pretrained Language Models
by: De Bellis, Alessandro, et al.
Published: (2025)
by: De Bellis, Alessandro, et al.
Published: (2025)
LLM Discussion: Enhancing the Creativity of Large Language Models via Discussion Framework and Role-Play
by: Lu, Li-Chun, et al.
Published: (2024)
by: Lu, Li-Chun, et al.
Published: (2024)
Inducing Sustained Creativity and Diversity in Large Language Models
by: Luo, Queenie, et al.
Published: (2026)
by: Luo, Queenie, et al.
Published: (2026)
Similar Items
-
DMON: A Simple yet Effective Approach for Argument Structure Learning
by: Sun, Wei, et al.
Published: (2024) -
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
by: Kim, Dahyun, et al.
Published: (2023) -
MapGuide: A Simple yet Effective Method to Reconstruct Continuous Language from Brain Activities
by: Zhao, Xinpei, et al.
Published: (2024) -
CreativityPrism: A Holistic Evaluation Framework for Large Language Model Creativity
by: Hou, Zhaoyi Joey, et al.
Published: (2025) -
Sibyl: Simple yet Effective Agent Framework for Complex Real-world Reasoning
by: Wang, Yulong, et al.
Published: (2024)