Evaluation Framework for AI Creativity: A Case Study Based on Story Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Sathya, Pharath, Huang, Yin Jou, Cheng, Fei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Strategy Adaptation in Large Language Model Werewolf Agents
di: Nakamori, Fuya, et al.
Pubblicazione: (2025)
di: Nakamori, Fuya, et al.
Pubblicazione: (2025)
Hallucination or Creativity: How to Evaluate AI-Generated Scientific Stories?
di: Argese, Alex, et al.
Pubblicazione: (2026)
di: Argese, Alex, et al.
Pubblicazione: (2026)
How Does Cognitive Bias Affect Large Language Models? A Case Study on the Anchoring Effect in Price Negotiation Simulations
di: Takenami, Yoshiki, et al.
Pubblicazione: (2025)
di: Takenami, Yoshiki, et al.
Pubblicazione: (2025)
Investigating Cost-Efficiency of LLM-Generated Training Data for Conversational Semantic Frame Analysis
di: Matta, Shiho, et al.
Pubblicazione: (2024)
di: Matta, Shiho, et al.
Pubblicazione: (2024)
Collective Critics for Creative Story Generation
di: Bae, Minwook, et al.
Pubblicazione: (2024)
di: Bae, Minwook, et al.
Pubblicazione: (2024)
Developing Story: Case Studies of Generative AI's Use in Journalism
di: Brigham, Natalie Grace, et al.
Pubblicazione: (2024)
di: Brigham, Natalie Grace, et al.
Pubblicazione: (2024)
Evaluating Creative Short Story Generation in Humans and Large Language Models
di: Ismayilzada, Mete, et al.
Pubblicazione: (2024)
di: Ismayilzada, Mete, et al.
Pubblicazione: (2024)
A Character-Centric Creative Story Generation via Imagination
di: Park, Kyeongman, et al.
Pubblicazione: (2024)
di: Park, Kyeongman, et al.
Pubblicazione: (2024)
How Personality Traits Influence Negotiation Outcomes? A Simulation based on Large Language Models
di: Huang, Yin Jou, et al.
Pubblicazione: (2024)
di: Huang, Yin Jou, et al.
Pubblicazione: (2024)
Beyond Self-Reports: Multi-Observer Agents for Personality Assessment in Large Language Models
di: Huang, Yin Jou, et al.
Pubblicazione: (2025)
di: Huang, Yin Jou, et al.
Pubblicazione: (2025)
CreativEval: Evaluating Creativity of LLM-Based Hardware Code Generation
di: DeLorenzo, Matthew, et al.
Pubblicazione: (2024)
di: DeLorenzo, Matthew, et al.
Pubblicazione: (2024)
Benchmarking Language Model Creativity: A Case Study on Code Generation
di: Lu, Yining, et al.
Pubblicazione: (2024)
di: Lu, Yining, et al.
Pubblicazione: (2024)
BookWorld: From Novels to Interactive Agent Societies for Creative Story Generation
di: Ran, Yiting, et al.
Pubblicazione: (2025)
di: Ran, Yiting, et al.
Pubblicazione: (2025)
AMR-RE: Abstract Meaning Representations for Retrieval-Based In-Context Learning in Relation Extraction
di: Han, Peitao, et al.
Pubblicazione: (2024)
di: Han, Peitao, et al.
Pubblicazione: (2024)
What Matters in Evaluating Book-Length Stories? A Systematic Study of Long Story Evaluation
di: Yang, Dingyi, et al.
Pubblicazione: (2025)
di: Yang, Dingyi, et al.
Pubblicazione: (2025)
EmplifAI: a Fine-grained Dataset for Japanese Empathetic Medical Dialogues in 28 Emotion Labels
di: She, Wan Jou, et al.
Pubblicazione: (2026)
di: She, Wan Jou, et al.
Pubblicazione: (2026)
RecMind: Japanese Movie Recommendation Dialogue with Seeker's Internal State
di: Kodama, Takashi, et al.
Pubblicazione: (2024)
di: Kodama, Takashi, et al.
Pubblicazione: (2024)
Beyond Divergent Creativity: A Human-Based Evaluation of Creativity in Large Language Models
di: Nakajima, Kumiko, et al.
Pubblicazione: (2026)
di: Nakajima, Kumiko, et al.
Pubblicazione: (2026)
StoryWriter: A Multi-Agent Framework for Long Story Generation
di: Xia, Haotian, et al.
Pubblicazione: (2025)
di: Xia, Haotian, et al.
Pubblicazione: (2025)
CreativityPrism: A Holistic Evaluation Framework for Large Language Model Creativity
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
SS-GEN: A Social Story Generation Framework with Large Language Models
di: Feng, Yi, et al.
Pubblicazione: (2024)
di: Feng, Yi, et al.
Pubblicazione: (2024)
Rethinking Creativity Evaluation: A Critical Analysis of Existing Creativity Evaluations
di: Lu, Li-Chun, et al.
Pubblicazione: (2025)
di: Lu, Li-Chun, et al.
Pubblicazione: (2025)
IDEAFix: Evaluation Framework for Creative Defixation Prompting in LLMs
di: Carichon, F., et al.
Pubblicazione: (2026)
di: Carichon, F., et al.
Pubblicazione: (2026)
StoryAlign: Evaluating and Training Reward Models for Story Generation
di: Xia, Haotian, et al.
Pubblicazione: (2026)
di: Xia, Haotian, et al.
Pubblicazione: (2026)
DiaSynth: Synthetic Dialogue Generation Framework for Low Resource Dialogue Applications
di: Suresh, Sathya Krishnan, et al.
Pubblicazione: (2024)
di: Suresh, Sathya Krishnan, et al.
Pubblicazione: (2024)
Evaluating the Creativity of LLMs in Persian Literary Text Generation
di: Tourajmehr, Armin, et al.
Pubblicazione: (2025)
di: Tourajmehr, Armin, et al.
Pubblicazione: (2025)
QUIET: A Multi-Blank Cascaded Story Cloze Benchmark for LLM Creative Generation Capability
di: Zou, Bo, et al.
Pubblicazione: (2026)
di: Zou, Bo, et al.
Pubblicazione: (2026)
Spontaneous Speech Variables for Evaluating LLMs Cognitive Plausibility
di: Wang, Sheng-Fu, et al.
Pubblicazione: (2025)
di: Wang, Sheng-Fu, et al.
Pubblicazione: (2025)
CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing
di: Qian, Cheng, et al.
Pubblicazione: (2026)
di: Qian, Cheng, et al.
Pubblicazione: (2026)
Text2Stories: Evaluating the Alignment Between Stakeholder Interviews and Generated User Stories
di: Dente, Francesco, et al.
Pubblicazione: (2025)
di: Dente, Francesco, et al.
Pubblicazione: (2025)
STORYTELLER: An Enhanced Plot-Planning Framework for Coherent and Cohesive Story Generation
di: Li, Jiaming, et al.
Pubblicazione: (2025)
di: Li, Jiaming, et al.
Pubblicazione: (2025)
CAP: Evaluation of Persuasive and Creative Image Generation
di: Aghazadeh, Aysan, et al.
Pubblicazione: (2024)
di: Aghazadeh, Aysan, et al.
Pubblicazione: (2024)
Creativity Bias: How Machine Evaluation Struggles with Creativity in Literary Translations
di: Gerrits, Kyo, et al.
Pubblicazione: (2026)
di: Gerrits, Kyo, et al.
Pubblicazione: (2026)
Multigenre AI-powered Story Composition
di: de Lima, Edirlei Soares, et al.
Pubblicazione: (2024)
di: de Lima, Edirlei Soares, et al.
Pubblicazione: (2024)
CS4: Measuring the Creativity of Large Language Models Automatically by Controlling the Number of Story-Writing Constraints
di: Atmakuru, Anirudh, et al.
Pubblicazione: (2024)
di: Atmakuru, Anirudh, et al.
Pubblicazione: (2024)
A Persona-Based Evaluation Framework for Pluralistic Alignment in Generative AI
di: Karagoz, Atahan
Pubblicazione: (2026)
di: Karagoz, Atahan
Pubblicazione: (2026)
Generative AI and Teachers -- For Us or Against Us? A Case Study
di: Pettersson, Jenny, et al.
Pubblicazione: (2024)
di: Pettersson, Jenny, et al.
Pubblicazione: (2024)
From XAI to Stories: A Factorial Study of LLM-Generated Explanation Quality
di: Lukassen, Fabian, et al.
Pubblicazione: (2026)
di: Lukassen, Fabian, et al.
Pubblicazione: (2026)
SimulBench: Evaluating Language Models with Creative Simulation Tasks
di: Jia, Qi, et al.
Pubblicazione: (2024)
di: Jia, Qi, et al.
Pubblicazione: (2024)
CAPE: Context-Aware Personality Evaluation Framework for Large Language Models
di: Sandhan, Jivnesh, et al.
Pubblicazione: (2025)
di: Sandhan, Jivnesh, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Strategy Adaptation in Large Language Model Werewolf Agents
di: Nakamori, Fuya, et al.
Pubblicazione: (2025) -
Hallucination or Creativity: How to Evaluate AI-Generated Scientific Stories?
di: Argese, Alex, et al.
Pubblicazione: (2026) -
How Does Cognitive Bias Affect Large Language Models? A Case Study on the Anchoring Effect in Price Negotiation Simulations
di: Takenami, Yoshiki, et al.
Pubblicazione: (2025) -
Investigating Cost-Efficiency of LLM-Generated Training Data for Conversational Semantic Frame Analysis
di: Matta, Shiho, et al.
Pubblicazione: (2024) -
Collective Critics for Creative Story Generation
di: Bae, Minwook, et al.
Pubblicazione: (2024)