Evaluation of Instruction-Following Ability for Large Language Models on Story-Ending Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Hida, Rem, Ohmura, Junki, Sekiya, Toshiyuki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Social Bias Evaluation for Large Language Models Requires Prompt Variations
di: Hida, Rem, et al.
Pubblicazione: (2024)
di: Hida, Rem, et al.
Pubblicazione: (2024)
InFoBench: Evaluating Instruction Following Ability in Large Language Models
di: Qin, Yiwei, et al.
Pubblicazione: (2024)
di: Qin, Yiwei, et al.
Pubblicazione: (2024)
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
di: Kim, Dongjun, et al.
Pubblicazione: (2025)
di: Kim, Dongjun, et al.
Pubblicazione: (2025)
Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability
di: Sakai, Yusuke, et al.
Pubblicazione: (2025)
di: Sakai, Yusuke, et al.
Pubblicazione: (2025)
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
di: Chen, Xinyi, et al.
Pubblicazione: (2024)
di: Chen, Xinyi, et al.
Pubblicazione: (2024)
Evaluating the Generalization Capabilities of Large Language Models on Code Reasoning
di: Yang, Rem, et al.
Pubblicazione: (2025)
di: Yang, Rem, et al.
Pubblicazione: (2025)
LibriTTS-VI: A Public Corpus and Novel Methods for Efficient Voice Impression Control
di: Ohmura, Junki, et al.
Pubblicazione: (2025)
di: Ohmura, Junki, et al.
Pubblicazione: (2025)
Evaluating Large Language Models at Evaluating Instruction Following
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2023)
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2023)
Conifer: Improving Complex Constrained Instruction-Following Ability of Large Language Models
di: Sun, Haoran, et al.
Pubblicazione: (2024)
di: Sun, Haoran, et al.
Pubblicazione: (2024)
From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models
di: He, Qianyu, et al.
Pubblicazione: (2024)
di: He, Qianyu, et al.
Pubblicazione: (2024)
XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
Instruction-Following Evaluation of Large Vision-Language Models
di: Shiono, Daiki, et al.
Pubblicazione: (2025)
di: Shiono, Daiki, et al.
Pubblicazione: (2025)
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
LIFEBench: Evaluating Length Instruction Following in Large Language Models
di: Zhang, Wei, et al.
Pubblicazione: (2025)
di: Zhang, Wei, et al.
Pubblicazione: (2025)
Remedy-R: Generative Reasoning for Machine Translation Evaluation without Error Annotations
di: Tan, Shaomu, et al.
Pubblicazione: (2025)
di: Tan, Shaomu, et al.
Pubblicazione: (2025)
Instruction-Following Pruning for Large Language Models
di: Hou, Bairu, et al.
Pubblicazione: (2025)
di: Hou, Bairu, et al.
Pubblicazione: (2025)
RefuteBench: Evaluating Refuting Instruction-Following for Large Language Models
di: Yan, Jianhao, et al.
Pubblicazione: (2024)
di: Yan, Jianhao, et al.
Pubblicazione: (2024)
IHEval: Evaluating Language Models on Following the Instruction Hierarchy
di: Zhang, Zhihan, et al.
Pubblicazione: (2025)
di: Zhang, Zhihan, et al.
Pubblicazione: (2025)
Learned but Not Expressed: Capability-Expression Dissociation in Large Language Models
di: Shigemura, Toshiyuki
Pubblicazione: (2026)
di: Shigemura, Toshiyuki
Pubblicazione: (2026)
Do Language Models Enjoy Their Own Stories? Prompting Large Language Models for Automatic Story Evaluation
di: Chhun, Cyril, et al.
Pubblicazione: (2024)
di: Chhun, Cyril, et al.
Pubblicazione: (2024)
LexInstructEval: Lexical Instruction Following Evaluation for Large Language Models
di: Ren, Huimin, et al.
Pubblicazione: (2025)
di: Ren, Huimin, et al.
Pubblicazione: (2025)
LIFBench: Evaluating the Instruction Following Performance and Stability of Large Language Models in Long-Context Scenarios
di: Wu, Xiaodong, et al.
Pubblicazione: (2024)
di: Wu, Xiaodong, et al.
Pubblicazione: (2024)
Investigating Test-Time Scaling with Reranking for Machine Translation
di: Tan, Shaomu, et al.
Pubblicazione: (2025)
di: Tan, Shaomu, et al.
Pubblicazione: (2025)
Evaluating Creative Short Story Generation in Humans and Large Language Models
di: Ismayilzada, Mete, et al.
Pubblicazione: (2024)
di: Ismayilzada, Mete, et al.
Pubblicazione: (2024)
Help Me Write a Story: Evaluating LLMs' Ability to Generate Writing Feedback
di: Rashkin, Hannah, et al.
Pubblicazione: (2025)
di: Rashkin, Hannah, et al.
Pubblicazione: (2025)
Distilling Instruction-following Abilities of Large Language Models with Task-aware Curriculum Planning
di: Yue, Yuanhao, et al.
Pubblicazione: (2024)
di: Yue, Yuanhao, et al.
Pubblicazione: (2024)
Eliciting the Translation Ability of Large Language Models via Multilingual Finetuning with Translation Instructions
di: Li, Jiahuan, et al.
Pubblicazione: (2023)
di: Li, Jiahuan, et al.
Pubblicazione: (2023)
ICLEval: Evaluating In-Context Learning Ability of Large Language Models
di: Chen, Wentong, et al.
Pubblicazione: (2024)
di: Chen, Wentong, et al.
Pubblicazione: (2024)
Can It Edit? Evaluating the Ability of Large Language Models to Follow Code Editing Instructions
di: Cassano, Federico, et al.
Pubblicazione: (2023)
di: Cassano, Federico, et al.
Pubblicazione: (2023)
Argument Quality Assessment in the Age of Instruction-Following Large Language Models
di: Wachsmuth, Henning, et al.
Pubblicazione: (2024)
di: Wachsmuth, Henning, et al.
Pubblicazione: (2024)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
di: Zou, Tao, et al.
Pubblicazione: (2025)
di: Zou, Tao, et al.
Pubblicazione: (2025)
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models
di: Sun, Yuchong, et al.
Pubblicazione: (2023)
di: Sun, Yuchong, et al.
Pubblicazione: (2023)
Large Language Model Instruction Following: A Survey of Progresses and Challenges
di: Lou, Renze, et al.
Pubblicazione: (2023)
di: Lou, Renze, et al.
Pubblicazione: (2023)
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
di: Zhu, Qin, et al.
Pubblicazione: (2025)
di: Zhu, Qin, et al.
Pubblicazione: (2025)
Evaluating the Ability of Large Language Models to Reason about Cardinal Directions
di: Cohn, Anthony G, et al.
Pubblicazione: (2024)
di: Cohn, Anthony G, et al.
Pubblicazione: (2024)
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
di: LI, Yizhi, et al.
Pubblicazione: (2024)
di: LI, Yizhi, et al.
Pubblicazione: (2024)
Crafting Narrative Closures: Zero-Shot Learning with SSM Mamba for Short Story Ending Generation
di: Sharma, Divyam, et al.
Pubblicazione: (2024)
di: Sharma, Divyam, et al.
Pubblicazione: (2024)
Step-by-Step Mastery: Enhancing Soft Constraint Following Ability of Large Language Models
di: Ren, Qingyu, et al.
Pubblicazione: (2025)
di: Ren, Qingyu, et al.
Pubblicazione: (2025)
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
di: Zeng, Bo, et al.
Pubblicazione: (2025)
di: Zeng, Bo, et al.
Pubblicazione: (2025)
Evaluating the Symbol Binding Ability of Large Language Models for Multiple-Choice Questions in Vietnamese General Education
di: Nguyen, Duc-Vu, et al.
Pubblicazione: (2023)
di: Nguyen, Duc-Vu, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Social Bias Evaluation for Large Language Models Requires Prompt Variations
di: Hida, Rem, et al.
Pubblicazione: (2024) -
InFoBench: Evaluating Instruction Following Ability in Large Language Models
di: Qin, Yiwei, et al.
Pubblicazione: (2024) -
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
di: Kim, Dongjun, et al.
Pubblicazione: (2025) -
Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability
di: Sakai, Yusuke, et al.
Pubblicazione: (2025) -
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
di: Chen, Xinyi, et al.
Pubblicazione: (2024)