Evaluation of Instruction-Following Ability for Large Language Models on Story-Ending Generation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hida, Rem, Ohmura, Junki, Sekiya, Toshiyuki |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Social Bias Evaluation for Large Language Models Requires Prompt Variations
von: Hida, Rem, et al.
Veröffentlicht: (2024)
von: Hida, Rem, et al.
Veröffentlicht: (2024)
InFoBench: Evaluating Instruction Following Ability in Large Language Models
von: Qin, Yiwei, et al.
Veröffentlicht: (2024)
von: Qin, Yiwei, et al.
Veröffentlicht: (2024)
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
von: Kim, Dongjun, et al.
Veröffentlicht: (2025)
von: Kim, Dongjun, et al.
Veröffentlicht: (2025)
Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability
von: Sakai, Yusuke, et al.
Veröffentlicht: (2025)
von: Sakai, Yusuke, et al.
Veröffentlicht: (2025)
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
von: Chen, Xinyi, et al.
Veröffentlicht: (2024)
von: Chen, Xinyi, et al.
Veröffentlicht: (2024)
Evaluating the Generalization Capabilities of Large Language Models on Code Reasoning
von: Yang, Rem, et al.
Veröffentlicht: (2025)
von: Yang, Rem, et al.
Veröffentlicht: (2025)
LibriTTS-VI: A Public Corpus and Novel Methods for Efficient Voice Impression Control
von: Ohmura, Junki, et al.
Veröffentlicht: (2025)
von: Ohmura, Junki, et al.
Veröffentlicht: (2025)
Evaluating Large Language Models at Evaluating Instruction Following
von: Zeng, Zhiyuan, et al.
Veröffentlicht: (2023)
von: Zeng, Zhiyuan, et al.
Veröffentlicht: (2023)
Conifer: Improving Complex Constrained Instruction-Following Ability of Large Language Models
von: Sun, Haoran, et al.
Veröffentlicht: (2024)
von: Sun, Haoran, et al.
Veröffentlicht: (2024)
From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models
von: He, Qianyu, et al.
Veröffentlicht: (2024)
von: He, Qianyu, et al.
Veröffentlicht: (2024)
XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
von: Li, Zhenyu, et al.
Veröffentlicht: (2025)
von: Li, Zhenyu, et al.
Veröffentlicht: (2025)
Instruction-Following Evaluation of Large Vision-Language Models
von: Shiono, Daiki, et al.
Veröffentlicht: (2025)
von: Shiono, Daiki, et al.
Veröffentlicht: (2025)
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
von: Sun, Wangtao, et al.
Veröffentlicht: (2024)
von: Sun, Wangtao, et al.
Veröffentlicht: (2024)
LIFEBench: Evaluating Length Instruction Following in Large Language Models
von: Zhang, Wei, et al.
Veröffentlicht: (2025)
von: Zhang, Wei, et al.
Veröffentlicht: (2025)
Remedy-R: Generative Reasoning for Machine Translation Evaluation without Error Annotations
von: Tan, Shaomu, et al.
Veröffentlicht: (2025)
von: Tan, Shaomu, et al.
Veröffentlicht: (2025)
Instruction-Following Pruning for Large Language Models
von: Hou, Bairu, et al.
Veröffentlicht: (2025)
von: Hou, Bairu, et al.
Veröffentlicht: (2025)
RefuteBench: Evaluating Refuting Instruction-Following for Large Language Models
von: Yan, Jianhao, et al.
Veröffentlicht: (2024)
von: Yan, Jianhao, et al.
Veröffentlicht: (2024)
IHEval: Evaluating Language Models on Following the Instruction Hierarchy
von: Zhang, Zhihan, et al.
Veröffentlicht: (2025)
von: Zhang, Zhihan, et al.
Veröffentlicht: (2025)
Learned but Not Expressed: Capability-Expression Dissociation in Large Language Models
von: Shigemura, Toshiyuki
Veröffentlicht: (2026)
von: Shigemura, Toshiyuki
Veröffentlicht: (2026)
Do Language Models Enjoy Their Own Stories? Prompting Large Language Models for Automatic Story Evaluation
von: Chhun, Cyril, et al.
Veröffentlicht: (2024)
von: Chhun, Cyril, et al.
Veröffentlicht: (2024)
LexInstructEval: Lexical Instruction Following Evaluation for Large Language Models
von: Ren, Huimin, et al.
Veröffentlicht: (2025)
von: Ren, Huimin, et al.
Veröffentlicht: (2025)
LIFBench: Evaluating the Instruction Following Performance and Stability of Large Language Models in Long-Context Scenarios
von: Wu, Xiaodong, et al.
Veröffentlicht: (2024)
von: Wu, Xiaodong, et al.
Veröffentlicht: (2024)
Investigating Test-Time Scaling with Reranking for Machine Translation
von: Tan, Shaomu, et al.
Veröffentlicht: (2025)
von: Tan, Shaomu, et al.
Veröffentlicht: (2025)
Evaluating Creative Short Story Generation in Humans and Large Language Models
von: Ismayilzada, Mete, et al.
Veröffentlicht: (2024)
von: Ismayilzada, Mete, et al.
Veröffentlicht: (2024)
Help Me Write a Story: Evaluating LLMs' Ability to Generate Writing Feedback
von: Rashkin, Hannah, et al.
Veröffentlicht: (2025)
von: Rashkin, Hannah, et al.
Veröffentlicht: (2025)
Distilling Instruction-following Abilities of Large Language Models with Task-aware Curriculum Planning
von: Yue, Yuanhao, et al.
Veröffentlicht: (2024)
von: Yue, Yuanhao, et al.
Veröffentlicht: (2024)
Eliciting the Translation Ability of Large Language Models via Multilingual Finetuning with Translation Instructions
von: Li, Jiahuan, et al.
Veröffentlicht: (2023)
von: Li, Jiahuan, et al.
Veröffentlicht: (2023)
ICLEval: Evaluating In-Context Learning Ability of Large Language Models
von: Chen, Wentong, et al.
Veröffentlicht: (2024)
von: Chen, Wentong, et al.
Veröffentlicht: (2024)
Can It Edit? Evaluating the Ability of Large Language Models to Follow Code Editing Instructions
von: Cassano, Federico, et al.
Veröffentlicht: (2023)
von: Cassano, Federico, et al.
Veröffentlicht: (2023)
Argument Quality Assessment in the Age of Instruction-Following Large Language Models
von: Wachsmuth, Henning, et al.
Veröffentlicht: (2024)
von: Wachsmuth, Henning, et al.
Veröffentlicht: (2024)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
von: Zou, Tao, et al.
Veröffentlicht: (2025)
von: Zou, Tao, et al.
Veröffentlicht: (2025)
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models
von: Sun, Yuchong, et al.
Veröffentlicht: (2023)
von: Sun, Yuchong, et al.
Veröffentlicht: (2023)
Large Language Model Instruction Following: A Survey of Progresses and Challenges
von: Lou, Renze, et al.
Veröffentlicht: (2023)
von: Lou, Renze, et al.
Veröffentlicht: (2023)
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
von: Zhu, Qin, et al.
Veröffentlicht: (2025)
von: Zhu, Qin, et al.
Veröffentlicht: (2025)
Evaluating the Ability of Large Language Models to Reason about Cardinal Directions
von: Cohn, Anthony G, et al.
Veröffentlicht: (2024)
von: Cohn, Anthony G, et al.
Veröffentlicht: (2024)
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
von: LI, Yizhi, et al.
Veröffentlicht: (2024)
von: LI, Yizhi, et al.
Veröffentlicht: (2024)
Crafting Narrative Closures: Zero-Shot Learning with SSM Mamba for Short Story Ending Generation
von: Sharma, Divyam, et al.
Veröffentlicht: (2024)
von: Sharma, Divyam, et al.
Veröffentlicht: (2024)
Step-by-Step Mastery: Enhancing Soft Constraint Following Ability of Large Language Models
von: Ren, Qingyu, et al.
Veröffentlicht: (2025)
von: Ren, Qingyu, et al.
Veröffentlicht: (2025)
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
von: Zeng, Bo, et al.
Veröffentlicht: (2025)
von: Zeng, Bo, et al.
Veröffentlicht: (2025)
Evaluating the Symbol Binding Ability of Large Language Models for Multiple-Choice Questions in Vietnamese General Education
von: Nguyen, Duc-Vu, et al.
Veröffentlicht: (2023)
von: Nguyen, Duc-Vu, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Social Bias Evaluation for Large Language Models Requires Prompt Variations
von: Hida, Rem, et al.
Veröffentlicht: (2024) -
InFoBench: Evaluating Instruction Following Ability in Large Language Models
von: Qin, Yiwei, et al.
Veröffentlicht: (2024) -
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
von: Kim, Dongjun, et al.
Veröffentlicht: (2025) -
Revisiting Compositional Generalization Capability of Large Language Models Considering Instruction Following Ability
von: Sakai, Yusuke, et al.
Veröffentlicht: (2025) -
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
von: Chen, Xinyi, et al.
Veröffentlicht: (2024)