StoryAlign: Evaluating and Training Reward Models for Story Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Xia, Haotian, Peng, Hao, Qi, Yunjia, Wang, Xiaozhi, Xu, Bin, Hou, Lei, Li, Juanzi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
StoryWriter: A Multi-Agent Framework for Long Story Generation
por: Xia, Haotian, et al.
Publicado: (2025)
por: Xia, Haotian, et al.
Publicado: (2025)
Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems
por: Peng, Hao, et al.
Publicado: (2025)
por: Peng, Hao, et al.
Publicado: (2025)
WildReward: Learning Reward Models from In-the-Wild Human Interactions
por: Peng, Hao, et al.
Publicado: (2026)
por: Peng, Hao, et al.
Publicado: (2026)
Constraint Back-translation Improves Complex Instruction Following of Large Language Models
por: Qi, Yunjia, et al.
Publicado: (2024)
por: Qi, Yunjia, et al.
Publicado: (2024)
VerIF: Verification Engineering for Reinforcement Learning in Instruction Following
por: Peng, Hao, et al.
Publicado: (2025)
por: Peng, Hao, et al.
Publicado: (2025)
AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios
por: Qi, Yunjia, et al.
Publicado: (2025)
por: Qi, Yunjia, et al.
Publicado: (2025)
ADELIE: Aligning Large Language Models on Information Extraction
por: Qi, Yunjia, et al.
Publicado: (2024)
por: Qi, Yunjia, et al.
Publicado: (2024)
ChatLog: Carefully Evaluating the Evolution of ChatGPT Across Time
por: Tu, Shangqing, et al.
Publicado: (2023)
por: Tu, Shangqing, et al.
Publicado: (2023)
EvolvR: Self-Evolving Pairwise Reasoning for Story Evaluation to Enhance Generation
por: Wang, Xinda, et al.
Publicado: (2025)
por: Wang, Xinda, et al.
Publicado: (2025)
MAVEN-Fact: A Large-scale Event Factuality Detection Dataset
por: Li, Chunyang, et al.
Publicado: (2024)
por: Li, Chunyang, et al.
Publicado: (2024)
Event-level Knowledge Editing
por: Peng, Hao, et al.
Publicado: (2024)
por: Peng, Hao, et al.
Publicado: (2024)
Preserving Knowledge Invariance: Rethinking Robustness Evaluation of Open Information Extraction
por: Qi, Ji, et al.
Publicado: (2023)
por: Qi, Ji, et al.
Publicado: (2023)
StoryLens: Preference-Aligned Story Rewriting via Context-Aware Narrative Enrichment
por: Cui, Hanwen, et al.
Publicado: (2026)
por: Cui, Hanwen, et al.
Publicado: (2026)
MRCEval: A Comprehensive, Challenging and Accessible Machine Reading Comprehension Benchmark
por: Ma, Shengkun, et al.
Publicado: (2025)
por: Ma, Shengkun, et al.
Publicado: (2025)
Lost in Stories: Consistency Bugs in Long Story Generation by LLMs
por: Li, Junjie, et al.
Publicado: (2026)
por: Li, Junjie, et al.
Publicado: (2026)
R-Eval: A Unified Toolkit for Evaluating Domain Knowledge of Retrieval Augmented Large Language Models
por: Tu, Shangqing, et al.
Publicado: (2024)
por: Tu, Shangqing, et al.
Publicado: (2024)
Towards Understanding Safety Alignment: A Mechanistic Perspective from Safety Neurons
por: Chen, Jianhui, et al.
Publicado: (2024)
por: Chen, Jianhui, et al.
Publicado: (2024)
TacoERE: Cluster-aware Compression for Event Relation Extraction
por: Guan, Yong, et al.
Publicado: (2024)
por: Guan, Yong, et al.
Publicado: (2024)
Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
por: Jing, Yi, et al.
Publicado: (2026)
por: Jing, Yi, et al.
Publicado: (2026)
Retell, Reward, Repeat: Reinforcement Learning for Narrative Theory-Informed Story Generation
por: Liu, David Y., et al.
Publicado: (2026)
por: Liu, David Y., et al.
Publicado: (2026)
Story2MIDI: Emotionally Aligned Music Generation from Text
por: Shokri, Mohammad, et al.
Publicado: (2025)
por: Shokri, Mohammad, et al.
Publicado: (2025)
On the Paradoxical Interference between Instruction-Following and Task Solving
por: Qi, Yunjia, et al.
Publicado: (2026)
por: Qi, Yunjia, et al.
Publicado: (2026)
CollabStory: Multi-LLM Collaborative Story Generation and Authorship Analysis
por: Venkatraman, Saranya, et al.
Publicado: (2024)
por: Venkatraman, Saranya, et al.
Publicado: (2024)
Evaluating Creative Short Story Generation in Humans and Large Language Models
por: Ismayilzada, Mete, et al.
Publicado: (2024)
por: Ismayilzada, Mete, et al.
Publicado: (2024)
Rewarding Creativity: A Human-Aligned Generative Reward Model for Reinforcement Learning in Storytelling
por: Li, Zhaoyan, et al.
Publicado: (2026)
por: Li, Zhaoyan, et al.
Publicado: (2026)
STORYSUMM: Evaluating Faithfulness in Story Summarization
por: Subbiah, Melanie, et al.
Publicado: (2024)
por: Subbiah, Melanie, et al.
Publicado: (2024)
Arabic Automatic Story Generation with Large Language Models
por: El-Shangiti, Ahmed Oumar, et al.
Publicado: (2024)
por: El-Shangiti, Ahmed Oumar, et al.
Publicado: (2024)
Collective Critics for Creative Story Generation
por: Bae, Minwook, et al.
Publicado: (2024)
por: Bae, Minwook, et al.
Publicado: (2024)
WaterBench: Towards Holistic Evaluation of Watermarks for Large Language Models
por: Tu, Shangqing, et al.
Publicado: (2023)
por: Tu, Shangqing, et al.
Publicado: (2023)
LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks
por: Bai, Yushi, et al.
Publicado: (2024)
por: Bai, Yushi, et al.
Publicado: (2024)
Pre-training Distillation for Large Language Models: A Design Space Exploration
por: Peng, Hao, et al.
Publicado: (2024)
por: Peng, Hao, et al.
Publicado: (2024)
Event GDR: Event-Centric Generative Document Retrieval
por: Guan, Yong, et al.
Publicado: (2024)
por: Guan, Yong, et al.
Publicado: (2024)
Affective and Dynamic Beam Search for Story Generation
por: Huang, Tenghao, et al.
Publicado: (2023)
por: Huang, Tenghao, et al.
Publicado: (2023)
Generating Visual Stories with Grounded and Coreferent Characters
por: Liu, Danyang, et al.
Publicado: (2024)
por: Liu, Danyang, et al.
Publicado: (2024)
Multiverse of Greatness: Generating Story Branches with LLMs
por: Taveekitworachai, Pittawat, et al.
Publicado: (2024)
por: Taveekitworachai, Pittawat, et al.
Publicado: (2024)
Parameterized Synthetic Text Generation with SimpleStories
por: Finke, Lennart, et al.
Publicado: (2025)
por: Finke, Lennart, et al.
Publicado: (2025)
Boundary-Guided Policy Optimization for Memory-efficient RL of Diffusion Large Language Models
por: Lin, Nianyi, et al.
Publicado: (2025)
por: Lin, Nianyi, et al.
Publicado: (2025)
Avoidance Decoding for Diverse Multi-Branch Story Generation
por: Park, Kyeongman, et al.
Publicado: (2025)
por: Park, Kyeongman, et al.
Publicado: (2025)
S^2tory: Story Spine Distillation for Movie Script Summarization
por: Lu, Mingzhe, et al.
Publicado: (2026)
por: Lu, Mingzhe, et al.
Publicado: (2026)
Hallucination or Creativity: How to Evaluate AI-Generated Scientific Stories?
por: Argese, Alex, et al.
Publicado: (2026)
por: Argese, Alex, et al.
Publicado: (2026)
Ejemplares similares
-
StoryWriter: A Multi-Agent Framework for Long Story Generation
por: Xia, Haotian, et al.
Publicado: (2025) -
Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems
por: Peng, Hao, et al.
Publicado: (2025) -
WildReward: Learning Reward Models from In-the-Wild Human Interactions
por: Peng, Hao, et al.
Publicado: (2026) -
Constraint Back-translation Improves Complex Instruction Following of Large Language Models
por: Qi, Yunjia, et al.
Publicado: (2024) -
VerIF: Verification Engineering for Reinforcement Learning in Instruction Following
por: Peng, Hao, et al.
Publicado: (2025)