DECOR: Improving Coherence in L2 English Writing with a Novel Benchmark for Incoherence Detection, Reasoning, and Rewriting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Xuanming, Diaz, Anthony, Chen, Zixun, Wu, Qingyang, Qian, Kun, Voss, Erik, Yu, Zhou |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ProLex: A Benchmark for Language Proficiency-oriented Lexical Substitution
par: Zhang, Xuanming, et autres
Publié: (2024)
par: Zhang, Xuanming, et autres
Publié: (2024)
VarBench: Robust Language Model Benchmarking Through Dynamic Variable Perturbation
par: Qian, Kun, et autres
Publié: (2024)
par: Qian, Kun, et autres
Publié: (2024)
Locally Coherent, Globally Incoherent: Bounding Compositional Incoherence in Multi-Component LLM Agents
par: Kotawala, Anany
Publié: (2026)
par: Kotawala, Anany
Publié: (2026)
DECOR: Auditing LLM Deception via Information Manipulation Theory
par: Cai, Linyue, et autres
Publié: (2026)
par: Cai, Linyue, et autres
Publié: (2026)
Socratic Reasoning Improves Positive Text Rewriting
par: Goel, Anmol, et autres
Publié: (2024)
par: Goel, Anmol, et autres
Publié: (2024)
Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers
par: Zhang, Tianhua, et autres
Publié: (2024)
par: Zhang, Tianhua, et autres
Publié: (2024)
Generalization or Memorization: Dynamic Decoding for Mode Steering
par: Zhang, Xuanming
Publié: (2025)
par: Zhang, Xuanming
Publié: (2025)
Dynamic Adaptive Attention and Supervised Contrastive Learning: A Novel Hybrid Framework for Text Sentiment Classification
par: Li, Qingyang
Publié: (2026)
par: Li, Qingyang
Publié: (2026)
Rewrite to Jailbreak: Discover Learnable and Transferable Implicit Harmfulness Instruction
par: Huang, Yuting, et autres
Publié: (2025)
par: Huang, Yuting, et autres
Publié: (2025)
LIONs: An Empirically Optimized Approach to Align Language Models
par: Yu, Xiao, et autres
Publié: (2024)
par: Yu, Xiao, et autres
Publié: (2024)
Cognition-of-Thought Elicits Social-Aligned Reasoning in Large Language Models
par: Zhang, Xuanming, et autres
Publié: (2025)
par: Zhang, Xuanming, et autres
Publié: (2025)
Discourse Coherence and Response-Guided Context Rewriting for Multi-Party Dialogue Generation
par: Cao, Zhiyu, et autres
Publié: (2026)
par: Cao, Zhiyu, et autres
Publié: (2026)
Who is the richest club in the championship? Detecting and Rewriting Underspecified Questions Improve QA Performance
par: Huang, Yunchong, et autres
Publié: (2026)
par: Huang, Yunchong, et autres
Publié: (2026)
Telegraph English: Semantic Prompt Compression via Structured Symbolic Rewriting
par: Arbuzov, Mikhail L., et autres
Publié: (2026)
par: Arbuzov, Mikhail L., et autres
Publié: (2026)
FEANEL: A Benchmark for Fine-Grained Error Analysis in K-12 English Writing
par: Ye, Jingheng, et autres
Publié: (2025)
par: Ye, Jingheng, et autres
Publié: (2025)
WritingBench: A Comprehensive Benchmark for Generative Writing
par: Wu, Yuning, et autres
Publié: (2025)
par: Wu, Yuning, et autres
Publié: (2025)
Incorporating Self-Rewriting into Large Language Model Reasoning Reinforcement
par: Yao, Jiashu, et autres
Publié: (2025)
par: Yao, Jiashu, et autres
Publié: (2025)
Budget-Aware Anytime Reasoning with LLM-Synthesized Preference Data
par: Zhang, Xuanming, et autres
Publié: (2026)
par: Zhang, Xuanming, et autres
Publié: (2026)
Learning to Rewrite Prompts for Bootstrapping LLMs on Downstream Tasks
par: Zhou, Qinhao, et autres
Publié: (2025)
par: Zhou, Qinhao, et autres
Publié: (2025)
Speak & Improve Corpus 2025: an L2 English Speech Corpus for Language Assessment and Feedback
par: Knill, Kate, et autres
Publié: (2024)
par: Knill, Kate, et autres
Publié: (2024)
BEnQA: A Question Answering and Reasoning Benchmark for Bengali and English
par: Shafayat, Sheikh, et autres
Publié: (2024)
par: Shafayat, Sheikh, et autres
Publié: (2024)
Small Language Models Improve Giants by Rewriting Their Outputs
par: Vernikos, Giorgos, et autres
Publié: (2023)
par: Vernikos, Giorgos, et autres
Publié: (2023)
Learning to Rewrite: Generalized LLM-Generated Text Detection
par: Li, Ran, et autres
Publié: (2024)
par: Li, Ran, et autres
Publié: (2024)
A Benchmark Dataset and a Framework for Urdu Multimodal Named Entity Recognition
par: Ahmad, Hussain, et autres
Publié: (2025)
par: Ahmad, Hussain, et autres
Publié: (2025)
Just Ask One More Time! Self-Agreement Improves Reasoning of Language Models in (Almost) All Scenarios
par: Lin, Lei, et autres
Publié: (2023)
par: Lin, Lei, et autres
Publié: (2023)
Probe-Rewrite-Evaluate: A Workflow for Reliable Benchmarks and Quantifying Evaluation Awareness
par: Xiong, Lang, et autres
Publié: (2025)
par: Xiong, Lang, et autres
Publié: (2025)
Automatic Input Rewriting Improves Translation with Large Language Models
par: Ki, Dayeon, et autres
Publié: (2025)
par: Ki, Dayeon, et autres
Publié: (2025)
Raidar: geneRative AI Detection viA Rewriting
par: Mao, Chengzhi, et autres
Publié: (2024)
par: Mao, Chengzhi, et autres
Publié: (2024)
R2-Write: Reflection and Revision for Open-Ended Writing with Deep Reasoning
par: Liu, Wanlong, et autres
Publié: (2026)
par: Liu, Wanlong, et autres
Publié: (2026)
Improve Student's Reasoning Generalizability through Cascading Decomposed CoTs Distillation
par: Dai, Chengwei, et autres
Publié: (2024)
par: Dai, Chengwei, et autres
Publié: (2024)
ARWI: Arabic Write and Improve
par: Chirkunov, Kirill, et autres
Publié: (2025)
par: Chirkunov, Kirill, et autres
Publié: (2025)
Incoherent Probability Judgments in Large Language Models
par: Zhu, Jian-Qiao, et autres
Publié: (2024)
par: Zhu, Jian-Qiao, et autres
Publié: (2024)
DARWIN: Dynamic Agentically Rewriting Self-Improving Network
par: Jiang, Henry
Publié: (2026)
par: Jiang, Henry
Publié: (2026)
LLMs can Perform Multi-Dimensional Analytic Writing Assessments: A Case Study of L2 Graduate-Level Academic English Writing
par: Wang, Zhengxiang, et autres
Publié: (2025)
par: Wang, Zhengxiang, et autres
Publié: (2025)
TTT-Bench: A Benchmark for Evaluating Reasoning Ability with Simple and Novel Tic-Tac-Toe-style Games
par: Mishra, Prakamya, et autres
Publié: (2025)
par: Mishra, Prakamya, et autres
Publié: (2025)
Bringing Pedagogy into Focus: Evaluating Virtual Teaching Assistants' Question-Answering in Asynchronous Learning Environments
par: Siyan, Li, et autres
Publié: (2025)
par: Siyan, Li, et autres
Publié: (2025)
DetectiveQA: Evaluating Long-Context Reasoning on Detective Novels
par: Xu, Zhe, et autres
Publié: (2024)
par: Xu, Zhe, et autres
Publié: (2024)
Benchmarking Temporal Reasoning and Alignment Across Chinese Dynasties
par: Wang, Zhenglin, et autres
Publié: (2025)
par: Wang, Zhenglin, et autres
Publié: (2025)
CHIQ: Contextual History Enhancement for Improving Query Rewriting in Conversational Search
par: Mo, Fengran, et autres
Publié: (2024)
par: Mo, Fengran, et autres
Publié: (2024)
Rewrite-to-Rank: Optimizing Ad Visibility via Retrieval-Aware Text Rewriting
par: Ho, Chloe, et autres
Publié: (2025)
par: Ho, Chloe, et autres
Publié: (2025)
Documents similaires
-
ProLex: A Benchmark for Language Proficiency-oriented Lexical Substitution
par: Zhang, Xuanming, et autres
Publié: (2024) -
VarBench: Robust Language Model Benchmarking Through Dynamic Variable Perturbation
par: Qian, Kun, et autres
Publié: (2024) -
Locally Coherent, Globally Incoherent: Bounding Compositional Incoherence in Multi-Component LLM Agents
par: Kotawala, Anany
Publié: (2026) -
DECOR: Auditing LLM Deception via Information Manipulation Theory
par: Cai, Linyue, et autres
Publié: (2026) -
Socratic Reasoning Improves Positive Text Rewriting
par: Goel, Anmol, et autres
Publié: (2024)