Reviewing the Reviewer: Elevating Peer Review Quality through LLM-Guided Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Purkayastha, Sukannya, Wan, Qile, Lauscher, Anne, Qu, Lizhen, Gurevych, Iryna |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LazyReview A Dataset for Uncovering Lazy Thinking in NLP Peer Reviews
par: Purkayastha, Sukannya, et autres
Publié: (2025)
par: Purkayastha, Sukannya, et autres
Publié: (2025)
Decision-Making with Deliberation: Meta-reviewing as a Document-grounded Dialogue
par: Purkayastha, Sukannya, et autres
Publié: (2025)
par: Purkayastha, Sukannya, et autres
Publié: (2025)
Commitment Checklist: Auditing Author Commitments in Peer Review
par: Chen, Chung-Chi, et autres
Publié: (2026)
par: Chen, Chung-Chi, et autres
Publié: (2026)
The Good, the Bad and the Constructive: Automatically Measuring Peer Review's Utility for Authors
par: Sadallah, Abdelrahman, et autres
Publié: (2025)
par: Sadallah, Abdelrahman, et autres
Publié: (2025)
Is Peer Review Really in Decline? Analyzing Review Quality across Venues and Time
par: Kuznetsov, Ilia, et autres
Publié: (2026)
par: Kuznetsov, Ilia, et autres
Publié: (2026)
Identifying Aspects in Peer Reviews
par: Lu, Sheng, et autres
Publié: (2025)
par: Lu, Sheng, et autres
Publié: (2025)
PeerQA: A Scientific Question Answering Dataset from Peer Reviews
par: Baumgärtner, Tim, et autres
Publié: (2025)
par: Baumgärtner, Tim, et autres
Publié: (2025)
The Lou Dataset -- Exploring the Impact of Gender-Fair Language in German Text Classification
par: Waldis, Andreas, et autres
Publié: (2024)
par: Waldis, Andreas, et autres
Publié: (2024)
Decoding Multilingual Moral Preferences: Unveiling LLM's Biases Through the Moral Machine Experiment
par: Vida, Karina, et autres
Publié: (2024)
par: Vida, Karina, et autres
Publié: (2024)
Sensitivity, Performance, Robustness: Deconstructing the Effect of Sociodemographic Prompting
par: Beck, Tilman, et autres
Publié: (2023)
par: Beck, Tilman, et autres
Publié: (2023)
STRICTA: Structured Reasoning in Critical Text Assessment for Peer Review and Beyond
par: Dycke, Nils, et autres
Publié: (2024)
par: Dycke, Nils, et autres
Publié: (2024)
What Can Natural Language Processing Do for Peer Review?
par: Kuznetsov, Ilia, et autres
Publié: (2024)
par: Kuznetsov, Ilia, et autres
Publié: (2024)
Position on LLM-Assisted Peer Review: Addressing Reviewer Gap through Mentoring and Feedback
par: Yun, JungMin, et autres
Publié: (2026)
par: Yun, JungMin, et autres
Publié: (2026)
Automatic Reviewers Fail to Detect Faulty Reasoning in Research Papers: A New Counterfactual Evaluation Framework
par: Dycke, Nils, et autres
Publié: (2025)
par: Dycke, Nils, et autres
Publié: (2025)
Aligned Probing: Relating Toxic Behavior and Model Internals
par: Waldis, Andreas, et autres
Publié: (2025)
par: Waldis, Andreas, et autres
Publié: (2025)
Policies Permitting LLM Use for Polishing Peer Reviews Are Currently Not Enforceable
par: Saha, Rounak, et autres
Publié: (2026)
par: Saha, Rounak, et autres
Publié: (2026)
DeepReviewer 2.0: A Traceable Agentic System for Auditable Scientific Peer Review
par: Weng, Yixuan, et autres
Publié: (2026)
par: Weng, Yixuan, et autres
Publié: (2026)
Exposía: Teaching and Assessment of Academic Writing Skills for Research Project Proposals and Peer Feedback
par: Zyska, Dennis, et autres
Publié: (2026)
par: Zyska, Dennis, et autres
Publié: (2026)
Benchmark on Peer Review Toxic Detection: A Challenging Task with a New Dataset
par: Luo, Man, et autres
Publié: (2025)
par: Luo, Man, et autres
Publié: (2025)
Local Contrastive Editing of Gender Stereotypes
par: Lutz, Marlene, et autres
Publié: (2024)
par: Lutz, Marlene, et autres
Publié: (2024)
Hidden Prompts in Manuscripts Exploit AI-Assisted Peer Review
par: Lin, Zhicheng
Publié: (2025)
par: Lin, Zhicheng
Publié: (2025)
Robust Pronoun Fidelity with English LLMs: Are they Reasoning, Repeating, or Just Biased?
par: Gautam, Vagrant, et autres
Publié: (2024)
par: Gautam, Vagrant, et autres
Publié: (2024)
Stop! In the Name of Flaws: Disentangling Personal Names and Sociodemographic Attributes in NLP
par: Gautam, Vagrant, et autres
Publié: (2024)
par: Gautam, Vagrant, et autres
Publié: (2024)
Common Sense vs. Morality: The Curious Case of Narrative Focus Bias in LLMs
par: Purkayastha, Saugata, et autres
Publié: (2026)
par: Purkayastha, Saugata, et autres
Publié: (2026)
LLM-Generated or Human-Written? Comparing Review and Non-Review Papers on ArXiv
par: Elazar, Yanai, et autres
Publié: (2026)
par: Elazar, Yanai, et autres
Publié: (2026)
LLM-as-a-Reviewer: Benchmarking Their Ability, Divergence, and Prompt Injection Resistance as Paper Reviewers
par: Li, Lingyao, et autres
Publié: (2026)
par: Li, Lingyao, et autres
Publié: (2026)
Beyond "Not Novel Enough": Enriching Scholarly Critique with LLM-Assisted Feedback
par: Afzal, Osama Mohammed, et autres
Publié: (2025)
par: Afzal, Osama Mohammed, et autres
Publié: (2025)
LLM Review: Enhancing Creative Writing via Blind Peer Review Feedback
par: Li, Weiyue, et autres
Publié: (2026)
par: Li, Weiyue, et autres
Publié: (2026)
Position: The AI Conference Peer Review Crisis Demands Author Feedback and Reviewer Rewards
par: Kim, Jaeho, et autres
Publié: (2025)
par: Kim, Jaeho, et autres
Publié: (2025)
SciCoQA: Quality Assurance for Scientific Paper--Code Alignment
par: Baumgärtner, Tim, et autres
Publié: (2026)
par: Baumgärtner, Tim, et autres
Publié: (2026)
AgentReview: Exploring Peer Review Dynamics with LLM Agents
par: Jin, Yiqiao, et autres
Publié: (2024)
par: Jin, Yiqiao, et autres
Publié: (2024)
Understanding the LLM-ification of CHI: Unpacking the Impact of LLMs at CHI through a Systematic Literature Review
par: Pang, Rock Yuren, et autres
Publié: (2025)
par: Pang, Rock Yuren, et autres
Publié: (2025)
A Scoping Review of LLM-as-a-Judge in Healthcare and the MedJUDGE Framework
par: Li, Chenyu, et autres
Publié: (2026)
par: Li, Chenyu, et autres
Publié: (2026)
LLM Roleplay: Simulating Human-Chatbot Interaction
par: Tamoyan, Hovhannes, et autres
Publié: (2024)
par: Tamoyan, Hovhannes, et autres
Publié: (2024)
A Comprehensive Review of Datasets for Clinical Mental Health AI Systems
par: Mandal, Aishik, et autres
Publié: (2025)
par: Mandal, Aishik, et autres
Publié: (2025)
Ethical Concern Identification in NLP: A Corpus of ACL Anthology Ethics Statements
par: Karamolegkou, Antonia, et autres
Publié: (2024)
par: Karamolegkou, Antonia, et autres
Publié: (2024)
When Your Reviewer is an LLM: Biases, Divergence, and Prompt Injection Risks in Peer Review
par: Zhu, Changjia, et autres
Publié: (2025)
par: Zhu, Changjia, et autres
Publié: (2025)
Learning from Implicit User Feedback, Emotions and Demographic Information in Task-Oriented and Document-Grounded Dialogues
par: Petrak, Dominic, et autres
Publié: (2024)
par: Petrak, Dominic, et autres
Publié: (2024)
Computational Studies in Influencer Marketing: A Systematic Literature Review
par: Gui, Haoyang, et autres
Publié: (2025)
par: Gui, Haoyang, et autres
Publié: (2025)
Optimizing Peer Grading: A Systematic Literature Review of Reviewer Assignment Strategies and Quantity of Reviewers
par: Paul, Uchswas, et autres
Publié: (2025)
par: Paul, Uchswas, et autres
Publié: (2025)
Documents similaires
-
LazyReview A Dataset for Uncovering Lazy Thinking in NLP Peer Reviews
par: Purkayastha, Sukannya, et autres
Publié: (2025) -
Decision-Making with Deliberation: Meta-reviewing as a Document-grounded Dialogue
par: Purkayastha, Sukannya, et autres
Publié: (2025) -
Commitment Checklist: Auditing Author Commitments in Peer Review
par: Chen, Chung-Chi, et autres
Publié: (2026) -
The Good, the Bad and the Constructive: Automatically Measuring Peer Review's Utility for Authors
par: Sadallah, Abdelrahman, et autres
Publié: (2025) -
Is Peer Review Really in Decline? Analyzing Review Quality across Venues and Time
par: Kuznetsov, Ilia, et autres
Publié: (2026)