Decision-Making with Deliberation: Meta-reviewing as a Document-grounded Dialogue
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Purkayastha, Sukannya, Dycke, Nils, Lauscher, Anne, Gurevych, Iryna |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LazyReview A Dataset for Uncovering Lazy Thinking in NLP Peer Reviews
par: Purkayastha, Sukannya, et autres
Publié: (2025)
par: Purkayastha, Sukannya, et autres
Publié: (2025)
Reviewing the Reviewer: Elevating Peer Review Quality through LLM-Guided Feedback
par: Purkayastha, Sukannya, et autres
Publié: (2026)
par: Purkayastha, Sukannya, et autres
Publié: (2026)
Automatic Reviewers Fail to Detect Faulty Reasoning in Research Papers: A New Counterfactual Evaluation Framework
par: Dycke, Nils, et autres
Publié: (2025)
par: Dycke, Nils, et autres
Publié: (2025)
The Lou Dataset -- Exploring the Impact of Gender-Fair Language in German Text Classification
par: Waldis, Andreas, et autres
Publié: (2024)
par: Waldis, Andreas, et autres
Publié: (2024)
STRICTA: Structured Reasoning in Critical Text Assessment for Peer Review and Beyond
par: Dycke, Nils, et autres
Publié: (2024)
par: Dycke, Nils, et autres
Publié: (2024)
Sensitivity, Performance, Robustness: Deconstructing the Effect of Sociodemographic Prompting
par: Beck, Tilman, et autres
Publié: (2023)
par: Beck, Tilman, et autres
Publié: (2023)
Aligned Probing: Relating Toxic Behavior and Model Internals
par: Waldis, Andreas, et autres
Publié: (2025)
par: Waldis, Andreas, et autres
Publié: (2025)
DAPR: A Benchmark on Document-Aware Passage Retrieval
par: Wang, Kexin, et autres
Publié: (2023)
par: Wang, Kexin, et autres
Publié: (2023)
Learning from Implicit User Feedback, Emotions and Demographic Information in Task-Oriented and Document-Grounded Dialogues
par: Petrak, Dominic, et autres
Publié: (2024)
par: Petrak, Dominic, et autres
Publié: (2024)
Common Sense vs. Morality: The Curious Case of Narrative Focus Bias in LLMs
par: Purkayastha, Saugata, et autres
Publié: (2026)
par: Purkayastha, Saugata, et autres
Publié: (2026)
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
par: Paul, Indraneil, et autres
Publié: (2024)
par: Paul, Indraneil, et autres
Publié: (2024)
Attribute or Abstain: Large Language Models as Long Document Assistants
par: Buchmann, Jan, et autres
Publié: (2024)
par: Buchmann, Jan, et autres
Publié: (2024)
Re3: A Holistic Framework and Dataset for Modeling Collaborative Document Revision
par: Ruan, Qian, et autres
Publié: (2024)
par: Ruan, Qian, et autres
Publié: (2024)
Like a Good Nearest Neighbor: Practical Content Moderation and Text Classification
par: Bates, Luke, et autres
Publié: (2023)
par: Bates, Luke, et autres
Publié: (2023)
Are Large Language Models Good Classifiers? A Study on Edit Intent Classification in Scientific Document Revisions
par: Ruan, Qian, et autres
Publié: (2024)
par: Ruan, Qian, et autres
Publié: (2024)
GRITHopper: Decomposition-Free Multi-Hop Dense Retrieval
par: Erker, Justus-Jonas, et autres
Publié: (2025)
par: Erker, Justus-Jonas, et autres
Publié: (2025)
Citation Failure: Definition, Analysis and Efficient Mitigation
par: Buchmann, Jan, et autres
Publié: (2025)
par: Buchmann, Jan, et autres
Publié: (2025)
IDALC: A Semi-Supervised Framework for Intent Detection and Active Learning based Correction
par: Mullick, Ankan, et autres
Publié: (2025)
par: Mullick, Ankan, et autres
Publié: (2025)
SciCoQA: Quality Assurance for Scientific Paper--Code Alignment
par: Baumgärtner, Tim, et autres
Publié: (2026)
par: Baumgärtner, Tim, et autres
Publié: (2026)
Document Structure in Long Document Transformers
par: Buchmann, Jan, et autres
Publié: (2024)
par: Buchmann, Jan, et autres
Publié: (2024)
M4FC: a Multimodal, Multilingual, Multicultural, Multitask Real-World Fact-Checking Dataset
par: Geng, Jiahui, et autres
Publié: (2025)
par: Geng, Jiahui, et autres
Publié: (2025)
Commitment Checklist: Auditing Author Commitments in Peer Review
par: Chen, Chung-Chi, et autres
Publié: (2026)
par: Chen, Chung-Chi, et autres
Publié: (2026)
Identifying Aspects in Peer Reviews
par: Lu, Sheng, et autres
Publié: (2025)
par: Lu, Sheng, et autres
Publié: (2025)
Token Weighting for Long-Range Language Modeling
par: Helm, Falko, et autres
Publié: (2025)
par: Helm, Falko, et autres
Publié: (2025)
COVE: COntext and VEracity prediction for out-of-context images
par: Tonglet, Jonathan, et autres
Publié: (2025)
par: Tonglet, Jonathan, et autres
Publié: (2025)
Turning Logic Against Itself : Probing Model Defenses Through Contrastive Questions
par: Sachdeva, Rachneet, et autres
Publié: (2025)
par: Sachdeva, Rachneet, et autres
Publié: (2025)
Expert Preference-based Evaluation of Automated Related Work Generation
par: Şahinuç, Furkan, et autres
Publié: (2025)
par: Şahinuç, Furkan, et autres
Publié: (2025)
How to Handle Different Types of Out-of-Distribution Scenarios in Computational Argumentation? A Comprehensive and Fine-Grained Field Study
par: Waldis, Andreas, et autres
Publié: (2023)
par: Waldis, Andreas, et autres
Publié: (2023)
Robust Utility-Preserving Text Anonymization Based on Large Language Models
par: Yang, Tianyu, et autres
Publié: (2024)
par: Yang, Tianyu, et autres
Publié: (2024)
Dive into the Chasm: Probing the Gap between In- and Cross-Topic Generalization
par: Waldis, Andreas, et autres
Publié: (2024)
par: Waldis, Andreas, et autres
Publié: (2024)
DARA: Decomposition-Alignment-Reasoning Autonomous Language Agent for Question Answering over Knowledge Graphs
par: Fang, Haishuo, et autres
Publié: (2024)
par: Fang, Haishuo, et autres
Publié: (2024)
Overview of PerpectiveArg2024: The First Shared Task on Perspective Argument Retrieval
par: Falk, Neele, et autres
Publié: (2024)
par: Falk, Neele, et autres
Publié: (2024)
LLM Roleplay: Simulating Human-Chatbot Interaction
par: Tamoyan, Hovhannes, et autres
Publié: (2024)
par: Tamoyan, Hovhannes, et autres
Publié: (2024)
CATfOOD: Counterfactual Augmented Training for Improving Out-of-Domain Performance and Calibration
par: Sachdeva, Rachneet, et autres
Publié: (2023)
par: Sachdeva, Rachneet, et autres
Publié: (2023)
How are Prompts Different in Terms of Sensitivity?
par: Lu, Sheng, et autres
Publié: (2023)
par: Lu, Sheng, et autres
Publié: (2023)
Reward Modeling for Scientific Writing Evaluation
par: Şahinuç, Furkan, et autres
Publié: (2026)
par: Şahinuç, Furkan, et autres
Publié: (2026)
Triple-Encoders: Representations That Fire Together, Wire Together
par: Erker, Justus-Jonas, et autres
Publié: (2024)
par: Erker, Justus-Jonas, et autres
Publié: (2024)
Culturally Aware and Adapted NLP: A Taxonomy and a Survey of the State of the Art
par: Liu, Chen Cecilia, et autres
Publié: (2024)
par: Liu, Chen Cecilia, et autres
Publié: (2024)
ABCD-LINK: Annotation Bootstrapping for Cross-Document Fine-Grained Links
par: Basch, Serwar, et autres
Publié: (2025)
par: Basch, Serwar, et autres
Publié: (2025)
The Inherent Limits of Pretrained LLMs: The Unexpected Convergence of Instruction Tuning and In-Context Learning Capabilities
par: Bigoulaeva, Irina, et autres
Publié: (2025)
par: Bigoulaeva, Irina, et autres
Publié: (2025)
Documents similaires
-
LazyReview A Dataset for Uncovering Lazy Thinking in NLP Peer Reviews
par: Purkayastha, Sukannya, et autres
Publié: (2025) -
Reviewing the Reviewer: Elevating Peer Review Quality through LLM-Guided Feedback
par: Purkayastha, Sukannya, et autres
Publié: (2026) -
Automatic Reviewers Fail to Detect Faulty Reasoning in Research Papers: A New Counterfactual Evaluation Framework
par: Dycke, Nils, et autres
Publié: (2025) -
The Lou Dataset -- Exploring the Impact of Gender-Fair Language in German Text Classification
par: Waldis, Andreas, et autres
Publié: (2024) -
STRICTA: Structured Reasoning in Critical Text Assessment for Peer Review and Beyond
par: Dycke, Nils, et autres
Publié: (2024)