REM-CTX: Automated Peer Review via Reinforcement Learning with Auxiliary Context
Fuente:
arXiv
Guardado en:
| Autores principales: | Taechoyotin, Pawin, Acuna, Daniel E. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
REMOR: Automated Peer Review Generation with LLM Reasoning and Multi-Objective Reinforcement Learning
por: Taechoyotin, Pawin, et al.
Publicado: (2025)
por: Taechoyotin, Pawin, et al.
Publicado: (2025)
miniCTX: Neural Theorem Proving with (Long-)Contexts
por: Hu, Jiewen, et al.
Publicado: (2024)
por: Hu, Jiewen, et al.
Publicado: (2024)
Is Peer-Reviewing Worth the Effort?
por: Church, Kenneth, et al.
Publicado: (2024)
por: Church, Kenneth, et al.
Publicado: (2024)
Demonstration Selection for In-Context Learning via Reinforcement Learning
por: Wang, Xubin, et al.
Publicado: (2024)
por: Wang, Xubin, et al.
Publicado: (2024)
Breaking the Reviewer: Assessing the Vulnerability of Large Language Models in Automated Peer Review Under Textual Adversarial Attacks
por: Lin, Tzu-Ling, et al.
Publicado: (2025)
por: Lin, Tzu-Ling, et al.
Publicado: (2025)
EchoReview: Learning Peer Review from the Echoes of Scientific Citations
por: Zhang, Yinuo, et al.
Publicado: (2026)
por: Zhang, Yinuo, et al.
Publicado: (2026)
Can AI Be a Good Peer Reviewer? A Survey of Peer Review Process, Evaluation, and the Future
por: Wu, Sihong, et al.
Publicado: (2026)
por: Wu, Sihong, et al.
Publicado: (2026)
Paraphrase Identification with Deep Learning: A Review of Datasets and Methods
por: Zhou, Chao, et al.
Publicado: (2022)
por: Zhou, Chao, et al.
Publicado: (2022)
Peer Review as A Multi-Turn and Long-Context Dialogue with Role-Based Interactions
por: Tan, Cheng, et al.
Publicado: (2024)
por: Tan, Cheng, et al.
Publicado: (2024)
PRAIB: Peer Review AI Benchmark of Behaviour of LLM-Assisted Reviewing
por: Żurawicki, Krzysztof, et al.
Publicado: (2026)
por: Żurawicki, Krzysztof, et al.
Publicado: (2026)
Learning from Committee: Reasoning Distillation from a Mixture of Teachers with Peer-Review
por: Li, Zhuochun, et al.
Publicado: (2024)
por: Li, Zhuochun, et al.
Publicado: (2024)
When Reviews Disagree: Fine-Grained Contradiction Analysis in Scientific Peer Reviews
por: Kumar, Sandeep, et al.
Publicado: (2026)
por: Kumar, Sandeep, et al.
Publicado: (2026)
LLM Review: Enhancing Creative Writing via Blind Peer Review Feedback
por: Li, Weiyue, et al.
Publicado: (2026)
por: Li, Weiyue, et al.
Publicado: (2026)
Dynamic Long Context Reasoning over Compressed Memory via End-to-End Reinforcement Learning
por: Chen, Zhuoen, et al.
Publicado: (2026)
por: Chen, Zhuoen, et al.
Publicado: (2026)
Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-Review Process
por: Chen, Zhijun, et al.
Publicado: (2025)
por: Chen, Zhijun, et al.
Publicado: (2025)
Is Your Paper Being Reviewed by an LLM? Benchmarking AI Text Detection in Peer Review
por: Yu, Sungduk, et al.
Publicado: (2025)
por: Yu, Sungduk, et al.
Publicado: (2025)
Is Your Paper Being Reviewed by an LLM? Investigating AI Text Detectability in Peer Review
por: Yu, Sungduk, et al.
Publicado: (2024)
por: Yu, Sungduk, et al.
Publicado: (2024)
AutoForge: Automated Environment Synthesis for Agentic Reinforcement Learning
por: Cai, Shihao, et al.
Publicado: (2025)
por: Cai, Shihao, et al.
Publicado: (2025)
ReviewerToo: Should AI Join The Program Committee? A Look At The Future of Peer Review
por: Sahu, Gaurav, et al.
Publicado: (2025)
por: Sahu, Gaurav, et al.
Publicado: (2025)
PeerQA: A Scientific Question Answering Dataset from Peer Reviews
por: Baumgärtner, Tim, et al.
Publicado: (2025)
por: Baumgärtner, Tim, et al.
Publicado: (2025)
Optimizing In-Context Demonstrations for LLM-based Automated Grading
por: Chu, Yucheng, et al.
Publicado: (2026)
por: Chu, Yucheng, et al.
Publicado: (2026)
DeepReviewer 2.0: A Traceable Agentic System for Auditable Scientific Peer Review
por: Weng, Yixuan, et al.
Publicado: (2026)
por: Weng, Yixuan, et al.
Publicado: (2026)
The Good, the Bad and the Constructive: Automatically Measuring Peer Review's Utility for Authors
por: Sadallah, Abdelrahman, et al.
Publicado: (2025)
por: Sadallah, Abdelrahman, et al.
Publicado: (2025)
Using Large Language Models to Automate and Expedite Reinforcement Learning with Reward Machine
por: Alsadat, Shayan Meshkat, et al.
Publicado: (2024)
por: Alsadat, Shayan Meshkat, et al.
Publicado: (2024)
ReviewRL: Towards Automated Scientific Review with RL
por: Zeng, Sihang, et al.
Publicado: (2025)
por: Zeng, Sihang, et al.
Publicado: (2025)
ReMIND: Orchestrating Modular Large Language Models for Controllable Serendipity A REM-Inspired System Design for Emergent Creative Ideation
por: Sato, Makoto
Publicado: (2026)
por: Sato, Makoto
Publicado: (2026)
CTRL-RAG: Contrastive Likelihood Reward Based Reinforcement Learning for Context-Faithful RAG Models
por: Tan, Zhehao, et al.
Publicado: (2026)
por: Tan, Zhehao, et al.
Publicado: (2026)
CycleResearcher: Improving Automated Research via Automated Review
por: Weng, Yixuan, et al.
Publicado: (2024)
por: Weng, Yixuan, et al.
Publicado: (2024)
Learning Approximate and Exact Numeral Systems via Reinforcement Learning
por: Carlsson, Emil, et al.
Publicado: (2021)
por: Carlsson, Emil, et al.
Publicado: (2021)
Reinforced Context Order Recovery for Adaptive Reasoning and Planning
por: Ma, Long, et al.
Publicado: (2025)
por: Ma, Long, et al.
Publicado: (2025)
PiCO: Peer Review in LLMs based on the Consistency Optimization
por: Ning, Kun-Peng, et al.
Publicado: (2024)
por: Ning, Kun-Peng, et al.
Publicado: (2024)
EngramaBench: Evaluating Long-Term Conversational Memory with Structured Graph Retrieval
por: Acuna, Julian
Publicado: (2026)
por: Acuna, Julian
Publicado: (2026)
Auxiliary task demands mask the capabilities of smaller language models
por: Hu, Jennifer, et al.
Publicado: (2024)
por: Hu, Jennifer, et al.
Publicado: (2024)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
por: Chen, Mingyang, et al.
Publicado: (2025)
por: Chen, Mingyang, et al.
Publicado: (2025)
Improving Aviation Safety Analysis: Automated HFACS Classification Using Reinforcement Learning with Group Relative Policy Optimization
por: Ahmadi, Arash, et al.
Publicado: (2025)
por: Ahmadi, Arash, et al.
Publicado: (2025)
Fewer is More: Boosting LLM Reasoning with Reinforced Context Pruning
por: Huang, Xijie, et al.
Publicado: (2023)
por: Huang, Xijie, et al.
Publicado: (2023)
Hit-RAG: Learning to Reason with Long Contexts via Preference Alignment
por: Liu, Junming, et al.
Publicado: (2026)
por: Liu, Junming, et al.
Publicado: (2026)
RetICL: Sequential Retrieval of In-Context Examples with Reinforcement Learning
por: Scarlatos, Alexander, et al.
Publicado: (2023)
por: Scarlatos, Alexander, et al.
Publicado: (2023)
CoCoNUTS: Concentrating on Content while Neglecting Uninformative Textual Styles for AI-Generated Peer Review Detection
por: Chen, Yihan, et al.
Publicado: (2025)
por: Chen, Yihan, et al.
Publicado: (2025)
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
por: Wang, Jiaan, et al.
Publicado: (2025)
por: Wang, Jiaan, et al.
Publicado: (2025)
Ejemplares similares
-
REMOR: Automated Peer Review Generation with LLM Reasoning and Multi-Objective Reinforcement Learning
por: Taechoyotin, Pawin, et al.
Publicado: (2025) -
miniCTX: Neural Theorem Proving with (Long-)Contexts
por: Hu, Jiewen, et al.
Publicado: (2024) -
Is Peer-Reviewing Worth the Effort?
por: Church, Kenneth, et al.
Publicado: (2024) -
Demonstration Selection for In-Context Learning via Reinforcement Learning
por: Wang, Xubin, et al.
Publicado: (2024) -
Breaking the Reviewer: Assessing the Vulnerability of Large Language Models in Automated Peer Review Under Textual Adversarial Attacks
por: Lin, Tzu-Ling, et al.
Publicado: (2025)