Interleaved Reasoning for Large Language Models via Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Xie, Roy, Qiu, David, Gopinath, Deepak, Lin, Dong, Sun, Yanchao, Wang, Chong, Potdar, Saloni, Dhingra, Bhuwan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Over-Searching in Search-Augmented Large Language Models
di: Xie, Roy, et al.
Pubblicazione: (2026)
di: Xie, Roy, et al.
Pubblicazione: (2026)
Adversarial Math Word Problem Generation
di: Xie, Roy, et al.
Pubblicazione: (2024)
di: Xie, Roy, et al.
Pubblicazione: (2024)
Raccoon: Prompt Extraction Benchmark of LLM-Integrated Applications
di: Wang, Junlin, et al.
Pubblicazione: (2024)
di: Wang, Junlin, et al.
Pubblicazione: (2024)
Knowing When to Stop: Efficient Context Processing via Latent Sufficiency Signals
di: Xie, Roy, et al.
Pubblicazione: (2025)
di: Xie, Roy, et al.
Pubblicazione: (2025)
To Trust or Not to Trust? Enhancing Large Language Models' Situated Faithfulness to External Contexts
di: Huang, Yukun, et al.
Pubblicazione: (2024)
di: Huang, Yukun, et al.
Pubblicazione: (2024)
Leveraging the Power of Large Language Models in Entity Linking via Adaptive Routing and Targeted Reasoning
di: Li, Yajie, et al.
Pubblicazione: (2025)
di: Li, Yajie, et al.
Pubblicazione: (2025)
ChatShop: Interactive Information Seeking with Language Agents
di: Chen, Sanxing, et al.
Pubblicazione: (2024)
di: Chen, Sanxing, et al.
Pubblicazione: (2024)
GenEOL: Harnessing the Generative Power of LLMs for Training-Free Sentence Embeddings
di: Thirukovalluru, Raghuveer, et al.
Pubblicazione: (2024)
di: Thirukovalluru, Raghuveer, et al.
Pubblicazione: (2024)
RVPO: Risk-Sensitive Alignment via Variance Regularization
di: Montero, Ivan, et al.
Pubblicazione: (2026)
di: Montero, Ivan, et al.
Pubblicazione: (2026)
Calibrating Long-form Generations from Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2024)
di: Huang, Yukun, et al.
Pubblicazione: (2024)
Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2025)
di: Huang, Yukun, et al.
Pubblicazione: (2025)
Automated Benchmark Auditing for AI Agents and Large Language Models
di: Wang, Junlin, et al.
Pubblicazione: (2026)
di: Wang, Junlin, et al.
Pubblicazione: (2026)
Atomic Self-Consistency for Better Long Form Generations
di: Thirukovalluru, Raghuveer, et al.
Pubblicazione: (2024)
di: Thirukovalluru, Raghuveer, et al.
Pubblicazione: (2024)
Do Large Language Models Have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
When Greedy Wins: Emergent Exploitation Bias in Meta-Bandit LLM Training
di: Chen, Sanxing, et al.
Pubblicazione: (2025)
di: Chen, Sanxing, et al.
Pubblicazione: (2025)
AgREE: Agentic Reasoning for Knowledge Graph Completion on Emerging Entities
di: Zhao, Ruochen, et al.
Pubblicazione: (2025)
di: Zhao, Ruochen, et al.
Pubblicazione: (2025)
Real-time Factuality Assessment from Adversarial Feedback
di: Chen, Sanxing, et al.
Pubblicazione: (2024)
di: Chen, Sanxing, et al.
Pubblicazione: (2024)
InData: Towards Secure Multi-Step, Tool-Based Data Analysis
di: K, Karthikeyan, et al.
Pubblicazione: (2025)
di: K, Karthikeyan, et al.
Pubblicazione: (2025)
Hierarchical Multi-Label Classification of Online Vaccine Concerns
di: Zhu, Chloe Qinyu, et al.
Pubblicazione: (2024)
di: Zhu, Chloe Qinyu, et al.
Pubblicazione: (2024)
ReCaLL: Membership Inference via Relative Conditional Log-Likelihoods
di: Xie, Roy, et al.
Pubblicazione: (2024)
di: Xie, Roy, et al.
Pubblicazione: (2024)
mRAKL: Multilingual Retrieval-Augmented Knowledge Graph Construction for Low-Resourced Languages
di: Nigatu, Hellina Hailu, et al.
Pubblicazione: (2025)
di: Nigatu, Hellina Hailu, et al.
Pubblicazione: (2025)
Coding Agents are Effective Long-Context Processors
di: Cao, Weili, et al.
Pubblicazione: (2026)
di: Cao, Weili, et al.
Pubblicazione: (2026)
Improving Model Alignment Through Collective Intelligence of Open-Source LLMS
di: Wang, Junlin, et al.
Pubblicazione: (2025)
di: Wang, Junlin, et al.
Pubblicazione: (2025)
CX-Mind: A Pioneering Multimodal Large Language Model for Interleaved Reasoning in Chest X-ray via Curriculum-Guided Reinforcement Learning
di: Li, Wenjie, et al.
Pubblicazione: (2025)
di: Li, Wenjie, et al.
Pubblicazione: (2025)
Atomic Consistency Preference Optimization for Long-Form Question Answering
di: Chen, Jingfeng, et al.
Pubblicazione: (2025)
di: Chen, Jingfeng, et al.
Pubblicazione: (2025)
Extracting Polymer Nanocomposite Samples from Full-Length Documents
di: Khalighinejad, Ghazal, et al.
Pubblicazione: (2024)
di: Khalighinejad, Ghazal, et al.
Pubblicazione: (2024)
A Platform for Investigating Public Health Content with Efficient Concern Classification
di: Li, Christopher, et al.
Pubblicazione: (2025)
di: Li, Christopher, et al.
Pubblicazione: (2025)
DS@GT at Touché: Large Language Models for Retrieval-Augmented Debate
di: Miyaguchi, Anthony, et al.
Pubblicazione: (2025)
di: Miyaguchi, Anthony, et al.
Pubblicazione: (2025)
Persona-Assigned Large Language Models Exhibit Human-Like Motivated Reasoning
di: Dash, Saloni, et al.
Pubblicazione: (2025)
di: Dash, Saloni, et al.
Pubblicazione: (2025)
Evaluating Morphological Compositional Generalization in Large Language Models
di: Ismayilzada, Mete, et al.
Pubblicazione: (2024)
di: Ismayilzada, Mete, et al.
Pubblicazione: (2024)
ConvKGYarn: Spinning Configurable and Scalable Conversational Knowledge Graph QA datasets with Large Language Models
di: Pradeep, Ronak, et al.
Pubblicazione: (2024)
di: Pradeep, Ronak, et al.
Pubblicazione: (2024)
DEEPAMBIGQA: Ambiguous Multi-hop Questions for Benchmarking LLM Answer Completeness
di: Ji, Jiabao, et al.
Pubblicazione: (2025)
di: Ji, Jiabao, et al.
Pubblicazione: (2025)
Generalizability of Large Language Model-Based Agents: A Comprehensive Survey
di: Zhang, Minxing, et al.
Pubblicazione: (2025)
di: Zhang, Minxing, et al.
Pubblicazione: (2025)
Document-as-Image Representations Fall Short for Scientific Retrieval
di: Khalighinejad, Ghazal, et al.
Pubblicazione: (2026)
di: Khalighinejad, Ghazal, et al.
Pubblicazione: (2026)
AGRaME: Any-Granularity Ranking with Multi-Vector Embeddings
di: Reddy, Revanth Gangi, et al.
Pubblicazione: (2024)
di: Reddy, Revanth Gangi, et al.
Pubblicazione: (2024)
Integrating Large Language Models and Reinforcement Learning for Non-Linear Reasoning
di: Alon, Yoav, et al.
Pubblicazione: (2024)
di: Alon, Yoav, et al.
Pubblicazione: (2024)
Interleaved Latent Visual Reasoning with Selective Perceptual Modeling
di: Dong, Shuai, et al.
Pubblicazione: (2025)
di: Dong, Shuai, et al.
Pubblicazione: (2025)
An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
di: Jin, Bowen, et al.
Pubblicazione: (2025)
di: Jin, Bowen, et al.
Pubblicazione: (2025)
ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models
di: Liu, Mingjie, et al.
Pubblicazione: (2025)
di: Liu, Mingjie, et al.
Pubblicazione: (2025)
VEGA: Learning Interleaved Image-Text Comprehension in Vision-Language Large Models
di: Zhou, Chenyu, et al.
Pubblicazione: (2024)
di: Zhou, Chenyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Over-Searching in Search-Augmented Large Language Models
di: Xie, Roy, et al.
Pubblicazione: (2026) -
Adversarial Math Word Problem Generation
di: Xie, Roy, et al.
Pubblicazione: (2024) -
Raccoon: Prompt Extraction Benchmark of LLM-Integrated Applications
di: Wang, Junlin, et al.
Pubblicazione: (2024) -
Knowing When to Stop: Efficient Context Processing via Latent Sufficiency Signals
di: Xie, Roy, et al.
Pubblicazione: (2025) -
To Trust or Not to Trust? Enhancing Large Language Models' Situated Faithfulness to External Contexts
di: Huang, Yukun, et al.
Pubblicazione: (2024)