Hybrid Latent Reasoning via Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yue, Zhenrui, Jin, Bowen, Zeng, Huimin, Zhuang, Honglei, Qin, Zhen, Yoon, Jinsung, Shang, Lanyu, Han, Jiawei, Wang, Dong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
par: Jin, Bowen, et autres
Publié: (2025)
par: Jin, Bowen, et autres
Publié: (2025)
Evidence-Driven Retrieval Augmented Response Generation for Online Misinformation
par: Yue, Zhenrui, et autres
Publié: (2024)
par: Yue, Zhenrui, et autres
Publié: (2024)
Retrieval Augmented Fact Verification by Synthesizing Contrastive Arguments
par: Yue, Zhenrui, et autres
Publié: (2024)
par: Yue, Zhenrui, et autres
Publié: (2024)
An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
par: Jin, Bowen, et autres
Publié: (2025)
par: Jin, Bowen, et autres
Publié: (2025)
Open-Vocabulary Federated Learning with Multimodal Prototyping
par: Zeng, Huimin, et autres
Publié: (2024)
par: Zeng, Huimin, et autres
Publié: (2024)
Retrieval Augmented Conversational Recommendation with Reinforcement Learning
par: Yue, Zhenrui, et autres
Publié: (2026)
par: Yue, Zhenrui, et autres
Publié: (2026)
Can Pre-training Indicators Reliably Predict Fine-tuning Outcomes of LLMs?
par: Zeng, Hansi, et autres
Publié: (2025)
par: Zeng, Hansi, et autres
Publié: (2025)
Long-Context LLMs Meet RAG: Overcoming Challenges for Long Inputs in RAG
par: Jin, Bowen, et autres
Publié: (2024)
par: Jin, Bowen, et autres
Publié: (2024)
Inference Scaling for Long-Context Retrieval Augmented Generation
par: Yue, Zhenrui, et autres
Publié: (2024)
par: Yue, Zhenrui, et autres
Publié: (2024)
Federated Recommendation via Hybrid Retrieval Augmented Generation
par: Zeng, Huimin, et autres
Publié: (2024)
par: Zeng, Huimin, et autres
Publié: (2024)
LLM Alignment as Retriever Optimization: An Information Retrieval Perspective
par: Jin, Bowen, et autres
Publié: (2025)
par: Jin, Bowen, et autres
Publié: (2025)
Uncertainty-Aware Variational Reward Factorization via Probabilistic Preference Bases for LLM Personalization
par: Lee, Gyuseok, et autres
Publié: (2026)
par: Lee, Gyuseok, et autres
Publié: (2026)
Structure-R1: Dynamically Leveraging Structural Knowledge in LLM Reasoning through Reinforcement Learning
par: Wu, Junlin, et autres
Publié: (2025)
par: Wu, Junlin, et autres
Publié: (2025)
Transferable Sequential Recommendation via Vector Quantized Meta Learning
par: Yue, Zhenrui, et autres
Publié: (2024)
par: Yue, Zhenrui, et autres
Publié: (2024)
FASA: Frequency-aware Sparse Attention
par: Wang, Yifei, et autres
Publié: (2026)
par: Wang, Yifei, et autres
Publié: (2026)
The Price of a Second Thought: On the Evaluation of Reasoning Efficiency in Large Language Models
par: Fan, Siqi, et autres
Publié: (2025)
par: Fan, Siqi, et autres
Publié: (2025)
Train Once, Deploy Anywhere: Matryoshka Representation Learning for Multimodal Recommendation
par: Wang, Yueqi, et autres
Publié: (2024)
par: Wang, Yueqi, et autres
Publié: (2024)
ASTER: Agentic Scaling with Tool-integrated Extended Reasoning
par: Zhang, Xuqin, et autres
Publié: (2026)
par: Zhang, Xuqin, et autres
Publié: (2026)
Cell-o1: Training LLMs to Solve Single-Cell Reasoning Puzzles with Reinforcement Learning
par: Fang, Yin, et autres
Publié: (2025)
par: Fang, Yin, et autres
Publié: (2025)
Bridging Latent Reasoning and Target-Language Generation via Retrieval-Transition Heads
par: Patel, Shaswat, et autres
Publié: (2026)
par: Patel, Shaswat, et autres
Publié: (2026)
WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning
par: Zhuang, Yuchen, et autres
Publié: (2025)
par: Zhuang, Yuchen, et autres
Publié: (2025)
Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning
par: Hu, Wenbin, et autres
Publié: (2025)
par: Hu, Wenbin, et autres
Publié: (2025)
Rectify Evaluation Preference: Improving LLMs' Critique on Math Reasoning via Perplexity-aware Reinforcement Learning
par: Tian, Changyuan, et autres
Publié: (2025)
par: Tian, Changyuan, et autres
Publié: (2025)
Controlling Performance and Budget of a Centralized Multi-agent LLM System with Reinforcement Learning
par: Jin, Bowen, et autres
Publié: (2025)
par: Jin, Bowen, et autres
Publié: (2025)
Decompose, Look, and Reason: Reinforced Latent Reasoning for VLMs
par: Zhu, Mengdan, et autres
Publié: (2026)
par: Zhu, Mengdan, et autres
Publié: (2026)
Grasping the Essentials: Tailoring Large Language Models for Zero-Shot Relation Extraction
par: Zhou, Sizhe, et autres
Publié: (2024)
par: Zhou, Sizhe, et autres
Publié: (2024)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
par: Yan, Yuchen, et autres
Publié: (2026)
par: Yan, Yuchen, et autres
Publié: (2026)
Interleaved Reasoning for Large Language Models via Reinforcement Learning
par: Xie, Roy, et autres
Publié: (2025)
par: Xie, Roy, et autres
Publié: (2025)
Dr. Assistant: Enhancing Clinical Diagnostic Inquiry via Structured Diagnostic Reasoning Data and Reinforcement Learning
par: Guo, Yue, et autres
Publié: (2026)
par: Guo, Yue, et autres
Publié: (2026)
Converted, Not Equivalent: Benchmarking Codebase Conversion via Observational Equivalence
par: Song, Linxin, et autres
Publié: (2026)
par: Song, Linxin, et autres
Publié: (2026)
LongR: Unleashing Long-Context Reasoning via Reinforcement Learning with Dense Utility Rewards
par: Ping, Bowen, et autres
Publié: (2026)
par: Ping, Bowen, et autres
Publié: (2026)
STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning
par: Ni, Juntong, et autres
Publié: (2026)
par: Ni, Juntong, et autres
Publié: (2026)
STEER: Structured Event Evidence for Video Reasoning via Multi-Objective Reinforcement Learning
par: Li, Zinuo, et autres
Publié: (2026)
par: Li, Zinuo, et autres
Publié: (2026)
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
par: Xu, Ran, et autres
Publié: (2025)
par: Xu, Ran, et autres
Publié: (2025)
Optimizing Retrieval for RAG via Reinforcement Learning
par: Zhou, Jiawei, et autres
Publié: (2025)
par: Zhou, Jiawei, et autres
Publié: (2025)
Learning Multiplex Representations on Text-Attributed Graphs with One Language Model Encoder
par: Jin, Bowen, et autres
Publié: (2023)
par: Jin, Bowen, et autres
Publié: (2023)
Math-PUMA: Progressive Upward Multimodal Alignment to Enhance Mathematical Reasoning
par: Zhuang, Wenwen, et autres
Publié: (2024)
par: Zhuang, Wenwen, et autres
Publié: (2024)
SAKE: Structured Agentic Knowledge Extrapolation for Complex LLM Reasoning via Reinforcement Learning
par: He, Jiashu, et autres
Publié: (2025)
par: He, Jiashu, et autres
Publié: (2025)
MemSearcher: Training LLMs to Reason, Search and Manage Memory via End-to-End Reinforcement Learning
par: Yuan, Qianhao, et autres
Publié: (2025)
par: Yuan, Qianhao, et autres
Publié: (2025)
Agentic Conversational Search with Contextualized Reasoning via Reinforcement Learning
par: Mo, Fengran, et autres
Publié: (2026)
par: Mo, Fengran, et autres
Publié: (2026)
Documents similaires
-
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
par: Jin, Bowen, et autres
Publié: (2025) -
Evidence-Driven Retrieval Augmented Response Generation for Online Misinformation
par: Yue, Zhenrui, et autres
Publié: (2024) -
Retrieval Augmented Fact Verification by Synthesizing Contrastive Arguments
par: Yue, Zhenrui, et autres
Publié: (2024) -
An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
par: Jin, Bowen, et autres
Publié: (2025) -
Open-Vocabulary Federated Learning with Multimodal Prototyping
par: Zeng, Huimin, et autres
Publié: (2024)