Hybrid Deep Searcher: Scalable Parallel and Sequential Search Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Ko, Dayoon, Kim, Jihyuk, Park, Haeju, Kim, Sohyeon, Lee, Dahyun, Jo, Yongrae, Kim, Gunhee, Lee, Moontae, Lee, Kyungjae |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
When Is Enough Not Enough? Illusory Completion in Search Agents
por: Ko, Dayoon, et al.
Publicado: (2026)
por: Ko, Dayoon, et al.
Publicado: (2026)
Shifting from Ranking to Set Selection for Retrieval Augmented Generation
por: Lee, Dahyun, et al.
Publicado: (2025)
por: Lee, Dahyun, et al.
Publicado: (2025)
DynamicER: Resolving Emerging Mentions to Dynamic Entities for RAG
por: Kim, Jinyoung, et al.
Publicado: (2024)
por: Kim, Jinyoung, et al.
Publicado: (2024)
Lost in the Noise: How Reasoning Models Fail with Contextual Distractors
por: Lee, Seongyun, et al.
Publicado: (2026)
por: Lee, Seongyun, et al.
Publicado: (2026)
Early Decisions Matter: Proximity Bias and Initial Trajectory Shaping in Non-Autoregressive Diffusion Language Models
por: Kim, Jiyeon, et al.
Publicado: (2026)
por: Kim, Jiyeon, et al.
Publicado: (2026)
One Missing Piece for Open-Source Reasoning Models: A Dataset to Mitigate Cold-Starting Short CoT LLMs in RL
por: Chae, Hyungjoo, et al.
Publicado: (2025)
por: Chae, Hyungjoo, et al.
Publicado: (2025)
Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection
por: Lee, Kyungjae, et al.
Publicado: (2024)
por: Lee, Kyungjae, et al.
Publicado: (2024)
Can LLMs Deceive CLIP? Benchmarking Adversarial Compositionality of Pre-trained Multimodal Representation via Text Updates
por: Ahn, Jaewoo, et al.
Publicado: (2025)
por: Ahn, Jaewoo, et al.
Publicado: (2025)
Can Language Models Laugh at YouTube Short-form Videos?
por: Ko, Dayoon, et al.
Publicado: (2023)
por: Ko, Dayoon, et al.
Publicado: (2023)
The CoT Encyclopedia: Analyzing, Predicting, and Controlling how a Reasoning Model will Think
por: Lee, Seongyun, et al.
Publicado: (2025)
por: Lee, Seongyun, et al.
Publicado: (2025)
Self-Corrective Task Planning by Inverse Prompting with Large Language Models
por: Lee, Jiho, et al.
Publicado: (2025)
por: Lee, Jiho, et al.
Publicado: (2025)
When Should Dense Retrievers Be Updated in Evolving Corpora? Detecting Out-of-Distribution Corpora Using GradNormIR
por: Ko, Dayoon, et al.
Publicado: (2025)
por: Ko, Dayoon, et al.
Publicado: (2025)
EXAONE Deep: Reasoning Enhanced Language Models
por: Bae, Kyunghoon, et al.
Publicado: (2025)
por: Bae, Kyunghoon, et al.
Publicado: (2025)
Open Ko-LLM Leaderboard2: Bridging Foundational and Practical Evaluation for Korean LLMs
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language Models
por: Kim, Dahyun, et al.
Publicado: (2024)
por: Kim, Dahyun, et al.
Publicado: (2024)
Open Ko-LLM Leaderboard: Evaluating Large Language Models in Korean with Ko-H5 Benchmark
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
Distilling Reinforcement Learning Algorithms for In-Context Model-Based Planning
por: Son, Jaehyeon, et al.
Publicado: (2025)
por: Son, Jaehyeon, et al.
Publicado: (2025)
Recasting Continual Learning as Sequence Modeling
por: Lee, Soochan, et al.
Publicado: (2023)
por: Lee, Soochan, et al.
Publicado: (2023)
Byzantine-Robust Decentralized Coordination of LLM Agents
por: Jo, Yongrae, et al.
Publicado: (2025)
por: Jo, Yongrae, et al.
Publicado: (2025)
Dataverse: Open-Source ETL (Extract, Transform, Load) Pipeline for Large Language Models
por: Park, Hyunbyung, et al.
Publicado: (2024)
por: Park, Hyunbyung, et al.
Publicado: (2024)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
por: Song, Yeda, et al.
Publicado: (2024)
por: Song, Yeda, et al.
Publicado: (2024)
Evidentiality-aware Retrieval for Overcoming Abstractiveness in Open-Domain Question Answering
por: Song, Yongho, et al.
Publicado: (2023)
por: Song, Yongho, et al.
Publicado: (2023)
Towards Scalable Lifelong Knowledge Editing with Selective Knowledge Suppression
por: Jung, Dahyun, et al.
Publicado: (2026)
por: Jung, Dahyun, et al.
Publicado: (2026)
EXAONE 3.0 7.8B Instruction Tuned Language Model
por: An, Soyoung, et al.
Publicado: (2024)
por: An, Soyoung, et al.
Publicado: (2024)
Adaptive Parallel Monte Carlo Tree Search for Efficient Test-time Compute Scaling
por: Kim, Hongbeen, et al.
Publicado: (2026)
por: Kim, Hongbeen, et al.
Publicado: (2026)
1 Trillion Token (1TT) Platform: A Novel Framework for Efficient Data Sharing and Compensation in Large Language Models
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
KU-DMIS at EHRSQL 2024:Generating SQL query via question templatization in EHR
por: Kim, Hajung, et al.
Publicado: (2024)
por: Kim, Hajung, et al.
Publicado: (2024)
SafeDPO: A Simple Approach to Direct Preference Optimization with Enhanced Safety
por: Kim, Geon-Hyeong, et al.
Publicado: (2025)
por: Kim, Geon-Hyeong, et al.
Publicado: (2025)
Think, Verbalize, then Speak: Bridging Complex Thoughts and Comprehensible Speech
por: Woo, Sang Hoon, et al.
Publicado: (2025)
por: Woo, Sang Hoon, et al.
Publicado: (2025)
Adaptive Retrieval for Reasoning-Intensive Retrieval
por: Kim, Jongho, et al.
Publicado: (2026)
por: Kim, Jongho, et al.
Publicado: (2026)
Semantic Skill Grounding for Embodied Instruction-Following in Cross-Domain Environments
por: Shin, Sangwoo, et al.
Publicado: (2024)
por: Shin, Sangwoo, et al.
Publicado: (2024)
Learning to Continually Learn with the Bayesian Principle
por: Lee, Soochan, et al.
Publicado: (2024)
por: Lee, Soochan, et al.
Publicado: (2024)
Policy-labeled Preference Learning: Is Preference Enough for RLHF?
por: Cho, Taehyun, et al.
Publicado: (2025)
por: Cho, Taehyun, et al.
Publicado: (2025)
Bellman Unbiasedness: Toward Provably Efficient Distributional Reinforcement Learning with General Value Function Approximation
por: Cho, Taehyun, et al.
Publicado: (2024)
por: Cho, Taehyun, et al.
Publicado: (2024)
GRACE: Discriminator-Guided Chain-of-Thought Reasoning
por: Khalifa, Muhammad, et al.
Publicado: (2023)
por: Khalifa, Muhammad, et al.
Publicado: (2023)
Model-Based Data-Centric AI: Bridging the Divide Between Academic Ideals and Industrial Pragmatism
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
LEGO: Latent-space Exploration for Geometry-aware Optimization of Humanoid Kinematic Design
por: Yoon, Jihwan, et al.
Publicado: (2026)
por: Yoon, Jihwan, et al.
Publicado: (2026)
GrowOVER: How Can LLMs Adapt to Growing Real-World Knowledge?
por: Ko, Dayoon, et al.
Publicado: (2024)
por: Ko, Dayoon, et al.
Publicado: (2024)
Assessing LLM Reasoning Steps via Principal Knowledge Grounding
por: Hwang, Hyeon, et al.
Publicado: (2025)
por: Hwang, Hyeon, et al.
Publicado: (2025)
EXAONE 4.0: Unified Large Language Models Integrating Non-reasoning and Reasoning Modes
por: Bae, Kyunghoon, et al.
Publicado: (2025)
por: Bae, Kyunghoon, et al.
Publicado: (2025)
Ejemplares similares
-
When Is Enough Not Enough? Illusory Completion in Search Agents
por: Ko, Dayoon, et al.
Publicado: (2026) -
Shifting from Ranking to Set Selection for Retrieval Augmented Generation
por: Lee, Dahyun, et al.
Publicado: (2025) -
DynamicER: Resolving Emerging Mentions to Dynamic Entities for RAG
por: Kim, Jinyoung, et al.
Publicado: (2024) -
Lost in the Noise: How Reasoning Models Fail with Contextual Distractors
por: Lee, Seongyun, et al.
Publicado: (2026) -
Early Decisions Matter: Proximity Bias and Initial Trajectory Shaping in Non-Autoregressive Diffusion Language Models
por: Kim, Jiyeon, et al.
Publicado: (2026)